Documentation Vela

Créer un index, ingérer des embeddings et interroger vos vecteurs par similarité

Tout pour démarrer

Créez un index, envoyez un premier lot d'embeddings et lancez une requête par similarité cosinus en quelques minutes.

Que vous construisiez un pipeline RAG, une recherche produit ou un moteur de recommandation, la documentation couvre l'ingestion, les filtres par métadonnées, les namespaces, le réglage HNSW et la réindexation.

Guides de démarrage
SDK Python, TypeScript, Go
Référence de l'API
Notes de version

Une documentation structurée

Six catégories qui couvrent le cycle de vie complet d'un index

01

Démarrage rapide

Créer une clé d'API, déclarer un index, envoyer un premier lot d'embeddings et exécuter une requête k-NN.

02

Référence de l'API

Points d'entrée REST et gRPC : index, upsert, requête, filtres par métadonnées, statistiques et quotas.

03

SDK

Bibliothèques Python, TypeScript et Go, avec ingestion par lots, reprise sur erreur et pagination des résultats.

04

Tutoriels

Créer un index, ingérer des vecteurs, filtrer par métadonnées et brancher un pipeline RAG de bout en bout.

05

Exploitation

Dimensionner les shards, régler HNSW et arbitrer entre rappel et latence p50/p99 selon la charge.

06

Notes de version

Historique des versions, changements d'API, dépréciations annoncées et procédures de migration.

12 ms latence p99

Des réponses en millisecondes

L'index HNSW répond aux requêtes k plus proches voisins sous 12 ms au p99.

Un index accepte jusqu'à 1 milliard de vecteurs et 4096 dimensions. Le rappel mesuré atteint 99,2 % sur les jeux de référence. Les filtres par métadonnées s'appliquent pendant le parcours du graphe, sans post-traitement.

12 ms Latence p99
99,2 % Rappel mesuré
4096 Dimensions max

Cas d'usage documentés

RAG Recherche produit Recommandation Déduplication Recherche multilingue

Des SDK et un outillage

Les bibliothèques et les ressources qui entourent l'API

SDK officiels

Trois bibliothèques maintenues par l'équipe, avec typage complet, reprise sur erreur et ingestion par lots. Chaque exemple de la documentation est fourni dans les trois langages.

  • SDK Python
  • SDK TypeScript
  • SDK Go
  • Clients REST et gRPC

Intégrations

Connecteurs pour les pipelines d'ingestion et les frameworks RAG les plus répandus.

Régions

8 régions de déploiement et choix de la résidence des données au niveau de chaque index.

Notes de version

Changements d'API, dépréciations annoncées à l'avance et guides de migration versionnés.

Support

Questions techniques à contact@vela.dev et échanges dans la communauté publique des utilisateurs.

Résidence des données

Vela est déployé dans 8 régions. La région se choisit à la création de l'index et les vecteurs n'en sortent pas.

Région par défaut

eu-west-1
Paris, France

Points d'entrée

API REST sur api.vela.dev
gRPC Ingestion par lots de vecteurs
CLI Administration des index et namespaces
8 régions disponibles Amérique, Europe, Asie-Pacifique

Une question sur l'API

La documentation complète est publiée sur docs.vela.dev. Pour le reste, écrivez à contact@vela.dev.