Réduire la latence p99 d'un index vectoriel
Pourquoi la queue de distribution se dégrade avant la médiane : efSearch, filtrage par métadonnées, réindexation et effets de la mémoire sur les latences hautes.
Lire l'articleIngénierie Vela
Collectif qui conçoit et opère le moteur d'indexation et l'API de Vela
L’équipe ingénierie regroupe les personnes qui construisent et opèrent Vela : couche de stockage des vecteurs, construction et maintenance des graphes HNSW, plan de requête, filtrage par métadonnées, et exploitation des clusters en production.
Les articles signés par cette équipe sont des notes d’ingénierie collectives. Ils décrivent des choix d’implémentation, des compromis assumés et des incidents dont nous avons tiré des enseignements. Aucun de ces textes n’est attribué à une personne en particulier.
Pourquoi la queue de distribution se dégrade avant la médiane : efSearch, filtrage par métadonnées, réindexation et effets de la mémoire sur les latences hautes.
Lire l'article