Bases vectorielles

Stockage et recherche d'embeddings : Pinecone, Qdrant, recherche semantique.

22 skills

# Skill Source Description Maj
1 redis-semantic-cache redis/agent-skills Mettre en cache sémantiquement les réponses LLM via Redis LangCache pour réduire coûts et latence. 95 13h
2 pinecone-assistant pinecone-io/skills Créer, alimenter et interroger un assistant RAG Pinecone via des scripts. 14 1j
3 pinecone-quickstart pinecone-io/skills Effectuer une recherche sémantique vectorielle avec Pinecone via un agent IA guidé. 14 1j
4 pinecone-full-text-search pinecone-io/skills Créer et interroger un index full-text-search Pinecone avec l'API preview. 14 1j
5 qdrant-edge qdrant/skills Intégrer Qdrant Edge en local pour synchroniser, rechercher et opérer des shards vectoriels embarqués. 220 1mo
6 pinecone-rag github/awesome-copilot Construire un pipeline RAG ou une mémoire d'agent persistante avec Pinecone. 37 704 2mo
7 nemo-retriever nvidia/skills Indexer et interroger des dossiers de fichiers multimédias via une CLI RAG optimisée. 2 858 2mo
8 similarity-search-patterns wshobson/agents Implémenter une recherche vectorielle sémantique efficace et scalable en production. 38 718 2mo
9 vector-index-tuning wshobson/agents Optimiser les index vectoriels HNSW pour maximiser rappel, vitesse et mémoire. 38 718 2mo
10 hybrid-search-implementation wshobson/agents Combiner recherche vectorielle et par mots-clés pour améliorer le rappel RAG. 38 718 2mo
11 embedding-analysis mkurman/zorai Dédupliquer et filtrer des datasets textuels via analyse d'embeddings sémantiques. 321 2mo
12 embedding-analysis mkurman/zorai Dédupliquer et filtrer des datasets textuels via analyse d'embeddings sémantiques. 321 3mo
13 embedding-analysis mkurman/zorai Dédupliquer et filtrer des datasets textuels via analyse d'embeddings sémantiques. 321 3mo
14 chromadb mkurman/zorai Stocker et interroger des documents via une base vectorielle embarquée avec filtrage sémantique. 321 3mo
15 weaviate mkurman/zorai Gérer une base vectorielle Weaviate avec recherche hybride et RAG intégré. 321 3mo
16 lancedb mkurman/zorai Stocker et interroger des vecteurs multimodaux avec LanceDB sans serveur dédié. 321 3mo
17 milvus mkurman/zorai Déployer et interroger une base vectorielle Milvus pour la recherche de similarité à grande échelle. 321 3mo
18 qdrant mkurman/zorai Indexer et rechercher des vecteurs dans une base Qdrant haute performance. 321 3mo
19 azure-search-documents-py microsoft/skills Implémenter la recherche full-text, vectorielle et hybride avec Azure AI Search. 2 878 3mo
20 chroma-local chroma-core/agent-skills Intégrer Chroma localement pour indexer et interroger des documents via embeddings. 21 3mo
21 chroma-local chroma-core/agent-skills Intégrer Chroma localement pour indexer et interroger des documents via embeddings. 21 3mo
22 cognee topoteretes/cognee Gérer des graphes de connaissances avec Cognee via ingestion, enrichissement et recherche. 29 960 4mo

À propos de cette sélection

Relier un LLM à une mémoire persistante exige bien plus qu'un appel HTTP. Il faut créer des collections typées, gérer les namespaces par tenant, calibrer les paramètres HNSW pour que la latence reste acceptable sous charge, et piloter les mises à jour d'embeddings sans corrompre les vecteurs existants. Ce sont ces opérations que couvrent les skills bases vectorielles répertoriés ici. Le profil ciblé est le dev backend ou ML engineer qui intègre de la recherche sémantique dans un pipeline RAG ou un moteur de recommandation. Qdrant concentre une part importante de la sélection, avec des skills dédiés à la migration de modèles, au scaling et à l'optimisation d'indexation. Pinecone est aussi représenté. L'outillage est mature côté SDK, mais reste fragmenté dès qu'on touche à l'observabilité ou au fine-tuning des index en production.