如果你想从零了解向量数据库,这四个 GitHub 项目值得按顺序看:
1. qdrant:高性能向量库加搜索引擎
过滤、载荷、云/自托管都齐,下一代 AI 检索很常见。中小到中等规模可以先用它很顺。
2. milvus:云原生,冲大规模 ANN
向量量级上去后,扩容和分布式是强项,企业级检索常被点名。
3. weaviate:对象和向量一起存
向量检索能叠结构化过滤,云原生容错,适合「语义 + 元数据」混合查询。
4. chroma:定位 AI 搜索基础设施
上手快,原型和中小应用很香,跟 LangChain/LlamaIndex 生态贴。周末 PoC 可以先用它。
建议顺序:原型 Chroma/Qdrant,大规模 Milvus,要混合过滤看 Weaviate。先定数据量再选型,别让向量库拖垮整条 RAG。
显示更多