milvus-io/milvus
Milvus is a high-performance, cloud-native vector database built for scalable vector ANN search
What it solves
Milvus 是一个高性能向量数据库,旨在组织和搜索大量非结构化数据,如文本、图像和多模态信息。它解决了 AI 应用中向量搜索的扩展难题,使开发者能够在高可用性的前提下处理数十亿向量和数万条查询。
How it works
Milvus 使用 Go 和 C++ 编写,采用分布式、K8s 原生架构,将计算与存储分离。这使得它可以通过独立增加查询节点(读取)或数据节点(写入)来水平扩展。它支持多种向量索引类型(如 HNSW、IVF、DiskANN),并利用 CPU 与 GPU 的硬件加速来优化搜索性能。此外,Milvus 还支持混合搜索方式,结合用于语义搜索的密集向量和用于全文搜索的稀疏向量(BM25)。
Who it’s for
它面向 AI 开发者和企业,适用于构建关键任务的应用,如检索增强生成(RAG)系统、图像和文本搜索引擎以及推荐系统。
Highlights
- Distributed Scalability: Separates compute and storage to scale horizontally on Kubernetes.
- Hardware Acceleration: Implements CPU/GPU acceleration for best-in-class search performance.
- Hybrid Search: Natively supports both dense and sparse vectors for combined semantic and full-text search.
- Flexible Storage: Features hot/cold storage mechanisms to balance performance and cost.
- Enterprise Security: Includes mandatory authentication, TLS encryption, and Role-Based Access Control (RBAC).