milvus-io/milvus

Milvus is a high-performance, cloud-native vector database built for scalable vector ANN search

What it solves

Milvus 是一个高性能向量数据库,旨在组织和搜索大量非结构化数据,如文本、图像和多模态信息。它解决了 AI 应用中向量搜索的扩展难题,使开发者能够在高可用性的前提下处理数十亿向量和数万条查询。

How it works

Milvus 使用 Go 和 C++ 编写,采用分布式、K8s 原生架构,将计算与存储分离。这使得它可以通过独立增加查询节点(读取)或数据节点(写入)来水平扩展。它支持多种向量索引类型(如 HNSW、IVF、DiskANN),并利用 CPU 与 GPU 的硬件加速来优化搜索性能。此外,Milvus 还支持混合搜索方式,结合用于语义搜索的密集向量和用于全文搜索的稀疏向量(BM25)。

Who it’s for

它面向 AI 开发者和企业,适用于构建关键任务的应用,如检索增强生成(RAG)系统、图像和文本搜索引擎以及推荐系统。

Highlights

  • Distributed Scalability: Separates compute and storage to scale horizontally on Kubernetes.
  • Hardware Acceleration: Implements CPU/GPU acceleration for best-in-class search performance.
  • Hybrid Search: Natively supports both dense and sparse vectors for combined semantic and full-text search.
  • Flexible Storage: Features hot/cold storage mechanisms to balance performance and cost.
  • Enterprise Security: Includes mandatory authentication, TLS encryption, and Role-Based Access Control (RBAC).