alibaba/zvec
A lightweight, lightning-fast, in-process vector database
解决的问题
Zvec 提供了一个轻量级、高性能的向量数据库,可以作为进程内库直接嵌入到应用程序中。它消除了管理单独数据库服务器或复杂配置的需要,同时实现了跨数十亿向量的低延迟相似性搜索。
工作原理
Zvec 作为嵌入式库而非独立服务器运行,可以在应用程序代码执行的任何地方运行(包括 notebook 和边缘设备)。它支持稠密和稀疏嵌入,并提供从内存到磁盘的可扩展的多种索引类型。为了确保数据安全,它使用预写日志 (WAL) 进行持久化,并允许多个进程同时读取同一个集合。
适用对象
专为需要生产级相似性搜索和向量存储,且不想承担单独服务器开销的开发者设计,特别是针对在服务器、CLI 工具或边缘设备上运行的应用程序。
亮点
- 混合搜索:在单个查询中结合向量相似性、全文搜索 (FTS) 和结构化过滤器。
- 进程内架构:无需服务器设置;直接嵌入应用以实现极低延迟。
- 广泛的语言支持:提供 Python、Node.js、Go、Rust 和 Dart/Flutter 的官方 SDK。
- 高级索引:支持 HNSW、HNSW-RaBitQ 和 DiskANN,并具有通过随机旋转量化 (random rotation quantization) 来提高召回率的功能。
- 全文搜索:包含具有 Unicode 标准分词器并支持 34 多种语言的原生 FTS 流水线。