infiniflow/infinity
The AI-native database built for LLM applications, providing incredibly fast hybrid search of dense vector, sparse vector, tensor (multi-vector), and full-text.
What it solves
Infinity 是一個 AI 原生的資料庫,專為處理 LLM 應用的複雜資料檢索需求而設計。它解決了需要多套系統分別執行不同類型搜尋(例如語意向量搜尋與關鍵字全文搜尋)的問題,將這些功能整合於單一高效能引擎中。
How it works
Infinity 提供統一的混合搜尋系統,允許使用者將密集嵌入、稀疏嵌入、張量與全文搜尋結合,並支援過濾條件。它採用單一二進位檔架構,無需外部相依,簡化部署。對於 AI 開發者而言,可直接以 Python 模組方式嵌入,或透過 Docker 以獨立伺服器方式執行。
Who it’s for
此專案針對開發 RAG(檢索增強生成)應用的 AI 開發者打造,應用範例包括對話式 AI、協同助理、推薦系統與問答系統。
Highlights
- Hybrid Search Capabilities: Supports dense and sparse embeddings, tensors, and full-text search in one place.
- High Performance: Achieves sub-millisecond query latency on million-scale vector datasets and high QPS for full-text search.
- Advanced Reranking: Includes support for various rerankers, including ColBERT, RRF, and weighted sum.
- Easy Deployment: Offered as a single-binary architecture or a Docker image for rapid setup.