infiniflow/infinity

The AI-native database built for LLM applications, providing incredibly fast hybrid search of dense vector, sparse vector, tensor (multi-vector), and full-text.

解決的問題

Infinity 解決了 LLM 應用(特別是檢索增強生成 RAG)對高性能數據檢索的需求。它解決了在單一快速資料庫系統中管理與搜尋多種數據類型(如密集與稀疏嵌入、張量及全文數據)的挑戰。

工作原理

它作為一個支援混合搜尋的 AI 原生資料庫運作,允許使用者將不同的搜尋模態(密集、稀疏、張量及全文)與過濾條件結合。它採用單一二進位制架構,便於部署,並提供直覺的 Python API,可以作為模組嵌入或透過 Docker 作為獨立伺服器執行。

適用對象

此工具專為構建 LLM 驅動型應用(如對話式 AI、Copilot、推薦系統、問答系統及內容生成工具)的 AI 開發人員設計。

亮點

  • 高性能:在百萬級向量數據集上實現 0.1ms 的查詢延遲,在 33M 文件全文搜尋上實現 1ms 的延遲。
  • 混合搜尋:支援結合密集嵌入、稀疏嵌入、張量及全文搜尋。
  • 進階重排序:包括對 ColBERT、RRF 及加權求和等重排序器(rerankers)的支援。
  • 開發者友善:提供無依賴的單一二進位制架構與專用的 Python SDK。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案