chroma-core/chroma

Search infrastructure for AI

What it solves

Chroma 為 AI 提供開源的資料基礎設施,特別專注於嵌入向量的儲存與檢索。它簡化了為 AI 應用程式建立向量資料庫的過程,讓開發者可以儲存文件與其相關的元數據(metadata),接著進行相似度搜尋以找到最相關的資訊。

How it works

Chroma 作為一個向量資料庫,會自動處理分詞(tokenization)、嵌入(embedding)與索引(indexing)。使用者可以建立文件集合(collections),新增具有唯一 ID 與元數據的文件,並使用查詢文本來查詢這些集合,以根據向量相似度檢索出最相似的結果。 它支援在記憶體中進行原型設計,也支援持久化儲存,以及客戶端-伺服器模式。

Who it’s for

它是為 AI 開發者設計的,這些開發者需要一種快速且簡單的方式,為其 AI 應用程式整合向量搜尋與資料持久化,無論是在 Python 或 JavaScript 中進行原型設計。

Highlights

  • 向量、混合與全文搜尋能力。
  • 自動處理分詞、嵌入與索引。
  • 具有建立集合、新增文件與元數據過濾的核心功能之簡單 API。
  • 支援 Python 與 JavaScript 客戶端。
  • 透過 Chroma Cloud 提供託管的無伺服器版本。"},