xAI Grok Collections API 發佈
xAI 已宣佈推出 Collections API,這是一項託管式知識庫服務,允許開發者上傳並搜尋整個資料集——包括 PDF、Excel 表格和程式碼庫——以建構檢索增強生成 (RAG) 應用程式,而無需自行管理索引與檢索基礎設施。
託管式索引與文件理解
Collections API 處理了資料攝取與儲存的複雜性。它利用 OCR 與佈局感知解析技術來提取文字,同時保留文件的結構完整性,例如 Excel 表格的層級、PDF 的佈局以及程式碼的語法。
關鍵管理功能包括:
- 廣泛的格式支援:API 支援多種檔案類型。
- 高效的重新索引:系統會在檔案變更時自動重新索引,以確保知識庫保持最新。
- 檔案管理:開發者可以在其集合 (collections) 中上傳、更新與下載檔案。
檢索方法與搜尋能力
為了針對不同使用場景進行優化,Collections API 提供三種不同的檢索方法:
- 語義搜尋 (Semantic Search):用於基於意義與意圖的查詢。
- 關鍵字搜尋 (Keyword Search):用於精確的術語匹配。
- 混合搜尋 (Hybrid Search):結合關鍵字與語義搜尋以達到最高準確度。此方法支援倒數排名融合 (reciprocal rank fusion) 與專用的重排序模型 (reranker model)。
效能基準測試
xAI 表示,Collections API 搭配 Grok 4.1 Fast,在金融、法律與程式碼等具有長篇且密集文件特徵的領域中,提供了頂尖的檢索效能。
特定領域的準確度
根據內部基準測試,Grok 4.1 Fast 在幾項關鍵任務中表現優於或等同於競爭對手:
| Task | xAI Grok 4.1 Fast | Google Gemini Pro 3 | OpenAI GPT 5.1 |
|---|---|---|---|
| 金融 (表格與數值問題) | 93.0 | 85.9 | 84.7 |
| 法律 (跨多個區塊的複雜推理) | 73.9 | 74.5 | 71.2 |
| 程式碼 (程式碼理解與大型檔案系統) | 86 | 85 | 81 |
特化資料集評估
- 金融分析:混合搜尋被強調為從 SEC filings 等來源檢索表格與數值資料的關鍵工具。
- 法律分析:使用 LegalBench 資料集(包含來自商業合約的 128 組問答對),測試了 API 處理細微法律用語與交叉引用的能力。
- DeepCodeBench:API 的程式碼理解能力透過 DeepCodeBench 資料集進行了評估,該資料集包含來自真實世界開源程式碼庫與複雜演算法問題的任務。端到端回答效能是在包含 8,000 個檔案的 8 個程式碼庫中進行測試的。
資料隱私與定價
資料隱私:xAI 表示,儲存在 Collections 中的使用者資料不會用於模型訓練,除非使用者提供明確同意。
定價:在初始發佈階段,檔案索引與儲存於第一週內是免費的。檢索費用按每 1,000 次搜尋 2.50 美元的固定費率計算。
Sources
- OriginalGrok Collections API
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch