xAI Grok Collections API リリース

xAIは、Collections APIを発表しました。これは、開発者がPDF、Excel、コードベースを含むデータセット全体をアップロードして検索できる、マネージド・ナレッジベース・サービスです。これにより、開発者は独自のインデックス作成や検索インフラを管理することなく、Retrieval-Augmented Generation (RAG) アプリケーションを構築できます。

マネージド・インデックス作成とドキュメント理解

Collections APIは、データの取り込みと保存の複雑さを処理します。OCRとレイアウトを認識するパーシングを利用して、Excelテーブルの階層、PDFのレイアウト、コードの構文など、ドキュメントの構造的な整合性を維持しながらテキストを抽出します。

主な管理機能には以下が含まれます:

  • Broad Format Support: APIは幅広いファイル形式をサポートしています。
  • Efficient Reindexing: システムは、ナレッジベースが最新の状態に保たれるよう、ファイルが変更されたときに自動的に再インデックスを行います。
  • File Management: 開発者は、コレクション内でファイルをアップロード、更新、ダウンロードできます。

検索方法と検索機能

さまざまなユースケースに最適化するために、Collections APIは3つの異なる検索方法を提供します:

  • Semantic Search: 意味と意図に基づいたクエリに使用されます。
  • Keyword Search: 正確な用語一致に使用されます。
  • Hybrid Search: キーワード検索とセマンティック検索を組み合わせて、最大限の精度を実現します。この方法は、reciprocal rank fusionと専用のrerankerモデルをサポートしています。

パフォーマンス・ベンチマーク

xAIは、Collections APIをGrok 4.1 Fastと組み合わせることで、金融、法務、コーディングといった、長く密度の高いドキュメントを特徴とするドメインにおいて、最先端の検索性能を提供すると報告しています。

ドメイン特化型精度

内部ベンチマークによると、Grok 4.1 Fastは、いくつかの主要なタスクにおいて競合他社を上回るか、同等の性能を示しました:

Task xAI Grok 4.1 Fast Google Gemini Pro 3 OpenAI GPT 5.1
Finance (Tabular and numerical questions) 93.0 85.9 84.7
Legal (Complex reasoning over multiple chunks) 73.9 74.5 71.2
Coding (Code understanding and large file systems) 86 85 81

特化型データセット評価

  • Financial Analysis: ハイブリッド検索は、SEC filingsのようなソースから表形式および数値データを取得するための重要なツールとして強調されています。
  • Legal Analysis: LegalBenchデータセット(商用契約書からの128の質問回答ペア)を使用して、APIは、微妙な法的表現や相互参照を処理する能力をテストされました。
  • DeepCodeBench: APIのコード理解能力は、DeepCodeBenchデータセットを使用して評価されました。これには、実際のオープンソース・リポジトリや複雑なアルゴリズム問題が含まれます。エンドツーエンドの回答性能は、8,000個のファイルを含む8つのリポジトリにわたってテストされました。

データ・プライバシーと価格設定

Data Privacy: xAIは、ユーザーが明示的な同意を提供しない限り、Collectionsに保存されたユーザーデータはモデルのトレーニング目的には使用されないと述べています。

Pricing: 初期リリース段階では、ファイルのインデックス作成と保存は最初の1週間、無料です。検索は、1,000回の検索につき2.50ドルの定額料金が設定されています。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch