Mixedbread Toast 1 専門型検索エージェントのリリース
Toast 1 はコストの一部で最先端レベルの検索を実現
Toast 1 は、Mixedbreadの最初の専門型検索エージェントであり、Claude Opus 5 や GPT-5.6 Sol といったトップクラスのモデルと同等またはそれ以上の回答品質を達成しています。一方で、コストは最大で 10倍低く、クエリの処理速度は 12倍速い です。このエージェントは単体の検索システムとして使用できるほか、あらゆる最先端モデルのサブエージェントとしても利用でき、検索ループ全体を完全に制御します。クエリの分解、証拠の収集、ソースの検証、コンテキストのキュレーションを実行し、結果を推論モデルに渡す前に処理を完了します。
企業向けベンチマークでのコストパフォーマンスの飛躍
OfficeQA Pro V2
- 70% の回答正解率 で 1タスクあたり約 $1.15 – DatabricksのOfficeQA Pro V2ベンチマークで報告された最高スコア。
- 一方、Databricks Genie上のClaude Fable 5は1タスクあたり約 $4で60%の正解率にとどまり、Toast 1なしのGPT-5.6 Solはわずか33%の正解率にとどまりました。
- この改善は、Toast 1が トークン効率の高い証拠パッケージ を生成できることに起因しており、最先端モデルが計算リソースを推論に集中できるようにしています。
「Codex内でサブエージェントとして利用可能なGPT-5.6 SolにToast 1を組み込むと、1タスクあたり約$1.20で70%の回答正解率を達成し、Databricks評価の以前のパレート前線を上回りました。」 – Mixedbreadブログ
Harvey LAB 法律事務所知識ベンチマーク
- 3つの構成で同じタスクスコアの 55 を達成したが、トークン使用量は 80.6M(通常エージェント)→ 47M(Mixedbread Search搭載)→ 23M(Toast 1搭載)へと減少。
- タスクあたりのターン数は 21.7 → 14.6 → 11.2 へと減少し、3.5倍 のトークン消費削減と 60%以上 のコスト削減を実現。
- このベンチマークは、高品質な検索が回答品質を損なうものではなく、むしろプロセスをはるかに効率化することを示しています。
深度検索ベンチマークでのパフォーマンス
- 中央値の遅延時間:標準設定で1クエリあたり8秒、最高品質の融合モードでは11秒。
- 1クエリあたりのコスト:標準設定で$0.016~$0.023、融合モードでは$0.05~$0.07。
- 最先端モデルの検索エージェントが20秒から4分かかるのに対し、Toast 1は 7~11倍安価 で、はるかに高速です。
- BrowseComp Plus、OfficeQA Pro、LongSealなどのベンチマークにおいて、Toast 1は最良の最先端モデルのスイープと同等またはそれに近いパフォーマンスを発揮しながら、より低いコスト・遅延の層に留まります。
統合の柔軟性
バックエンド非依存設計
- Toast 1 は Mixedbread Search と共同開発されていますが、既存の検索インデックスと互換性があります。データ移行は不要です。
- Mixedbread の Chat Completions API または提供されている ゴールデンハーネス(GitHub:
mixedbread-ai/toast-harness)を通じて、既存のエージェントワークフローに簡単に追加できます。
コーディングエージェント対応
- コーディングエージェントとの統合は1つのコマンドで完了:
npx skills add mixedbread-ai/skills。 - OpenCodeとの統合により、コード中心のパイプライン内で直接サブエージェントとして利用可能になります。
Mixedbread Stores とのPython使用例
from mixedbread import Mixedbread
client = Mixedbread()
results = client.stores.search(
store_identifiers=["legal-documents"],
query="does the MSA allow assignment on a change of control?",
search_options={"agentic": True}, # Toast 1 を有効化
)
価格設定と提供状況
- リリース価格(割引適用):
- 入力トークン 100万トークンあたり $0.30
- キャッシュ済み入力トークン 100万トークンあたり $0.036(キャッシュ書き込みは無料)
- 出力トークン 100万トークンあたり $0.72
- Toast 1 が行う Mixedbread Search の呼び出しは 特別料金 で課金されます(Mixedbreadの価格ページを参照)。
- 無料トライアル用に $5分の無料クレジット を含むAPIキーが即時利用可能です。
Hacker Newsでのコミュニティの反応
- ユーザーは専門的な検索LLMの概念を称賛し、複数ステップのGoogle検索を1つのLLM駆動のループに置き換える可能性に注目しました。
- 複数のコメントで、既存のクラウド検索エージェント(Perplexity、Gemini with search、Parallel AI)との比較を求める声があり、オープンウェイトの代替案への関心も示されました。
- オンプレミス展開やデータ所有権に関する質問が上がったことから、柔軟な展開オプションへの需要が浮き彫りになりました。
- 全体としてポジティブな反応であり、多くのユーザーがToast 1を、より安価で高速かつ高品質なエージェント検索への実用的な一歩と捉えています。
Toast 1 の特徴
- 専門的なアーキテクチャ – 深度検索に特化して訓練されており、簡潔で高品質な証拠パッケージを生成できます。
- 完全な検索ループ自動化 – クエリの分解から証拠のキュレーションまで、外部のオーケストレーションを必要としません。
- パレート前線の改善 – 複数の現実世界ベンチマークで、コスト、遅延、トークン効率の同時向上を実現。
- プラグアンドプレイ互換性 – Mixedbread Searchと最適なパフォーマンスを発揮しますが、他の検索バックエンドにも依存しません。
今後の展望
Toast 1 は、SID-1 や ChromaのContext-1 など、専門型検索エージェントの成長するエコシステムに加わります。企業がエージェントワークフローを採用するにつれ、コスト効率が高く高品質な検索の需要が高まり、専用モデルのさらなる革新、検索プリミティブとの緊密な統合、オンプレミスおよびハイブリッド展開への広範なサポートが進むでしょう。
Sources
関連
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch