Databricks、エンタープライズエージェントワークフローにGPT-5.5を統合
Databricks、エンタープライズエージェントワークフローにGPT-5.5を統合
Databricksは、エンタープライズエージェントワークフローにGPT-5.5を統合し、複雑な文書処理の信頼性を向上させました。この統合が重要なのは、GPT-5.5がOfficeQA Proベンチマークで初めて50%以上の精度を超えたモデルであり、レガシー文書やスキャン文書全体のパースと推論におけるエラーを大幅に削減するからです。
OfficeQA Proにおける最先端のパフォーマンス
GPT-5.5は、スキャンされたPDFやレガシーファイル全体でのパース、検索、根拠に基づく推論の処理能力を評価するために特別に設計されたベンチマーク、OfficeQA Proにおいて新たな最先端(SOTA)を確立しました。エージェントハーネス設定において、GPT-5.5はGPT-5.4と比較してエラーを46%削減し、このベンチマークで初めて50%以上の精度を達成したモデルとなりました。
リサーチエンジニアのArnav Singhviによると、モデルは古い文書やスキャンされたPDFのパースにおいて「ステップ関数的な向上」を示し、従来のGPT-5.4などのモデルでは数字や数値の抽出に失敗することが多かった。このパースの改善は重要で、これらのワークフローにおける抽出エラーは通常、下流に連鎖してエージェントの作業全体の軌跡を変えてしまいます。
オーケストレーションと信頼性の向上
パースに加えて、GPT-5.5はマルチステップタスク全体でのオーケストレーションが向上していることを示しています。GPT-5.4が時折「不要な検索迂回」を行い、非効率的な軌跡につながっていたのに対し、GPT-5.5は関連コンテキストの取得と複雑なワークフローの完了において、追加の監督を必要とせず、より信頼性が高くなっています。
エンタープライズプロダクションへの統合
DatabricksはAI Unity Gatewayを通じてGPT-5.5を提供しています。顧客はAgentBricksとAgent Supervisor APIで構築されたワークフロー内でこのモデルを利用でき、GPT-5.5は専門エージェント間でのパース、検索、実行のオーケストレーターとして機能します。
リサーチエンジニアのArnav Singhviは次のように述べています。「GPT-5.5は知識の向上という点で非常に優れています。我々の知的作業において、ステップサイズ関数的な変化と言えるでしょう。」