Databricks 整合 GPT-5.5 用於企業代理工作流程
Databricks 整合 GPT-5.5 用於企業代理工作流程
Databricks 已將 GPT-5.5 整合到其企業代理工作流程中,以提升複雜文件處理的可靠性。此整合很重要,因為 GPT-5.5 是首個在 OfficeQA Pro 基準測試中超過 50% 準確率的模型,顯著降低了在舊版和掃描文件上的解析與推理錯誤。
OfficeQA Pro 的最先進性能
GPT-5.5 在 OfficeQA Pro 上建立了新的最先進(SOTA)成績,這是一個專門設計用來評估模型在掃描 PDF 與舊版檔案上處理解析、檢索和基礎推理的基準測試。在 agent-harness 設置中,GPT-5.5 相較於 GPT-5.4 將錯誤減少了 46%,成為首個在該基準測試中超過 50% 準確率的模型。
根據研究工程師 Arnav Singhvi 的說法,該模型在解析較舊文件和掃描 PDF 上展現出「階梯式提升」,此時之前的模型如 GPT-5.4 常常無法正確提取數字和數位。此解析的改進至關重要,因為這些工作流程中的提取錯誤通常會向下游 cascading,改變代理工作的整個軌跡。
改進的編排與可靠性
除了解析之外,GPT-5.5 在多步驟任務中展現出改進的編排能力。儘管 GPT-5.4 偶爾會執行「不必要的搜尋繞道」,導致軌跡低效,但 GPT-5.5 在檢索相關內容和完成複雜工作流程方面更可靠,且無需額外監督。
企業生產環境整合
Databricks 將透過 AI Unity Gateway 提供 GPT-5.5。客戶可以在使用 AgentBricks 和 Agent Supervisor API 構建的工作流程中使用該模型,其中 GPT-5.5 充當專門代理解析、檢索與執行的編排器。
正如研究工程師 Arnav Singhvi 所指出,「GPT-5.5 在知識提升方面表現出色。這是在進行我們的知識工作時的一種步長函數變化。」