Databricks가 기업 에이전트 워크플로우에 GPT-5.5를 통합합니다
Databricks가 기업 에이전트 워크플로우에 GPT-5.5를 통합합니다
Databricks는 복잡한 문서 처리의 신뢰성을 높이기 위해 기업 에이전트 워크플로우에 GPT-5.5를 통합했습니다. 이 통합은 GPT-5.5가 OfficeQA Pro 벤치마크에서 50% 정확도를 넘어선 첫 번째 모델이기 때문에 중요하며, 이는 레거시 및 스캔된 문서 전반에 걸친 파싱 및 추론 오류를 크게 줄입니다.
OfficeQA Pro에서의 최첨단 성능
GPT-5.5는 스캔된 PDF와 레거시 파일 전반에 걸친 파싱, 검색, 근거 기반 추론을 평가하도록 특별히 설계된 OfficeQA Pro 벤치마크에서 새로운 최첨단 성능(SOTA)을 달성했습니다. 에이전트-하네스 설정에서 GPT-5.5는 GPT-5.4에 비해 오류를 46% 줄였으며, 이 벤치마크에서 50% 정확도를 넘어선 첫 번째 모델이 되었습니다.
Research Engineer Arnav Singhvi에 따르면, 이 모델은 이전 모델인 GPT-5.4가 종종 숫자와 숫자를 올바르게 추출하지 못했던 오래된 문서와 스캔된 PDF의 파싱에서 '단계 함수적 향상'을 보입니다. 이 파싱 개선은 중요한데, 이러한 워크플로우에서의 추출 오류는 일반적으로 하류로 cascading되어 에이전트의 작업 전체 궤적을 바꾸기 때문입니다.
향상된 오케스트레이션 및 신뢰성
파싱 외에도, GPT-5.5는 다단계 작업 전반에 걸쳐 향상된 오케스트레이션을 보여줍니다. GPT-5.4는 때때로 비효율적인 궤적으로 이어지는 '불필요한 검색 우회'를 수행했으나, GPT-5.5는 추가적인 감독 없이 관련 컨텍스트를 검색하고 복잡한 워크플로우를 완료하는 데 더 신뢰할 수 있습니다.
기업 생산 통합
Databricks는 AI Unity Gateway를 통해 GPT-5.5를 제공하고 있습니다. 고객은 AgentBricks와 Agent Supervisor API로 구축된 워크플로우 내에서 모델을 활용할 수 있으며, 여기서 GPT-5.5는 전문 에이전트 전반에 걸친 파싱, 검색 및 실행을 위한 오케스트레이터 역할을 합니다.
Research Engineer Arnav Singhvi는 다음과 같이 언급했습니다: "GPT-5.5는 지식 향상 측면에서 뛰어났습니다. 이는 우리에게 지식 작업을 수행하는 데 있어 단계 크기 함수 변화입니다."