GPT-6 Astra: Legora 財務報表審查效能
OpenAI 宣布了一項涉及 Legora 的案例研究,Legora 是一個用於法律和專業工作的代理式作業系統,該研究使用 GPT-6 Astra 來自動化財務報表對帳(tie-out)流程。這種整合讓法律專業人士能在幾分鐘內處理數十份複雜的財務文件,而非耗費數天,顯著減少了數字驗證所需的繁重人工工作。
高規模處理複雜財務情境
GPT-6 Astra 使 Legora 的 Agent 能夠在單次執行中完成跨越 41 份文件的財務報表對帳。系統會檢查每個餘額是否與其支持明細表一致,識別金額差異,並記錄每次檢查以提供細粒度的記錄供專業審查。
根據 Legora 的法律工程師 Percevale Perks 表示,主要的進步在於模型的處理能力,以及其同時攝取並消化大量複雜資訊與細項的能力。
透過 Legora 代理式推理基準測試 (BAR) 獲得效能提升
Legora 使用 Legora Benchmark for Agentic Reasoning (BAR) 來衡量 GPT-6 Astra 的效能,該基準測試利用真實世界的端到端法律任務。結果顯示財務報表工作流程有顯著提升:
- 工作流程特定改進: GPT-6 Astra 在財務報表對帳任務上的效能比前一代模型提升了近 40%。
- 一般 BAR 效能: 在 BAR 的所有任務中,該模型顯示出平均約 3% 的改進。
財務審計中的準確性與可靠性
在實際測試中,GPT-6 Astra 展示了更高的準確性、完整性與可靠性。在一次受控測試中,Legora 在帳目中植入了四個錯誤,模型成功識別出所有四個錯誤,包括營收附註中 500,000 英鎊的缺口。
此外,該模型保留了前一代模型執行的所有正確檢查,同時額外完成了約 50 項檢查。這確保了數據的初步審查更為全面,而最終的判斷與決策仍由人類法律專家負責。 \n## 人機協作整合 (Human-in-the-Loop)
Legora 採用人機協作(human-in-the-loop)的方法,由 AI Agent 處理詳盡的數據比對,但專家仍負責對每個結果做出最終判斷。這種營運模式正被用於將 Legora 的平台擴展至審計、稅務、合規與風險管理領域。