Claude Opus 4.1 發佈說明
Anthropic 已發佈 Claude Opus 4.1,這是 Claude Opus 4 的升級版本,旨在提升在代理任務 (agentic tasks)、現實世界編碼以及推理方面的性能。此次更新是在計劃於未來幾週進行更大規模模型更新之前的一次增量改進。
編碼性能與基準測試
Claude Opus 4.1 在 SWE-bench Verified 上達到了 74.5% 的頂尖編碼性能分數。與其前身 Opus 4 相比,該模型在現實世界的軟體工程任務中展現了顯著的改進。
外部合作夥伴報告了以下性能提升:
- GitHub: 指出在大多數能力方面都有所改進,特別是在多文件代碼重構方面有具體增益。
- Rakuten Group: 報告稱 Opus 4.1 擅長在大型代碼庫中精確定位正確的修正,且不會引入錯誤或進行不必要的調整。
- Windsurf: 報告稱在其初級開發者基準測試中,比 Opus 4 有一個標準差的提升,並將此次性能飛躍比作從 Sonnet 3.7 到 Sonnet 4 的轉變。
研究與數據分析能力
Opus 4.1 增強了 Claude 在深入研究與數據分析方面的能力。這些改進特別專注於細節追蹤與代理搜尋 (agentic search),從而實現更精確的信息檢索與綜合。
可用性與集成
Claude Opus 4.1 已向付費 Claude 用戶開放,並已集成到 Claude Code 中。對於開發者,可以透過 API 使用識別碼 claude-opus-4-1-20250805 進行訪問,也可以透過 Amazon Bedrock 和 Google Cloud 的 Vertex AI 使用。Opus 4.1 的定價與 Opus 4 的定價保持一致。
Sources
- OriginalClaude Opus 4.1
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch