Claude Opus 4.1 发布说明
Anthropic 发布了 Claude Opus 4.1,这是对 Claude Opus 4 的升级,旨在提高在智能体任务、真实世界编码和推理方面的性能。此次更新是在计划于未来几周进行更大规模模型更新之前的一次增量改进。
编码性能与基准测试
Claude Opus 4.1 在 SWE-bench Verified 上实现了 74.5% 的最先进编码性能评分。与前代产品 Opus 4 相比,该模型在真实世界的软件工程任务中表现出显著改进。
外部合作伙伴报告了以下性能提升:
- GitHub: 指出在大多数能力方面都有所改进,特别是在多文件代码重构方面有所提升。
- Rakuten Group: 报告称 Opus 4.1 擅长在大型代码库中精准定位准确的修正,而不会引入 Bug 或进行不必要的调整。
- Windsurf: 报告称在其初级开发人员基准测试中,相比 Opus 4 有一个标准差的提升,并将这种性能飞跃比作从 Sonnet 3.7 到 Sonnet 4 的转变。
研究与数据分析能力
Opus 4.1 增强了 Claude 在深入研究和数据分析方面的能力。这些改进专门针对细节追踪和智能体搜索,从而实现更精确的信息检索和综合。
可用性与集成
Claude Opus 4.1 已面向付费 Claude 用户开放,并已集成到 Claude Code 中。对于开发者,可以通过 API 使用标识符 claude-opus-4-1-20250805 进行访问,也可以通过 Amazon Bedrock 和 Google Cloud 的 Vertex AI 进行访问。Opus 4.1 的定价与 Opus 4 的定价保持一致。
Sources
- OriginalClaude Opus 4.1
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch