Claude Opus 4.1 릴리스 노트
Anthropic는 에이전트 작업, 실제 세계의 코딩 및 추론에서 성능을 향상시키기 위해 설계된 Claude Opus 4의 업그레이드 버전인 Claude Opus 4.1을 출시했습니다. 이번 업데이트는 앞으로 며칠 내로 예정된 더 큰 모델 업데이트를 앞두고 이루어진 점진적인 개선 사항입니다.
코딩 성능 및 벤치마크
Claude Opus 4.1은 SWE-bench Verified에서 최고 수준의 코딩 성능 점수인 74.5%를 기록했습니다. 이 모델은 전작인 Opus 4에 비해 실제 소프트웨어 엔지니어링 작업에서 상당한 성능 향상을 보였습니다.
외부 파트너들은 다음과 같은 성능 향상을 보고했습니다:
- GitHub: 대부분의 기능에서 개선을 기록했으며, 특히 다중 파일 코드 리팩터링에서 두드러진 성과를 보였습니다.
- Rakuten Group: Opus 4.1이 큰 코드베이스 내 정확한 수정 사항을 정확히 파악하면서 버그를 유발하거나 불필요한 조정을 하지 않는다는 점에서 뛰어난 성능을 보였다고 보고했습니다.
- Windsurf: 자체 주니어 개발자 벤치마크에서 Opus 4보다 1개 표준편차 수준의 성능 향상을 기록했으며, 이 성능 향상은 Sonnet 3.7에서 Sonnet 4로의 전환과 유사하다고 평가했습니다.
연구 및 데이터 분석 능력
Opus 4.1은 Claude의 심층적 연구 및 데이터 분석 능력을 강화했습니다. 이러한 개선은 세부 사항 추적과 에이전트 기반 검색에 집중되어 있어, 더 정확한 정보 검색과 통합을 가능하게 합니다.
가용성 및 통합
Claude Opus 4.1은 유료 Claude 사용자에게 제공되며, Claude Code에 통합되어 있습니다. 개발자들은 claude-opus-4-1-20250805 식별자로 API를 통해 모델에 접근할 수 있으며, Amazon Bedrock 및 Google Cloud의 Vertex AI를 통해도 이용할 수 있습니다. Opus 4.1의 가격은 Opus 4와 동일하게 유지됩니다.
Sources
- OriginalClaude Opus 4.1
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch