Anthropic Claude Sonnet 5 발표
요약 (TL;DR)
Claude Sonnet 5는 Anthropic의 최신 Sonnet-class 모델로, 더 낮은 가격과 향상된 안전성을 제공하면서 Opus-class에 근접한 에이전트 기능(계획 수립, 도구 사용, 코딩 및 지식 작업)을 제공합니다.
Sonnet 5는 무엇이 더 에이전트적인가?
Sonnet 5는 "가장 에이전트적인 Sonnet 모델"로 설명됩니다. 이 모델은 자율적으로 계획을 수립하고, 브라우저 및 터미널과 같은 외부 도구를 호출하며, 이전에는 더 크고 비싼 모델이 필요했던 다단계 작업을 수행할 수 있습니다. 이전 모델인 Sonnet 4.6과 비교했을 때, Sonnet 5는 추론, 도구 사용, 코딩 및 지식 작업 성능에서 측정 가능한 이득을 보여줍니다.
다른 Anthropic 모델과의 성능 비교
- Opus 4.8에 근접: 발표된 벤치마크 표에 따르면 Sonnet 5의 다양한 평가 점수는 더 높은 등급인 Opus 4.8과 대등하며, Sonnet-class 가격을 유지합니다.
- Sonnet 4.6 대비 개선: 에이전트 검색(BrowseComp) 및 컴퓨터 사용(OSWorld-Verified) 작업에서 Sonnet 5는 Sonnet 4.6을 지속적으로 능가하며, Opus 4.8보다 더 넓은 가성비 범위를 제공합니다.
- 비용 효율성: 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $10의 가격으로, Sonnet 5는 특히 일부 작업에서 Opus 4.8과 대등한 성능을 보여주는 중간 정도의 노력 수준에서 달러당 더 높은 성능을 제공합니다.
실제 개발자 피드백
얼리 액세스 파트너들은 Sonnet 5가 이전 Sonnet 모델들이 포기했던 복잡하고 다단계적인 워크플로우를 완료한다고 보고합니다. 대표적인 인용구는 다음과 같습니다:
"Claude Sonnet 5는 우리의 에이전트에게 다단계 소프트웨어 엔지니어링 작업을 위한 강력한 실행 레이어를 제공합니다. 복잡한 기술적 맥락 속에서도 지속적인 코딩, 도구 사용 및 디버깅을 잘 처리합니다."
"우리는 Claude Sonnet 5에게 두 부분으로 구성된 작업—Salesforce 계정 등급 업데이트, 기업 고객에게 출시 발표를 보내는 것—을 맡겼고, 모델은 이를 처음부터 끝까지 완료했습니다. 이전에는 작업이 중간에 멈추곤 했습니다."
"Claude Sonnet 5는 더 적은 것으로 더 많은 일을 합니다. 출력 품질은 동일하지만, 도달하는 데 필요한 단계는 더 적습니다. 또한 안전하지 않은 요청을 깔끔하고 일관되게 거부합니다."
"I asked Claude Sonnet 5 to investigate a bug. Unprompted, it wrote a reproducing test, implemented the fix, then stashed it to confirm the bug came back without the change. All in a single pass."
이러한 일화들은 모델이 지속적인 프롬프트 없이도 집중력을 유지하고, 관습을 따르며, 검증된 코드 변경 사항을 생성할 수 있는 능력을 보여줍니다.
안전성 프로필
Anthropic의 배포 전 안전성 평가에 따르면 다음과 같습니다:
- Sonnet 4.6보다 낮은 전반적인 바람직하지 않은 행동: 환각(hallucination), 아첨(sycophancy) 현상이 줄어들고 악의적인 요청에 대한 거부 능력이 향상되었습니다.
- 에이전트 오용에 대해 Opus 4.8보다 높은 안전성: 비록 Sonnet 5가 광범위한 자동화된 행동 감사에서 Mythos preview 및 Opus 4.8보다 약간 높은 정렬(misalignment) 비율을 보이지만, Sonnet 5는 에이전트 오용에 대해 Opus 4.8보다 높은 안전성을 보여줍니다.
- 감축된 사이버 보안 능력: Sonnet 5는 Firefox 기반 테스트에서 전체 익스플로잇을 개발할 수 없었으며, 부분적인 성공률도 낮게 유지되었습니다. 그럼에도 불구하고, 일반 지능의 향상으로 인해 Sonnet 4.6보다는 약간 높습니다.
사이버 관련 능력의 미미한 증가로 인해, Anthropic은 Sonnet 5를 실시간 사이버 안전 장치가 기본적으로 활성화된 상태로 출시합니다. 이는 Opus 4.7/4.8에 사용되는 것과 동일하지만 Fable 5를 위한 것보다는 덜 제한적입니다.
가용성 및 가격
- 일반 가용성: Sonnet 5는 Free 및 Pro 플랜의 기본 모델이며, Max, Team, 및 Enterprise 고객도 이용할 수 있습니다.
- 가격: 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $10 (2026년 8월 10일 기준 영구 적용). Claude Chat, Cowork, Claude Code, 및 Claude Platform의 속도 제한(rate limits)이 더 높은 수준의 작업량을 지원하기 위해 상향 조정되었습니다.
- API 액세스: 개발자는
claude-sonnet-5식별자를 사용하여 Claude API를 통해 모델을 호출할 수 있습니다.
AI 생태계에 미치는 영향
- 에이전트 AI의 민주화: Sonnet과 Opus 계열 간의 성능 차이를 좁힘으로써, Anthropic은 고품질의 자율 에이전트 기능을 더 넓은 개발자 기반이 더 저렴렴하게 이용할 수 있도록 합니다.
- 경쟁 압력: Sonnet 5가 구축한 가성비의 경계선은 다른 제공업체들이 유사하게 유능능한, 더 저렴한 에이전트 모델을 모델을 출시하도록 압박할 수 있습니다.
- 안전성 트레이드오프: 이전 Sonnet 모델에 비해 안전성이 향상되었지만, 모델은 여전히 최급위 Opus 모델들보다 안전하지 않으합니다니다. 이는 능력과 정렬(alignment) 사이의 지속적인 균형을 균형을 강조합니다.
모든 수치, 차트 및 직접 인용구는 Anthropic의 공식 Claude Sonnet 5 발표 및 시스템 카드에서 가져왔습니다.
Sources
- OriginalIntroducing Claude Sonnet 5
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch