Claude Opus 4.7 릴리스 노트 / 새로운 기능
Anthropic은 복잡하고 장기적인 소프트웨어 엔지니어링 작업을 더욱 엄격하고 일관되게 처리하도록 설계된 모델인 Claude Opus 4.7의 일반 공개를 발표했습니다. 이번 릴리스는 코딩에서의 자율성 향상, 고해상도 비전을 통한 멀티모달 기능 강화, 그리고 특정 사이버 보안 안전장치 구현에 중점을 두고 있습니다.
고급 소프트웨어 엔지니어링 및 에이전트 기능
Claude Opus 4.7은 고급 소프트웨어 엔지니어링, 특히 가장 어려운 작업에서 Opus 4.6보다 눈에 띄는 개선을 제공합니다. 이 모델은 지침을 더 문자 그대로 따르고 결과를 보고하기 전에 자체 출력을 검증함으로써 복잡하고 장기적인 작업을 정밀하게 처리하도록 설계되었습니다.
초기 액세스 테스터들은 에이전트 워크플로우에서 몇 가지 주요 개선 사항을 보고했습니다:
- 자율성 및 신뢰성: 테스터들은 계획 단계에서 논리적 오류를 포착하는 모델의 능력과 심층 조사 작업에 대해 수 시간 동안 일관되게 작업할 수 있는 능력을 언급했습니다. 예를 들어, Devin은 Opus 4.7이 이전에는 신뢰할 수 없었던 유형의 심층 조사 작업을 가능하게 한다고 보고했습니다.
- 코딩 벤치마크: 93개 작업 코딩 벤치마크에서 Opus 4.7은 Opus 4.6 대비 해결률을 13% 향상시켰으며, Opus 4.6이나 Sonnet 4.6이 해결하지 못한 4개의 작업을 해결했습니다. CursorBench에서는 Opus 4.6의 58%에 비해 70%를 달성했습니다.
- 도구 사용 및 오류 복구: Notion Agent는 Opus 4.6 대비 14%의 개선을 보고했으며 도구 오류는 3분의 1로 줄어들었습니다. 이전에는 모델을 중단시켰던 도구 실패를 뚫고 실행을 계속할 수 있는 모델의 능력을 언급했습니다.
- 생산 작업 해결: Rakuten-SWE-Bench에서 Opus 4.7은 Opus 4.6보다 3배 더 많은 생산 작업을 해결하며, 코드 및 테스트 품질에서 두 자릿수 이득을 얻었습니다.
강화된 멀티모달 지원 및 비전
Opus 4.7은 더 높은 해상도의 이미지를 지원함으로써 실질적으로 더 나은 비전 기능을 도입합니다. 이제 모델은 긴 쪽 가장자리가 최대 2,576픽셀(약 3.75 메가픽셀)인 이미지를 수용할 수 있으며, 이는 이전 Claude 모델의 해상도보다 3배 이상 높습니다.
이러한 해상도 증가는 다음과 같은 더 정밀한 멀티모달 사용 사례를 가능하게 합니다:
- 컴퓨터 사용 에이전트를 위한 밀집된 스크린샷 읽기.
- 복잡한 기술적 다이어그램에서 데이터 추출.
- 생명 과학 워크플로우를 위한 화학 구조 해석.
사이버 보안 안전장치 및 사이버 검증 프로그램
Project Glasswing의 일환으로 Anthropic의 전략에 따라, Opus 4.7은 Claude Mythos Preview와 같이 더 강력한 모델에 적용하기 전 새로운 사이버 보안 안전장치를 테스트하는 시험장 역할을 합니다. Opus 4.7의 사이버 기능은 Mythos Preview보다 덜 발전되어 있지만(부분적으로는 이러한 기능을 차별적으로 감소시키기 위해 설계된 훈련 실험 때문), 금지되거나 고위험 사이버 보안 요청을 자동으로 탐지하고 차단하는 안전장치를 포함하고 있습니다.
침투 테스트, 취약점 연구, 레드팀 활동과 같은 정당한 작업을 수행하는 보안 전문가를 위해, Anthropic은 관리형 액세스를 제공하기 위해 Cyber Verification Program을 도입했습니다.
기술 사양 및 플랫폼 업데이트
가격 및 가용성
Claude Opus 4.7은 모든 Claude 제품, Claude API, Amazon Bedrock, Google Cloud Vertex AI, 그리고 Microsoft Foundry를 통해 사용할 수 있습니다. 가격은 Opus 4.6과 동일하게 유지됩니다:
- Input tokens: $5 per million
- Output tokens: $25 per million
새로운 기능 및 제어 기능
- Effort Levels:
high와max사이에 새로운xhigh("extra high") 노력 수준이 도입되었습니다. 이를 통해 사용자는 추론론 깊이와 지연 시간 사이의 균형을 더 잘 맞출 수 있습니다. Claude Code에서는 모든 플랜의 기본 노력 수준이 이제xhigh입니다. - Task Budgets: 현재 Claude API에서 공개 베타로 제공되는 task budgets는 개발자가 토큰 사용량을 가이드하여 장기적인 작업을 수행하는 동안 작업의 우선순위를 정할 수 있게 해줍니다.
- Claude Code 업데이트: 새로운
/ultrareview명령어가 제공되어 버그와 설계 문제를 식별하기 위한 전용 리뷰 세션을 제공합니다. 또한,
Sources
- OriginalIntroducing Claude Opus 4.7
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch