Claude Opus 5.5 릴리스 노트
Claude Opus 5.5, 40% 낮은 비용으로 더 높은 성능 제공
Anthropic이 Claude 5.5 제품군의 첫 번째 모델인 Claude Opus 5.5를 출시했습니다. 이 모델은 대부분의 작업에서 Claude Fable 5.1의 성능에 필적하면서도, 이전 모델인 Opus 5 대비 일반적인 워크로드 실행 비용을 40% 절감하도록 설계되었습니다. 또한 Opus 5보다 30% 이상 빠르게 출력을 생성합니다.
가격 및 효율성
Opus 5.5는 Opus 5보다 계산 효율이 높아 토큰 가격이 낮고 작업당 토큰 사용량도 줄었습니다.
| 100만 토큰당 가격 | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| 캐시 읽기 | $0.20 | $0.50 |
| 입력 토큰 | $4 | $5 |
| 출력 토큰 | $20 | $25 |
| 캐시 쓰기 | $5 | $6.25 |
더 높은 속도가 필요한 사용자를 위해 Claude Code 및 Claude 플랫폼에서 "빠른 모드"를 사용할 수 있으며, 입력 토큰 100만 개당 $8, 출력 토큰 100만 개당 $40에 최대 2.5배 속도를 제공합니다.
에이전트 코딩 및 소프트웨어 엔지니어링 발전
Claude Opus 5.5는 특히 코드베이스 전체 마이그레이션 및 감사와 같은 대규모의 복잡한 소프트웨어 엔지니어링 작업 처리에서 상당한 개선을 보여줍니다.
실제 코딩 성능
- 대규모 마이그레이션: 한 초기 테스터는 하루도 채 안 되어 680,000줄의 코드 마이그레이션을 완료했습니다.
- 코드베이스 감사: 한 테스트에서 Opus 5.5는 200,000줄의 코드베이스를 3시간 이내에 감사하고 수정한 반면, Opus 5는 20시간 이상과 2.5배 더 많은 토큰이 필요했습니다.
- 언어 번역: HAProxy를 C에서 Rust로 번역하는 테스트에서 Opus 5.5는 9.5시간 만에 완료했으며(Fable 5.1의 12시간과 비교), 비용은 51% 절감되었습니다.
벤치마크
Opus 5.5는 에이전트 코딩 및 컴퓨터 사용 분야에서 선두를 달리고 있습니다. Terminal-Bench 4.0에서 GPT-6 Astra와 비슷한 성능을 약 40%의 비용으로 달성합니다. CursorBench에서는 GPT-5.6 Sol보다 11포인트 높은 성능을 약 1/3 비용으로 달성합니다.
지식 작업 및 연구 역량
Opus 5.5는 고신뢰성 연구 및 재무 분석에 최적화되어 데이터가 많은 보고서에서 환각을 줄입니다.
연구 정확성
찾기 어려운 실적 발표 자료를 기반으로 보고서를 작성해야 하는 내부 테스트에서 Opus 5.5 보고서 18개 중 16개가 허위 수치나 인용이 전혀 없어야 하는 품질 기준을 통과했습니다. Fable 5.1과 Opus 5는 어떤 시도에서도 이 기준을 통과하지 못했습니다.
비즈니스 및 재무 분석
- 재무 모델링: 가상의 합병 분석에서 Opus 5.5는 Opus 5보다 더 철저한 재무 모델과 더 읽기 쉬운 경영진 프레젠테이션을 63분 만에 완성했으며(93분 대비), 비용은 50% 절감되었습니다.
- 전문 업무: GDPval-AA v2.1 벤치마크(44개 직업 포함)에서 Opus 5.5는 1846 Elo를 기록하여 Fable 5.1(1735)과 Opus 5(1708)를 모두 능가했습니다.
커뮤니케이션 및 협업 스타일
Anthropic은 Opus 5.5의 커뮤니케이션 스타일을 더 자연스럽고 덜 장황하게 개편했습니다. 이제 모델은 응답 시작 부분에 가장 중요한 정보를 우선시하고 독특한 전문 용어를 피하여 긴 작업 세션에서 더 효과적인 파트너가 됩니다.
안전성, 정렬 및 보호 장치
Opus 5.5는 "프런티어 속도 조절"에 중점을 두고 배포되어 모델 역량과 함께 안전 관행도 발전하도록 보장합니다.
정렬 및 행동 감사
Opus 5.5는 Anthropic의 자동화된 행동 감사에서 현재까지 최고 점수를 달성했습니다. 프롬프트 주입에 훨씬 더 강하며, 되돌리기 어려운 조치를 취하거나 격리 경계를 우회할 가능성이 훨씬 낮습니다. 격리 경계 위반 테스트에서 Opus 5 또는 Claude Mythos 5.1보다 경계 우회 시도가 85% 더 적었습니다.
도메인별 보호 장치
생물학 및 사이버 보안 분야의 높은 역량으로 인해 Opus 5.5는 Fable 5.1과 유사한 보호 장치를 사용합니다.
- 사이버 보안: 대부분의 사이버 보안 작업은 Opus 4.8로 다시 라우팅됩니다. 검증된 실무자는 확장된 액세스를 위해 사이버 검증 프로그램에 신청할 수 있습니다.
- 생물학: 생물학 관련 작업은 검증된 조직을 위한 생명 과학 검증 프로그램을 통해 관리됩니다.
- 증류: 모델 역량 추출을 방지하기 위해 Opus 5.5는 "보존된 사고"를 사용하여 API 사용자가 이전 컨텍스트를 편집하여 추론을 추출하는 것을 방지합니다.
사용 가능 여부
Claude Opus 5.5는 Amazon Web Services, Google Cloud, Microsoft Azure를 포함한 모든 플랫폼에서 사용할 수 있습니다. 개발자는 Claude 플랫폼에서 모델 식별자 claude-opus-5-5를 사용하여 액세스할 수 있습니다.