Anthropic Claude Sonnet 4.5는 오직 오픈소스 도구만을 사용해 자율적인 다단계 공격을 수행함
요약
Claude Sonnet 4.5는 이제 Kali Linux 호스트에서 표준 Bash 명령어만을 사용해 수십 대의 호스트를 가진 네트워크에 대해 다단계 네트워크 공격을 수행하고, Equifax 스타일의 침해 상황에서 시뮬레이션된 개인 정보를 탈취할 수 있으며, 이는 AI 모델이 현실적인 사이버 레인지 환경에서 성공하기 위해 맞춤형 사이버 도구 키트를 더 이상 필요로 하지 않는다는 것을 보여줍니다.
1. 발표 개요
Anthropic는 2026년 1월 16일에 Claude Sonnet 4.5 모델의 새로운 기능을 발표했습니다:
"최근 AI 모델의 사이버 능력을 평가한 결과, 현재의 Claude 모델은 이전 세대가 필요로 했던 맞춤형 도구 대신 표준 오픈소스 도구만으로 수십 대의 호스트를 가진 네트워크에 대해 다단계 공격에 성공할 수 있습니다."
이 발표는 카네기 멜론 대학교의 CyLab 사이버 레인지에서 Claude를 평가한 2025년 논문을 바탕으로 하며, 일반적인 CTF 환경보다 훨씬 더 정교한 환경을 제공합니다. 주요 진전은 이전 모델이 필요로 했던 맞춤형 사이버 도구 키트 없이도 Sonnet 4.5가 성공할 수 있다는 점입니다.
2. 마지막 평가 이후의 기술적 진보
| 모델 | 출시일 | 맞춤형 도구 키트 필요 여부 | Equifax 시뮬레이션 성공 여부 |
|---|---|---|---|
| Claude Sonnet 3.5 | 2024–2025 | 필요 | 0 / 5 시도 |
| Claude Sonnet 4.5 | 2026 | 소수의 네트워크에서는 필요 없음; 여전히 9개 네트워크 중 5개에서는 필요 | 2 / 5 시도 (자율적) |
이 추세는 다른 AI 발전 경향과 일치합니다: 모델들은 처음에는 전용 보조 도구에 의존하다가, 나중에는 공개된 도구만으로도 작동할 수 있게 됩니다.
3. Equifax 스타일 침해 시뮬레이션 세부 사항
평가에서는 2017년 Equifax 침해 사례를 재현했습니다. 이 침해는 아직 패치되지 않은 공개된 CVE를 악용했습니다. Sonnet 4.5는 Kali Linux 호스트에서 단지 Bash 쉘만을 사용해 다음 단계를 수행했습니다:
- 취약점 인식 – 외부 검색 없이 공개된 CVE를 즉시 식별함.
- 공격 코드 생성 – 실시간으로 공격 코드를 작성함.
- 데이터 탈취 – 타겟 시스템에서 모든 시뮬레이션된 개인 정보를 추출함.
"Sonnet 4.5는 이제 고정밀도로 Equifax 데이터 침해 사례를 시뮬레이션한 환경에서 (시뮬레이션된) 모든 개인 정보를 탈취할 수 있습니다… 단지 널리 사용되는 Kali Linux 호스트에서 표준 Bash 쉘만을 사용하여 (보안 테스트용 표준 오픈소스 도구; 맞춤형 키트가 아님)"
이 모델은 5번의 시도 중 2번에서 자율적으로 성공했으며, 현재 AI 기반 공격 자동화의 가능성과 변동성을 보여줍니다.
4. 한계 및 성공률
- 부분적 성공 – Sonnet 4.5는 Equifax 시뮬레이션에서 2/5번의 시도에서 자율적으로 성공했으며, 9개 네트워크 중 5개에서는 맞춤형 도구 키트 없이 진행할 수 없었습니다.
- 네트워크 조건 의존성 – 여전히 접근 가능한 취약 서비스와 적절한 자격 증명이 필요하며, 모든 타겟에서 성공을 보장하지 않습니다.
- 도구 가용성 – 이 시연은 Bash와 Kali 유틸리티만 사용했지만, 더 복잡한 환경에서는 추가 도구가 여전히 필요할 수 있습니다.
이러한 제약 사항은 Anthropic가 명시적으로 인정하고 있습니다:
"현 상태를 과장해서는 안 됩니다. Claude는 이러한 테스트에서 항상 성공하지는 않습니다. Sonnet 4.5는 Equifax 사이버 레인지에서 5번의 시도 중 2번에서 자율적으로 성공했습니다. 또한, 9개 네트워크 중 5개에서는 맞춤형 사이버 도구 키트 없이 진행할 수 없었습니다."
5. 보다 넓은 함의
5.1 AI 기반 사이버 공격의 장벽 하락
표준 오픈소스 도구만으로도 정교한 공격을 수행할 수 있다는 점은 비기술적 사용자가 AI 모델을 활용해 대규모 탐지 및 공격을 자동화할 수 있음을 의미합니다. 모델이 공개된 CVE를 빠르게 인식하고 공격 코드를 생성하는 속도는 알려진 취약점의 빠른 자동 무기화 위험을 강조합니다.
5.2 기본 보안 절차의 중요성
Anthropic는 Equifax 스타일 시나리오가 오랜 기간 지속되는 방어 원칙을 강조합니다:
"이러한 접근 방식을 활용하는 매우 능력 있고 빠른 AI 에이전트의 가능성을 고려하면, 즉각적인 업데이트와 패치와 같은 보안 최선의 실천 방안이 더욱 절실해졌습니다."
공개된 CVE에 대해 시스템을 패치하는 것은 AI가 즉시 이를 발견하고 악용할 수 있기 때문에 지금보다 더욱 중요해졌습니다.
5.3 방어용 AI 연구의 필요성
이 포스트는 Anthropic가 자체적으로 AI 기반 사이버 방어자 연구를 진행하고 있음을 언급합니다:
"최근 AI가 주도하는 사이버 스파이 활동 사례와 같은 실제 사례들은, 사이버 방어자가 AI 기반 도구를 어떻게 효과적으로 갖출 수 있을지에 대한 심층적인 연구가 필요함을 보여줍니다."
AI 기반 공격을 탐지하고 제어하며 복구할 수 있는 방어용 AI 개발이 시급합니다.
6. 실무자들을 위한 권고사항
- 패치 관리 – AI 에이전트가 취약점을 악용하기 전에 알려진 CVE를 조기에 패치할 수 있도록 패치 배포 파이프라인을 가속화하세요.
- 네트워크 세분화 – 중요한 자산(예: 데이터베이스)을 격리하여 횡단 이동 기회를 제한하세요.
- 이상적인 도구 사용 모니터링 – 예기치 않은 호스트에서 일반적인 보안 테스트 유틸리티(예:
curl에 의심스러운 페이로드)가 사용되는 것을 감지할 수 있는 규칙을 도입하세요. - 방어용 AI 투자 – 공격용 AI의 속도에 맞서는 AI 기반 위협 탐지 및 자동 응답 플랫폼을 탐색하세요.
- AI를 활용한 레드팀 훈련 – 새로운 공격 경로를 발견하기 위해 보안 테스트에 AI 보조 공격자(Adversary)를 포함하세요.
7. 더 많은 정보를 찾는 방법
- Incalmo의 상세 블로그 포스트 – https://www.incalmo.ai/blog/2025/10/01/sonnet_eval/
- Claude Sonnet 4.5 시스템 카드(5.3절) – https://assets.anthropic.com/m/12f214efcc2f457a/original/Claude‑Sonnet‑4‑5‑System‑Card.pdf
- Anthropic의 이전 2025년 사이버 도구 키트 논문 – https://red.anthropic.com/2025/cyber-toolkits/
- Anthropic의 AI를 통한 사이버 방어자 포스트 – https://red.anthropic.com/2025/ai-for-cyber-defenders/
- 최근 AI 주도 스파이 활동 캠페인 발표 – https://www.anthropic.com/news/disrupting-AI-espionage
8. 결론
Anthropic의 최신 평가는 Claude Sonnet 4.5가 Kali Linux에서 표준 Bash 명령어만을 사용해 현실적인 Equifax 스타일 침해 상황에서 자율적으로 다단계 공격을 수행하고 데이터를 탈취할 수 있음을 보여줍니다. 이는 AI 기반 공격 능력의 중요한 진전이며, 강력한 패치 관리, 네트워크 세분화, 그리고 AI 기반 방어 도구 개발의 시급성을 강화합니다.
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch