GPT-5.2-Codex 릴리스 노트

OpenAI는 Codex 환경 내에서 에이전트형 코딩에 최적화된 GPT-5.2의 특수 버전인 GPT-5.2-Codex를 출시했습니다. 이 모델은 대규모 리팩터링 및 마이그레이션을 포함한 복잡하고 실제적인 소프트웨어 엔지니어링 작업을 처리하도록 설계되었으며, 사이버 보안 능력을 크게 향상시켰습니다.

고급 에이전트형 소프트웨어 엔지니어링

GPT-5.2-Codex는 장기 작업과 터미널 환경에서의 신뢰성을 중점으로 GPT-5.2 및 GPT-5.1-Codex-Max의 기능을 개선했습니다. 이 모델은 전체 컨텍스트 유지가 중요한 장시간 코딩 세션에서 신뢰할 수 있는 파트너가 되도록 설계되었습니다.

주요 기술 개선 사항

  • Context Compaction: 모델은 토큰 효율성을 유지하면서 추론 중에 네이티브 압축을 활용하고 장기 컨텍스트 이해를 향상시킵니다.
  • Tool Calling and Factuality: 신뢰할 수 있는 도구 호출 및 사실성 개선을 통해 장시간 작업 중 오류를 감소시킵니다.
  • Environment Support: 네이티브 Windows 환경에서 작동할 때 모델의 효율성과 신뢰성이 크게 향상됩니다.
  • Vision Integration: 향상된 비전 성능으로 기술 다이어그램, 차트, UI 화면 및 스크린샷을 정확히 해석하여 디자인 목업을 기능 프로토타입으로 변환할 수 있습니다.

성능 벤치마크

GPT-5.2-Codex는 두 가지 주요 벤치마크에서 최첨단 성능을 달성합니다:

  • SWE-Bench Pro: 코드 저장소 내에서 현실적인 소프트웨어 엔지니어링 작업을 해결하기 위한 패치를 생성하는 모델의 능력을 테스트합니다.
  • Terminal-Bench 2.0: 서버 설정, 모델 학습, 코드 컴파일 등 실제 터미널 환경에서 에이전트형 성능을 평가합니다.

사이버 보안 능력 및 이중 사용 위험

GPT-5.2-Codex는 이전 버전 대비 사이버 보안 능력이 크게 향상되었습니다. OpenAI의 Preparedness Framework에 따르면 아직 "High" 수준의 사이버 능력에 도달하지는 않았지만, 이중 사용 위험 가능성 때문에 배포에 신중을 기하고 있습니다.

취약점 연구에서의 실제 적용 사례

OpenAI는 보안 연구원 Andrew MacPherson가 GPT-5.1-Codex-Max를 사용해 React Server Components에서 이전에 알려지지 않은 취약점을 발견한 사례를 강조합니다. 연구원은 Codex CLI와 반복 프롬프트를 활용해 로컬 테스트 환경을 설정하고 퍼징을 통해 시스템을 탐색함으로써 2025년 12월 11일에 React 팀에 새로운 취약점을 책임감 있게 공개했습니다.

안전 및 배포 프레임워크

접근성과 안전성을 균형 있게 유지하기 위해 OpenAI는 다음과 같은 조치를 시행하고 있습니다:

  • Gradual Rollout: 모델은 유료 ChatGPT 사용자를 위한 모든 Codex 환경에서 이용 가능하며, API 접근은 향후 몇 주 내에 제공될 예정입니다.
  • Additional Safeguards: 시스템 카드에 상세히 설명된 새로운 안전 장치가 모델과 제품에 통합되었습니다.
  • Trusted Access Pilot: 검증된 보안 전문가와 조직을 대상으로 초대 전용 프로그램을 파일럿 운영하고 있습니다. 이 프로그램은 허가된 방어자에게 보다 관대한 모델과 고급 기능을 제공하여 악성코드 분석 및 인프라 스트레스 테스트와 같은 방어 보안 작업을 가속화합니다.

가용성 요약

접근 등급 가용성
유료 ChatGPT 사용자 현재 모든 Codex 환경에서 사용 가능
API 사용자 몇 주 내에 제공 예정
검증된 전문가 방어 사이버 작업을 위한 초대 전용 신뢰 접근 파일럿

Sources