GPT-5.6 Sol, Terra, Luna: 성능, 기능 및 제공
GPT-5.6 Sol, Terra, Luna: 성능, 기능 및 제공
TL;DR
OpenAI는 GPT‑5.6 패밀리를 출시했습니다—주력 모델인 Sol, 균형 잡힌 모델인 Terra, 가장 비용 효율적인 모델인 Luna—각 토큰당 높은 지능을 제공하고, 여러 에이전트를 병렬로 실행하는 새로운 ultra 설정을 도입했으며, 현재까지 가장 견고한 안전 시스템을 제공합니다.
모델 패밀리 개요
GPT‑5.6은 Sol, Terra, Luna의 세 계층으로 구성됩니다. Sol은 고강도 작업을 위한 주력 모델이며, Terra는 일상적인 작업에 균형 잡힌 성능을 제공하고, Luna는 가장 빠르고 비용이 낮은 옵션을 제공합니다. 세 모델 모두 동일한 세대 번호를 공유하지만, 계층 이름은 독립적으로 진화할 수 있는 지속 가능한 역량 수준을 나타냅니다.
성능 및 효율성 향상
GPT‑5.6 Sol은 코딩, 지식 작업, 사이버 보안, 과학 분야에서 최첨단 결과를 달성하면서 이전 및 경쟁 최전선 모델보다 적은 토큰을 사용하고 추정 비용도 낮춥니다. Agents’ Last Exam에서 Sol은 53.6점을 받아 Claude Fable 5보다 13.1점 높게 기록했으며, 중간 추론 단계에서는 약 ¼의 추정 비용으로 Fable 5보다 11.4점 앞섭니다. Terra와 Luna는 각각 약 1/16 비용으로 Fable 5를 능가합니다. Artificial Analysis Intelligence Index에서는 max 추론을 사용할 때 Sol이 Fable 5와 1점 차이 안에 머무르면서 작업 시간을 61% 단축하고 비용은 약 절반 수준으로 수행합니다.
코딩 우수성
GPT‑5.6 Sol은 Artificial Analysis Coding Agent Index에서 80점이라는 새로운 최첨단 점수를 기록했으며, 이는 Claude Fable 5보다 2.8점 높은 수치입니다. 출력 토큰은 절반 이하, 소요 시간도 절반 이하, 비용은 약 1/3 수준으로 감소했습니다. Terra는 Fable 5보다 약간 높은 성능을 보이며, Luna는 Claude Opus 4.8을 능가합니다; 각각은 약 1/3 시간에 수행하고 출력 토큰은 절반 정도, 추정 비용은 약 1/4 수준입니다. Sol은 또한 복잡한 명령줄 워크플로와 실제 코드베이스에서의 장기 엔지니어링을 평가하는 Terminal‑Bench 2.1 및 DeepSWE에서도 새로운 최첨단 결과를 달성했습니다.
지식 작업 및 디자인 판단
GPT‑5.6 Sol은 BrowseComp에서 92.2%, OSWorld 2.0에서 62.6%를 기록해 Claude Opus 4.8을 능가했으며, 출력 토큰은 85% 감소했습니다. 이 모델은 자연어 요청을 ChatGPT Work 내에서 다듬어진 인터랙티브 설명 및 시각화로 변환할 수 있습니다. Slack, Notion, Microsoft 365, Google Drive에서 복잡한 컨텍스트를 추출해 전문가 수준의 공유 가능한 산출물로 전환합니다. 프레젠테이션, 문서, 스프레드시트에서는 Sol이 더 정교하고 정확한 결과물을 생성하며, 처음부터 완전 편집 가능한 프레젠테이션을 만들고, 레이아웃, 타이포그래피, 간격, 색상, 반복 콘텐츠 패턴 등 디자인 시스템을 추론해 새로운 자료에 일관되게 적용합니다.
사이버 보안 역량 및 안전
ExploitBench에서 GPT‑5.6 Sol은 출력 토큰 예산이 비슷한 상황에서 GPT‑5.5의 47.9%에 비해 73.5%를 기록했습니다. ExploitGym에서는 2시간 제한 하에 15.1%에서 24.9%로 거의 두 배에 가까운 상승을 보였으며, 6시간에서는 33.7%에 도달했습니다. SEC‑Bench Pro에서는 향상된 지연 시간 속에서 GPT‑5.5의 45.8%에 비해 71.2%를 기록했습니다. 모델은 보안 코드 리뷰, 패치, 위협 모델링, 블루 팀 작업 등 방어적 작업을 지원하며, OpenAI Daybreak의 Trusted Access 프로그램을 통해 검증된 접근을 제공합니다. GPT‑5.6의 안전 장치는 지금까지 가장 견고하며, 모델에 내장된 보호와 실시간 검사, 지속적인 모니터링, 계정 수준 강제 적용을 결합하고, 대화 내용을 검토해 잠재적 해를 판단하는 추론 모니터를 추가했습니다. 이전 모델에 비해 Sol의 사이버 안전 장치는 잠재적으로 해로운 활동을 약 10배 더 차단하며, 낮은 역량 모델에서 프롬프트 재시도를 선택할 수 있어 정상적인 사용의 마찰을 완화합니다.
Ultra 및 다중 에이전트 워크플로우
ultra 설정은 기본적으로 네 개의 에이전트를 병렬로 조정하여 토큰 사용량이 늘어나는 대신 더 강력한 결과와 빠른 시간‑대‑결과를 제공합니다. 차트는 병렬 에이전트를 추가하면 BrowseComp, SEC‑Bench Pro, Terminal‑Bench 2.1에서 점수‑지연 프론티어가 위쪽 및 왼쪽으로 이동함을 보여주며, 16‑에이전트 구성도 시연되었습니다. 개발자는 Responses API의 다중 에이전트 베타를 활용해 ultra와 유사한 경험을 구축할 수 있습니다. max 설정은 xhigh보다 더 많은 추론 시간을 제공해 모델이 대안을 탐색하고, 검사를 실행하며, 접근 방식을 수정할 수 있게 합니다.
제공, 접근 및 가격
GPT‑5.6 Sol, Terra, Luna는 오늘부터 ChatGPT, Codex, OpenAI API 전반에 걸쳐 이용 가능하며, 전 세계 롤아웃이 진행 중으로 향후 24시간 내에 전체 제공을 목표로 합니다. ChatGPT에서는 Plus, Pro, Business, Enterprise 사용자가 중간 및 높은 노력 설정을 통해 Sol에 접근할 수 있으며, Pro와 Enterprise 사용자는 최고 품질 결과를 위한 Sol Pro도 선택할 수 있습니다. 무료 및 Go 사용자는 ChatGPT Work와 Codex에서 Terra에 접근하고, Plus, Pro, Business, Enterprise 사용자는 Sol, Terra, Luna 중 선택해 각각 노력 수준을 설정할 수 있습니다. max 토글은 ChatGPT Work와 Codex에 접근 권한이 있는 모든 사용자가 사용할 수 있으며, ultra는 ChatGPT Work의 Pro와 Enterprise 사용자, 그리고 Codex의 Plus 이상 플랜에서 제공됩니다. API 개발자는 OpenAI API를 통해 세 계층 모두에 접근할 수 있으며, Responses API의 Programmatic Tool Calling을 통해 모델이 도구를 조정하는 인‑메모리 프로그램을 작성·실행하게 할 수 있고, 다중 에이전트 베타를 통해 동시 서브에이전트를 활성화합니다. 1M 토큰당 가격은 다음과 같습니다: Sol 입력 $5 / 출력 $30; Terra 입력 $2.50 / 출력 $15; Luna 입력 $1 / 출력 $6. 프롬프트 캐싱은 명시적 캐시 중단점과 최소 30분 캐시 수명을 제공해 예측 가능성을 높이며, 캐시 쓰기는 비캐시 입력 요금의 1.25배로 청구되고, 캐시 읽기는 90% 캐시 입력 할인 혜택을 받습니다.
결론
GPT‑5.6은 달러당 성능 한계를 높이고 ultra 규모 다중 에이전트 추론을 도입하며, 코딩, 지식 작업, 디자인 판단, 사이버 보안 방어를 개선하고, 현재까지 OpenAI가 배포한 가장 포괄적인 안전 시스템과 이 모든 진보를 결합한 모델 패밀리를 제공합니다.
SUMMARY: OpenAI는 GPT-5.6을 출시하며, Sol, Terra, Luna 모델을 도입해 달러당 성능 향상, 초대형 다중 에이전트 기능, 강화된 안전 장치를 제공합니다.
TITLE: GPT-5.6 Sol, Terra, Luna: 성능, 기능 및 제공