GPT-5.6 가격 및 성능 업데이트
OpenAI는 GPT-5.6 Luna와 Terra의 가격을 인하하고 GPT-5.6 Sol에 “Fast mode”(빠른 모드)를 도입하여 개발자가 대용량 AI 작업을 보다 비용 효율적으로 확장하면서 고우선 순위 작업을 가속화할 수 있도록 했습니다.
API 가격 및 성능 업데이트
OpenAI는 대용량 AI 애플리케이션의 비용을 낮추기 위해 GPT-5.6 모델군에 대한 대규모 가격 인하를 시행했습니다.
- GPT-5.6 Luna: 가족 중 가장 저렴하고 가장 빠른 모델로, 현재 비용이 80% 감소했습니다. API 가격은 입력 토큰 백만 개당 $0.20, 출력 토큰 백만 개당 $1.20입니다.
- GPT-5.6 Terra: 일상 작업에 적합한 균형 잡힌 모델로, 현재 비용이 20% 감소했습니다. API 가격은 입력 토큰 백만 개당 $2, 출력 토큰 백만 개당 $12입니다.
- GPT-5.6 Sol: 가격은 변동이 없지만, 새로운 Fast mode가 Priority Processing을 대체합니다. Fast mode는 표준 처리보다 최대 2.5배 빠른 속도를 제공하지만 가격은 두 배이며, 지능에는 변화가 없습니다.
이러한 가격 변경은 Codex와 ChatGPT Work의 유료 구독에 대한 사용량 집계 방식에도 반영됩니다.
모델 선택 및 워크플로우 최적화
기업은 작업의 특정 지능 요구 사항에 모델 버전을 맞춤으로써 AI 비용을 최적화할 수 있습니다.
- Luna의 효율성: Luna는 1년 전 최첨단 모델에 필적하는 성능을 작업당 약 6센트(달러 대비)와 거의 9배 빠른 속도로 제공합니다. 전문 작업(Agents’ Last Exam 기준)에서 Luna는 Fable 5보다 작업당 비용이 약 99% 낮은 것으로 추정됩니다.
- 하이브리드 워크플로우: 조직은 지능에 대한 계층적 접근 방식을 사용할 수 있습니다. 예를 들어, 코딩 워크플로우에서는 GPT-5.6 Sol을 사용해 계획을 정의하고 불확실성을 해결한 뒤, GPT-5.6 Luna로 전환하여 변경을 구현하고 테스트를 실행하며 결과를 평가할 수 있습니다.
효율성의 기술적 요인
GPT-5.6의 가격 대비 성능 향상은 모델 아키텍처, 추론 시스템, 그리고 에이전트 활용 전반에 걸친 개선에 의해 이루어졌습니다.
- 인프라 개선: 하드웨어 활용도를 유지하기 위한 더 나은 라우팅, 토큰 생성을 위한 최적화된 프로덕션 소프트웨어, 그리고 작업 반복을 방지하는 더 스마트한 컨텍스트 관리 등을 통해 효율성이 향상되었습니다.
- AI 기반 최적화: GPT-5.6 Sol은 인간 주도 프로세스 내에서 자동으로 프로덕션 커널을 재작성하고 최적화하는 데 사용되어 모델 제공의 전체 비용을 20% 감소시켰습니다. 또한, Sol이 주도한 실험을 통해 토큰 생성 효율성이 15% 이상 향상되었습니다.
가용성
GPT-5.6 Terra와 Luna는 ChatGPT Work, Codex, 그리고 OpenAI API에서 사용할 수 있습니다. ChatGPT Work와 Codex에서는 Free 및 Go 사용자가 Terra에 접근할 수 있으며, Plus, Pro, Business, Enterprise 사용자는 Terra와 Luna 모두에 접근할 수 있습니다. 가격 업데이트는 2026년 7월 30일부터 AWS에 순차적으로 적용됩니다.