개발자를 위한 GPT-5 릴리스 노트
OpenAI는 API 플랫폼을 통해 GPT-5를 출시했으며, 코딩 및 복잡한 에이전트 작업에 최적화된 새로운 모델군을 도입했습니다. GPT-5는 소프트웨어 엔지니어링 및 도구 호출 분야에서 새로운 최첨단(SOTA) 벤치마크를 설정하고, 추론 노력 및 응답 길이에 대한 개발자 중심 제어 기능을 제공합니다.
최첨단 코딩 및 프론트엔드 기능
GPT-5는 버그 수정, 코드 편집 및 복잡한 코드베이스 탐색이 가능한 코딩 협업 파트너로 설계되었습니다. 주요 소프트웨어 엔지니어링 벤치마크에서 o3를 포함한 이전 모델들을 능가합니다.
- SWE-bench Verified: GPT-5는 74.9% 점수를 기록했으며, o3의 69.1%를 능가했습니다. 이는 높은 추론 노력 상황에서 o3보다 출력 토큰을 22% 적게, 도구 호출을 45% 적게 사용하여 달성되었습니다.
- Aider Polyglot: 이 모델은 88%라는 기록적인 점수를 달성했으며, o3에 비해 오류율을 1/3로 감소시켰습니다.
- Frontend Development: 내부 테스트에서 GPT-5는 향상된 미적 감각과 코드 품질 덕분에 프론트엔드 웹 개발에서 o3보다 70% 더 선호되었습니다.
Cursor, Windsurf, Vercel 등 초기 채택자들은 GPT-5가 사용해 본 가장 지능적인 코딩 모델이며, 조작이 용이하고 미적 프론트엔드 작업에서 높은 성능을 보인다고 보고했습니다.
고급 에이전트 지능 및 도구 사용
GPT-5는 장기 에이전트 작업 실행 및 복잡한 도구 호출을 연쇄적으로 수행하면서 컨텍스트 손실 없이 크게 향상된 성능을 보여줍니다.
- Tool Calling Performance: GPT-5는 τ 2-bench 텔레콤 벤치마크에서 96.7% 점수를 기록했으며, 이전 최전선 모델들이 49%를 넘지 못했던 것에 비해 크게 향상되었습니다.
- Instruction Following: 이 모델은 Scale MultiChallenge(오3-mini가 평가)에서 69.6%, COLLIE에서는 99% 점수를 받았습니다.
- Long-Context Retrieval: GPT-5는 OpenAI-MRCR 벤치마크에서 o3와 GPT-4.1을 능가하며, 입력 길이가 길어질수록 성능 향상이 증가합니다. BrowseComp Long Context 벤치마크(128K–256K 토큰)에서는 정답을 89%의 비율로 제공합니다.
- Context Window: 모든 GPT-5 모델은 최대 272,000 입력 토큰과 128,000 추론 및 출력 토큰을 지원하여 총 400,000 토큰 컨텍스트 길이를 제공합니다.
개발자 제어를 위한 새로운 API 기능
OpenAI는 개발자가 모델 동작을 보다 세밀하게 제어할 수 있도록 여러 매개변수와 도구 유형을 도입했습니다:
reasoning_effort매개변수: 개발자는 이제minimal,low,medium(기본값),high중에서 선택할 수 있습니다.minimal설정은 추론 시간을 최소화하여 답변을 더 빠르게 반환합니다.verbosity매개변수:low,medium(기본값),high값을 갖는 새로운 매개변수로 응답 길이를 제어합니다. 명시적인 프롬프트 지시가 이 설정을 우선합니다.- Custom Tools: GPT-5는 이제 JSON 대신 일반 텍스트를 통해 도구를 호출할 수 있습니다. 이는 긴 출력에서 제어 문자 이스케이프와 관련된 오류를 줄여줍니다. 개발자는 정규식이나 문맥 자유 문법을 사용해 이러한 도구를 제한할 수 있습니다.
- Preamble Messages: 지시가 있으면 GPT-5는 도구 호출 전후에 가시적인 메시지를 출력하여 계획과 진행 상황을 최종 사용자에게 전달할 수 있습니다.
사실성 및 안전성
GPT-5는 이전 모델에 비해 환각 현상이 크게 감소했습니다. LongFact 및 FactScore 벤치마크에서 GPT-5는 o3에 비해 사실 오류가 약 80% 적습니다. 또한 이 모델은 건강 관련 질문에 대한 정확성을 높이고 자체 한계에 대한 자기 인식을 강화하도록 특별히 조정되었습니다.
모델 가용성 및 가격
GPT-5는 성능, 비용 및 지연 시간을 균형 있게 조절할 수 있도록 세 가지 크기로 제공됩니다. 또한 Responses API, Chat Completions API를 통해, 그리고 Codex CLI의 기본값으로도 사용할 수 있습니다.
| 모델 | 입력 가격 (1M 토큰당) | 출력 가격 (1M 토큰당) |
|---|---|---|
gpt-5 |
$1.25 | $10.00 |
gpt-5-mini |
$0.25 | $2.00 |
gpt-5-nano |
$0.05 | $0.40 |
또한, ChatGPT에서 사용되는 비추론 버전은 gpt-5-chat-latest($1.25 입력 / $10.00 출력)로 제공됩니다. GPT-5는 Azure AI Foundry, GitHub Copilot, Microsoft 365 Copilot 등 Microsoft 플랫폼 전반에 배포되고 있습니다.
Sources
- OriginalIntroducing GPT-5 for developers