GPT-4o mini 릴리스 노트 / 새로운 소식

OpenAI는 고성능 AI를 보다 저렴하고 접근하기 쉽게 만들기 위해 설계된 비용 효율적인 소형 모델인 GPT-4o mini를 소개했습니다. 이 모델은 GPT-3.5 Turbo를 대체하도록 배치되었으며, 훨씬 낮은 가격으로 뛰어난 텍스트 지능과 멀티모달 추론을 제공합니다.

기술 사양 및 기능

GPT-4o mini는 API에서 텍스트와 비전을 지원하는 멀티모달 모델이며, 향후 이미지, 비디오, 오디오 입력 및 출력 지원이 계획되어 있습니다. 128K 토큰 컨텍스트 윈도우를 제공하며, 요청당 최대 16K 출력 토큰을 지원합니다. 모델의 지식 컷오프는 2023년 10월입니다.

주요 기술적 장점은 다음과 같습니다:

  • Improved Tokenizer: GPT-4o와 공유되는 이 토크나이저는 비영어 텍스트 처리를 보다 비용 효율적으로 만듭니다.
  • Long-Context Performance: 이 모델은 GPT-3.5 Turbo에 비해 장기 컨텍스트 상황에서 향상된 성능을 보여줍니다.
  • Function Calling: 함수 호출에서 강력한 성능을 제공하여 개발자가 외부 시스템과 상호 작용해 데이터를 가져오거나 작업을 수행하는 애플리케이션을 구축할 수 있습니다.

성능 벤치마크

GPT-4o mini는 여러 학술 벤치마크에서 GPT-3.5 Turbo 및 기타 소형 모델들을 능가합니다:

추론 및 텍스트 지능

GPT-4o mini는 MMLU에서 82.0%를 기록했으며, Gemini Flash(77.9%)와 Claude Haiku(73.8%)를 앞섰습니다.

수학 및 코딩

  • MGSM (Math Reasoning): GPT-4o mini는 87.0%를 기록했으며, Gemini Flash는 75.5%, Claude Haiku는 71.7%였습니다.
  • HumanEval (Coding): GPT-4o mini는 87.2%를 기록했으며, Gemini Flash는 71.5%, Claude Haiku는 75.9%였습니다.

멀티모달 추론

MMMU 벤치마크에서 GPT-4o mini는 59.4%를 기록했으며, Gemini Flash(56.1%)와 Claude Haiku(50.2%)를 앞섰습니다.

비용 및 가용성

GPT-4o mini는 이전 최첨단 모델보다 한 단계 더 저렴하며, GPT-3.5 Turbo보다 60% 이상 저렴합니다. 가격은 입력 토큰 백만 개당 15센트, 출력 토큰 백만 개당 60센트로 책정되었습니다.

가용성:

  • API: 이제 Assistants API, Chat Completions API, Batch API에서 사용할 수 있습니다.
  • ChatGPT: 무료, Plus, Team 사용자에게 즉시 제공되며, Enterprise 사용자는 다음 주부터 접근할 수 있게 됩니다.
  • Fine-tuning: 향후 며칠 내에 출시될 예정입니다.

안전 및 보안

안전은 사전 훈련 필터(혐오 발언, 성인 콘텐츠, 스팸 제거)와 인간 피드백을 활용한 강화 학습(RLHF) 후 훈련 정렬을 통해 개발 과정에 통합됩니다.

GPT-4o mini는 instruction hierarchy 방식을 적용한 최초의 모델로, 이 방법은 모델이 탈옥, 프롬프트 인젝션, 시스템 프롬프트 추출에 저항하는 능력을 강화하여 대규모 애플리케이션에 보다 신뢰할 수 있게 합니다.

사용 사례 및 산업 적용

낮은 비용과 낮은 지연 시간으로 인해 GPT-4o mini는 여러 모델 호출을 체인하거나 병렬화하고, 전체 코드베이스와 같은 대용량 컨텍스트를 전달하거나 실시간 고객 지원 챗봇을 제공하는 애플리케이션에 적합합니다. Ramp와 Superhuman과 같은 파트너들은 영수증에서 구조화된 데이터를 추출하거나 스레드 기록을 기반으로 고품질 이메일 응답을 생성하는 데 있어 GPT-3.5 Turbo보다 모델이 훨씬 뛰어난 성능을 보인다고 밝혔습니다.

Sources