OpenAI o1-preview 릴리스 노트 / 새로운 소식
OpenAI는 o1 시리즈를 도입했습니다. 이는 응답하기 전에 더 많은 시간을 "생각"하는 새로운 유형의 AI 모델입니다. 이러한 추론 중심 아키텍처로의 전환은 이전 버전보다 과학, 코딩, 수학 분야에서 훨씬 더 어려운 문제를 해결할 수 있게 합니다.
추론 능력 및 성능
OpenAI o1 모델은 사고 과정을 다듬고, 실수를 인식하며, 최종 답변을 제공하기 전에 다양한 전략을 시도하도록 훈련되었습니다. 이러한 접근 방식은 기술 분야에서 상당한 성능 향상을 가져옵니다:
- 수학: 국제수학올림피아드(IMO) 예선 시험에서 추론 모델은 83%를 기록했으며, GPT-4o는 13%에 불과했습니다.
- 코딩: 모델은 Codeforces 대회에서 89번째 백분위에 도달했습니다.
- 과학: 물리, 화학, 생물학 전반의 도전적인 벤치마크 과제에서 차기 모델 업데이트는 박사 과정 학생들과 비슷한 수준으로 수행됩니다.
많은 일반 작업에서는 o1-preview가 아직 웹 브라우징, 파일 업로드, 이미지 지원과 같은 기능이 없기 때문에 GPT-4o가 단기적으로 더 능력 있습니다.
안전 및 정렬 훈련
OpenAI는 모델 자체의 추론 능력을 활용하여 정렬 가이드라인을 준수하도록 하는 새로운 안전 훈련 방식을 도입했습니다. 상황에 맞는 안전 규칙을 추론함으로써 모델은 이를 보다 효과적으로 적용할 수 있습니다.
“탈옥”(안전 규칙을 우회하려는 시도)에 대한 내부 테스트에서 큰 개선이 나타났습니다: o1-preview 모델은 0-100 점수 척도에서 84점을 기록했으며, GPT-4o는 22점에 그쳤습니다.
이러한 능력을 지원하기 위해 OpenAI는 다음과 같은 거버넌스 조치를 통합했습니다:
- 준비 프레임워크: 엄격한 테스트와 평가.
- 외부 협력: 미국 및 영국 AI 안전 연구소와의 공식 협약으로, 모델 연구 버전에 대한 조기 접근 권한을 부여했습니다.
- 내부 검토: 안전 및 보안 위원회가 수행하는 이사회 수준의 검토 절차.
모델 변형: o1-preview 및 o1-mini
OpenAI는 성능과 효율성의 균형을 맞추기 위해 추론 시리즈의 두 가지 버전을 출시합니다:
- OpenAI o1-preview: 복잡하고 다단계 문제를 위해 설계된 주요 추론 모델.
- OpenAI o1-mini: 코딩에 특화된 더 빠르고 저렴한 대안. o1-preview보다 80% 저렴하며, 광범위한 세계 지식이 필요 없는 추론이 필요한 애플리케이션을 위해 설계되었습니다.
가용성 및 접근
o1 시리즈에 대한 접근은 다양한 등급에 걸쳐 순차적으로 제공되고 있습니다:
- ChatGPT Plus 및 Team: 모델 선택기를 통해 o1-preview와 o1-mini에 접근할 수 있습니다. 2024년 9월 17일 현재, o1-preview는 주당 50회, o1-mini는 일당 50회의 제한이 적용됩니다.
- ChatGPT Enterprise 및 Edu: 최초 9월 12일 출시 다음 주부터 접근이 시작되었습니다.
- Developers: 사용량 등급 5에 해당하는 사용자에게 API 접근이 제공되며, 초기 속도 제한은 분당 20회(RPM)입니다. 현재 API는 함수 호출, 스트리밍, 시스템 메시지를 지원하지 않습니다.
- Free Users: OpenAI는 모든 ChatGPT 무료 사용자에게 o1-mini 접근을 제공할 계획입니다.
향후 로드맵
OpenAI는 GPT 시리즈와 o1 시리즈를 동시에 개발해 나갈 예정입니다. o1 모델에 대한 향후 개선 사항으로는 웹 브라우징, 파일 업로드, 이미지 업로드 기능이 추가될 예정입니다.
Sources
- OriginalIntroducing OpenAI o1