Gemini Deep Think가 IMO 2025에서 금메달 기준을 달성했습니다
Gemini Deep Think가 IMO 2025에서 금메달 성능에 도달했습니다
Deep Think를 탑재한 Gemini의 고급 버전이 2025년 국제수학올림피아드(IMO)에서 공식적으로 금메달 기준을 달성했으며, 6문제 중 5문제를 완벽히 풀어 총 35점을 얻었습니다. 이 결과는 IMO 코디네이터가 학생 솔루션에 적용되는 동일한 기준으로 공식 채점 및 인증한 것입니다.
AlphaProof와 AlphaGeometry에서의 기술적 진화
이 성과는 2024년 결과와 비교했을 때 AI 수학 추론에서 상당한 도약을 의미합니다. 2024년에는 Google DeepMind의 AlphaProof와 AlphaGeometry 2 시스템이 4문제를 풀어 28점을 획득하며 은메달 기준을 달성했지만, 문제를 Lean과 같은 도메인 전용 언어로 전문가가 번역해야 했고 계산에 2~3일이 소요되었습니다.
대조적으로, 2025년 Gemini Deep Think 모델은 자연어로 엔드투엔드(end-to-end) 방식으로 작동하여 공식 문제 설명만으로 4.5시간 경기 제한 시간 내에 엄격한 수학적 증명을 직접 생성했습니다.
Deep Think 추론 아키텍처
Gemini Deep Think는 복잡한 문제를 위해 설계된 향상된 추론 모드입니다. 문제 해결 능력을 향상시키기 위해 여러 핵심 연구 기법을 활용합니다:
- Parallel Thinking: 단일 선형 사고 흐름을 따르는 대신, 모델은 여러 가능한 해결 경로를 동시에 탐색하고 결합하여 최종 답변에 도달할 수 있습니다.
- Reinforcement Learning: 모델은 다단계 추론, 정리 증명 및 문제 해결 데이터를 활용하도록 특별히 설계된 새로운 강화 학습 기법을 사용해 훈련되었습니다.
- Curated Knowledge: 시스템은 고품질 수학 솔루션의 선별된 코퍼스와 IMO 수준 문제에 접근하기 위한 일반적인 힌트와 팁을 포함한 구체적인 지시사항을 제공받았습니다.
수학 및 AGI의 미래에 대한 함의
Google DeepMind는 이 결과를 보다 복잡하고 고급 수학을 해결할 수 있는 AI 구축을 위한 초기 단계로 보고 있습니다. 2025년 성공은 자연어 유창성을 기반으로 했지만, 연구소는 AlphaGeometry와 AlphaProof와 같은 형식 시스템 개발을 지속하고 있습니다.
DeepMind는 수학적 발견의 미래가 자연어 유창성과 형식 언어에서 검증된 추론을 결합한 에이전트에 있다고 주장합니다. 이러한 도구는 수학자, 과학자, 엔지니어가 인공지능 일반화(Artificial General Intelligence, AGI)로 가는 길에서 인간 지식을 확장하도록 돕는 것을 목표로 합니다.
이용 가능성
Deep Think 모델의 한 버전이 수학자를 포함한 신뢰할 수 있는 테스터 그룹에 먼저 공개된 후, Google AI Ultra 구독자에게 순차적으로 배포될 예정입니다.
SUMMARY: Deep Think를 탑재한 Gemini의 고급 버전이 국제수학올림피아드(IMO) 6문제 중 5문제를 해결하여 35점을 획득하고 금메달 기준을 달성했습니다.
TITLE: Gemini Deep Think가 IMO 2025에서 금메달 기준을 달성했습니다