Gemini 3 Deep Think 업데이트

Google DeepMind는 Gemini 3 Deep Think라는 전문 추론 모드에 대한 대규모 업그레이드를 발표했습니다. 이 모드는 과학, 연구 및 엔지니어링 분야의 복잡한 문제를 해결하도록 설계되었으며, 명확한 가드레일이나 단일 정답이 없는, 종종 지저분하거나 불완전한 데이터를 포함하는 문제에 수학적·알고리즘적 엄밀성을 제공하는 데 초점을 맞추고 있습니다.

최첨단 추론 및 알고리즘 성능

Gemini 3 Deep Think는 여러 엄격한 학술 및 경쟁 벤치마크에서 새로운 성능 정점을 달성했습니다. 업데이트된 모델은 다음과 같은 결과를 보였습니다:

  • Humanity’s Last Exam: 48.4% 정확도 (도구 없이), 최첨단 모델 한계를 테스트하도록 설계된 벤치마크의 새로운 표준을 설정했습니다.
  • ARC-AGI-2: 84.6% 정확도, ARC Prize Foundation에 의해 검증되었습니다.
  • Codeforces: 경쟁 프로그래밍 챌린지에서 Elo 3455점.
  • International Math Olympiad (IMO) 2025: 2025 국제 수학 올림피아드 (IMO): 금메달 수준 성능.

과학 분야 숙련도

수학과 코딩을 넘어, 업데이트된 Deep Think 모드는 특히 화학과 물리학과 같은 광범위한 과학 분야에서 뛰어납니다. 2025 국제 물리 올림피아드와 2025 화학 올림피아드의 서면 부문에서 금메달 수준의 결과를 보여주었습니다. 또한, 모델은 CMT-Benchmark에서 50.5% 점수를 달성하여 고급 이론 물리학에 대한 숙련도를 입증합니다.

실용 엔지니어링 적용

Gemini 3 Deep Think는 추상 이론을 넘어 실용적인 활용을 목표로 설계되었습니다. 이 모델은 연구자들이 복잡한 데이터를 해석하도록 돕고 엔지니어가 코드를 통해 물리 시스템을 모델링할 수 있게 합니다. 이 기능의 구체적인 적용 사례는 스케치를 분석하고 복잡한 형태를 모델링한 뒤 3D 프린팅에 필요한 파일을 생성하여 3D 프린트 가능한 파일로 변환하는 능력입니다.

이용 가능성 및 접근

업데이트된 Deep Think 모드는 Google AI Ultra 구독자를 위한 Gemini 앱에서 즉시 이용할 수 있습니다. 처음으로 Deep Think는 선택된 연구자, 엔지니어 및 기업에게 조기 접근 프로그램을 통해 Gemini API를 통해 제공됩니다.

Sources