Gemini 3 Flash 릴리스 노트 / 새로운 기능
Google DeepMind은 높은 속도와 효율성으로 프론티어급 지능을 제공하도록 설계된 Gemini 3 Flash 모델을 출시했습니다. Gemini 3 Flash는 경량 아키텍처에 Gemini 3 Pro 모델의 추론 기능을 통합하여, 비용의 일부만으로 Google 제품 및 개발자 플랫폼 전반에 차세대 AI를 접근 가능하게 합니다.
프론티어 추론 및 멀티모달 성능
Gemini 3 Flash는 더 큰 프론티어 모델과 맞먹고 Gemini 2.5 Pro를 능가하는 박사 수준의 추론 및 지식 벤치마크 성능을 제공합니다. 주요 벤치마크 결과는 다음과 같습니다:
- GPQA Diamond: 90.4%
- Humanity’s Last Exam: 33.7% (도구 없이)
- MMMU Pro: 81.2% (Gemini 3 Pro와 비교 가능)
원시 벤치마크를 넘어, 이 모델은 효율성을 위해 설계되었습니다. 최고 사고 수준에서 작동할 때, Gemini 3 Flash는 복잡도에 따라 처리 시간을 조절할 수 있습니다. 일반적인 트래픽에서는 Gemini 2.5 Pro보다 평균 30% 적은 토큰을 사용하여 일상적인 작업을 더 높은 성능으로 완료합니다.
속도, 비용 및 효율성
Gemini 3 Flash는 저지연 애플리케이션에 최적화되어 있으며, Artificial Analysis 벤치마크에 따르면 Gemini 2.5 Pro보다 3배 더 빠르게 작동합니다. 이 속도는 에이전트 워크플로우 및 반응형 대화형 애플리케이션에 특히 적합합니다.
가격 구조:
- 입력 토큰: 1백만 토큰당 $0.50
- 출력 토큰: 1백만 토큰당 $3.00
- 오디오 입력: 1백만 토큰당 $1.00
개발자 기능 및 에이전트 코딩
Gemini 3 Flash는 반복적 개발 및 고주파 워크플로우에 최적화되어 있습니다. SWE-bench Verified에서 코딩 에이전트 능력에서 78%의 점수를 얻어 Gemini 2.5 시리즈 및 Gemini 3 Pro를 모두 능가합니다.
이러한 기능은 개발자가 게임 어시스턴트나 A/B 테스트 실험과 같이 깊은 추론과 빠른 응답 시간이 필요한 보다 지능적인 애플리케이션을 구축할 수 있게 합니다. 이 모델은 복잡한 비디오 분석, 데이터 추출, 시각적 Q&A에 특화되어 있습니다.
글로벌 통합 및 소비자 접근
Gemini 3 Flash는 이전 모델을 대체하고 사용자 경험을 향상시키기 위해 Google 생태계 전반에 통합되고 있습니다:
- Gemini 앱: Gemini 3 Flash는 이제 기본 모델이며, Gemini 2.5 Flash를 대체합니다. 이를 통해 사용자는 구조화되지 않은 음성 생각을 작동하는 앱 프로토타입으로 변환하거나 멀티모달 콘텐츠(비디오 및 이미지)를 실행 가능한 계획으로 변환할 수 있습니다.
- AI Mode in Search: 이 모델은 Search의 AI Mode에 대한 새로운 기본 모델이며, 미묘한 쿼리의 파싱을 개선하고 실시간 지역 정보 및 웹 링크를 통합한 포괄적이고 시각적으로 소화 가능한 응답을 제공합니다.
가용성
Gemini 3 Flash는 다음 채널을 통해 미리보기로 제공됩니다:
- 개발자 도구: Google AI Studio의 Gemini API, Google Antigravity, Vertex AI, Gemini Enterprise, Gemini CLI, Android Studio.
- 소비자 제품: Gemini 앱 및 Search의 AI Mode.