Gemini 3.6 Flash, 3.5 Flash-Lite, 및 3.5 Flash Cyber 릴리스 노트

Gemini 3.6 Flash, 3.5 Flash-Lite, 및 3.5 Flash Cyber 릴리스 노트

Google DeepMind은 프로덕션 AI 에이전트를 확장하기 위해 필요한 효율성, 지연 시간, 그리고 안정성을 제공하기 위해 Gemini 3.6 Flash, 3.5 Flash-Lite, 및 3.5 Flash Cyber를 도입했습니다. 이러한 모델은 품질과 비용 사이의 균형을 최적화하도록 설계되었으며, 특히 에이전트 워크플로우, 코딩, 그리고 사이버 보안을 대상으로 합니다.

Gemini 3.6 Flash: 향상된 효율성과 성능

Gemini 3.6 Flash는 출력 토큰 사용량을 줄이고 코딩 및 지식 작업에서의 성능을 향상시켜 Gemini 3.5 Flash를 개선한 작업용 모델로 설계되었습니다.

토큰 효율성과 비용

인공 분석 인덱스에 따르면 Gemini 3.6 Flash는 3.5 Flash 대비 출력 토큰 사용량을 17% 줄입니다. Datacurve의 DeepSWE와 같은 특정 벤치마크에서는 출력 토큰 감소가 최대 65%까지 관찰됩니다. 이 모델은 입력 토큰 1백만 개당 $1.50, 출력 토큰 1백만 개당 $7.50로 가격이 책정되어 이전 모델보다 더 비용 효율적입니다.

성능 벤치마크

3.6 Flash는 다음과 같은 주요 사용 사례에서 향상을 보여줍니다:

  • 코딩 및 ML 연구: DeepSWE에서 49%를 달성합니다(3.5 Flash의 37% 대비). MLE Bench에서는 63.9%를 달성합니다(3.5 Flash의 49.7% 대비).
  • 컴퓨터 사용: OSWorld-Verified에서 83.0%를 달성합니다(3.5 Flash의 78.4% 대비). 컴퓨터 사용은 이제 Gemini Enterprise 및 Gemini API를 통해 내장 클라이언트 측 도구로 통합되었습니다.
  • 지식 작업: GDPval-AA v2에서 1421점을 얻어 3.5 Flash의 1349점을 상회합니다.

안전 프레임워크

3.6 Flash는 사이버 공격 및 화학, 생물, 방사선 및 핵 (CBRN) 오용을 구체적으로 겨냥한 강화된 Frontier Safety 보호 장치를 포함하여 jailbreak에 대한 저항력을 높이면서 유익한 사용 사례에 대한 거부를 최소화합니다.

Gemini 3.5 Flash-Lite: 높은 처리량 에이전트 확장

Gemini 3.5 Flash-Lite는 3.5 시리즈에서 가장 빠른 모델로, 문서 처리 및 에이전트 검색과 같은 저지연 작업 및 높은 처리량 워크플로우에 최적화되었습니다.

속도와 비용

인공 분석 인덱스에 따르면 3.5 Flash-Lite는 초당 350 출력 토큰을 제공합니다. 입력 토큰 1백만 개당 $0.30, 출력 토큰 1백만 개당 $2.50로 가격이 책정됩니다.

에이전트 기능

3.5 Flash-Lite는 구성 가능한 사고 수준을 지원하여 개발자가 고-volume 작업에 대한 저지연 실행(최소/낮은 사고 수준) 또는 다단계 서브에이전트 워크로드에 대한 높은 사고 수준을 우선순위로 지정할 수 있게 합니다. 또한 내장 도구로서 컴퓨터 사용 기능을 제공합니다.

성능 개선

3.5 Flash-Lite는 특정 에이전트 및 코딩 작업에서 이전 세대 및 일부 더 큰 모델보다 성능이 뛰어납니다:

  • 코딩: Terminal-Bench 2.1에서 54%(3.1 Flash-Lite의 31%에서 향상).
  • 장기 컨텍스트: GDM-MRCR v2에서 72.2%(3.1 Flash-Lite의 60.1%에서 향상).
  • 실제 세계 실행: GDPval-AA v2에서 1140점(3.1 Flash-Lite의 642점에서 향상).
  • 비교 성능: SWE-Bench Pro에서 3 Flash보다 우수합니다(54.2% 대 49.6%) 및 OSWorld-Verified에서 우수합니다(74.0% 대 65.1%).

Gemini 3.5 Flash Cyber 및 CodeMender

Gemini 3.5 Flash Cyber는 사이버 보안 취약점을 탐지, 검증, 및 패치하기 위해 미세 조정된 특수 모델입니다.

CodeMender와의 통합

이 모델은 여러 개의 3.5 Flash Cyber 에이전트를 사용하여 결합된 보안 보고서를 생성하는 코드 보안 에이전트인 CodeMender에 통합됩니다. 이 조합은 CyberGym 벤치마크에서 경쟁력 있는 프론티어 성능을 달성합니다.

배포 및 접근

이 기술의 이중용도 특성 때문에 3.5 Flash Cyber는广泛적으로 제공되지 않습니다. CodeMender를 통한 제한된 접근 파일럿 프로그램을 통해 정부 및 신뢰할 수 있는 파트너에게 독점적으로 제공됩니다.

가용성 및 미래 로드맵

Gemini 3.6 Flash 및 3.5 Flash-Lite는 Gemini API(Google AI Studio 및 Android Studio), Google Antigravity, Gemini Enterprise Agent Platform, Gemini Enterprise 앱, 및 Gemini 앱을 통해 즉시 이용할 수 있습니다. 3.5 Flash-Lite는 또한 Google Search에서 점진적으로 출시되고 있습니다.

Google DeepMind은 Gemini 3.5 Pro가 현재 파트너와 테스트 중이며 곧广泛적으로 제공될 것이라고 발표했습니다. 또한, 차세대 Gemini 4를 위한 사전 훈련이 시작되었습니다.}

Sources