Gemini 3.6 Flash, 3.5 Flash-Lite, 및 3.5 Flash Cyber 릴리스
Gemini 3.6 Flash, 3.5 Flash-Lite, 및 3.5 Flash Cyber 릴리스
Google, 에이전트 워크플로우를 위한 Gemini Flash 제품군 확장
Google은 Gemini 3.6 Flash, 3.5 Flash-Lite, 그리고 3.5 Flash Cyber라는 세 가지 새로운 모델을 선보였습니다. 이 모델들은 생산 AI 에이전트의 효율성, 지연 시간, 신뢰성을 최적화하도록 설계되었습니다. 이번 릴리스의 주요 목표는 다단계 에이전트 워크플로우의 비용과 토큰 오버헤드를 줄이면서 코딩 및 지식 작업에서 성능을 유지하거나 향상시키는 것입니다.
Gemini 3.6 Flash: 효율성 및 품질 향상
Gemini 3.6 Flash는 기본 "작업 말뚝" 모델로, 이전 모델인 3.5 Flash보다 더 나은 코딩 및 멀티모달 성능을 제공하면서 자원 소비는 적습니다.
주요 성능 향상
- 토큰 효율성: Artificial Analysis Index에 따르면, 3.6 Flash는 3.5 Flash에 비해 출력 토큰 사용량을 17% 감소시킵니다. DeepSWE와 같은 특정 벤치마크에서는 토큰 감소율이 최대 65%에 달합니다.
- 코딩 및 연구: 이 모델은 원치 않는 코드 편집이 적은 높은 정밀도를 보여줍니다. DeepSWE에서 49% (3.5 Flash의 37%에서 상승)와 MLE Bench에서 63.9% (49.7%에서 상승)를 기록했습니다.
- 컴퓨터 사용: 3.6 Flash는 컴퓨터 사용 능력이 향상되어 OSWorld-Verified에서 83.0%를 기록했으며, 3.5 Flash의 78.4%를 앞섭니다. 컴퓨터 사용은 이제 Gemini API와 Gemini Enterprise를 통한 내장 클라이언트‑사이드 도구로 통합되었습니다.
- 지식 작업: 이 모델은 GDPval-AA v2에서 3.5 Flash(1421 vs. 1349)를 앞섭니다.
가격 및 안전성
3.6 Flash는 입력 토큰 1M당 $1.50, 출력 토큰 1M당 $7.50의 가격으로 3.5 Flash보다 저렴합니다. 또한 CBRN(화학, 생물, 방사선, 핵) 및 사이버 공격 분야에서 탈옥을 방지하는 향상된 Frontier Safety 보호 장치를 포함합니다.
Gemini 3.5 Flash-Lite: 고처리량 확장
Gemini 3.5 Flash-Lite는 3.5 시리즈 중 가장 빠른 모델로, 저지연 작업 및 에이전트 검색, 문서 처리와 같은 고처리량 워크로드에 최적화되었습니다.
속도 및 성능
- 지연 시간: 이 모델은 Artificial Analysis 기준으로 초당 350개의 출력 토큰을 제공합니다.
- 에이전트 기능: 3.5 Flash-Lite는 Terminal-Bench 2.1(54% vs. 31%) 및 GDM-MRCR v2(72.2% vs. 60.1%) 등 다양한 벤치마크에서 3.1 Flash-Lite를 앞섭니다.
- Flash와 비교: 일부 코딩 및 에이전트 평가에서 3.5 Flash-Lite는 3 Flash보다 우수한 성능을 보이며, SWE-Bench Pro(54.2% vs. 49.6%)와 OSWorld-Verified(74.0% vs. 65.1%)에서 특히 두드러집니다.
가격
3.5 Flash-Lite는 입력 토큰 1M당 $0.3, 출력 토큰 1M당 $2.5의 가격으로 제공됩니다.
Gemini 3.5 Flash Cyber 및 CodeMender
Gemini 3.5 Flash Cyber는 사이버 보안 취약점을 탐지하고 패치하도록 특화된 모델이며, CodeMender라는 에이전트 인프라 내에서 여러 Cyber 에이전트를 활용해 보안 보고서를 생성합니다.
사이버 보안 AI의 이중 사용 특성 때문에 3.5 Flash Cyber는 일반에 공개되지 않으며, 제한된 접근 파일럿 프로그램을 통해 정부 및 신뢰할 수 있는 파트너에게만 제공됩니다.
향후 로드맵: Gemini 3.5 Pro 및 Gemini 4
Google은 Gemini 3.5 Pro가 현재 파트너와 함께 테스트 중이며 곧 광범위하게 제공될 예정이라고 확인했습니다. 또한, 회사는 지금까지 가장 야심찬 사전 학습 작업으로 설명되는 Gemini 4의 사전 학습을 시작했습니다.
커뮤니티 인사이트 및 개발자 피드백
Hacker News에서의 개발자 반응은 모델의 기술적 속도와 Google의 제품 실행 사이에 차이가 있음을 보여줍니다.
성능 및 가치
일부 사용자는 Flash 시리즈의 속도와 유용성을 반복 개발 및 대량 작업에 대해 높이 평가했습니다. 한 개발자는 3.5 Flash가 경쟁 모델에 비해 프론트엔드 작업에 특히 효과적이라고 언급했습니다. 그러나 다른 사람들은 모델이 다른 연구소의 최신 릴리스에 뒤처지고 있으며, Laguna S 2.1이 Flash-Lite보다 우수한 대안이라고 주장했습니다.
가격 우려
"Lite" 모델의 가격 추이에 대한 비판이 크게 제기되었습니다. 여러 사용자는 버전 간 비용이 꾸준히 상승하고 있음을 지적했습니다:
"Gemini 2.5 Flash-Lite는 저렴한 문서 처리를 위해 제가 가장 많이 사용하던 모델이었지만, 버전마다 가격이 끊임없이 올라가고 있습니다... 3.5-flash-lite: 입력 $0.30 / 출력 $2.50 (2.5 대비 6.25배 상승!)"
제품 생태계 마찰
사용자들은 Google의 명명 규칙과 AI 플랫폼(Vertex AI, AI Studio, Gemini Enterprise, Antigravity)의 파편화에 불만을 표시했습니다.
"그들의 네이밍 스킴이 혼란스럽습니다... Vertex, AI Studio, Gemini, Antigravity까지. 솔직히 사용하기 너무 복잡합니다. 어떤 플랫폼과 모델을 선택해야 할지 결정하려면 Gemini 자체를 사용해야 할 정도입니다."
다른 개발자들은 Antigravity IDE 문제와 명확한 마이그레이션 경로 없이 이전 구독이 폐기된 점을 지적했습니다.
요약: Google은 Gemini 3.6 Flash, 3.5 Flash-Lite, 그리고 3.5 Flash Cyber를 출시했으며, 토큰 효율성, 낮은 지연 시간, 그리고 에이전트 워크플로우를 위한 특화된 사이버 보안 기능에 중점을 두었습니다.
제목: Gemini 3.6 Flash, 3.5 Flash-Lite, 및 3.5 Flash Cyber 릴리스