DeepSeek-V4-Flash 업데이트
DeepSeek-V4-Flash 공개 베타 출시
DeepSeek은 공식 DeepSeek-V4-Flash API의 공개 베타를 출시했습니다. 이 업데이트는 에이전트 기능을 크게 향상시키는 데 중점을 두고 있으며, 이전 V4-Pro-Preview를 초과하는 벤치마크 결과를 보여줍니다. 업데이트된 모델을 사용하려면 개발자는 API 호출에서 모델 이름을 deepseek-v4-flash로 설정하기만 하면 됩니다.
성능 및 벤치마크 결과
DeepSeek-V4-Flash는 에이전트 및 코딩 작업에서 상당한 향상을 보여줍니다. 다음과 같은 벤치마크 점수가 보고되었습니다:
- 터미널 벤치 2.1: 82.7
- NL2Repo: 54.2
- Cybergym: 76.7
- DeepSWE: 54.4
- Toolathlon verified: 70.3
- 에이전트 마지막 시험: 25.2
- 자동화 벤치 (공개): 25.1
- DSBench-FullStack (내부): 68.7
- DSBench-Hard (내부): 59.6
Code Agent 작업의 경우, 모델은 최대 노력 수준의 DeepSeek Harness 최소 모드에서 topp=0.95 및 temperature=1.0을 사용하여 테스트되었습니다.
기술 사양 및 통합
DeepSeek-V4-Flash-0731은 DeepSeek-V4-Flash-Preview와 동일한 모델 아키텍처와 크기를 유지하며, 성능 향상은 재후 훈련의 결과입니다.
주요 통합 세부 사항은 다음과 같습니다:
- Responses API: Responses API 형식에 대한 네이티브 지원.
- Codex 적응: Codex 통합을 위해 특별히 적응되었습니다.
- 범위: 이 업데이트는
deepseek-v4-flashAPI에만 적용됩니다. DeepSeek-V4-Pro API 및 APP/WEB 모델은 변경되지 않으며, 공식 V4-Pro 출시는 곧 예상됩니다.
커뮤니티 인사이트 및 실제 응용
사용자 토론에서는 모델의 높은 지능-비용 비율이 강조되며, 많은 개발자가 이를 코딩 및 에이전트 워크플로의 주요 "워크호스"로 활용하고 있습니다.
비용 효율성 및 성능
개발자는 대량 작업에 대해 extrêmement 낮은 운영 비용을 보고합니다. 한 사용자는 30일 동안 3,467개의 API 요청에 걸쳐 3억 2,300만 토큰 이상에 대해 단지 4.55 USD만 지출했다고 언급했습니다. 또 다른 사용자는 MCP 서버 및 컨텍스트 리듀서 툴링을 통해 복잡한 작업을 구현하여 시간당 약 0.50 달러의 비용이 들었다고 보고했습니다.
사용 사례 전문화
커뮤니티 피드백에 따르면, DeepSeek-V4-Flash는 구현 및 "그런트 작업"에 사용되고, 더 비싼 모델은 고급 계획 및 검토를 위해 예약되는 계층형 모델 전략을 제안합니다.
"저는 제 작업의 90%에서 플래시 모델을 사용하고 있습니다... 저는 변경 사항을 1000줄 이하로 유지하고 스스로 아키텍처 결정을 내리며, frontier 모델과 비교했을 때 거의 차이를 느끼지 못합니다.
로컬 배포 및 하드웨어
크기와 효율성 때문에 플래시 모델은 더 큰 프론티어 모델에 비해 로컬 호스팅에 더 접근하기 쉬운 것으로 간주됩니다. 사용자들은 이 모델이 듀얼 RTX Pro 6000 GPU와 같은 프로슈머 하드웨어에서 실행될 수 있다고 언급하며, 이는 클라우드 기반 API에 대한 빠르고 프라이빗한 대안을 제공합니다.
DeepSeek API 진화 타임라인
DeepSeek은 2024년과 2025년 동안 모델 제공을 빠르게 반복했습니다:
- 2026년 7월: 향상된 에이전트 기능을 갖춘 DeepSeek-V4-Flash 공개 베타 출시
- 2026년 4월: V4-Pro 및 V4-Flash 도입, 레거시
deepseek-chat및deepseek-reasoner이름 대체 - 2025년 12월: DeepSeek-V3.2로 업그레이드, distinct thinking 및 non-thinking 모드 도입
- 2025년 8월: 하이브리드 추론 아키텍처 및 향상된 도구 사용을 특징으로 하는 DeepSeek-V3.1 출시 (SWE-bench Verified: 66.0)
- 2025년 1월:
deepseek-reasoner출시 (DeepSeek-R1) - 2024년 12월:
deepseek-chat을 DeepSeek-V3로 업그레이드 - 2024년 8월: API 가격을 낮추기 위한 디스크上的 Context Caching 기술 구현