DeepSeek-V4 Preview Release
DeepSeek는 표준 1M 토큰 컨텍스트 길이를 특징으로 하는 고효율 아키텍처를 갖춘 오픈 소스 모델 시리즈인 DeepSeek-V4 Preview를 출시했습니다. 이번 출시에는 고성능 추론과 비용 효율적인 성능 사이의 균형을 맞추도록 설계된 두 가지 별도의 모델 변체인 DeepSeek-V4-Pro와 DeepSeek-V4-Flash가 포함됩니다.
Model Variants and Specifications
DeepSeek-V4는 서로 다른 성능 및 효율성 요구 사항에 맞춤화된 두 가지 모델을 도입합니다:
- DeepSeek-V4-Pro: 총 1.6T 파라미터와 49B 활성 파라미터를 보유한 고용량 모델입니다. 성능 면에서 최고 수준의 폐쇄형 소스 모델과 경쟁하도록 설계되었습니다.
- DeepSeek-V4-Flash: 총 284B 파라미터와 13B 활성 파라미터를 보유한 더 작고 효율적인 모델로, 속도와 비용 효율성에 최적화되어 있습니다.
Technical Capabilities and Benchmarks
DeepSeek-V4-Pro는 여러 주요 도메인에서 최첨단 오픈 소스 모델로 자리매김하고 있습니다:
- Agentic Coding: 이 모델은 에이전트 코딩 벤치마크에서 최첨단(SOTA) 성능을 달성합니다.
- World Knowledge: DeepSeek-V4-Pro는 세계 지식 분야에서 현재 모든 오픈 모델을 선도하며, Gemini-3.1-Pro에 이은 두 번째를 기록하고 있습니다.
- Reasoning: 이 모델은 Math, STEM, Coding 분야에서 현재 모든 오픈 모델을 능가하며, 최고 수준의 폐쇄형 소스 대안 모델들과 경쟁합니다.
DeepSeek-V4-Flash는 Pro 버전의 추론 능력에 근접하는 추론 능력을 제공하며, 간단한 에이전트 작업에서는 V4-Pro와 대등한 성능을 보여주는 동시에 더 빠른 응답 시간과 더 낮은 API 가격을 제공합니다.
Structural Innovation and Context Efficiency
DeepSeek-V4는 모든 공식 서비스에서 기본값으로 1M 토큰 컨텍스트 창을 구현하기 위해 새로운 어텐션 메커니즘을 도입합니다. 이 효율성은 다음과 같은 방식을 통해 달성됩니다:
- Token-wise compression
- DSA (DeepSeek Sparse Attention)
이러한 혁신은 긴 컨텍스트 창을 처리하는 데 수반되는 컴퓨팅 및 메모리 비용을 줄여, 이 시리즈의 1M 컨텍스트 표준을 확립합니다.
Agent Integration and Optimizations
DeepSeek-V4는 에이전트 워크플로우에 최적화되어 있으며, Claude Code, OpenClaw, OpenCode와 같은 주요 AI 에이전트와 이미 통합되어 있습니다. 이 모델은 DeepSeek 내부에서도 에이전트 코딩 작업을 위해 사용되고 있습니다.
API Availability and Migration
DeepSeek-V4 모델은 오늘부터 API를 통해 사용할 수 있으며, OpenAI ChatCompletions 및 Anthropic API를 지원합니다. 사용자는 동일한 base_url을 유지하면서 모델 이름을 deepseek-v4-pro 또는 deepseek-v4-flash로 업데이트하여 마이그레이션할 수 있습니다.
두 모델 모두 Thinking 및 Non-Thinking의 이중 모드를 지원합니다.
Important Migration Note: deepseek-chat 및 deepseek-reasoner 모델은 2026년 7월 24일 15:59 UTC 이후에 완전히 은퇴하고 접근할 수 없게 됩니다. 현재, 이러한 레거시 모델은 각각 non-thinking 및 thinking 모드에서 deepseek-v4-flash로 라우팅되고 있습니다.
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch