DeepSeek-V4-Pro GA 릴리스

DeepSeek는 프로덕션 수준의 에이전트 워크플로우와 복잡한 추론 작업을 위한 모델인 DeepSeek-V4-Pro를 출시했습니다. 이번 릴리스는 유연한 추론 노력 제어 기능과 OpenAI Responses API와의 네이티브 통합을 도입하여 개발자들의 채택을 용이하게 합니다.

향상된 에이전트 기능과 추론 제어

DeepSeek-V4-Pro는 프로덕션 에이전트 워크플로우에서 상당한 성능 향상을 제공합니다. 지연 시간과 정확성의 균형을 최적화하기 위해, V4-Pro와 V4-Flash 모두에서 사용 가능한 유연한 "추론 노력" 설정을 도입했습니다.

사용자는 작업의 복잡도에 따라 추론 노력 수준을 구성할 수 있습니다:

  • 낮음: 간단한 작업에 최적화됨.
  • 높음: 일상적인 에이전트 워크플로우에 설계됨.
  • 최대: 깊은 추론이 필요한 가장 복잡한 작업에 예약됨.

API 통합 및 생태계 지원

DeepSeek-V4-Pro는 Codex 통합에 최적화된 OpenAI Responses API와 네이티브로 호환됩니다. 이로 인해 개발자는 한 번의 클릭 설정 프로세스로 모델을 구현할 수 있습니다.

가용성 및 접근성

DeepSeek-V4-Pro는 다음 채널을 통해 이용할 수 있습니다:

  • 웹 및 앱: "전문 모드"를 통해 접근 가능.
  • API: 기존 모델 이름을 사용하여 이용 가능; 설정 세부 사항은 공식 API 문서에 제공됨.

업데이트된 API 가격 모델

2026년 8월 16일 16:00 UTC부터, DeepSeek는 API 가격 구조를 업데이트합니다. 새로운 시스템은 유연한 워크로드 스케줄링을 장려하기 위해 피크 시간대 및 비피크 시간대 요금제를 도입합니다. 비피크 시간대 요금은 피크 시간대 요금의 50%에 불과합니다.

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch