DeepSeek-V3.1 릴리스 노트

DeepSeek-V3.1은 하이브리드 추론 모드와 강화된 도구 사용 기능을 도입하여 '에이전트 시대'로의 전환을 목표로 한 모델 업데이트입니다. 이번 릴리스는 사고 지연 시간을 줄이고, 다단계 추론 능력을 향상시키며, 사고 모드와 비사고 모드 모두에 대해 컨텍스트 창을 확장하는 데 중점을 두고 있습니다.

하이브리드 추론: 사고 모드와 비사고 모드

DeepSeek-V3.1은 단일 모델 아키텍처 내에서 두 가지 다른 작동 모드를 전환할 수 있는 하이브리드 추론 시스템을 구현했습니다:

  • 사고 모드 (deepseek-reasoner): 복잡한 추론에 최적화된 모드입니다. DeepSeek-V3.1-Think는 이전의 DeepSeek-R1-0528 모델보다 더 빠르게 답변에 도달한다고 보고되었습니다.
  • 비사고 모드 (deepseek-chat): 확장된 추론 과정 없이 표준 채팅 상호작용을 제공하는 모드입니다.

두 모드 모두 128K 컨텍스트 창을 지원합니다.

에이전트 기능과 도구 사용

DeepSeek-V3.1은 도구 사용 및 다단계 에이전트 작업 능력을 향상시키기 위해 사후 훈련 개선을 특별히 적용했습니다. 이러한 업그레이드로 인해 다음과 같은 결과를 얻었습니다:

  • 개선된 벤치마크 성능: SWE 및 Terminal-Bench에서 더 나은 성능을 보였습니다.
  • 복잡한 검색: 복잡한 검색 작업에 대해 더 강력한 다단계 추론 능력이 있습니다.
  • 효율성: 사고 효율성에서 상당한 향상을 보였습니다.

이러한 에이전트 워크플로우를 지원하기 위해 베타 API는 이제 Strict Function Calling을 지원합니다.

기술적 모델 업데이트

DeepSeek-V3.1은 V3 아키텍처를 기반으로 하며, 다음과 같은 기술적 변경 사항을 포함합니다:

  • 지속적 사전 훈련: V3.1 Base 모델은 장기 컨텍스트 기능을 확장하기 위해 840B 토큰으로 지속적 사전 훈련을 수행했습니다.
  • 토크나이저 및 템플릿: 토크나이저 구성과 채팅 템플릿이 업데이트되었습니다.
  • 오픈소스 공개: V3.1 Base 및 표준 V3.1 가중치 모두 Hugging Face를 통해 공개되었습니다.

API 및 통합 세부 정보

DeepSeek는 새로운 모델 모드에 맞춰 API를 업데이트하고 통합 옵션을 개선했습니다:

  • API 엔드포인트: 비사고 모드에는 deepseek-chat, 사고 모드에는 deepseek-reasoner를 사용합니다.
  • 호환성: API는 이제 Anthropic API 형식을 지원합니다.
  • 인프라: 사용자 경험을 원활하게 하기 위해 API 리소스를 증가시켰습니다.

가격 및 일정

새로운 가격 구조와 비정상 시간 할인 종료는 2025년 9월 5일 16:00 UTC부터 적용됩니다. 그 전까지는 현재 API 가격이 유지됩니다.

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch