DeepSeek-R1-0528 릴리스 노트

DeepSeek는 추론 성능과 개발자 활용도를 향상시키기 위해 설계된 R1 모델의 업데이트 버전인 DeepSeek-R1-0528을 출시했습니다. 이번 릴리스는 모델의 정확도 향상, 환상(허구 생성) 감소, 구조화된 데이터 출력 및 도구 통합 기능 확장에 중점을 두고 있습니다.

주요 모델 개선 사항

DeepSeek-R1-0528은 모델 성능의 여러 핵심 영역에서 향상된 성능을 보여줍니다:

  • 벤치마크 성능: 이전 버전 대비 표준화된 벤치마크에서 개선된 성능을 기록합니다.
  • 환상 감소: DeepSeek는 환상 발생 빈도를 줄이기 위한 개선 사항을 도입하여 모델의 응답 신뢰도를 높였습니다.
  • 프론트엔드 기능: 프론트엔드 상호작용을 위한 향상된 기능이 포함되어 있습니다.

개발자 기능 및 통합

DeepSeek-R1-0528은 프로그래밍적 사용 및 에이전트 워크플로우에 더 적합하도록 특정 기능을 도입했습니다:

  • JSON 출력 지원: 모델은 이제 JSON 출력을 지원하여 구조화된 데이터 추출이 가능하고 소프트웨어 파이프라인에 더 신뢰성 있게 통합할 수 있습니다.
  • 함수 호출: 모델은 함수 호출을 지원하여 외부 도구 및 API와 상호작용하여 특정 작업을 수행할 수 있습니다.

배포 및 접근성

DeepSeek-R1-0528은 여러 채널을 통해 이용할 수 있습니다:

  • 채팅 인터페이스: 사용자는 chat.deepseek.com를 통해 모델에 접근할 수 있습니다.
  • API 접근: 모델은 DeepSeek API를 통해 이용 가능합니다. 이번 업데이트로 API 사용 요구사항에 변화는 없습니다.
  • 오픈소스 가중치: 모델 가중치는 Hugging Face에서 huggingface.co/deepseek-ai/DeepSeek-R1-0528에 공개되었습니다.

기술 문서

모델을 구현하는 개발자를 위해 DeepSeek는 R1 시리즈의 추론 과정의 핵심 요소인 "사고 모드(Thinking Mode)"에 대한 구체적인 안내를 제공합니다. 자세한 내용은 공식 사고 모드 가이드를 참조하세요.

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch