DeepSeek-R1-0528 リリースノート
DeepSeek は、推論性能と開発者向けユーティリティを向上させるために設計された R1 モデルの更新版である DeepSeek-R1-0528 をリリースしました。このリリースでは、モデルの精度の向上、幻覚の低減、構造化データ出力およびツール連携機能の拡張に注力しています。
主なモデル改善点
DeepSeek-R1-0528 は、モデルパフォーマンスの複数の主要領域で改善を実現しています。
- ベンチマーク性能: 前回リリースと比較して、標準化されたベンチマークでの性能が向上しています。
- 幻覚の低減: DeepSeek は幻覚の発生頻度を低減するための改善を実装しており、生成された応答の信頼性が向上しています。
- フロントエンド機能: フロントエンドとのインタラクションを強化する機能が追加されています。
開発者向け機能と統合
DeepSeek-R1-0528 は、プログラムによる利用やエージェントワークフローに適した特定の機能を導入しています。
- JSON 出力対応: モデルは JSON 出力をサポートしており、構造化データの抽出やソフトウェアパイプラインへの信頼性の高い統合が可能になります。
- 関数呼び出し: モデルは関数呼び出しをサポートしており、外部ツールや API と連携して特定のタスクを実行できます。
デプロイとアクセス方法
DeepSeek-R1-0528 は複数のチャネルから利用可能です。
- チャットインターフェース: ユーザーは chat.deepseek.com を通じてモデルにアクセスできます。
- API アクセス: モデルは DeepSeek API を通じて利用可能です。今回の更新では API の使用要件に変更はありません。
- オープンソース重み: モデルの重みは Hugging Face に公開されており、huggingface.co/deepseek-ai/DeepSeek-R1-0528 で入手できます。
技術文書
モデルの実装を行う開発者向けに、R1 シリーズの推論プロセスの核となる「Thinking Mode」についての具体的なガイダンスを DeepSeek が提供しています。詳細は公式の Thinking Mode ガイド を参照してください。
Sources
関連
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch