DeepSeek-R1-0528 发布说明
DeepSeek 已发布 DeepSeek-R1-0528,这是 R1 模型的更新版本,旨在提升推理性能和开发实用性。此次发布重点优化了模型的准确性,减少了幻觉现象,并扩展了结构化数据输出和工具集成能力。
核心模型改进
DeepSeek-R1-0528 在模型性能的多个核心领域均表现出提升:
- 基准测试表现: 与之前的版本相比,该模型在标准化基准测试中的表现有所提升。
- 减少幻觉: DeepSeek 已实施改进措施,以降低幻觉的发生频率,从而提高模型生成回复的可靠性。
- 前端功能: 本次发布增强了前端交互能力。
开发者功能与集成
DeepSeek-R1-0528 引入了特定功能,使其更适用于程序化使用和智能体工作流:
- JSON 输出支持: 模型现在支持 JSON 输出,便于结构化数据提取,并能更可靠地集成到软件流水线中。
- 函数调用: 模型支持函数调用,使其能够与外部工具和 API 交互,执行特定任务。
部署与访问
DeepSeek-R1-0528 可通过多种渠道获取:
- 聊天界面: 用户可通过 chat.deepseek.com 访问该模型。
- API 访问: 模型可通过 DeepSeek API 获取。本次更新未对 API 使用要求进行任何更改。
- 开源权重: 模型权重已在 Hugging Face 上发布,地址为 huggingface.co/deepseek-ai/DeepSeek-R1-0528。
技术文档
对于实现该模型的开发者,DeepSeek 提供了关于“思考模式”的具体指导,这是 R1 系列推理过程的核心组成部分,详情请参阅官方 思考模式指南。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch