DeepSeek-R1-0528发布,推理与工具调用能力增强

发布时间:2025-05-29 分类:行业洞察 原文:查看原文 阅读:2分钟
DeepSeek-R1-0528发布,推理与工具调用能力增强

5月28日,DeepSeek发布DeepSeek-R1-0528。此次更新继续围绕推理能力展开,并提升前端开发体验、降低部分事实错误,同时新增或加强JSON结构化输出与函数调用支持。模型权重同步对外开放。

DeepSeek模型卡显示,新版本通过增加推理阶段的计算投入和后训练算法优化,提升数学、代码和通用逻辑任务表现。以官方测试为例,AIME 2025准确率由上一版本的70%提升至87.5%,但相应的平均推理Token也明显增加。

结构化输出与函数调用对企业应用具有直接意义。模型只有能够稳定返回指定字段,并正确调用搜索、数据库、计算和业务接口,才更容易从对话工具进入自动化工作流程。与此同时,调用链越长,越需要校验每一步的输入与结果。

DeepSeek-R1-0528继续采用MIT许可证,支持研究、部署、商业使用和蒸馏。对于计划本地运行的团队,除模型能力外,还需评估685B参数模型带来的硬件、推理优化、并发和运维要求。

*本文为基于官方发布信息的中文摘要,详情以原文链接为准。

获取适合企业发展的解决方案

围绕企业业务目标与组织需求,提供面向实际场景的产品与服务支持