DeepSeek-R1-0528发布,推理与工具调用能力增强
5月28日,DeepSeek发布DeepSeek-R1-0528。此次更新继续围绕推理能力展开,并提升前端开发体验、降低部分事实错误,同时新增或加强JSON结构化输出与函数调用支持。模型权重同步对外开放。
DeepSeek模型卡显示,新版本通过增加推理阶段的计算投入和后训练算法优化,提升数学、代码和通用逻辑任务表现。以官方测试为例,AIME 2025准确率由上一版本的70%提升至87.5%,但相应的平均推理Token也明显增加。
结构化输出与函数调用对企业应用具有直接意义。模型只有能够稳定返回指定字段,并正确调用搜索、数据库、计算和业务接口,才更容易从对话工具进入自动化工作流程。与此同时,调用链越长,越需要校验每一步的输入与结果。
DeepSeek-R1-0528继续采用MIT许可证,支持研究、部署、商业使用和蒸馏。对于计划本地运行的团队,除模型能力外,还需评估685B参数模型带来的硬件、推理优化、并发和运维要求。
*本文为基于官方发布信息的中文摘要,详情以原文链接为准。