DeepSeek-R1正式发布,开源推理模型受到行业关注
1月20日,DeepSeek正式发布推理模型DeepSeek-R1。根据官方说明,模型、代码和技术报告均对外开放,并采用MIT许可证;同时发布了6个由DeepSeek-R1蒸馏而来的小型模型。DeepSeek表示,R1在部分推理任务上的表现可与OpenAI o1相比,并将网页端与API同步开放。
与普通对话模型相比,推理模型更强调多步骤分析、数学计算、代码处理和复杂问题拆解。过去,这类能力更多集中在封闭模型中,而DeepSeek-R1的开放,使开发者可以进一步研究、部署、蒸馏和适配相关能力。
从企业应用角度看,推理能力提升并不意味着所有任务都需要更长的“思考过程”。客服回复、文本改写、资料分类等常规任务,更关注速度和成本;合同分析、代码排错和复杂经营判断,则可能从推理模型中获得更多帮助。
*本文为基于官方发布信息的中文摘要,详情以原文链接为准。