Qwen3系列开放权重,混合思考模式覆盖多规模与多语言需求
4月29日,通义千问团队发布Qwen3系列,并开放两款混合专家模型和六款稠密模型的权重。旗舰版本Qwen3-235B-A22B总参数规模为2350亿、激活参数为220亿;系列还覆盖从0.6B到32B的多种稠密模型,相关模型采用Apache 2.0许可证。
Qwen3的重要变化之一是混合思考模式。模型可以在需要复杂分析时进入逐步推理,也可以在简单任务中关闭思考,以更快速度直接回答。用户还可以按轮次切换思考状态,从而在推理质量、延迟和计算成本之间进行更细的控制。
官方介绍显示,Qwen3支持119种语言和方言,并加强代码、智能体和MCP相关能力。不同规模模型可通过Hugging Face、ModelScope和Kaggle获取,也支持vLLM、SGLang、Ollama和llama.cpp等部署工具,为云端和本地应用提供了多种路径。
开放权重扩大了企业进行本地部署和行业适配的空间,但模型规模越多,选型与版本管理也越复杂。企业应先确定任务所需的上下文、推理强度、语言覆盖和硬件条件,再选择合适规格,并通过真实样本验证输出质量。
*本文为基于官方发布信息的中文摘要,详情以原文链接为准。