NVIDIA发布Nemotron 3开放模型家族,面向多智能体系统优化
12月15日,NVIDIA发布Nemotron 3开放模型家族,包括Nano、Super和Ultra不同规模,定位于多智能体和企业级任务。首批开放的Nano版本采用混合Mamba、Transformer与MoE架构。
模型支持最长100万Token上下文,面向检索、规划、工具执行和结果验证等多个智能体角色。NVIDIA同时开放模型、数据和相关开发组件,方便企业进行定制。
多智能体系统可以把复杂目标拆成多个并行任务,但会增加通信、去重和冲突解决成本。模型数量增加并不自动提高最终质量。
企业应明确每个智能体的职责、权限和验收条件,并记录中间结果如何汇总为最终结论。