Mistral发布Medium 3,兼顾性能、成本与企业部署
5月7日,Mistral AI发布Mistral Medium 3。该模型被定位为面向企业应用的前沿级多模态模型,重点覆盖代码、科学技术任务、文档理解和视觉信息处理,并尝试在模型能力、调用成本与部署难度之间取得平衡。
根据Mistral官方介绍,Medium 3支持混合云、本地环境和企业私有网络部署,也可进行持续预训练、完整微调及行业知识适配。官方公布的API价格为每百万输入Token 0.4美元、每百万输出Token 2美元,并表示模型可在四张GPU及以上的自托管环境中运行。
相比只追求更大的参数规模,这次更新更强调企业是否能够真正接入和维护模型。金融、能源、医疗等场景往往同时关注数据控制、响应速度、定制能力和长期成本,单项评测成绩并不能完整反映模型进入生产环境后的实际表现。
需要注意的是,性能与成本数据主要来自厂商测试。企业在正式选型前,仍应使用自身的合同、代码、报告和客户资料进行对比测试,并记录准确率、延迟、并发能力、失败重试和人工复核成本。
*本文为基于官方发布信息的中文摘要,详情以原文链接为准。