Gemini 3.1 Flash-Lite 正式商用,为企业高频场景提供高性价比 AI 选择
Gemini 3.1 Flash-Lite 已正式商用(GA),面向企业生产环境开放。该模型是 Gemini 3 系列中速度最快、性价比最高的选择,定价每百万输入 token 0.25 美元、输出 token 1.50 美元,输入价格仅为同级别竞品的四分之一。相比上一代,首次响应时间提升 2.5 倍,输出速度提升 45%。
性能方面,在 GPQA Diamond 测试中得分 86.9%,超越同级别竞品;MMMU-Pro 得分 76.8%。模型支持 100 万 token 上下文窗口和多模态输入,内置“思考层级”控制功能,开发者可根据任务复杂度灵活调整推理深度,在批量简单任务中进一步压缩成本。
目前已有客服平台 Gladly 用于驱动 AI 智能体,每周处理数百万次交互,成本降低约 60%,成功率高达 99.6%;JetBrains 集成至 IDE 助手提供实时开发支持;Oracle 也计划在 Fusion Applications 和 NetSuite 中采用。
在企业客服、内容审核、智能助手等高频大批量场景中,Gemini 3.1 Flash-Lite 提供了兼顾性能与成本的优质选择,加速企业 AI 应用落地。