Gemini系列模型持续优化,多模态理解能力不断增强
Google在近期更新中宣布Gemini系列模型持续优化,重点强化了多模态理解能力。新版本在文本、图片、视频及音频内容的联合理解上取得进展,可更准确地完成跨模态推理与内容生成任务。
此次升级涵盖模型效率、上下文窗口和指令跟随能力的改进,为教育、医疗、创意产业等领域的实际应用提供了更可靠的基础模型支持。Google表示,未来将继续推进Gemini在多模态方向的研发,并逐步向更多开发者和企业用户开放相关能力。
本文为基于官方发布信息的中文摘要,详情以原文链接为准。