Gemini模型生态升级,多模态AI能力进一步扩展
Google在近期更新中进一步扩展Gemini模型的多模态能力,覆盖图像识别、视频内容解析和复杂文件理解等方向。
新能力可支持更精细的视觉问答、跨模态检索和长文档信息提取,为内容创作、数据分析及企业自动化流程带来更高效的AI辅助方案。
本文为基于官方发布信息的中文摘要,详情以原文链接为准。
Google在近期更新中进一步扩展Gemini模型的多模态能力,覆盖图像识别、视频内容解析和复杂文件理解等方向。
新能力可支持更精细的视觉问答、跨模态检索和长文档信息提取,为内容创作、数据分析及企业自动化流程带来更高效的AI辅助方案。
本文为基于官方发布信息的中文摘要,详情以原文链接为准。