Google发布Veo 3与Imagen 4,生成式媒体能力升级

发布时间:2025-05-21 分类:行业洞察 原文:查看原文 阅读:2分钟
Google发布Veo 3与Imagen 4,生成式媒体能力升级

5月20日,Google发布新一代视频生成模型Veo 3和图像生成模型Imagen 4,并同步推出面向影视创作的Flow工具。此次更新将视频、图像和声音生成放入同一套创作链路,进一步拓展生成式媒体的应用范围。

Veo 3首次原生支持声音生成,可在视频中同步加入环境声、音效和人物对话。Google还表示,新模型加强了真实世界物理表现、文本和图片提示理解以及口型同步能力。Veo 3首批进入Gemini应用、Flow和Vertex AI。

Imagen 4则重点提升细节清晰度、文字呈现和生成速度,可输出多种画面比例及最高2K分辨率的图片。对于海报、社交媒体素材、概念设计和演示内容,这类能力有助于缩短从创意到视觉样稿的时间。

但音画一体化也使审核范围扩大。企业不仅要检查画面是否符合品牌规范,还要核对人物形象、音乐音效、对话内容和素材来源。用于广告或公开传播时,生成结果仍需经过版权、事实和合规审查。

*本文为基于官方发布信息的中文摘要,详情以原文链接为准。

获取适合企业发展的解决方案

围绕企业业务目标与组织需求,提供面向实际场景的产品与服务支持