Google

Google Veo

Google Veo 3.1 提供行业领先的视频生成,具备原生音频合成、照片级画质和最高 1080p 分辨率。Extend 变体增加了视频续写和视频到视频功能,实现无缝片段延伸。

Veo 3.1 是 Google 的旗舰视频模型,将文生视频和图生视频与内置音频相结合——音频与视觉内容原生同步生成,而非作为单独步骤添加。它提供快速和标准两个生成档位,支持参考图像进行风格和角色引导,输出分辨率为 720p 或 1080p。Extend 变体接受现有视频片段并无缝续写,以视频到视频模式运行。两者共同实现从初始生成到延伸的端到端视频制作,全程配有同步音频。

Illustrative sample of a Google Veo 3.1 photorealistic cinematic still implying natively generated synchronized audio on the Astorie canvas
示意样例 — 代表性输出,并非模型逐帧渲染结果

Google Veo 变体

变体说明
Veo 3.1文生视频和图生视频,原生音频,参考图像支持,快速和标准档位,最高 1080p。
Veo 3.1 续写无缝视频延伸和现有片段的视频到视频续写。

支持的功能

文本生成视频
图像生成视频
视频到视频
参考图像
尾帧控制
分镜编辑
音频驱动

支持的宽高比

1:116:99:16

质量档位

Standard
Fast

更高的质量档位通常提供更好的细节和一致性,但需要更多积分和生成时间。

最适合

  • 需要同步音频的专业视频制作
  • 用于广告和媒体的照片级内容
  • 通过片段延伸组装长视频
  • 基于参考图像引导生成以保持品牌一致性
  • 1080p 高分辨率最终交付物

优势

  • 原生音频生成消除了单独拟音或配乐的需要
  • 照片级输出质量处于行业最佳水平
  • 快速/标准双档位平衡速度和质量
  • 参考图像一致地引导风格和角色外观
  • Extend 变体实现无缝多片段组装

局限性

  • 高端输出质量伴随相对更长的渲染时间
  • Extend 变体需要现有片段作为起点
  • 原生音频在生成后无法独立微调

使用技巧

使用快速档进行概念迭代,标准档用于最终渲染以控制成本。
在提示中包含环境音描述以引导 Veo 的原生音频生成。
提供具有确切所需视觉风格的参考图像以减少提示修改次数。
将基础模型与 Extend 串联以构建更长的序列同时保持音频一致。

Astorie 上使用 Google Veo

Astorie 的无限画布上将 Google Veo 与其他 AI 模型连接使用。无需 GPU,免费开始。

免费开始

相关功能

操作指南

延伸阅读

相关视频模型

返回所有视频模型