Veo 3.1 — Google DeepMind 视频 AI,原生音频

在 SeedDance 使用 Google DeepMind 的 Veo 3.1。可选原生音频、更强提示词跟随与改进的图生视频——支持文本或图像输入,时长 4、6 或 8 秒,最高 1080p。

已在 SeedDance 平台上线

从文本或图像生成电影级视频

Veo 3.1 于 2025 年 10 月发布,在 Veo 3 基础上提升提示词跟随、原生音频表现与图生视频质量。在 SeedDance 上可用于文生视频与图生视频,支持可选音频、最多三张参考图、时长 4 / 6 / 8 秒,以及 720p 或 1080p 输出。

原生音频生成

Veo 3.1 可同步生成视频与音频——对话、环境音效和音乐与画面一并合成,音画更紧,无需单独配音流程。

更强的提示词跟随

相较 Veo 3,Veo 3.1 对复杂指令跟随更稳——镜头角度、光线、节奏、人物行为与场景构图。

改进的图生视频质量

为静态图注入更自然的运动与更好的连贯性。在 SeedDance 上最多可提供三张参考图引导生成。

真实世界物理与写实感

流体、光照、物体交互与人物运动更可信——适合电影向草稿与产品类短片。

在 SeedDance 上用 Veo 3.1 能做什么

生成器中已开放的 Veo 3.1 核心能力——时长、分辨率与音频规格清晰可查。

需要对话与环境音时开启音频,与画面一并生成。可在提示词中写明语种、语气与声音设计,获得更紧的音画叙事。

SeedDance 上的 Veo 3.1 功能

SeedDance AI 视频生成器中 Veo 3.1 已开放的能力。

文生视频

将详细文本提示词转化为电影级片段。Veo 3.1 理解语言、空间关系与时序,结果更连贯。

图生视频

为静态图注入自然运动,并可选用音频。最多上传三张参考图,并描述动作与镜头语言。

可选原生音频

开启音频时,对话、环境音与音效与视频一并生成,与画面动作对齐,无需单独配音步骤。

提示词驱动的镜头控制

在提示词中描述平移、俯仰、变焦、跟踪镜头与电影感转场——Veo 3.1 对摄影指令跟随较强。

物理感运动

流体、物体交互、光照与人物运动更可信,减少漂浮感与不一致。

4 / 6 / 8 秒时长

单次生成可选 4、6 或 8 秒,适合社交短片、产品演示与短叙事节拍。

720p / 1080p 画质

在 SeedDance 上,Veo 3.1 输出 720p 或 1080p,画幅为 16:9 或 9:16(图生视频支持 auto)。

SynthID 内容标识

Veo 输出带有 Google SynthID 水印技术标识,便于透明识别 AI 生成媒体。

常见问题

关于 Veo 3.1 及在 SeedDance 上使用的常见问题。










立即开始使用 Veo 3.1 创作

在 SeedDance 试用 Veo 3.1——文生视频与图生视频,可选原生音频,时长 4 / 6 / 8 秒,最高 1080p。