Gemini Omni Flash — SeeVid 上的多模态 AI 视频

Google Gemini Omni Flash,用于快速视频创作与编辑。支持文本或图像生成、图像参考引导,或用自然语言指令编辑已有片段——输出 3–10 秒,含原生音频。

已在 SeeVid 平台上线

Gemini Omni Flash 概览

快速多模态视频生成与编辑

Gemini Omni Flash 是 Google Gemini Omni 系列的首发模型,约于 Google I/O 2026 前后推出。在 SeeVid 上支持文生视频、图生视频、图像参考生成与指令式视频编辑——时长 3–10 秒(或 auto),画幅 16:9 / 9:16。

文生与图生视频

用文字描述场景,或上传一张参考图做动画。Omni Flash 将提示词与照片变为短片,动作连贯并含原生音频。

图像参考生成

在 SeeVid 的参考生视频模式中,最多可提供六张参考图,引导主体、风格或构图并生成新片段。

指令式视频编辑

在 AI 视频编辑器中上传源视频,用自然语言描述修改——背景、光线、风格或元素。SeeVid 通过 Gemini Omni Flash 视频编辑执行该指令。

在 SeeVid 上用 Gemini Omni Flash 能做什么

视频生成器与视频编辑器中已开放的实用工作流——时长与输入上限清晰可查。

时长可选 3 至 10 秒,或由模型 Auto 决定。适合社交短片、产品节拍与带原生音频的短叙事瞬间。

短片生成

SeeVid 上的 Gemini Omni Flash 功能

SeeVid AI 视频生成器与 AI 视频编辑器中 Gemini Omni Flash 已开放的能力。

文生视频

用自然语言描述场景、运动与情绪。Omni Flash 渲染带同步音频的短电影向片段。

图生视频

上传一张参考图并描述运动。模型为静态图注入动感,并尽量保持主体与风格一致。

参考生视频(图像)

最多 10 张参考图引导生成——适合角色外观、产品形态或短片视觉风格。

原生音频输出

片段通常包含与画面同步生成的音频——可在提示词中写明对白、环境音与音效线索。

AI 视频编辑

在 SeeVid 视频编辑器中上传源视频与编辑指令。Gemini Omni Flash 执行修改,适合后期式调整与元素更新。

3–10 秒时长控制

可选 3–10 秒或 Auto。生成积分在 SeeVid 上按时长计算。

世界感知的提示词跟随

基于 Gemini 多模态理解,场景逻辑、物理感运动与短叙事连贯性更强。

常见问题

关于在 SeeVid 上使用 Gemini Omni Flash 的常见问题。









立即开始使用 Gemini Omni Flash

在 SeeVid 试用 Gemini Omni Flash——文生视频、图生视频、图像参考与 AI 视频编辑,时长 3–10 秒。