新模型:Gemini Omni 1.1 Flash 已上线

Gemini Omni 1.1 Flash AI 视频生成器

使用文本、图片、音频、角色、视频参考或首尾帧生成多模态 AI 视频,输出分辨率最高支持 4K。

一个高速模型,两种清晰的镜头控制方式

需要从现有素材获取上下文时,使用多模态参考;需要精确设计画面过渡时,使用首尾帧。两条路径分开使用,能减少素材之间的指令冲突。

多模态参考

在共享素材额度内组合图片、音频 ID、角色 ID 和一段经过截取的源视频。

首尾帧控制

锁定视频开场画面,并可搭配结束帧,让画面过渡更符合预期。

灵活输出规格

可选 4、6、8 或 10 秒,横屏或竖屏,以及 360p 到 4K 分辨率。

可复现测试

设置随机种子,更方便对比提示词和参考素材的变化,同时保留模型的随机性。

围绕现有素材设计下一支镜头

Gemini Omni 1.1 Flash 能适配不同的创作起点,不必把所有需求都塞进单一提示词。

当没有视频或角色素材占用共享额度时,最多可添加 7 张图片作为主体、场景、风格或分镜参考。

Gemini Omni 1.1 Flash 模型能力

用清晰的输入与输出控制,更快完成视频草稿、参考素材驱动的动态和高分辨率测试。

文本生成视频

用最长 20,000 字符的提示词描述画面、风格、镜头语言与角色动作。

图片生成视频

使用多张公开可访问的图片,控制主体、场景、风格、构图或分镜连续性。

首尾帧生成

指定起始图片,并可配合结束图片,获得更有目标的视觉过渡。

视频参考

用一段经过截取的源视频引导生成;使用视频输入时,成片时长由模型决定。

音频与角色

当人物一致性或声音方向需要更多控制时,可加入兼容的音频与角色素材。

360p 至 4K

先用低分辨率快速测试方向,确定方案后再选择 720p、1080p 或 4K。

Gemini Omni 1.1 Flash 常见问题

了解模型输入、输出设置与关键限制。

Gemini Omni 1.1 Flash 是什么?

Gemini Omni 1.1 Flash 是 Gemini Omni 工作台提供的多模态 AI 视频模型,可通过提示词和兼容的图片、音频、角色、视频或首尾帧素材生成视频。


可以生成多长的视频?

不使用视频输入时,可选择 4、6、8 或 10 秒。使用源视频时,输出时长由模型决定,时长设置不会生效。


支持哪些画幅和分辨率?

支持 16:9 横屏与 9:16 竖屏,分辨率可选 360p、720p、1080p 或 4K。


首帧可以和其他参考素材一起使用吗?

不可以。首帧模式不能与图片参考、音频 ID、源视频或角色 ID 同时使用。每次生成应在首尾帧路径和多模态参考路径之间选择一种。


可以只提供结束帧吗?

不可以。结束帧必须与首帧一起提供;首帧可以单独使用。


最多可以添加多少参考素材?

多模态素材共享 7 个单位:每张图片占 1 个单位,一段视频占 2 个单位,每个角色 ID 占 1 个单位。每次最多 1 段视频、3 个角色 ID。


素材文件有哪些限制?

每张图片不能超过 20MB;源视频不能超过 100MB、时长不能超过 30 秒,截取片段最长 10 秒。


如何开始使用这个模型?

打开视频生成器,选择 Gemini Omni 1.1 Flash,选择一种兼容的输入方式,设置输出规格后提交任务。


把参考素材变成一支目标明确的视频小样

打开 Gemini Omni 视频工作台,选择 1.1 Flash,围绕真正重要的输入设计下一支镜头。