Gemini Omni 1.1 Flash AI 视频生成器
使用文本、图片、音频、角色、视频参考或首尾帧生成多模态 AI 视频,输出分辨率最高支持 4K。
多模态参考
在共享素材额度内组合图片、音频 ID、角色 ID 和一段经过截取的源视频。
首尾帧控制
锁定视频开场画面,并可搭配结束帧,让画面过渡更符合预期。
灵活输出规格
可选 4、6、8 或 10 秒,横屏或竖屏,以及 360p 到 4K 分辨率。
可复现测试
设置随机种子,更方便对比提示词和参考素材的变化,同时保留模型的随机性。
围绕现有素材设计下一支镜头
Gemini Omni 1.1 Flash 能适配不同的创作起点,不必把所有需求都塞进单一提示词。
Gemini Omni 1.1 Flash 模型能力
用清晰的输入与输出控制,更快完成视频草稿、参考素材驱动的动态和高分辨率测试。
文本生成视频
用最长 20,000 字符的提示词描述画面、风格、镜头语言与角色动作。
图片生成视频
使用多张公开可访问的图片,控制主体、场景、风格、构图或分镜连续性。
首尾帧生成
指定起始图片,并可配合结束图片,获得更有目标的视觉过渡。
视频参考
用一段经过截取的源视频引导生成;使用视频输入时,成片时长由模型决定。
音频与角色
当人物一致性或声音方向需要更多控制时,可加入兼容的音频与角色素材。
360p 至 4K
先用低分辨率快速测试方向,确定方案后再选择 720p、1080p 或 4K。
Gemini Omni 1.1 Flash 常见问题
了解模型输入、输出设置与关键限制。
Gemini Omni 1.1 Flash 是什么?
Gemini Omni 1.1 Flash 是 Gemini Omni 工作台提供的多模态 AI 视频模型,可通过提示词和兼容的图片、音频、角色、视频或首尾帧素材生成视频。
可以生成多长的视频?
不使用视频输入时,可选择 4、6、8 或 10 秒。使用源视频时,输出时长由模型决定,时长设置不会生效。
支持哪些画幅和分辨率?
支持 16:9 横屏与 9:16 竖屏,分辨率可选 360p、720p、1080p 或 4K。
首帧可以和其他参考素材一起使用吗?
不可以。首帧模式不能与图片参考、音频 ID、源视频或角色 ID 同时使用。每次生成应在首尾帧路径和多模态参考路径之间选择一种。
可以只提供结束帧吗?
不可以。结束帧必须与首帧一起提供;首帧可以单独使用。
最多可以添加多少参考素材?
多模态素材共享 7 个单位:每张图片占 1 个单位,一段视频占 2 个单位,每个角色 ID 占 1 个单位。每次最多 1 段视频、3 个角色 ID。
素材文件有哪些限制?
每张图片不能超过 20MB;源视频不能超过 100MB、时长不能超过 30 秒,截取片段最长 10 秒。
如何开始使用这个模型?
打开视频生成器,选择 Gemini Omni 1.1 Flash,选择一种兼容的输入方式,设置输出规格后提交任务。
