Nuevo: Gemini Omni 1.1 Flash ya está disponible

Generador de video con IA Gemini Omni 1.1 Flash

Crea videos multimodales con texto, imágenes, audio, personajes, referencias de video o fotogramas inicial y final, hasta en 4K.

Un modelo rápido, dos formas claras de dirigir la toma

Usa referencias multimodales para aprovechar el contexto de tus materiales o fotogramas inicial y final cuando la transición sea clave. Separar ambos caminos evita instrucciones contradictorias.

Referencias multimodales

Combina imágenes, identificadores de audio y personajes, y un clip recortado dentro del límite compartido.

Fotogramas inicial y final

Fija la imagen inicial y añade opcionalmente una final para diseñar la transición visual.

Salida flexible

Elige 4, 6, 8 o 10 segundos, formato horizontal o vertical y resoluciones de 360p a 4K.

Pruebas comparables

Define una semilla para comparar de forma más controlada los cambios de prompts y referencias.

Construye la toma con los materiales que ya tienes

Gemini Omni 1.1 Flash se adapta a distintos puntos de partida sin obligarte a concentrarlo todo en un único prompt.

Añade hasta siete imágenes cuando las referencias de video o personajes no ocupen el límite compartido.

Capacidades de Gemini Omni 1.1 Flash

Controles prácticos para borradores rápidos, movimiento guiado por referencias y pruebas de alta resolución.

Texto a video

Describe el contenido, estilo, cámara y acciones de los personajes en prompts de hasta 20.000 caracteres.

Imagen a video

Usa varias imágenes para guiar sujetos, escenas, estilo, composición o continuidad del storyboard.

Del primer al último fotograma

Define una imagen inicial y otra final opcional para crear una transición más intencionada.

Referencia de video

Guía la generación con un clip recortado; en este modo el modelo determina la duración final.

Audio y personajes

Añade recursos compatibles cuando la identidad o la dirección sonora necesiten más control.

De 360p a 4K

Prueba rápido en baja resolución y sube a 720p, 1080p o 4K cuando la dirección esté validada.

Preguntas frecuentes sobre Gemini Omni 1.1 Flash

Detalles clave sobre entradas, opciones de salida y límites del modelo.

¿Qué es Gemini Omni 1.1 Flash?

Es un modelo de video IA multimodal que genera videos a partir de un prompt y referencias compatibles de imagen, audio, personajes, video o fotogramas.


¿Qué duraciones están disponibles?

Sin un video de entrada puedes elegir 4, 6, 8 o 10 segundos. Con un video de origen, el modelo determina la duración final.


¿Qué relaciones de aspecto y resoluciones admite?

Admite 16:9 horizontal, 9:16 vertical y resoluciones de 360p, 720p, 1080p y 4K.


¿Puedo combinar el primer fotograma con otras referencias?

No. El modo de primer fotograma no se puede combinar con imágenes de referencia, identificadores de audio, video de origen o personajes.


¿Puedo proporcionar solo el último fotograma?

No. El último fotograma debe acompañar a uno inicial. El fotograma inicial sí puede usarse solo.


¿Cuántas referencias puedo añadir?

Las entradas multimodales comparten siete unidades: una imagen usa una, un video usa dos y cada personaje usa una.


¿Cómo empiezo?

Abre el generador de video, selecciona Gemini Omni 1.1 Flash y configura una entrada compatible junto con las opciones de salida.


Convierte tus referencias en un borrador de video enfocado

Abre el espacio de video Gemini Omni, selecciona 1.1 Flash y construye la siguiente toma alrededor de las entradas importantes.