Generador de video con IA Gemini Omni 1.1 Flash
Crea videos multimodales con texto, imágenes, audio, personajes, referencias de video o fotogramas inicial y final, hasta en 4K.
Un modelo rápido, dos formas claras de dirigir la toma
Usa referencias multimodales para aprovechar el contexto de tus materiales o fotogramas inicial y final cuando la transición sea clave. Separar ambos caminos evita instrucciones contradictorias.
Referencias multimodales
Combina imágenes, identificadores de audio y personajes, y un clip recortado dentro del límite compartido.
Fotogramas inicial y final
Fija la imagen inicial y añade opcionalmente una final para diseñar la transición visual.
Salida flexible
Elige 4, 6, 8 o 10 segundos, formato horizontal o vertical y resoluciones de 360p a 4K.
Pruebas comparables
Define una semilla para comparar de forma más controlada los cambios de prompts y referencias.
Construye la toma con los materiales que ya tienes
Gemini Omni 1.1 Flash se adapta a distintos puntos de partida sin obligarte a concentrarlo todo en un único prompt.
Capacidades de Gemini Omni 1.1 Flash
Controles prácticos para borradores rápidos, movimiento guiado por referencias y pruebas de alta resolución.
Texto a video
Describe el contenido, estilo, cámara y acciones de los personajes en prompts de hasta 20.000 caracteres.
Imagen a video
Usa varias imágenes para guiar sujetos, escenas, estilo, composición o continuidad del storyboard.
Del primer al último fotograma
Define una imagen inicial y otra final opcional para crear una transición más intencionada.
Referencia de video
Guía la generación con un clip recortado; en este modo el modelo determina la duración final.
Audio y personajes
Añade recursos compatibles cuando la identidad o la dirección sonora necesiten más control.
De 360p a 4K
Prueba rápido en baja resolución y sube a 720p, 1080p o 4K cuando la dirección esté validada.
Preguntas frecuentes sobre Gemini Omni 1.1 Flash
Detalles clave sobre entradas, opciones de salida y límites del modelo.
¿Qué es Gemini Omni 1.1 Flash?
Es un modelo de video IA multimodal que genera videos a partir de un prompt y referencias compatibles de imagen, audio, personajes, video o fotogramas.
¿Qué duraciones están disponibles?
Sin un video de entrada puedes elegir 4, 6, 8 o 10 segundos. Con un video de origen, el modelo determina la duración final.
¿Qué relaciones de aspecto y resoluciones admite?
Admite 16:9 horizontal, 9:16 vertical y resoluciones de 360p, 720p, 1080p y 4K.
¿Puedo combinar el primer fotograma con otras referencias?
No. El modo de primer fotograma no se puede combinar con imágenes de referencia, identificadores de audio, video de origen o personajes.
¿Puedo proporcionar solo el último fotograma?
No. El último fotograma debe acompañar a uno inicial. El fotograma inicial sí puede usarse solo.
¿Cuántas referencias puedo añadir?
Las entradas multimodales comparten siete unidades: una imagen usa una, un video usa dos y cada personaje usa una.
¿Cómo empiezo?
Abre el generador de video, selecciona Gemini Omni 1.1 Flash y configura una entrada compatible junto con las opciones de salida.
Convierte tus referencias en un borrador de video enfocado
Abre el espacio de video Gemini Omni, selecciona 1.1 Flash y construye la siguiente toma alrededor de las entradas importantes.
