Gemini Omni 1.1 Flash extiende escenas a 40 segundos

Qué cambia con Gemini Omni 1.1 Flash

Google DeepMind presentó este miércoles Gemini Omni 1.1 Flash, una actualización que convierte al modelo lanzado a fines de junio en una herramienta lista para flujos profesionales de video generativo. La novedad más concreta: ahora se pueden encadenar escenas en bloques de 10 segundos hasta un acumulado de 40 segundos, frente al tope de 10 segundos por clip del release original. El modelo también acepta keyframes de inicio y fin, drafts en 360p hasta 60% más rápidos y a un tercio del costo del 720p estándar, y exportación en 1080p o 4K.

Para un founder que ya experimentaba con la versión preview, el cambio relevante no es solo más resolución: es control de continuidad. La API permite sostener narrativa, personajes y estilo a lo largo de varios cortes sin tener que reescribir el prompt desde cero cada vez.

Las cuatro novedades que cambian el flujo creativo

1. Extensión de escena con contexto real. El modelo analiza hasta 10 segundos de metraje previo para continuar la grabación, no solo el último segundo como en la versión anterior. Esto se traduce en mejor consistencia visual y adherence a la historia narrada. Cada bloque es de 10 segundos y se puede repetir hasta llegar a 40 segundos acumulados.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

2. Especificación de primer y último frame. Permite pedir una transición continua entre dos keyframes, ideal para movimientos de cámara complejos (orbits, zooms, loops). El propio blog de DeepMind incluye ejemplos como un whip-pan entre un baterista y un saxofonista o un zoom hacia una pantalla de TV que muestra la escena original.

3. Drafts rápidos en 360p. Pensado para storyboards y prototipado: hasta 60% más rápido y un tercio del costo frente al 720p estándar, según datos de DeepMind. Un founder puede iterar el guion visual antes de gastar créditos en el render final.

4. Upscaling a 4K. La salida final puede llegar a 1080p o 4K sin herramientas externas. Combinado con el draft rápido, el flujo es: idea → preview 360p → aprobación → render 4K.

Adicionalmente, el input multimodal ahora acepta hasta 3 segundos de video como referencia visual, lo que permite mantener un personaje o estilo definido a lo largo de varias tomas.

Precio, integraciones y disponibilidad

El precio se mantiene en US$0,10 por segundo de video generado, el mismo que se fijó en el lanzamiento del 30 de junio según el comunicado reportado por TechTimes. Está disponible desde el día de hoy vía:

  • Gemini API y Google AI Studio (con code snippet de Python publicado en el blog oficial).
  • Gemini Enterprise Agent Platform para despliegues corporativos.
  • Google Flow para suscriptores AI Plus, Pro y Ultra a nivel global. La extensión de escena también llega a esos mismos suscriptores en la app de Gemini.

La distribución llega además a través de agregadores como Runware, que ya ofrece acceso comercial desde el día uno sin waitlist, según un comunicado de la empresa recogido por EIN Presswire. Y a nivel enterprise, WPP ya integró Omni Flash en su plataforma WPP Open, mientras que Adobe anunció planes de llevarlo a Firefly.

Cómo se compara con Veo, Runway y Seedance

La propia Google distingue Omni Flash de su otro modelo de video, Veo 3.1: según TechTimes, Veo apunta a generación one-shot de alta calidad, mientras que Omni Flash está diseñado para edición conversacional iterativa vía la Interactions API, que conserva el historial de la sesión entre ediciones.

En el terreno de los competidores externos, el panorama a agosto incluye:

  • ByteDance Seedance 2.5, anunciada el 23 de junio según TechTimes, con clips de hasta 30 segundos, salida 4K y hasta 50 inputs de referencia simultáneos. Omni Flash hoy sigue capeado a 10 segundos por clip, aunque Google describe ese límite como decisión de despliegue y no restricción del modelo.
  • Runway Gen-4.5, el rival más mencionado. TechCrunch reportó en mayo que Runway, fundada por tres latinoamericanos en NYU, está valorada en US$5.300 millones y cerró una ronda de US$315 millones en febrero con AMD Ventures y Nvidia entre los inversores. Tiene acuerdos firmados con Lionsgate y AMC Networks, y sus herramientas se usaron en Everything Everywhere All At Once.
  • Seance, incluido por Geeky Gadgets en su comparativa de agosto entre los modelos especializados en video generación, junto a Video 3.1 de Google y Runway Gen-4.5.

La diferencia estratégica para un developer es menos el modelo específico y más el flujo: si tu producto necesita iterar conversacionalmente con el usuario (un editor de video con chat, una herramienta de e-commerce que anima fotos de producto), Omni Flash está construido para eso. Si buscas un render cinematográfico único de alta calidad, Veo sigue siendo la opción dentro del propio stack de Google.

Qué significa esto para tu startup

1. Prototipa con 360p antes de gastar en 4K. El modo draft es hasta 60% más rápido y cuesta un tercio. Úsalo como storyboard automatizado: itera el guion visual con el usuario hasta dar con el corte correcto, y solo entonces renderiza a 4K. Para una agencia o estudio pequeño, eso reduce drásticamente el costo por pieza aprobada.

2. Construye flujos de extensión de escena, no solo generación. La API acepta bloques encadenados de 10 segundos hasta 40. Si tu producto es de creación asistida (un asistente de storytelling, un generador de anuncios cortos), la propiedad a defender no es el clip aislado sino la continuidad narrativa: que el personaje de la toma 1 siga siendo el de la toma 4 sin tener que reescribir el prompt cada vez.

3. Aprovecha el contexto multimodal. Puedes pasarle hasta 3 segundos de video como referencia y mantener personaje y estilo. Útil para apps donde el usuario sube un video corto de su marca o producto y quiere que el modelo lo anime manteniendo su identidad visual.

Conclusión

Omni 1.1 Flash no compite por generar el video más impresionante, sino por hacer iterable la generación. Para un founder hispanohablante que está construyendo producto sobre video generativo, el dato operativo es: a US$0,10 por segundo, con drafts a un tercio de ese costo y la posibilidad de encadenar escenas, la barrera económica para integrar video AI en un SaaS creativo cae a un nivel donde el unit economics empieza a cerrar sin subsidio.

Fuentes

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...