Google I/O 2026: Gemini Omni sustituye a Veo 4 y llega a todas partes
Google I/O comenzó hoy con la respuesta a la pregunta que todo el mundo se hacía: sí, hay un nuevo modelo de vídeo; no, no se llama Veo 4. El modelo es Gemini Omni, y el cambio de marca es la estrategia. Google está integrando la generación de vídeo, audio, imágenes y texto en un único modelo unificado bajo el nombre Gemini. Veo e Imagen, como líneas de producto independientes, quedan absorbidas de facto.
Demis Hassabis presenta Gemini Omni durante la conferencia inaugural de I/O 2026
Qué es realmente Gemini Omni
Omni acepta como entrada cualquier combinación de texto, imágenes, audio y vídeo, y genera vídeo de alta calidad como salida, basándose en el conocimiento del mundo de Gemini. El modelo permite editar mediante conversación: sube un clip, pídele que gire el encuadre, añada un elemento, cambie la iluminación o sustituya el vestuario del actor. El flujo de trabajo está unificado, lo que significa que el mismo modelo se encarga de la generación, la edición y la continuación en una sola pasada.
La distribución desde el primer día es agresiva. Gemini Omni Flash ya está disponible en la aplicación Gemini, Google Flow y YouTube Shorts para suscriptores de AI Plus, Pro y Ultra de todo el mundo. Es un alcance mucho mayor que el de cualquier lanzamiento anterior de vídeo con IA de Google y una respuesta directa al cierre de Sora hace tres semanas. Google se está asegurando de que el público abandonado por Sora tenga de inmediato un destino propiedad de Google.
Cómo se compara
En comparación con Kling 3.0, la principal diferencia de Gemini Omni es la entrada multimodal. El punto fuerte de Kling es la continuidad entre múltiples planos y la salida en 4K; el de Omni es la capacidad de combinar libremente referencias de distintas modalidades (un clip de voz + una imagen de referencia + un prompt + un vídeo guía, integrados en una sola salida).
El enfoque de modelo unificado también cambia el flujo de trabajo de edición. Mientras que Kling y Runway tratan la edición como una pasada independiente del modelo —normalmente más lenta y cara—, Omni realiza las ediciones en la misma pasada de difusión que la generación. En la práctica, esto hace que las iteraciones se parezcan más a un chat de texto que a las herramientas de vídeo tradicionales.
No se anunció el precio del nivel Pro durante la conferencia inaugural, pero el lanzamiento de la variante Flash a través de la aplicación Gemini significa que la mayoría de los suscriptores obtendrán acceso gratuito mediante su plan actual. Solo eso atraerá una parte significativa del mercado de vídeo con IA hacia el ecosistema de Google.
Resumen independiente de las demostraciones más impactantes de Gemini Omni
Gemini 3.5 Flash y Google Antigravity
Otros dos anuncios son importantes para quienes crean productos. Gemini 3.5 Flash es el nuevo modelo de gama media y, según se informa, supera a Gemini 3.1 Pro en pruebas de programación y agentes, al tiempo que mantiene la velocidad y el precio del nivel Flash. Para cualquier aplicación que use Gemini actualmente, la migración supone una mejora en todos los aspectos.
Google Antigravity es la plataforma de desarrollo de Google centrada en agentes. La propuesta es que, en lugar de crear herramientas que ayuden a los desarrolladores a escribir código, Antigravity ofrece agentes que ayudan a los desarrolladores a actuar, incluso entre los distintos productos de Google (Search, Workspace, Cloud y el nuevo asistente Gemini Spark). Se presenta como competidor directo de Claude de Anthropic con uso del ordenador y de la plataforma de agentes de OpenAI basada en GPT.
También se mostró el adelanto de las gafas Android XR, que resulta realmente interesante, pero llega un año demasiado pronto como para ser relevante para los flujos de trabajo de desarrollo de juegos y creación de contenido.
Qué significa esto para el mercado del vídeo con IA
Hoy cambian tres cosas.
En primer lugar, el patrón de «muchos modelos especializados» que definió 2024 y 2025 —uno para texto, otro para imágenes, otro para vídeo y otro para audio— está siendo eliminado explícitamente por uno de los laboratorios que ayudaron a definirlo. Que este enfoque se consolide dependerá de si la calidad de salida unificada de Omni se mantiene en todas las modalidades durante el uso real, no solo en las demostraciones.
En segundo lugar, la ventaja de distribución acaba de ampliarse. Sora murió porque no pudo llegar a mil millones de usuarios con la suficiente rapidez. Omni comienza desde el primer día en la aplicación Gemini, Google Flow y YouTube Shorts. Ahí es donde miles de millones de personas ya crean y ven vídeos.
En tercer lugar, los modelos de código abierto y con precios competitivos —Kling a 0,07-0,14 dólares por segundo, LTX-2 con pesos abiertos y Wan2.2— quedan en una posición interesante. Si la oferta incluida de Google es «gratis con tu suscripción a Gemini de 20 dólares al mes», solo quedan dos espacios para competir: por encima, con herramientas profesionales que ofrezcan mayor control, o por debajo, con soluciones de código abierto autoalojadas.
Qué probaríamos primero
Para cualquiera que esté creando herramientas para creadores, la pregunta inmediata es si la API de Omni se lanzará durante la jornada para desarrolladores de I/O, cuál será su precio y qué límites de uso tendrá. La superficie comercial —la aplicación Gemini, Flow y Shorts— está restringida a Google. La API es la única forma de integrar Omni en tu propio producto. Actualizaremos esta publicación cuando se publiquen esos detalles.
Para los estudios de videojuegos en particular, habrá que prestar atención a la coherencia entre múltiples planos. Si Omni puede mantener un personaje entre cortes como lo hace Kling 3.0, pero con control editable durante el proceso, crear prototipos cinematográficos para tráileres de una demo vertical será mucho más barato.