Cómo Gemini Omni está cambiando la publicidad en vídeo
La época en la que se producían unos pocos anuncios de vídeo y se alargaban durante semanas está llegando a su fin.
En Google I/O, Google presentó Gemini Omni, un modelo de IA multimodal diseñado para procesar texto, imágenes, audio y video simultáneamente. Se posiciona como un cambio radical en la forma en que se produce y prueba el contenido creativo.
En lugar de crear anuncios pieza por pieza, primero el guion, luego las imágenes y después la edición, ahora los equipos pueden trabajar con una combinación de entradas simultáneamente. Una demostración del producto, un anuncio de la competencia y un breve brief se pueden combinar en un único sistema que comprende el contexto completo y genera el resultado en consecuencia.
Así es como se está presentando.
Lo que importa es cómo funciona en la práctica.
El problema
Como ha señalado Demis Hassabis en el contexto de los sistemas de IA más recientes, el objetivo es cerrar la brecha entre la intención y el resultado sin esfuerzo.
Esa idea suena abstracta hasta que ves cómo se desarrolla realmente el trabajo creativo.
En la práctica, la mayor parte de la ralentización proviene de convertir ese pensamiento sobre la realidad física en algo útil.
Tenemos una dirección y un mensaje claro. Pero llegar desde ese punto hasta el producto final requiere varios pasos: reuniones informativas, producción, revisiones y aprobaciones. Cada paso añade tiempo, y la demora se acumula.
Para cuando algo está listo, el contexto que lo rodea generalmente ya ha cambiado.
¿Qué es exactamente Gemini Omni?
Gemini Omni cambia la forma en que se procesan las entradas.
La mayoría de los flujos de trabajo creativos son lineales. Se empieza con un guion, luego se crean los elementos visuales a su alrededor y, finalmente, se ajusta el tono en la edición. Cada paso depende del anterior. Si algo no funciona, se vuelve atrás y se corrige.
Gemini Omni comprime ese proceso.
Como puede procesar varios formatos simultáneamente, no necesita que todo se traduzca primero a texto. Un equipo puede cargar:
- Vídeo explicativo del producto
- Dos anuncios de alto rendimiento de la competencia
- Algunas notas sobre la audiencia y el tono.
Y el modelo funciona en todos ellos a la vez.
Genera resultados que reflejan las relaciones entre esas entradas.
Esa distinción es fácil de pasar por alto hasta que intentas dar instrucciones a una herramienta de IA tradicional. Redactar una consigna que capture el tono, el ritmo, el estilo visual y la intención emocional es más difícil de lo que parece. La mayoría de las consignas terminan siendo demasiado vagas o demasiado rígidas.
Aquí, la información de entrada transmite más significado.
Veo 3.1: El motor de vídeo detrás de Gemini Omni
Gemini Omni se sitúa sobre un sistema más amplio desarrollado por Google DeepMind.
Uno de los componentes clave es Veo 3, un modelo de generación de vídeo que soluciona una limitación práctica que tenían la mayoría de las herramientas anteriores: la falta de audio nativo.
Ese detalle importa más de lo que parece.
Si alguna vez has probado anuncios de vídeo sin sonido, ya conoces el resultado. Incluso con subtítulos, les cuesta captar la atención. El audio transmite ritmo y emociones que las imágenes por sí solas no pueden.
Veo genera vídeo y audio simultáneamente. Además, permite un control más estructurado. En lugar de dar una sola instrucción y esperar lo mejor, puedes definir partes de la secuencia:
- cómo empieza la escena
- ¿Qué sucede a mitad de camino?
- cómo se resuelve el mensaje
Por ejemplo, puedes especificar que, durante los primeros tres segundos, el tema aborde directamente un problema común. A los cinco segundos, se presente el producto. Al final, se incluya la llamada a la acción.
Ese nivel de control se ajusta más a la forma en que se crean realmente los anuncios de rendimiento.
Gemini Omni conecta estas capacidades con una capa de razonamiento. Garantiza que las diferentes partes de la salida (visuales, audio, sincronización) funcionen en conjunto, en lugar de parecer elementos aislados.
Cómo Gemini Omni cambia el flujo de trabajo de los anuncios de vídeo.
Las sesiones informativas son más rápidas porque el contexto se transmite mejor.
Actualmente, configurar una herramienta de IA para anuncios de vídeo es un proceso caótico. Hay que redactar un texto extenso que explique qué es el producto, cómo se siente el público, cuál debe ser el estilo visual y cuál debe ser el gancho. Es un trabajo de traducción constante.
Con Gemini Omni, tu brief puede incluir un vídeo de referencia, una imagen del producto y texto. El modelo lo procesa todo como una sola entrada. Deja de intentar describir la esencia con palabras; simplemente muéstrala.
La variación de guiones a gran escala se vuelve práctica.
Aquí tienes un ejemplo práctico. Imagina que vendes un producto para el cuidado de la piel. Quieres probar cinco ganchos diferentes: uno para abordar un problema, otro para compartir un testimonio, otro para comparar, otro para mostrar los resultados y otro para despertar la curiosidad. Cada uno requiere un guion ligeramente distinto, una frase de apertura diferente y una llamada a la acción diferente.
Con Gemini Omni a cargo del briefing, puedes generar esos cinco guiones con el contexto del producto ya incorporado. Obtendrás guiones que conocen el producto, el formato y la audiencia porque les mostraste todo eso por adelantado.
Los anuncios estilo UGC reciben una mejora sustancial.
Los anuncios de vídeo generados por el usuario funcionan porque se sienten reales. El reto consiste en producir suficientes sin agotar el presupuesto de creación ni tener que esperar tres semanas para la entrega.
La capacidad de Gemini Omni para procesar vídeo como entrada permite analizar qué funciona en tu biblioteca de contenido generado por el usuario y utilizarlo para planificar con mayor precisión el nuevo contenido. ¿Qué elementos captan la atención? ¿Qué ritmo funciona? ¿Qué estructura visual fomenta la retención?
Si se toma ese patrón en cuenta, se informa a los nuevos creadores al respecto, se están probando variaciones más inteligentes, no solo más variaciones.
Para las marcas en las que el contenido generado por el usuario es un formato publicitario fundamental, esto supone una ventaja de producción significativa.
Las pruebas creativas adquieren una capa estratégica.
La mayoría de las pruebas creativas son reactivas. Pruebas lo que has creado. Aprendes qué funcionó. Intentas repetirlo.
Gemini Omni introduce la posibilidad de realizar pruebas proactivas. Puedes modelar hipótesis antes de producir. Puedes revisar un concepto de anuncio y preguntarle al modelo qué variables tienen más probabilidades de afectar el rendimiento, según la estructura, el tipo de gancho y el enfoque del mensaje. No estás sustituyendo las pruebas por predicciones, sino que estás reduciendo el área de prueba a los aspectos que tienen más probabilidades de ser relevantes.
Eso supone un cambio de estrategia creativa. Las marcas pequeñas y las grandes lo utilizarán de maneras muy diferentes.
Lo que la mayoría de la gente entiende mal sobre la IA en el marketing.
Tratan a la IA como una máquina de generar contenido en lugar de como un socio para pensar.
La pregunta que se hacen la mayoría de los profesionales del marketing es: "¿Cuántos anuncios puede generar esto?". La pregunta más pertinente es: "¿Cómo me ayuda esto a pensar de forma diferente sobre los anuncios?".
Gemini Omni es realmente útil para acelerar la producción. Pero su mayor valor reside en la fase de investigación y estrategia: analizar qué funciona, comprender los patrones creativos, generar hipótesis y elaborar briefs estructurados que conduzcan a mejores resultados tanto de las herramientas de IA como de los creadores humanos.
Si lo adaptas a un proceso creativo deficiente, solo conseguirás producir contenido mediocre más rápido. Ese no es el objetivo.
Las marcas que están marcando la pauta utilizan primero la IA para perfeccionar su pensamiento creativo y, posteriormente, para acelerar la producción.
Conclusión
Gemini Omni no sustituirá tu criterio creativo. No está diseñado para hacerlo.
Lo que hace es reducir la brecha entre tener una buena idea y tener una que se pueda probar. Para la mayoría de los equipos de marketing, esa brecha es donde se esfuman el tiempo, el presupuesto y el impulso.
Los profesionales del marketing que se tomen esto en serio parecerán tener una capacidad creativa excepcionalmente buena y ciclos de retroalimentación excepcionalmente rápidos.
Esa es la verdadera ventaja competitiva. No la tecnología en sí, sino lo que haces con el tiempo que te devuelve.
Preguntas frecuentes
Gemini Omni es el nuevo modelo de IA de Google que combina capacidades de razonamiento con herramientas de creación multimedia para generar y editar contenido en diversos formatos. La primera versión se centra en el vídeo. Se le proporciona texto, imágenes, audio o vídeo existente, y genera un vídeo que procesa todos esos elementos de forma conjunta, en lugar de hacerlo por separado.
Veo 3.1 es el motor de generación de vídeo. Se encarga del renderizado, el audio, la fidelidad visual y el formato de salida. Gemini Omni es la capa de razonamiento que se sitúa encima. Comprende el contexto, la intención del mensaje y la dirección creativa, y luego utiliza la capacidad de generación de Veo para producir un resultado que refleje esa comprensión. En conjunto, conforman la pila de vídeo con IA más potente que Google ha lanzado públicamente.
Gemini Omni Flash ya está disponible en la app Gemini, Google Flow y YouTube Shorts. Se implementará en Google Ads este verano. Google ha sido transparente al anunciar que habrá actualizaciones más importantes de Omni a finales de este año, lo que significa que la versión actual es una variante preliminar y rápida, no la funcionalidad completa del modelo global que describió Hassabis.
Hace que la presentación de informes sea más rápida, la iteración más barata y el volumen de variación más realista para equipos reducidos. Cuando combinas la generación de video por IA a nivel de modelo con plataformas de anuncios UGC diseñadas específicamente como TagshopCon .ai, todo el ciclo de producción, desde la URL del producto hasta el anuncio publicado, se reduce de semanas a horas.
Sí. Los equipos que ya utilizan herramientas de IA para contenido generado por el usuario (UGC) producen entre seis y siete vídeos diarios a una fracción del coste de producción tradicional. Gemini Omni eleva el nivel de calidad de los vídeos generados por IA, tanto en apariencia como en sonido. Las marcas que incorporen las pruebas creativas a su flujo de trabajo ahora tendrán una ventaja significativa a medida que las herramientas mejoren en los próximos 12 meses.