Producto
Google le pone cara a Gemini 3.8 Live
El 24 de septiembre de 2026, Google le puso cara a su modelo conversacional: Live Avatar es una figura humana en vídeo generado casi en tiempo real, sincronizada con lo que el modelo dice. La novedad no son los 97 idiomas, que ya venían de septiembre, sino que la sincronización labial y las expresiones se mantienen al cambiar de lengua. Lo cuenta Google, que vende el producto.
Recibe el resumen diario de IA
Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.
Al suscribirte aceptas recibir el newsletter de AI Informator. Puedes darte de baja cuando quieras.
En resumen
- El 24 de septiembre de 2026, Google puso Gemini 3.8 Live con Live Avatar en disponibilidad general dentro de Gemini Enterprise, su paquete para empresas.
- Lo nuevo: esa cara aguanta el salto entre los 97 idiomas «sin degradar la fidelidad del vídeo ni introducir deriva visual», según Google; los 97 ya venían del modelo del 15 de septiembre de 2026.
- Se ofrece con puntos de acceso en Estados Unidos y en la Unión Europea y gobernanza estricta de los datos; Google no nombra regiones ni habla de residencia de datos.
- Los avatares propios van «solo por lista blanca de empresa», todo el audio y el vídeo generados llevan marca de agua SynthID, y no hay precio ni límite de sesión publicados.
Lo nuevo es que la cara aguanta el cambio de idioma
Gemini 3.8 Live ya conversaba desde el 15 de septiembre de 2026: entraba audio y salía audio. El 24 de septiembre se le sumó una cara: el vídeo que genera Gemini mientras responde. Google lo resume como «presencia visual casi en tiempo real» y lo describe con tres cualidades: sincronización labial precisa, expresiones naturales y turnos de palabra fluidos. Ninguna la ha medido nadie de fuera, y ese «casi» no viene con ningún número.
La novedad concreta está en el cambio de lengua: Google escribe que el avatar «adapta dinámicamente su sincronización labial y sus expresiones y puede transitar sin costuras entre 97 idiomas sin degradar la fidelidad del vídeo ni introducir deriva visual». Esos 97 idiomas, con detección automática, no son el estreno: venían con el modelo del 15 de septiembre. Lo que se estrena es que la boca y el gesto no se descuadren al cambiar, y de la lista de idiomas Google no publica nada.
Qué hacía el modelo de septiembre y qué añade el avatar
| Capacidad | Gemini 3.8 Live (15-09-2026) | Con Live Avatar (24-09-2026) |
|---|---|---|
| Salida | Voz: entra audio y sale audio | Voz y vídeo generado casi en tiempo real |
| Idiomas | 97, con detección automática | Los mismos 97, y la sincronización labial y las expresiones se mantienen al cambiar entre ellos |
| Entrada visual | Procesa lo que ve en directo | Cámara en vivo y pantalla compartida, junto al audio y a la vez |
| Turnos de palabra | Ejecuta herramientas sin cortar la conversación | Turnos de palabra fluidos, sincronizados con la imagen |
| Personalización | Voces | Avatar propio desde una imagen de referencia, solo por lista blanca de empresa |
| Dónde | API de Gemini y Google AI Studio | Disponibilidad general en Gemini Enterprise, con puntos de acceso en Estados Unidos y la Unión Europea |
| Marca de agua | SynthID en el audio | SynthID en el audio y en el vídeo |
El cuadro de abajo separa lo heredado de lo nuevo. El capítulo anterior es del 15 de septiembre de 2026: Gemini 3.8 Live llegó con voz a voz, los 97 idiomas y la ejecución de herramientas sin cortar la conversación; la voz por encargo, el 23 de septiembre.
Puntos de acceso en Estados Unidos y en la Unión Europea
El detalle de disponibilidad no está en el anuncio del 24 de septiembre, sino en el blog de Google Cloud del día siguiente, firmado por Fabien Blanc-paques, responsable de producto de Gemini Live. Allí se lee que Gemini 3.8 Live con Live Avatar «está ya disponible con puntos de acceso de Estados Unidos y de la Unión Europea, con rendimiento aprovisionado, cumplimiento normativo empresarial y gobernanza estricta de los datos». «Rendimiento aprovisionado» es capacidad reservada de antemano.
Lo que ahí no se dice importa igual: Google no nombra ninguna región concreta, no emplea la expresión «residencia de datos» y no afirma que el punto de acceso europeo responda más rápido a quien se conecta desde Europa. Sí precisa la entrada visual: la comprensión visual en directo «puede procesar señales de cámara en vivo y pantallas compartidas junto al audio, todo a la vez».
El avatar propio va por invitación y el precio no aparece
Una organización puede darle al avatar la cara que quiera partiendo de una imagen de referencia de alta calidad, y conservar el parecido de una persona o el estilo de una marca. La letra pequeña la pone Google en el propio anuncio: esa creación está disponible «solo por lista blanca de empresa».
De dinero, nada. Ninguno de los dos anuncios da precio, cuota ni límite de sesión, y el de Google Cloud remite a la página de tarifas sin adelantar cifra. Tampoco hay identificador de modelo publicado para el avatar.
Conclusión
Live Avatar es sobre todo una promesa de continuidad: el mismo modelo que ya hablaba 97 idiomas los pone ahora en una cara que, según Google, no se descuadra al cambiar de lengua. Falta lo que lo haría comparable: una cifra de retraso, la lista de idiomas, una tarifa y alguien de fuera que mida.
Fuentes primarias
- Google — «Introducing Gemini 3.8 Live with Live Avatar» (24-09-2026) ↗
- Google Cloud — «Gemini 3.8 Live with Live Avatar is now generally available» (Fabien Blanc-paques, 25-09-2026) ↗
- Google Cloud — Gemini Enterprise Agent Platform, página de precios ↗
- Google — «Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking» (15-09-2026) ↗
- AI Informator — «Gemini 3.8 Live: te habla mientras busca la respuesta» ↗
- AI Informator — «Gemini 3.8 TTS: describe una voz y la API te la fabrica» ↗
Recibe el resumen diario de IA
Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.
Al suscribirte aceptas recibir el newsletter de AI Informator. Puedes darte de baja cuando quieras.
Comentarios