Producto

Google le pone cara a Gemini 3.8 Live

El 24 de septiembre de 2026, Google le puso cara a su modelo conversacional: Live Avatar es una figura humana en vídeo generado casi en tiempo real, sincronizada con lo que el modelo dice. La novedad no son los 97 idiomas, que ya venían de septiembre, sino que la sincronización labial y las expresiones se mantienen al cambiar de lengua. Lo cuenta Google, que vende el producto.

Recibe el resumen diario de IA

Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

Frecuencia:

Caricatura de varietés: un empresario con la mano metida hasta la muñeca en la nuca de una cabeza de madera sin cuerpo; el muñeco recibe el aplauso y le cambia la boca sobre un collar de bocas talladas, mientras el titiritero mueve los labios a la vista de todos.
📷 Imagen generada con IA

En resumen

  • El 24 de septiembre de 2026, Google puso Gemini 3.8 Live con Live Avatar en disponibilidad general dentro de Gemini Enterprise, su paquete para empresas.
  • Lo nuevo: esa cara aguanta el salto entre los 97 idiomas «sin degradar la fidelidad del vídeo ni introducir deriva visual», según Google; los 97 ya venían del modelo del 15 de septiembre de 2026.
  • Se ofrece con puntos de acceso en Estados Unidos y en la Unión Europea y gobernanza estricta de los datos; Google no nombra regiones ni habla de residencia de datos.
  • Los avatares propios van «solo por lista blanca de empresa», todo el audio y el vídeo generados llevan marca de agua SynthID, y no hay precio ni límite de sesión publicados.

Lo nuevo es que la cara aguanta el cambio de idioma

Gemini 3.8 Live ya conversaba desde el 15 de septiembre de 2026: entraba audio y salía audio. El 24 de septiembre se le sumó una cara: el vídeo que genera Gemini mientras responde. Google lo resume como «presencia visual casi en tiempo real» y lo describe con tres cualidades: sincronización labial precisa, expresiones naturales y turnos de palabra fluidos. Ninguna la ha medido nadie de fuera, y ese «casi» no viene con ningún número.

La novedad concreta está en el cambio de lengua: Google escribe que el avatar «adapta dinámicamente su sincronización labial y sus expresiones y puede transitar sin costuras entre 97 idiomas sin degradar la fidelidad del vídeo ni introducir deriva visual». Esos 97 idiomas, con detección automática, no son el estreno: venían con el modelo del 15 de septiembre. Lo que se estrena es que la boca y el gesto no se descuadren al cambiar, y de la lista de idiomas Google no publica nada.

Qué hacía el modelo de septiembre y qué añade el avatar

Qué ya hacía y qué añade Live Avatar
Capacidad Gemini 3.8 Live (15-09-2026) Con Live Avatar (24-09-2026)
Salida Voz: entra audio y sale audio Voz y vídeo generado casi en tiempo real
Idiomas 97, con detección automática Los mismos 97, y la sincronización labial y las expresiones se mantienen al cambiar entre ellos
Entrada visual Procesa lo que ve en directo Cámara en vivo y pantalla compartida, junto al audio y a la vez
Turnos de palabra Ejecuta herramientas sin cortar la conversación Turnos de palabra fluidos, sincronizados con la imagen
Personalización Voces Avatar propio desde una imagen de referencia, solo por lista blanca de empresa
Dónde API de Gemini y Google AI Studio Disponibilidad general en Gemini Enterprise, con puntos de acceso en Estados Unidos y la Unión Europea
Marca de agua SynthID en el audio SynthID en el audio y en el vídeo
Todas las capacidades y todas las cifras las describe y las comunica Google, que vende el producto; no hay medición independiente. La columna del 15 de septiembre recoge lo anunciado entonces por Google; la del 24 de septiembre, lo anunciado en el blog de Google y, en el caso de los puntos de acceso y de la pantalla compartida, en el blog de Google Cloud del 25 de septiembre. Google no publica la lista de los 97 idiomas, ni cifras de latencia, ni precio de Live Avatar.

El cuadro de abajo separa lo heredado de lo nuevo. El capítulo anterior es del 15 de septiembre de 2026: Gemini 3.8 Live llegó con voz a voz, los 97 idiomas y la ejecución de herramientas sin cortar la conversación; la voz por encargo, el 23 de septiembre.

Puntos de acceso en Estados Unidos y en la Unión Europea

El detalle de disponibilidad no está en el anuncio del 24 de septiembre, sino en el blog de Google Cloud del día siguiente, firmado por Fabien Blanc-paques, responsable de producto de Gemini Live. Allí se lee que Gemini 3.8 Live con Live Avatar «está ya disponible con puntos de acceso de Estados Unidos y de la Unión Europea, con rendimiento aprovisionado, cumplimiento normativo empresarial y gobernanza estricta de los datos». «Rendimiento aprovisionado» es capacidad reservada de antemano.

Lo que ahí no se dice importa igual: Google no nombra ninguna región concreta, no emplea la expresión «residencia de datos» y no afirma que el punto de acceso europeo responda más rápido a quien se conecta desde Europa. Sí precisa la entrada visual: la comprensión visual en directo «puede procesar señales de cámara en vivo y pantallas compartidas junto al audio, todo a la vez».

El avatar propio va por invitación y el precio no aparece

Una organización puede darle al avatar la cara que quiera partiendo de una imagen de referencia de alta calidad, y conservar el parecido de una persona o el estilo de una marca. La letra pequeña la pone Google en el propio anuncio: esa creación está disponible «solo por lista blanca de empresa».

De dinero, nada. Ninguno de los dos anuncios da precio, cuota ni límite de sesión, y el de Google Cloud remite a la página de tarifas sin adelantar cifra. Tampoco hay identificador de modelo publicado para el avatar.

Conclusión

Live Avatar es sobre todo una promesa de continuidad: el mismo modelo que ya hablaba 97 idiomas los pone ahora en una cara que, según Google, no se descuadra al cambiar de lengua. Falta lo que lo haría comparable: una cifra de retraso, la lista de idiomas, una tarifa y alguien de fuera que mida.

Fuentes primarias

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Recibe el resumen diario de IA

    Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

    Frecuencia:

    ← Volver al blog