Puntos Clave
- Lanzamiento: Google anuncia el 24 de septiembre de 2026 Gemini 3.8 Live with Live Avatar, en disponibilidad general para los clientes de Gemini Enterprise en Estados Unidos y la Unión Europea.
- Tecnología: avatar animado con generación de video casi en tiempo real, sincronización labial en 97 idiomas con cambio de idioma a mitad de frase y ejecución asíncrona de herramientas en segundo plano.
- Adopción: los primeros clientes ya operativos son Cox Automotive, Equal AI y Salesforce, en un mercado donde Google persigue a competidores como HeyGen, OpenAI y Anthropic.
Un diálogo nativamente multimodal
Google ha combinado la generación de video casi en tiempo real con sus propios modelos de diálogo de voz nativos. El avatar procesa entradas visuales y de audio simultáneamente, observa lo que el usuario muestra a través de la cámara o al compartir pantalla, y responde con expresiones faciales, sincronización labial y turnos de conversación fluidos. No es un video precargado sobre un sintetizador de voz: es presencia visual generada en el momento.
La función está disponible para los clientes de Gemini Enterprise, con endpoints en Estados Unidos y en la Unión Europea, throughput dedicado y cumplimiento normativo empresarial.
97 idiomas, cero interrupciones
Live Avatar admite 97 idiomas y puede pasar de uno a otro durante la misma conversación sin degradar la fidelidad del video ni introducir desvíos visuales. Según The Verge, un video demostrativo muestra al avatar hablando inglés y japonés con la animación de la boca alineada a ambos idiomas. Para las empresas globales esto significa un único agente visual para todos los mercados, con detección automática del idioma sin interruptores manuales.
Trabaja mientras habla
El avatar puede activar llamadas de sistema, verificar datos y completar tareas complejas en segundo plano mientras la conversación continúa sin interrupciones. En una demo de Google, el avatar realiza el check-in de un huésped en un hotel dialogando con él mientras las operaciones del sistema avanzan en paralelo. En otra demostración, un agente de seguros analiza los daños mostrados por la cámara del cliente mientras un equipo de agentes construido con el Agent Development Kit verifica la póliza y prepara el expediente de liquidación.
Los desarrolladores pueden integrar estas funciones a través del Agent Development Kit de Google, definiendo memoria y streaming de audio sin pasar por los sistemas tradicionales de speech-to-text.
Un rostro a medida para la marca
Las organizaciones eligen entre una biblioteca de avatares preestablecidos o generan otros personalizados a partir de una imagen de referencia, preservando el parecido, el estilo de marca o la identidad del personaje. La creación de avatares personalizados requiere acceso mediante lista blanca empresarial, un filtro impuesto por Google.
La cuestión de la confianza: SynthID y salvaguardas
Google declara haber implementado salvaguardas para respetar la identidad y mantener transparente el contenido generado por IA, con marca de agua SynthID invisible impresa en todos los streams de audio y video generados.
Quién ya está construyendo sobre esto
Cox Automotive creó un asistente de compras para Autotrader que guía a los compradores en la búsqueda y comparación de vehículos en tiempo real. Equal AI gestiona más de un millón de llamadas en vivo al día en nueve idiomas de la India, señalando mejoras en el manejo de interrupciones y en las conversaciones multilingües. Salesforce está integrando Agentforce con las capacidades de Gemini 3.8 Live.
Qué cambia para todos los demás
Las variantes de Live Avatar solo sostienen unos pocos minutos de interacción continua, no horas, y por ahora la función sigue reservada a las empresas. El lanzamiento llega en un momento delicado para Google, con retrasos señalados en Gemini 3.5 Pro y lanzamientos competidores de OpenAI y Anthropic. Live Avatar posiciona a Google frente a startups como HeyGen, con una ventaja: los avatares no son un producto separado, sino que están integrados directamente en el runtime del modelo.
