Punti Chiave

  • Lancio: Google annuncia il 24 settembre 2026 Gemini 3.8 Live with Live Avatar, in disponibilità generale per i clienti Gemini Enterprise negli Stati Uniti e nell'Unione Europea.
  • Tecnologia: avatar animato con generazione video quasi in tempo reale, sincronizzazione labiale su 97 lingue con cambio lingua a metà frase ed esecuzione asincrona di strumenti in background.
  • Adozione: primi clienti già operativi sono Cox Automotive, Equal AI e Salesforce, in un mercato dove Google insegue concorrenti come HeyGen, OpenAI e Anthropic.

Un dialogo nativamente multimodale

Google ha accoppiato la generazione video quasi in tempo reale con i propri modelli di dialogo vocale nativi. L'avatar processa input visivi e audio simultaneamente, guarda ciò che l'utente mostra tramite telecamera o condivisione schermo, e risponde con espressioni facciali, sincronizzazione labiale e turni di conversazione fluidi. Non è un video precaricato su un sintetizzatore vocale: è presenza visiva generata nel momento.

La funzione è disponibile per i clienti di Gemini Enterprise, con endpoint negli Stati Uniti e nell'Unione Europea, throughput dedicato e conformità aziendale.



Google lancia Gemini 3.8 Live Avatar per le aziende - Foto 1

97 lingue, zero interruzioni

Live Avatar supporta 97 lingue e può passare da una all'altra durante la stessa conversazione senza degradare la fedeltà video né introdurre derive visive. Secondo The Verge, un video dimostrativo mostra l'avatar parlare inglese e giapponese con l'animazione della bocca allineata a entrambe le lingue. Per le aziende globali significa un unico agente visivo per tutti i mercati, con rilevazione automatica della lingua senza interruttori manuali.

Lavora mentre parla

L'avatar può attivare chiamate di sistema, verificare dati e completare attività complesse in background mentre la conversazione prosegue senza interruzioni. In una demo di Google, l'avatar effettua il check-in di un ospite in albergo dialogando con lui mentre le operazioni di sistema procedono in parallelo. In un'altra dimostrazione, un agente assicurativo analizza i danni mostrati dalla telecamera del cliente mentre un team di agenti costruito con l'Agent Development Kit verifica la polizza e prepara il fascicolo di liquidazione.



Google lancia Gemini 3.8 Live Avatar per le aziende - Foto 2

Gli sviluppatori possono integrare queste funzioni tramite l'Agent Development Kit di Google, definendo memoria e streaming audio senza passare per i tradizionali sistemi speech-to-text.

Un volto su misura per il brand

Le organizzazioni scelgono da una libreria di avatar preimpostati oppure ne generano di personalizzati partendo da un'immagine di riferimento, preservando somiglianza, stile del brand o identità del personaggio. La creazione di avatar custom richiede l'accesso tramite allowlist aziendale, un filtro voluto da Google.

La questione fiducia: SynthID e salvaguardie

Google dichiara di aver messo in atto salvaguardie per rispettare l'identità e mantenere trasparente il contenuto generato dall'IA, con filigrana SynthID invisibile impressa su tutti gli stream audio e video generati.

Chi ci sta già costruendo sopra

Cox Automotive ha creato un assistente per lo shopping su Autotrader che guida gli acquirenti nella ricerca e nel confronto di veicoli in tempo reale. Equal AI gestisce oltre un milione di chiamate live al giorno in nove lingue indiane, segnalando miglioramenti nella gestione delle interruzioni e nelle conversazioni multilingui. Salesforce sta integrando Agentforce con le capacità di Gemini 3.8 Live.



Google lancia Gemini 3.8 Live Avatar per le aziende - Foto 3

Cosa cambia per tutti gli altri

Le varianti Live Avatar sostengono solo pochi minuti di interazione continua, non ore, e per ora la funzione resta riservata alle imprese. Il lancio arriva in un momento delicato per Google, con ritardi segnalati su Gemini 3.5 Pro e lanci concorrenti di OpenAI e Anthropic. Live Avatar posiziona Google contro startup come HeyGen, con un vantaggio: gli avatar non sono un prodotto separato, ma integrati direttamente nel runtime del modello.