// TOM'S HARDWARE ITALIA — INTELLIGENZA ARTIFICIALE
Gemini 3.8 con Live Avatar, ora l'AI ha una faccia e ti parla
L'assistente AI di Google ora ha una faccia che si muove, parla e ascolta quasi come farebbe una persona. Si chiama Gemini 3.8 Live with Live Avatar, disponibile da subito in Gemini Enterprise: combina generazione video quasi in tempo reale con audio nativo, sincronizzazione labiale precisa ed espressioni che si adattano al tono della conversazione.
L'avatar può anche lavorare in background mentre parla (l'esempio ufficiale di Google è un check-in hotel, dove l'assistente recupera i dati della prenotazione senza interrompere il dialogo) e gestisce la transizione tra 97 lingue senza perdere qualità visiva o coerenza del labiale. Le aziende possono già creare un avatar personalizzato a partire da una singola immagine di riferimento, per ora riservato a chi ha accesso enterprise su allowlist.
La garanzia che Google offre contro l'abuso di questa tecnologia è un unico meccanismo: ogni flusso audio e video generato porta un watermark SynthID, descritto da Google stessa come impercettibile, al punto che non si vede né si sente in una conversazione ordinaria. Serve a chi indaga dopo i fatti, non a chi parla in quel momento. La persona dall'altra parte dello schermo non ha modo di accorgersi, mentre la conversazione avviene, che davanti a sé non c'è un essere umano.
Google chiama tutto questo "fiducia e trasparenza". Ma un watermark che si legge solo dopo, con gli strumenti giusti, non avvisa nessuno mentre la conversazione è in corso: quella, per chi parla, resta invisibile.
Dal 2 agosto 2026, l'articolo 50 dell'AI Act europeo impone a chi distribuisce un sistema che interagisce direttamente con le persone (chatbot, assistenti vocali, avatar) di informarle che stanno parlando con un'intelligenza artificiale, a meno che non sia già ovvio dal contesto. Un avatar con espressioni naturali e sincronizzazione labiale precisa è pensato apposta perché quella distinzione smetta di essere ovvia, con sanzioni fino a 15 milioni di euro o il 3% del fatturato globale per chi non lo dichiara.
Un watermark impercettibile risolve un problema diverso da quello della conversazione dal vivo: aiuta un'indagine forense a stabilire, mesi dopo, che un video era generato da un modello. Non aiuta l'impiegato di un'assicurazione, il cliente di un concessionario auto o il paziente di un servizio sanitario a sapere, mentre parlano, che l'interlocutore è software.
Il tema dei watermark invisibili si è già posto per testo e immagini. Su un avatar che imita in tempo reale il turno di parola e le espressioni di un essere umano, il rischio cambia scala e riguarda la percezione stessa di chi si ha di fronte, più che la sola attribuzione di un contenuto.
La soluzione tecnica esiste già ed è più semplice del watermark: un'etichetta visibile, un banner, una voce di sistema che annuncia la natura artificiale dell'interazione prima che cominci, come l'AI Act richiede esplicitamente per i casi non ovvi. Google lascia questa scelta ai clienti enterprise che costruiscono l'esperienza finale, dal chiosco interattivo all'agente per il servizio clienti: la conformità normativa diventa un compito del cliente, non una caratteristica del prodotto. Lo stesso vale per chi già non riesce a verificare da solo un contenuto sospetto: il watermark tecnico e l'etichetta che informa l'utente restano due strumenti separati, e solo il secondo soddisfa la legge.
Chi decide se un avatar Gemini si presenta o si finge umano è, per ora, l'azienda che lo distribuisce ai propri utenti finali, non Google. Chi paga il costo di una scelta sbagliata è il cliente finale che scopre solo in un secondo momento di aver parlato con un software, con la stessa dinamica già vista sui deepfake vocali che ingannano i dipendenti al telefono: le aziende che distribuiscono l'avatar senza etichetta restano esposte alle sanzioni dell'AI Act, a prescindere da quanto il watermark di Google fosse a norma.
Aggiungi Tom's Hardware alle tue fonti preferite su Google