In questo articolo4
Ascolta
Sintesi vocale non disponibile in questo browser.
Voce del browser e privacy

Parte solo quando premi Ascolta. Alcune voci possono usare un servizio online. La nuova velocità può applicarsi dal passaggio successivo. Il testo non viene tradotto.

Un marchio sonoro, non una barriera tecnica

Il 5 ottobre Giorgia Meloni ha depositato all'Ufficio dell'Unione europea per la proprietà intellettuale (Euipo) una domanda di marchio sonoro con la propria voce. La registrazione dura circa quattro secondi e contiene la frase «Io sono Giorgia Meloni», pronunciata due volte. La notizia, anticipata da Repubblica, è stata confermata da fonti di Palazzo Chigi.

La domanda riguarda tre categorie di prodotti e servizi: contenuti multimediali scaricabili, attività culturali e organizzazione di manifestazioni politiche. Secondo la documentazione Euipo, un marchio sonoro è costituito esclusivamente da un suono o da una combinazione di suoni e può essere rappresentato tramite un file audio. La richiesta risulta ancora «oggetto di esame».

Il deposito non crea una barriera tecnica contro il voice cloning: non impedisce a un modello di AI di apprendere o replicare la voce della premier. La protezione opera solo nel perimetro giuridico definito dalla registrazione e dai prodotti e servizi interessati. La mossa aggiunge uno strumento di tutela legale, ma non risolve il problema tecnologico.

La voce come superficie di attacco

Per la cyber security il caso supera la proprietà intellettuale. Una voce pubblicamente disponibile in centinaia di ore di registrazioni può diventare materia prima per sistemi di sintesi vocale capaci di attribuire a una persona parole mai pronunciate. Quando quella persona è un capo di governo, un ministro o un CEO, il deepfake smette di essere solo un falso audiovisivo e diventa un vettore di attacco.

L'AI generativa separa la voce dalla persona che l'ha prodotta. Come il numero visualizzato sul telefono può essere falsificato e un indirizzo email può essere oggetto di spoofing, anche la voce deve essere considerata replicabile e non affidabile come fattore autonomo di autenticazione. Per un clone credibile bastano, indicativamente, una decina di secondi di audio, e di un leader politico esistono ore di registrazioni pubbliche.

Il vettore non è più solo la telefonata: le frodi passano per videoconferenze, messaggi vocali, segreterie e video sintetici. Il caso dell'azienda di Hong Kong, spogliata di oltre 25 milioni di dollari dopo una videoconferenza deepfake, mostra la scala possibile.

Dalla disinformazione alla CEO fraud

Il primo scenario associato al caso Meloni è la disinformazione: un audio credibile potrebbe attribuire a un capo di governo dichiarazioni mai pronunciate su una crisi internazionale o una decisione politica. La caratteristica più pericolosa è la velocità: un deepfake non deve resistere per giorni alle verifiche, può bastare che circoli per pochi minuti prima della smentita.

Più delicato è l'utilizzo mirato. Un falso messaggio vocale può essere costruito per persuadere una singola persona. L'audio costa poco, circola su canali chiusi dove la moderazione arriva tardi e non offre indizi visivi da smascherare. La mossa della premier si ricollega alla campagna elettorale che si avvicina e al timore di una possibile guerra ibrida condotta da Mosca.

Il voice cloning converge direttamente con la cyber security. Nel febbraio 2025 una voce clonata del ministro della Difesa Guido Crosetto contattò grandi imprenditori sostenendo che servivano fondi urgenti per liberare giornalisti italiani detenuti all'estero. Secondo le ricostruzioni, Massimo Moratti versò quasi un milione di euro, poi bloccato dalla Procura di Milano su un conto olandese. È lo schema di autorità e urgenza della CEO fraud, con la voce al posto dell'email: nessun exploit, solo ingegneria sociale potenziata da un modello generativo.

Cosa devono fare le organizzazioni

L'FBI ha già avvertito che criminali informatici utilizzano tecniche di clonazione audio e video per impersonare familiari, colleghi e business partner con l'obiettivo di ottenere informazioni sensibili o autorizzare transazioni fraudolente. Nel maggio 2025 l'FBI ha segnalato una campagna di impersonation con messaggi di testo e vocali generati dall'AI fingendosi alti funzionari statunitensi.

Le organizzazioni dovrebbero eliminare dai processi più sensibili qualunque presupposto secondo cui riconoscere la voce costituisca una verifica sufficiente dell'identità. Un ordine ricevuto attraverso telefono, nota vocale o videoconferenza deve essere sottoposto agli stessi controlli previsti per qualsiasi altra richiesta potenzialmente compromessa.

C'è poi il problema opposto, il cosiddetto «dividendo del bugiardo»: quando l'opinione pubblica sa che voce e immagini possono essere generate artificialmente, chi viene confrontato con una registrazione autentica può provare a screditarla sostenendo che è stata prodotta dall'AI. Il danno è bidirezionale: aumenta la capacità di fabbricare evidenze false, ma anche quella di negare quelle vere.

FONTI CONSULTATECybersecurity360
#deepfake#voice cloning#identità digitale#social engineering#euipo