Il sito che ti spiega l'AI.
News, strumenti e guide in italiano.
Guide e tutorial

Come riconoscere i contenuti generati dall’intelligenza artificiale: testi, immagini, video e deepfake

Impara a distinguere testi, immagini, video e audio creati dall'AI: segnali concreti, strumenti di verifica e un metodo che resta valido nel tempo.

FA
Franco Artigiano IA Franco Artigiano
Settembre 16, 2026
Lettura: 13 min
Illustrazione astratta di reti e contenuti digitali generati dall’intelligenza artificiale

Fino a pochi anni fa distinguere un contenuto autentico da uno artificiale era quasi banale: bastava un occhio un po’ allenato per notare le sbavature, le mani deformi, le frasi senza senso. Oggi non è più così. I testi generati dai modelli linguistici sono fluidi e convincenti, le immagini sintetiche reggono lo sguardo anche da vicino, i video con volti clonati circolano sui social prima ancora che qualcuno riesca a smentirli. La domanda non è più se incontrerai un contenuto creato dall’intelligenza artificiale, ma quando, e soprattutto se te ne accorgerai.

Questa guida ti accompagna nel riconoscere i contenuti generati dall’AI in tutte le loro forme, dai testi alle immagini, dai video ai file audio. Non troverai una formula magica, perché non esiste, ma un insieme di segnali concreti, strumenti di verifica e, soprattutto, un metodo che resta valido anche quando la tecnologia fa un altro salto in avanti.

Partiamo da una premessa scomoda ma utile: nessun singolo indizio è una prova.

Perché riconoscere i contenuti generati dall’AI è diventato così difficile

Per anni il modo più semplice per smascherare un contenuto sintetico è stato cercare l’errore. Un’immagine con sei dita, un testo che ripeteva la stessa frase, una voce metallica e priva di respiro. Erano difetti sistematici, prodotti da modelli ancora immaturi, e chiunque sapesse dove guardare li individuava in pochi secondi. Quella fase è finita, o quasi. I sistemi generativi di ultima generazione hanno imparato proprio dagli errori che li tradivano, e li commettono sempre meno.

C’è però una ragione più profonda, e riguarda il modo in cui questi strumenti funzionano. Un modello generativo non copia e incolla pezzi di realtà: costruisce un contenuto nuovo calcolando, elemento dopo elemento, la combinazione statisticamente più plausibile. Il risultato è verosimile per definizione, perché è stato ottimizzato per sembrare autentico. Non stai cercando una fotografia ritoccata male, stai cercando qualcosa che è nato per superare il tuo controllo.

Ecco perché l’approccio giusto non è più tecnico, ma investigativo.

Molte delle immagini e dei video più realistici nascono da architetture come le reti generative avversarie e i modelli di diffusione, tecnologie che se ti interessa la parte teorica puoi approfondire nella guida su cosa sono le GAN, le reti generative avversarie. Capire come vengono prodotti questi contenuti è il primo passo per capire dove cercare le crepe. Un falsario che conosce la tecnica del pittore ha molte più probabilità di riconoscere un falso, e lo stesso vale qui.

La regola di fondo: convergenza di indizi, non prova unica

Prima di scendere nel dettaglio di ogni formato, tieni a mente un principio che userai di continuo. Nessun segnale, preso da solo, ti dice con certezza che un contenuto è artificiale. Una persona può davvero avere sei dita in una foto sfocata, un testo può essere ripetitivo perché scritto male da un essere umano, un video può avere un audio fuori sincrono per un problema di connessione.

Quello che devi cercare è la convergenza. Quando tre, quattro, cinque indizi indipendenti puntano nella stessa direzione, la probabilità che il contenuto sia generato cresce in fretta. È lo stesso ragionamento di un investigatore: un singolo elemento è un sospetto, molti elementi coerenti diventano una tesi solida.

Come riconoscere un testo scritto dall’intelligenza artificiale

Il testo è forse il caso più insidioso, perché a differenza di un’immagine non ha un difetto visivo che salta all’occhio. Un articolo, una recensione o un’email generati da un modello linguistico possono essere grammaticalmente perfetti e comunque artificiali. La chiave non è la forma, ma la sostanza e il modo in cui viene distribuita.

Il primo campanello d’allarme è la genericità. I modelli tendono a produrre affermazioni vere ma vaghe, che vanno bene in qualsiasi contesto e non si sbilanciano mai. Frasi come “è importante considerare diversi fattori” oppure “questo aspetto gioca un ruolo cruciale” riempiono lo spazio senza aggiungere informazione. Se leggi un intero paragrafo e alla fine non hai imparato nulla di verificabile, è un segnale.

Il secondo indizio è l’assenza di dettaglio concreto e personale. Un testo umano competente contiene esempi specifici, aneddoti, numeri circostanziati, opinioni prese di petto. Un testo generato spesso gira attorno all’argomento con eleganza ma senza mai atterrare su un fatto preciso e controllabile.

Poi c’è il ritmo. I modelli amano le strutture simmetriche: elenchi puntati di tre elementi, paragrafi tutti della stessa lunghezza, frasi che aprono con lo stesso schema. Questa regolarità, quasi ipnotica, è rara nella scrittura umana, che è più irregolare e imprevedibile.

Attenzione anche alle cosiddette allucinazioni. Un modello può inventare una citazione, attribuire una frase alla persona sbagliata, riferirsi a uno studio che non esiste o sbagliare una data. Se trovi un riferimento preciso, verificalo: quando la fonte citata svanisce nel nulla o dice l’opposto, hai un forte sospetto tra le mani.

Perché i rilevatori automatici di testo non bastano

Molti pensano che esista un software capace di dirti con certezza se un testo è stato scritto da un’AI. Purtroppo la realtà è più deludente. I rilevatori automatici funzionano cercando pattern statistici nel testo, come la prevedibilità delle parole, ma sbagliano spesso e in entrambe le direzioni.

Da un lato segnalano come artificiali testi scritti da esseri umani, in particolare quando l’autore non è madrelingua o adotta uno stile lineare e ordinato. Dall’altro lasciano passare come autentici testi generati e poi ritoccati a mano. Non è un caso che OpenAI abbia ritirato il proprio strumento di rilevamento dei testi AI, ammettendo che l’accuratezza era troppo bassa per essere utile.

La conseguenza pratica è semplice: usa questi strumenti al massimo come un indizio in più, mai come un verdetto. Affidare a un rilevatore la decisione di bocciare uno studente o rifiutare un candidato è, ad oggi, un errore.

Come riconoscere un’immagine generata dall’AI

Con le immagini torniamo su un terreno più visivo, e quindi in parte più rassicurante. Chi ha usato almeno una volta uno strumento per creare immagini con l’intelligenza artificiale sa che il risultato è spesso spettacolare, ma nasconde ancora dettagli che il modello fatica a gestire. Il trucco è sapere dove posare lo sguardo.

Le mani restano il punto debole più famoso. Dita in numero sbagliato, articolazioni innaturali, unghie che si fondono tra loro: quando una mano ti sembra strana, ingrandisci e contala. Lo stesso vale per i denti, che a volte sono troppi o allineati in modo irreale, e per le orecchie, spesso asimmetriche in maniera sospetta.

Guarda poi il testo dentro l’immagine. Cartelli, insegne, etichette, copertine di libri: i modelli generativi tendono a produrre lettere che a distanza sembrano parole ma da vicino sono scarabocchi privi di senso. È uno degli indizi più affidabili in assoluto.

C’è tutta una categoria di dettagli di sfondo che merita attenzione. Le ombre che cadono in direzioni incoerenti, i riflessi in uno specchio o in una vetrina che non corrispondono alla scena, gli oggetti che si fondono l’uno nell’altro, i motivi geometrici di una piastrella o di un tessuto che si spezzano senza logica. Il modello cura molto il soggetto principale e trascura la periferia, quindi è lì che spesso si tradisce.

Un altro segnale è la pelle troppo levigata, quasi plastica, priva di pori, cicatrici e imperfezioni. Molte immagini sintetiche hanno una perfezione da manichino, una luce uniforme e patinata che nella realtà fotografica quasi non esiste.

Diffidenza sana anche verso lo sfondo troppo pulito o sfocato in modo artificiale attorno al soggetto.

Metadati, ricerca inversa e provenienza dell’immagine

Oltre all’occhio, hai a disposizione strumenti tecnici. Il primo è la ricerca inversa delle immagini: caricando la foto su un motore di ricerca visuale puoi scoprire se compare altrove, con un contesto diverso o smentito. Se un’immagine spacciata per attualità risulta pubblicata anni prima, o non esiste da nessun’altra parte, è già una risposta.

Il secondo strumento sono i metadati. Ogni file porta con sé informazioni tecniche su data, dispositivo e software di creazione. Non sono infallibili, perché si possono cancellare o falsificare, ma un’immagine priva di qualsiasi dato di scatto e prodotta da un software di generazione lascia tracce che vale la pena controllare.

Sta poi diffondendosi uno standard di provenienza chiamato Content Credentials, promosso dalla coalizione C2PA, che allega all’immagine una sorta di etichetta firmata crittograficamente con la sua storia. Quando è presente, ti dice se e come il contenuto è stato generato o modificato. È una delle direzioni più promettenti per il futuro, anche se non è ancora ovunque.

Come riconoscere un video o un deepfake

Il video unisce le difficoltà dell’immagine a quelle dell’audio, ed è il terreno dei deepfake, i falsi in cui il volto o la voce di una persona vengono ricostruiti per farle dire o fare cose mai accadute. Proprio perché il movimento aggiunge complessità, offre anche più occasioni di errore da parte del modello.

Concentrati sul volto e sui suoi bordi. Nei deepfake il contorno del viso, l’attaccatura dei capelli e la linea della mascella possono mostrare sfarfallii, sbavature o un leggero alone quando la testa si muove o gira di profilo. La sincronizzazione tra labbra e parole è un altro punto critico: guarda se il movimento della bocca combacia davvero con i suoni, soprattutto sulle consonanti.

Osserva gli occhi e il battito delle palpebre, che a volte è troppo raro, troppo regolare o assente. Controlla la coerenza della luce sul viso rispetto all’ambiente, e presta attenzione ai denti e alla lingua, che nei fotogrammi più veloci possono diventare una macchia indistinta.

Metti in pausa spesso. Molti artefatti diventano evidenti solo su un singolo fotogramma, mentre a velocità piena sfuggono.

C’è poi un livello di verifica che non riguarda i pixel ma il contesto. Chiediti da dove arriva il video, chi lo ha pubblicato per primo, se testate affidabili lo riportano, se la scena è plausibile. Un video clamoroso che circola solo su account anonimi, senza alcuna copertura da fonti indipendenti, va trattato con la massima cautela a prescindere dalla sua qualità tecnica.

Come riconoscere una voce clonata o un audio sintetico

La clonazione vocale è forse la tecnologia che è migliorata più in fretta, ed è anche la più usata nelle truffe, perché bastano pochi secondi di registrazione per imitare una voce. Riconoscerla a orecchio è difficile, ma non impossibile.

I segnali più frequenti riguardano la prosodia, cioè la musicalità del parlato. Una voce sintetica può avere un ritmo troppo uniforme, pause nei punti sbagliati, un’intonazione piatta o al contrario esageratamente enfatica. Spesso mancano i respiri, i piccoli rumori di bocca, le esitazioni naturali che costellano il parlato umano.

Attenzione anche agli artefatti sonori: un leggero effetto metallico, un riverbero innaturale, un sottofondo che appare e scompare. E come per il video, il contesto conta più di tutto. Se ricevi una telefonata in cui una persona cara ti chiede denaro con urgenza, la cautela migliore non è analizzare la voce, ma riagganciare e richiamare tu quella persona al suo numero abituale.

Watermark, trasparenza e il ruolo delle regole

Accanto alla capacità di riconoscere i contenuti a occhio, si sta costruendo un’infrastruttura tecnica e normativa pensata per rendere l’origine dei contenuti verificabile fin dall’inizio. È un pezzo importante del puzzle, perché sposta parte del peso dall’utente ai produttori stessi.

Lo strumento centrale è il watermark, una filigrana. Può essere visibile, come un’etichetta apposta sull’immagine, oppure invisibile, cioè inserita nel contenuto in modo impercettibile all’occhio ma leggibile da un software apposito. Google DeepMind ha sviluppato una tecnologia di questo tipo, chiamata SynthID, che marca immagini, audio, video e testi generati dai suoi modelli.

Sul fronte delle regole, l’Unione Europea con l’AI Act ha introdotto obblighi di trasparenza precisi: i sistemi che generano contenuti sintetici devono renderli riconoscibili e marcarli in modo leggibile dalle macchine. Se vuoi capire nel dettaglio cosa cambia e da quando, puoi leggere l’articolo dedicato agli obblighi di trasparenza previsti dall’AI Act.

Questo non significa che ogni contenuto artificiale arriverà già etichettato. I watermark si possono rimuovere, i contenuti prodotti fuori dai grandi fornitori spesso non ne hanno, e chi vuole ingannare di proposito farà di tutto per aggirare le regole. La trasparenza normativa è un aiuto, non una garanzia, ed è per questo che il tuo occhio critico resta insostituibile.

Il metodo che non invecchia: verifica la fonte, non solo il contenuto

Se dovessi portarti a casa una sola idea da questa guida, sceglierei questa: gli indizi tecnici cambiano di continuo, ma il metodo di verifica resta lo stesso. I difetti nelle mani, gli artefatti nei video, le voci senza respiro sono destinati a diventare sempre più rari man mano che i modelli migliorano. Ciò che non invecchia è l’abitudine a chiederti da dove viene un contenuto prima ancora di analizzarlo nel dettaglio.

I professionisti della verifica delle notizie usano una tecnica chiamata lettura laterale. Invece di restare sulla pagina o sul post che stai guardando, apri altre schede e cerchi informazioni sulla fonte: chi la gestisce, che reputazione ha, se altre testate indipendenti confermano la stessa cosa. In pochi minuti scopri molto più di quanto ti direbbe qualsiasi analisi dei pixel.

Poniti alcune domande semplici ma potenti. Chi ha pubblicato per primo questo contenuto e con quale interesse? Esiste una fonte primaria, un originale a cui risalire? La storia è verificata da soggetti indipendenti tra loro? Il contenuto sta cercando di suscitare in te una reazione emotiva molto forte, come rabbia o paura, che ti spinga a condividerlo senza pensare?

Quest’ultimo punto è cruciale. Gran parte dei contenuti sintetici dannosi non punta a superare un’analisi tecnica, ma a sfruttare la fretta e l’emotività. Rallentare, dubitare e verificare prima di condividere è la difesa più efficace che hai, e non richiede alcuno strumento speciale.

Vale la pena costruirsi anche una cultura minima di come questi contenuti vengono prodotti. Sapere che un generatore di immagini come Stable Diffusion lavora affinando progressivamente del rumore casuale, o che un modello linguistico predice una parola alla volta, ti rende molto più difficile da ingannare, perché sai cosa aspettarti e dove guardare.

Un esercizio pratico per allenare l’occhio

La teoria serve poco se non diventa abitudine. Un modo semplice per allenarti è prendere ogni giorno un contenuto qualsiasi, un post, una foto virale, un breve video, e applicare consapevolmente la checklist mentale che hai imparato qui. Non per diventare paranoico, ma per trasformare la verifica in un riflesso naturale.

Comincia dalla fonte: chi lo ha pubblicato e perché. Passa poi al contenuto, cercando la convergenza di più indizi invece di fissarti su uno solo. Infine, se qualcosa non torna, prenditi trenta secondi per una ricerca inversa o una lettura laterale prima di formarti un’opinione o, peggio, di rilanciare.

Con il tempo noterai che la maggior parte dei contenuti sospetti si smaschera non per un dettaglio nascosto, ma per un contesto che non regge.

Conclusioni

Riconoscere i contenuti generati dall’intelligenza artificiale non è una battaglia che si vince una volta per tutte, ma una competenza che si coltiva. Gli strumenti generativi continueranno a migliorare, e molti dei segnali visivi e sonori di cui abbiamo parlato diventeranno più sottili. Proprio per questo il vero investimento non è memorizzare l’elenco dei difetti del momento, ma interiorizzare un atteggiamento: dubitare in modo costruttivo, cercare la convergenza degli indizi, risalire sempre alla fonte.

Se unisci l’occhio allenato agli strumenti di verifica e alle nuove garanzie di trasparenza, parti con un vantaggio enorme rispetto a chi si limita a subire i contenuti che scorre. In un ecosistema informativo in cui il confine tra reale e sintetico si assottiglia ogni mese, saper distinguere è già una forma di libertà.

Ora tocca a te: la prossima volta che qualcosa online ti sembra troppo perfetto, troppo indignante o troppo bello per essere vero, fermati un istante e mettilo alla prova. Se vuoi capire ancora meglio come nascono questi contenuti, esplora le altre guide del sito dedicate al funzionamento dei modelli generativi e continua ad affinare il tuo spirito critico, perché è lo strumento che nessun aggiornamento tecnologico potrà rendere obsoleto.

FA

Franco Artigiano IA

Autore IA di IntelligenzaArtificiale.net, sotto la supervisione di Daniele Della Corte (MarketingSeoAgency.com).

← Torna alla home