Sabato 25 Luglio 2026
Il sito che ti spiega l'AI.
News, strumenti e guide in italiano.
Machine learning

Cosa sono le GAN, le reti generative avversarie: come funzionano e a cosa servono

Le GAN, o reti generative avversarie, sono l'architettura in cui due reti neurali si sfidano per generare dati realistici. Ecco come funzionano.

FA
Franco Artigiano IA Franco Artigiano
Luglio 25, 2026
Lettura: 9 min
IA Contenuto firmato da un autore IA di IntelligenzaArtificiale.net e revisionato prima della pubblicazione. Le fonti sono nel pezzo, quando disponibili. Segnala un errore
Illustrazione astratta di una rete di punti e linee blu su sfondo nero che richiama le reti neurali delle GAN

Ti sarà capitato di vedere il volto di una persona perfettamente realistica e poi scoprire che quella persona non esiste, non è mai nata e non comparirà mai in nessuna fotografia reale. Dietro molte di queste immagini, per anni, c’è stata una singola idea tecnica tanto elegante quanto sorprendente: mettere due reti neurali una contro l’altra e lasciare che imparino sfidandosi.

Quell’idea ha un nome preciso, GAN, acronimo di generative adversarial network, che in italiano traduciamo con reti generative avversarie. Sono state uno dei motori della rivoluzione dell’AI generativa e ancora oggi restano un tassello fondamentale per capire come una macchina possa creare qualcosa che prima non esisteva.

In questa guida vediamo con calma cosa sono le GAN, come funziona il loro particolare metodo di addestramento, a cosa servono nella pratica e quali limiti e rischi portano con sé. Non servono formule matematiche per afferrare l’intuizione di fondo, che assomiglia più a una partita a scacchi che a un’equazione.

Cosa sono le GAN, le reti generative avversarie

Le reti generative avversarie sono un’architettura di intelligenza artificiale composta da due reti neurali che vengono addestrate insieme, con obiettivi opposti. Una genera dati nuovi, l’altra cerca di smascherarli. Dalla loro competizione nasce la capacità di produrre immagini, suoni o testi che assomigliano in modo convincente a quelli reali.

Il concetto è stato introdotto nel 2014 dal ricercatore Ian Goodfellow insieme ad alcuni colleghi, e ha segnato un punto di svolta nel modo di pensare i modelli generativi. Prima di allora far generare a una macchina immagini realistiche era un problema aperto e spesso frustrante. Le GAN hanno offerto una strada nuova, basata non sull’imitazione diretta di un esempio ma sul confronto continuo tra due sistemi.

Per capire come sia possibile, conviene partire da un’immagine mentale semplice.

L’intuizione del gioco tra falsario ed esperto

Immagina un falsario che vuole produrre banconote false e un esperto della banca centrale che deve riconoscerle. All’inizio il falsario è maldestro e le sue banconote vengono scoperte con facilità. Ogni volta che viene smascherato, però, capisce qualcosa in più su ciò che lo ha tradito e migliora la falsificazione successiva.

Allo stesso tempo anche l’esperto affina lo sguardo, perché si trova davanti falsi sempre più curati e deve diventare più bravo a distinguere il vero dal falso. Questa rincorsa reciproca spinge entrambi a migliorare senza sosta.

Nelle GAN accade esattamente questo. Il falsario è il generatore, l’esperto è il discriminatore, e la posta in gioco è la capacità di produrre dati indistinguibili da quelli autentici.

È un gioco, e come in ogni gioco competitivo il livello si alza da entrambe le parti.

Generatore e discriminatore, i due protagonisti

Il generatore è la rete che crea. Riceve in ingresso un insieme di numeri casuali, una sorta di rumore privo di significato, e lo trasforma in un dato strutturato, per esempio l’immagine di un volto. Questo punto di partenza fatto di numeri casuali viene chiamato spazio latente, ed è la materia grezza da cui il generatore plasma i suoi risultati.

Il discriminatore è invece un classificatore. Riceve dati che possono essere reali, presi da un archivio di esempi autentici, oppure finti, prodotti dal generatore, e deve rispondere a una domanda binaria: questo dato è vero o è generato? Il suo compito somiglia a quello di tanti altri sistemi di classificazione basati su reti neurali artificiali, con la differenza che qui il suo giudizio serve ad allenare un avversario.

Le due reti sono quindi legate a doppio filo. Nessuna delle due potrebbe migliorare senza l’altra.

Come funziona l’addestramento di una GAN

L’aspetto più affascinante delle GAN è il modo in cui vengono addestrate. Invece di avere un unico obiettivo da minimizzare, il sistema mette in equilibrio due forze contrapposte, in quello che i ricercatori descrivono come un gioco a somma zero. Ciò che è un guadagno per una rete è una perdita per l’altra, e questa tensione è proprio il motore dell’apprendimento.

Il gioco a somma zero tra le due reti

Durante l’addestramento le due reti si alternano. Prima si mostra al discriminatore un misto di dati reali e dati falsi, e lo si corregge quando sbaglia, in modo che diventi più preciso nel riconoscere le imitazioni. Poi tocca al generatore, che viene aggiornato in base agli errori commessi, cioè in base a quanto è riuscito o meno a ingannare il discriminatore.

Questo scambio si ripete migliaia di volte, attraverso il meccanismo della retropropagazione dell’errore, lo stesso che sta alla base dell’addestramento delle reti profonde. Il segnale che guida il generatore non è un esempio da copiare, ma il feedback dell’avversario: sei stato scoperto, riprova meglio.

Quando il sistema funziona, si arriva a un punto di equilibrio in cui il generatore produce dati così realistici che il discriminatore non riesce più a fare meglio che tirare a indovinare. In teoria, a quel punto, il falso diventa indistinguibile dal vero. Le GAN sono a tutti gli effetti un’architettura di deep learning, e ne condividono sia la potenza sia la notevole complessità di addestramento.

Raggiungere quell’equilibrio, però, è tutt’altro che scontato.

Quando l’addestramento riesce e quando fallisce

Addestrare una GAN è notoriamente delicato. Se una delle due reti diventa troppo brava troppo in fretta, l’equilibrio si rompe. Un discriminatore troppo severo non lascia al generatore indicazioni utili, e la generazione smette di migliorare. Un discriminatore troppo indulgente, al contrario, si accontenta di risultati mediocri e non spinge nessuno a fare meglio.

Esiste poi un problema tipico chiamato mode collapse, il collasso delle modalità. Si verifica quando il generatore scopre un piccolo insieme di risultati capaci di ingannare il discriminatore e comincia a produrre sempre quelli, perdendo varietà. È come un falsario che sa imitare bene una sola banconota e continua a stampare soltanto quella.

A tutto questo si aggiungono l’instabilità dell’addestramento, la difficoltà di convergenza e un forte bisogno di potenza di calcolo. Sono ostacoli concreti, che per anni hanno reso le GAN tanto potenti quanto capricciose da domare.

I principali tipi di GAN

Con il tempo le GAN si sono moltiplicate in numerose varianti, ciascuna pensata per un compito specifico. Non serve conoscerle tutte, ma alcuni nomi ti aiutano a orientarti se ti capita di incontrarli.

Le DCGAN, cioè le GAN convoluzionali profonde, hanno portato le reti convoluzionali dentro le GAN e sono state decisive per generare immagini di buona qualità. Le GAN condizionali, o conditional GAN, permettono di guidare la generazione fornendo un’informazione aggiuntiva, per esempio la categoria dell’oggetto da creare, così da non lasciare tutto al caso.

Ci sono poi le CycleGAN, specializzate nel trasformare immagini da un dominio a un altro senza bisogno di coppie di esempi perfettamente corrispondenti, e le StyleGAN, diventate celebri per la qualità sorprendente dei volti sintetici e per il controllo fine sullo stile dell’immagine generata.

Ogni variante nasce per superare un limite della precedente, segno di quanto questo campo sia stato vivace.

A cosa servono le GAN, le applicazioni principali

Al di là della teoria, le reti generative avversarie hanno trovato moltissime applicazioni pratiche, soprattutto nel campo delle immagini. La più nota è la generazione di volti umani realistici di persone inesistenti, resa celebre proprio da modelli della famiglia StyleGAN.

Le possibilità, però, vanno ben oltre i volti. Tra gli usi più diffusi si possono ricordare:

  • la super-risoluzione, cioè aumentare nitidezza e dettaglio di immagini a bassa qualità;
  • la generazione di dati sintetici per addestrare altri modelli quando i dati reali scarseggiano;
  • il trasferimento di stile e la trasformazione di un’immagine in un’altra, per esempio da schizzo a fotografia o da giorno a notte;
  • la creazione di texture, ambienti e personaggi nei videogiochi e nella grafica;
  • le applicazioni artistiche, di moda e di design, dove servono a esplorare rapidamente molte varianti visive.

In gran parte di questi casi il valore delle GAN sta nella capacità di produrre risultati nuovi e plausibili, non semplici copie di ciò che già esiste.

C’è però un rovescio della medaglia difficile da ignorare.

La stessa tecnologia che genera volti sintetici può essere usata per creare deepfake, cioè video e immagini manipolati in cui una persona sembra dire o fare cose mai avvenute. Le GAN hanno avuto un ruolo importante nella prima ondata di questi contenuti, e sollevano questioni serie che riprendiamo tra poco.

GAN e modelli di diffusione, quali differenze

Se oggi pensi alla generazione di immagini a partire dal testo, probabilmente ti vengono in mente strumenti basati su un’altra tecnologia, i modelli di diffusione. Non è un caso. Negli ultimi anni la diffusione ha in gran parte superato le GAN come approccio dominante per la sintesi di immagini di alta qualità.

Le ragioni sono diverse. I modelli di diffusione tendono a essere più stabili da addestrare, generano immagini più varie e gestiscono meglio il legame tra descrizione testuale e immagine prodotta. Le GAN, dal canto loro, conservano un vantaggio importante: sono spesso molto più rapide nel generare un risultato, perché lo producono in un solo passaggio invece che attraverso decine di passi successivi.

Per questo restano preziose in tutti i contesti dove conta la velocità, come alcune applicazioni in tempo reale, oppure dove servono modelli più leggeri.

Le due tecnologie, insomma, non si escludono. Convivono, ciascuna con i propri punti di forza.

Limiti, rischi e questioni etiche

Abbiamo già visto i limiti tecnici, dal mode collapse all’instabilità dell’addestramento. Ma le GAN pongono anche interrogativi etici che vanno molto oltre l’ingegneria.

Il più evidente riguarda la disinformazione. La capacità di generare volti, voci e video realistici di persone che non hanno mai detto o fatto ciò che vediamo può essere sfruttata per truffe, manipolazione dell’opinione pubblica e violazione dell’identità delle persone. Non è un rischio astratto, ma qualcosa che tocca la fiducia stessa che riponiamo nelle immagini e nei video.

Ci sono poi temi legati al consenso e ai diritti d’autore, quando i dati usati per l’addestramento contengono opere o volti reali senza autorizzazione. E c’è la questione dei pregiudizi, perché un modello generativo tende a riflettere gli squilibri presenti nei dati con cui è stato addestrato.

Capire come funziona la tecnologia è il primo passo per riconoscerne gli usi legittimi e distinguerli da quelli manipolatori.

Perché vale la pena capire le GAN

Le reti generative avversarie sono molto più di una curiosità tecnica. Hanno insegnato al mondo dell’AI che si può creare mettendo in competizione due sistemi, e hanno aperto la strada a gran parte di ciò che oggi chiamiamo intelligenza artificiale generativa.

Anche se i modelli di diffusione e i transformer hanno preso il centro della scena, l’idea alla base delle GAN continua a vivere in molti strumenti e in molte linee di ricerca. Conoscerla ti offre una chiave di lettura preziosa per capire davvero come le macchine imparano a generare, invece di limitarti a usarle come scatole nere.

Se questa guida ti ha incuriosito, continua a esplorare i concetti fondamentali dell’intelligenza artificiale qui sul blog. Ogni tassello che aggiungi rende più chiaro il quadro d’insieme e ti aiuta a distinguere le tecnologie reali dalle semplici promesse di marketing.

FA

Franco Artigiano IA

Autore IA di IntelligenzaArtificiale.net, sotto la supervisione di Daniele Della Corte (MarketingSeoAgency.com).

Nota di trasparenza — questo articolo è firmato da un autore IA e pubblicato a cura di Daniele Della Corte (MarketingSeoAgency.com), che ne supervisiona qualità e fonti.
← Torna alla home