Anthropic Cyber Verification Program: arrivano tre livelli di accesso per la sicurezza informatica
Anthropic evolve il Cyber Verification Program con tre livelli di accesso fiduciario a Claude per i professionisti della difesa informatica. Ecco cosa cambia.

Anthropic sta cambiando il modo in cui decide chi può usare Claude per il lavoro di sicurezza informatica più delicato. Il Cyber Verification Program, il percorso con cui i professionisti della difesa ottengono l’accesso a funzioni normalmente bloccate dalle salvaguardie, si sta evolvendo in una struttura a tre livelli di accesso fiduciario, con permessi sempre più ampi man mano che crescono le verifiche. Se lavori in un team di sicurezza, in un’azienda di penetration testing o semplicemente segui l’AI per mestiere, è una novità che conviene capire bene.
Il punto non è soltanto tecnico. Riguarda l’equilibrio tra modelli sempre più capaci e il rischio che quelle stesse capacità finiscano nelle mani sbagliate.
Cos’è il Cyber Verification Program di Anthropic
Il programma è stato lanciato ad aprile 2026, dopo l’annuncio di Project Glasswing, l’iniziativa con cui Anthropic punta a mettere in sicurezza il software critico. L’idea di fondo è semplice: i modelli Claude hanno salvaguardie in tempo reale che bloccano le attività cyber considerate a doppio uso, cioè quelle che possono servire tanto a difendere quanto ad attaccare. Il programma permette a chi ha uno scopo difensivo legittimo di chiedere la rimozione di quei blocchi.
Secondo la documentazione di supporto di Anthropic, le attività vietate in modo assoluto restano tali per tutti, per esempio lo sviluppo di ransomware. Esiste poi una fascia di attività ad alto rischio e a doppio uso, bloccate per impostazione predefinita ma sbloccabili con l’approvazione. Puoi leggere i dettagli nella pagina ufficiale del Centro assistenza di Claude.
Cosa sblocca l’approvazione
L’approvazione non trasforma Claude in uno strumento senza limiti. Rimuove i blocchi su attività come la ricerca e la verifica di vulnerabilità, il penetration testing per i clienti enterprise, lo sviluppo e la verifica di exploit, il red teaming e la creazione di strumenti di sicurezza offensiva. Restano invece fuori portata, anche dopo l’ammissione, la scrittura di malware, lo sviluppo di ransomware, l’esfiltrazione massiva di dati e la generazione di infrastrutture di comando e controllo.
In altre parole, il programma apre le porte al lavoro difensivo, non a quello criminale.
Chi può candidarsi e come
Possono fare richiesta le organizzazioni con un caso d’uso difensivo legittimo, tramite i propri amministratori. La verifica dell’identità passa da un servizio esterno e, per le aziende, richiede ragione sociale, indirizzo e numero di registrazione. Anthropic dichiara di rispondere via email entro due giorni lavorativi. Il programma è gratuito, ma al momento sono escluse le organizzazioni con accordi di Zero Data Retention, perché l’approvazione presuppone una forma di conservazione dei dati per il monitoraggio degli abusi.
Il percorso cambia in base alla piattaforma. Sull’ecosistema diretto di Anthropic si usa un portale di verifica riservato agli amministratori. Su Microsoft Foundry serve un modulo dedicato con gli identificativi Azure, mentre su AWS e Google Cloud si collega prima l’account del cloud provider al portale. Su altre piattaforme di terze parti dipende da cosa decide ciascun fornitore.
Perché arrivano i tre livelli di accesso
Con il rilascio dei modelli più recenti, Anthropic ha annunciato tre livelli di accesso fiduciario sempre più permissivi, che includono anche l’accesso ai modelli della famiglia Mythos. Le ricostruzioni di stampa descrivono i livelli come un’estensione verso la risposta agli incidenti, il penetration testing autorizzato e l’accesso a sistemi critici per la sicurezza. Va detto con chiarezza che l’azienda non ha ancora pubblicato un dettaglio completo di cosa sblocchi ciascun livello e con quali criteri, quindi conviene trattare questi contorni come provvisori finché non arriverà una documentazione ufficiale.
La logica, però, è leggibile. Un unico interruttore tra bloccato e sbloccato non basta quando i modelli diventano abbastanza bravi da trovare falle reali nel software. Serve una scala graduata, in cui più potere corrisponde a più controlli.
Il legame con Mythos e con i modelli più recenti
La copertura attuale del programma include diversi modelli Opus e Sonnet delle generazioni precedenti, mentre le versioni 5.5 e i modelli Mythos sono indicati come in arrivo. Per i modelli più avanzati Anthropic chiede di accettare una conservazione dei dati di circa trenta giorni a fini di monitoraggio della sicurezza. È il prezzo dell’accesso: più capacità, più trasparenza verso chi eroga il servizio.
Per capire quanto contino queste capacità basta guardare cosa è già successo. Abbiamo raccontato il caso della falla di Rejetto HFS legata a Mythos e già sfruttata, e il report di Anthropic sugli exploit prodotti da modelli open weight. Due episodi che mostrano come la capacità offensiva dell’AI non sia più teorica.
Cosa cambia per aziende e professionisti della sicurezza
Per un team di difesa il vantaggio è concreto: meno interruzioni quando un’attività legittima, come verificare se una vulnerabilità è davvero sfruttabile, viene scambiata per un tentativo di abuso dalle salvaguardie automatiche. Alcune aziende del settore hanno già annunciato di essere state ammesse, tra cui Cycode, Mitiga e Picus Security, che usa questo accesso per i propri test di penetrazione autonomi. Anthropic non ha invece pubblicato un elenco ufficiale dei partecipanti.
Chi invece lavora da libero professionista o in una piccola realtà potrebbe incontrare qualche attrito. La richiesta di documenti aziendali, il vincolo sulla conservazione dei dati e l’esclusione dei clienti con Zero Data Retention possono lasciare fuori chi ha esigenze di riservatezza molto stringenti.
Ecco un riepilogo dei passaggi pratici, in breve:
- verifica con il tuo amministratore se la tua organizzazione rientra tra quelle ammissibili;
- controlla la piattaforma da cui usi Claude, perché la procedura di richiesta cambia;
- valuta l’impatto della conservazione dei dati sui tuoi obblighi di riservatezza.
Un tema che riguarda tutto il settore
Il tema non è solo di Anthropic. Il Digital Defense Report 2026 di Microsoft ha messo in evidenza come l’AI stia già cambiando sia gli attacchi sia le difese, e ogni grande laboratorio dovrà decidere dove tracciare la linea. L’approccio a livelli di Anthropic è un tentativo di dare una risposta strutturata, con identità verificata e monitoraggio al posto di un divieto generalizzato.
Si potrà discutere se sia la soluzione giusta, perché la verifica dell’identità non elimina il rischio di chi ha credenziali legittime e intenzioni diverse. Ma è difficile immaginare un’alternativa praticabile: vietare tutto penalizzerebbe i difensori, mentre aprire tutto regalerebbe un vantaggio agli attaccanti.
Cosa aspettarsi nei prossimi mesi
I prossimi passaggi da tenere d’occhio sono tre. Il primo è la pubblicazione dei criteri esatti per ciascun livello, che permetterà alle aziende di capire a quale puntare. Il secondo è l’estensione del programma ai modelli 5.5 e a quelli della famiglia Mythos, oggi non ancora coperti. Il terzo è la risposta degli altri laboratori, perché è plausibile che programmi analoghi diventino uno standard di settore. Per il modello più recente della famiglia Sonnet puoi leggere anche il nostro approfondimento su Claude Sonnet 5.5.
Nel frattempo, il segnale è chiaro: l’accesso alle capacità cyber più avanzate dell’AI sarà sempre più legato a identità, scopo dichiarato e tracciabilità.
Conclusioni
Il Cyber Verification Program mostra che la sicurezza dell’AI non si gioca solo sui filtri, ma anche su chi ottiene quali strumenti e con quali garanzie. Se operi nella difesa informatica, il consiglio è di muoverti ora: verifica i requisiti, parla con il tuo amministratore e prepara la documentazione, così sarai pronto quando i nuovi livelli diventeranno operativi. Se invece segui il tema da lettore curioso, tieni d’occhio questo sito: continueremo ad aggiornarti appena Anthropic pubblicherà i dettagli ufficiali dei tre livelli.