In Breve (TL;DR)
- Anthropic amplia il Cyber Verification Program e consente ai professionisti di usare Claude con meno restrizioni, modulando l’accesso in base ad attività e livello di autorizzazione.
- I test mostrano quanto incidano i filtri: con Defense Access Opus 5.5 blocca 46 scenari su 50, mentre con Red Team Access non ne blocca nessuno e completa 34 scenari.
L'utilizzo dell'intelligenza artificiale nel settore della sicurezza informatica richiede un equilibrio costante tra la prevenzione delle minacce e l'efficacia degli strumenti di difesa.
Proprio per questo, Anthropic ha annunciato un ampliamento del proprio Cyber Verification Program, permettendo a una platea più vasta di professionisti accreditati della cybersecurity di utilizzare i modelli della famiglia Claude con restrizioni operative ridotte.
La novità interessa modelli come Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 e i sistemi che verranno rilasciati in futuro, con l’azienda di San Francisco che, invece di applicare blocchi rigidi e indistinti a tutti gli utenti, permetterà l’accesso alle funzioni dell'assistente in modo dinamico e in base al livello di verifica dell'identità e al tipo di attività autorizzata.
Perché alcuni esperti possono usare Claude con meno blocchi
Quello della sicurezza informatica è un settore, ovviamente, molto delicato dove gli stessi principi di codice e analisi che permettono di identificare una falla di sistema, possono essere utilizzati anche per strutturare un attacco o sfruttare una vulnerabilità.
Per questo motivo, le versioni standard di Claude applicano filtri di sicurezza piuttosto stringenti, bloccando l'esecuzione di comandi o analisi ritenute potenzialmente rischiose.
Per consentire alle aziende e ai ricercatori di difendere le proprie infrastrutture, Anthropic ha articolato il programma in tre livelli di accesso specifici
Il Defense Access è pensato per la gestione operativa e difensiva, come l'analisi dei malware, la risposta agli incidenti e il tracciamento delle vulnerabilità note.
Il Red Team Access, invece, permette di estendere le autorizzazioni all'esecuzione di penetration test e ad attività offensive controllate, utili per simulare attacchi reali e testare la stabilità dei sistemi.
Infine lo Specialized Access è riservato a un numero ristretto e altamente selezionato di organizzazioni che gestiscono infrastrutture critiche, come ad esempio reti elettriche, settori delle telecomunicazioni, mercati finanziari e sistemi aeronautici.
Quanto cambiano davvero le capacità di Claude senza questi limiti
L'impatto della rimozione dei filtri di Claude può essere compreso chiaramente analizzando i dati prestazionali registrati sul benchmark di valutazione CyScenarioBench con il modello Claude Opus 5.5.
Nel livello Defense Access, ad esempio, i sistemi di sicurezza hanno bloccato ben 46 scenari cyber su 50 per prevenire potenziali abusi.
Per il livello Red Team Access, il modello non ha applicato alcun blocco, riuscendo a portare a termine con successo 34 scenari su 50. Si tratta dello stesso risultato registrato quando le barriere di sicurezza vengono disattivate del tutto e questo dimostra come il modello possieda già competenze avanzate, le cui potenzialità vengono sbloccate in base al profilo dell'utente.
Importante anche ricordare che l'approccio basato sulla verifica preventiva dei ricercatori ha già mostrato un impatto concreto nei mesi precedenti e, tra aprile e luglio di quest’anno, i programmi di sicurezza di Anthropic hanno permesso alle organizzazioni aderenti di identificare circa 129 mila vulnerabilità verificate, a cui si aggiungono oltre 5.500 falle scoperte direttamente dall'azienda attraverso scansioni automatiche su progetti open source.
Per saperne di più: Claude AI, guida completa al chatbot di Anthropic
Domande frequenti (FAQ)
-
Come Anthropic ha ampliato il Cyber Verification Program?Anthropic ha ampliato il Cyber Verification Program permettendo a una platea più vasta di professionisti accreditati della cybersecurity di utilizzare i modelli della famiglia Claude con restrizioni operative ridotte.
-
Quali sono le differenze di capacità di Claude senza limiti operativi?Senza limiti operativi, Claude ha dimostrato di poter completare con successo un numero significativo di scenari cyber, mostrando competenze avanzate che vengono sbloccate in base al profilo dell'utente.
-
Qual è l'obiettivo del Defense Access nel programma di Anthropic?Il Defense Access è pensato per la gestione operativa e difensiva, come l'analisi dei malware, la risposta agli incidenti e il tracciamento delle vulnerabilità note.



