
Anthropic amplia l'accesso AI informatico verificato dopo 129.000 vulnerabilità trovate
Anthropic afferma che Project Glasswing ha trovato 129.000 vulnerabilità verificate e consentirà a più team verificati di usare Claude con meno blocchi di sicurezza.
Anthropic ha annunciato martedì di espandere un programma che consente a professionisti della sicurezza informatica verificati di testare i suoi modelli di intelligenza artificiale avanzati con salvaguardie e classificatori di blocco ridotti. L'azienda ha dichiarato che la sua iniziativa Project Glasswing ha scoperto almeno 129.000 vulnerabilità software verificate tra aprile e luglio 2026, e altre 5.500 vulnerabilità verificate tra aprile e ottobre 2026 tramite scansione open-source.
Di queste vulnerabilità verificate, più di 33.000 sono state classificate come critiche o di alta gravità, secondo Anthropic. L'azienda ha avvertito che questo numero è probabilmente sottostimato perché deriva da dati di sondaggi che coprono solo un sottoinsieme dei partner di Glasswing. Di conseguenza, Anthropic prevede che l'impatto reale sia almeno cinque volte superiore.
L'offerta ampliata si chiama Cyber Verification Program (CVP). Ha tre livelli di accesso e ogni livello include l'accesso ai modelli di Anthropic, in particolare Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 e nuovi modelli non appena disponibili. Il primo livello, Defense Access, è destinato al lavoro difensivo come risposta agli incidenti, reverse engineering di malware e analisi e validazione delle vulnerabilità. Il secondo, Red Team Access, aggiunge test di penetrazione autorizzati e red teaming, in cui i tester simulano attacchi reali con permesso, oltre ai casi d'uso difensivi. Il terzo, Specialized Access, ha il minor numero di salvaguardie ed è riservato a un gruppo limitato di organizzazioni verificate autorizzate a testare i sistemi di sicurezza.
Anthropic ha anche condiviso i risultati delle valutazioni da un benchmark chiamato CyScenarioBench. Su Claude Opus 5.5 nel livello Defense Access, le salvaguardie integrate hanno bloccato 46 dei 50 compiti. Nel livello Red Team Access sullo stesso modello, nessun compito è stato bloccato e il sistema ne ha completati 34 su 50, lo stesso tasso di completamento di quando non vengono applicate salvaguardie. Senza alcun accesso CVP, ogni compito veniva bloccato al primo prompt. Anthropic ha affermato che questi risultati danno all'azienda la fiducia che le capacità informatiche avanzate possano essere rese disponibili in modo sicuro a un insieme più ampio di difensori, ampliando il lavoro difensivo iniziato con Project Glasswing. L'azienda ha dichiarato di offrire gli strumenti a causa della loro natura a duplice uso, ovvero le stesse capacità che potrebbero essere usate in modo improprio da un attaccante possono anche aiutare i difensori a proteggere i sistemi.
Un'analisi del ricercatore di VulnCheck Patrick Garrity, pubblicata alla fine del mese scorso, ha esaminato 300 vulnerabilità scoperte da Anthropic o Project Glasswing. Solo due di esse, ovvero lo 0,67 percento, sono state sfruttate in natura. La distribuzione della gravità tra quelle 300 era 39 critiche, 141 alte, 81 medie e 18 basse. Le due vulnerabilità sfruttate attivamente sono CVE-2026-26980, una vulnerabilità di SQL injection in Ghost CMS, e CVE-2026-61500, una vulnerabilità di session forgery in Rejetto HTTP File Server. Una vulnerabilità di SQL injection consente a un attaccante di inserire comandi di database non autorizzati attraverso un modulo o un campo di input, mentre una vulnerabilità di session forgery consente a un attaccante di creare una sessione di accesso falsa per impersonare un utente.
Il quadro più ampio è che l'IA sta abbassando la barriera per trovare vulnerabilità, ma non ogni vulnerabilità scoperta da un'IA è necessariamente sfruttabile da attaccanti reali o in grado di causare danni significativi. Lavori separati di 1Password e Veracode hanno dimostrato che le patch di vulnerabilità generate dall'IA possono a loro volta introdurre nuovi rischi per la sicurezza. Veracode ha riferito che circa il 44 percento delle attività di generazione di codice IA ha introdotto una vulnerabilità di sicurezza rischiosa nei test. Il tasso medio di superamento della sicurezza tra i modelli era del 56 percento, appena cambiato dal 55 percento del primo rapporto. In altre parole, le prestazioni di sicurezza sono rimaste stabili mentre la quantità di codice generato dall'IA che entra nelle pipeline è aumentata vertiginosamente. Per i proprietari di siti web e i team IT, la piccola quota di vulnerabilità sfruttate non significa che il resto sia innocuo, ma suggerisce che l'applicazione di patch dovrebbe basarsi sulla sfruttabilità effettiva quando possibile, piuttosto che trattare ogni rilevamento automatico come un'emergenza.
Per i proprietari di siti web e i team IT, il punto chiave è che la scoperta di vulnerabilità assistita dall'IA è utile, ma le correzioni automatiche richiedono ancora una revisione umana prima di arrivare in produzione. L'hosting WordPress gestito come AEU Hosting può gestire l'applicazione di patch di routine e il monitoraggio della sicurezza, offrendo ai team una base protetta mentre valutano eventuali modifiche assistite dall'IA.
Come Proteggerti
- Mantieni aggiornati il software del tuo sito web, i plugin e i temi, ma prova gli aggiornamenti su una copia di staging separata prima di applicarli al sito live.
- Usa una password forte unica per ogni account amministratore e attiva l'autenticazione a due fattori in modo che le sessioni rubate o falsificate siano più difficili da usare.
- Se utilizzi Ghost CMS o Rejetto HTTP File Server, controlla le patch per CVE-2026-26980 e CVE-2026-61500 e installale il prima possibile.
- Non distribuire ciecamente codice o patch generati dall'IA; chiedi a uno sviluppatore di esaminarli per nuovi errori di sicurezza prima di metterli su un sito web reale.
- Esegui regolarmente il backup del tuo sito web e del database in un luogo sicuro in modo da poter ripristinare rapidamente se una vulnerabilità viene sfruttata o un aggiornamento difettoso rompe qualcosa.
Vulnerabilità e Soluzioni
- CVE-2026-26980 An SQL injection flaw in Ghost CMS; the source says it was one of two vulnerabilities exploited in the wild. Vedi la soluzione e i dettagli →
- CVE-2026-61500 A session forgery flaw in Rejetto HTTP File Server; the source says it was one of two vulnerabilities exploited in the wild. Vedi la soluzione e i dettagli →
I Termini Spiegati
- Artificial intelligence (AI) Sistemi informatici in grado di svolgere compiti che normalmente richiedono l'intelligenza umana, come trovare schemi nel codice.
- Vulnerability Una debolezza nel software che un aggressore potrebbe sfruttare per entrare o causare danni.
- Red teaming Attacchi simulati autorizzati che mettono alla prova quanto bene un sistema si difende.
- Penetration testing Un test di sicurezza in cui un tester approvato cerca di entrare in un sistema per trovare punti deboli.
- SQL injection Un attacco che invia comandi di database dannosi attraverso un modulo o un campo di input.
- Session forgery Un attacco che crea una sessione di accesso falsa per impersonare un utente.
- CVE Common Vulnerabilities and Exposures, un elenco pubblico che assegna nomi standard alle vulnerabilità di sicurezza note.
- Patch Un aggiornamento software che corregge una vulnerabilità.