Edizione del pomeriggio · 8 ottobre 2026

Anthropic apre Claude agli esperti di sicurezza con filtri ridotti

Anthropic ha allargato l'accesso alle capacità di cybersicurezza dei suoi modelli Claude: i professionisti verificati potranno usarli con filtri di sicurezza ridotti per cercare vulnerabilità, analizzare malware e condurre simulazioni di attacco autorizzate.

Anthropic
Immagine: HaeB / Wikimedia Commons, CC BY-SA 4.0

Tre livelli di accesso

Il 6 ottobre 2026 l'azienda statunitense ha annunciato una nuova versione del Cyber Verification Program (Cvp), che assorbe il precedente Project Glasswing. Chi viene ammesso può utilizzare i modelli Claude Opus 5.5, Sonnet 5.5 e Mythos 5.1 con limitazioni minori rispetto alle versioni pubbliche, che normalmente bloccano gran parte di queste attività perché le stesse capacità possono servire anche a chi attacca.

L'accesso è diviso in tre livelli. Defense Access riguarda le attività difensive, come la risposta agli incidenti, il reverse engineering del malware (cioè lo smontaggio di un software malevolo per capire come funziona) e la validazione delle vulnerabilità: possono candidarsi aziende, università, enti pubblici, operatori di infrastrutture critiche e ricercatori indipendenti con una storia di segnalazioni documentata. Red Team Access consente il penetration testing, ovvero attacchi simulati autorizzati per testare le difese, ed è riservato alle organizzazioni. Specialized Access, il livello più permissivo, è destinato a pochi soggetti che verificano sistemi critici come reti elettriche, telecomunicazioni, sistemi aeronautici o infrastrutture bancarie: per queste richieste Anthropic dichiara di svolgere verifiche insieme al governo statunitense.

I numeri dei test

Il nodo è che le stesse capacità servono a difendere e ad attaccare. Anthropic ha misurato l'effetto delle nuove barriere con CyScenarioBench, un benchmark sviluppato dalla società Irregular per valutare operazioni cyber a più passaggi. Con Claude Opus 5.5 senza accesso al programma, tutti i test sono stati bloccati già alla prima richiesta; con Defense Access i controlli sono intervenuti in 46 prove su 50; con Red Team Access non ci sono stati blocchi e il modello ha completato 34 prove su 50. Irregular precisa però che il benchmark misura le capacità in condizioni costruite per farle emergere, non il tasso di successo in un attacco reale.

Sul fronte dei risultati difensivi, Anthropic riferisce che i partner del precedente Project Glasswing hanno individuato almeno 129.000 vulnerabilità confermate tra aprile e luglio 2026, oltre 33.000 delle quali classificate come gravi o critiche. I dati provengono da sondaggi su una parte dei partner.

Perché la notizia conta

La scelta sostituisce il confine rigido fra contenuti permessi e vietati con un sistema basato su identità, autorizzazioni e livello di rischio: un modello che altri produttori di modelli avanzati potrebbero seguire. Per le aziende e le pubbliche amministrazioni italiane che gestiscono infrastrutture digitali, significa che strumenti molto potenti diventano disponibili ai team di sicurezza, ma anche che la verifica dell'identità di chi li usa diventa la vera barriera contro gli abusi.

Copertina del Reel
Edizione del pomeriggio · 8 ottobre 2026
Questa notizia è nel notiziario in video
▶ Guarda il ReelApri su Instagram

Nella stessa edizione

pomeriggio · 8 ottobre 2026

HSBC verso il taglio di circa metà dei posti di lavoro per l'AI

Secondo indiscrezioni di Bloomberg, HSBC taglierebbe circa la metà dei posti per fare spazio all'intelligenza artificiale, nonostante conti in crescita.

pomeriggio · 8 ottobre 2026

ChatGPT diventa visuale: con GPT-6 arriva la Intelligent UI

OpenAI lancia GPT-6 e la Intelligent UI: le risposte di ChatGPT includono grafici, pulsanti e piccoli strumenti interattivi. Rilascio globale, anche gratis.