OpenAI classifica Astra come 'Critical' in cyber e limita il lancio

L'Astra di OpenAI è il primo modello linguistico a superare la soglia 'Critical' del Preparedness Framework, trovando zero-day autonomamente. A causa dell'alto rischio, il lancio sarà limitato dalle regole di sicurezza della compagnia, secondo AI Weekly e TechCrunch.

OpenAI classifica Astra come 'Critical' in cyber e limita il lancio

L'OpenAI ha comunicato che il suo nuovo modello, chiamato Astra, ha raggiunto il livello massimo di allerta nel Preparedness Framework, il primo a raggiungere quel grado di rischio. La decisione è stata comunicata tramite la nuova edizione del bollettino AI Weekly e confermata dal TechCrunch, questo mercoledì 2 settembre 2026. Secondo le due pubblicazioni, il modello è riuscito a sfruttare vulnerabilità di sicurezza in modo autonomo, arrivando a scoprire un zero-day senza assistenza umana. Questo grado di proattività negli attacchi informatici ha fatto sì che il framework collocasse Astra al livello 'Critical'. In risposta, l'azienda ha annunciato che il modello sarà rilasciato al pubblico con serie restrizioni d'uso, ora scelte per ridurre i rischi immediati.

Il Preparedness Framework è l'insieme di politiche dell'OpenAI che definisce i livelli di minaccia associati alle capacità dei suoi sistemi, lo stesso standard che ora guida le decisioni di lancio fino ad oggi. Il grado 'Critical' è in cima alla scala e segnala che un modello può causare danni in aree sensibili in modo autonomo o con minima supervisione. Nel caso di Astra, la capacità centrale di trovare falle di sicurezza in software altrui è stata indicata come responsabile diretta della classificazione massima. In un comunicato citato dalle pubblicazioni, l'OpenAI afferma che il team di sicurezza aveva raccomandato di accelerare l'indagine sull'uso prima di qualsiasi implementazione ampia. Per il settore, è la prima volta che un sistema LLM raggiunge questa soglia in modo indipendente, creando un precedente per le altre aziende di IA.

OpenAI classifica Astra como 'Critical' em ciber e restringe lançamento
OpenAI classifica Astra como 'Critical' em ciber e restringe lançamento

Uno zero-day è una vulnerabilità ancora sconosciuta al produttore, e quindi senza patch pronta — esattamente il tipo di breccia che protagonizza attacchi seri su server, sistemi finanziari e governi. Riuscendo a trovarle da solo, Astra dimostra un balzo tecnico che preoccupa parte della comunità di sicurezza. D'altra parte, questa stessa capacità potrebbe favorire le aziende legittime nella ricerca attiva di vulnerabilità prima che i criminali le sfruttino. L'OpenAI, tuttavia, entra in una zona grigia che deve bilanciare la capacità tecnica con l'obbligo di non esporre armi cibernetiche su larga scala. Queste restrizioni dovrebbero concentrarsi su accesso limitato a istituti accreditati, senza rilascio tramite API aperta. Non ci sono ancora dettagli su finestre di test pubblici né sulle regole qualificate per i partner commerciali.

Questa classificazione riposiziona anche il mercato della sicurezza basata su IA, facendo uscire OpenAI da un fornitore di interfacce per diventare un protagonista attivo nel tema ciber-offense. Di conseguenza, l'approccio di altri laboratori come DeepMind e Anthropic dovrà usare il caso Astra come base per le proprie norme, accelerando probabilmente revisioni interne. Gli analisti notano che l'identificazione isolata di zero-day è un compito che normalmente richiede tempo a team professionali e costa milioni all'anno in ricerca e automazione. Ora, questo passo può essere affidato a modelli come Astra, con licenze controllate. L'unica certezza pubblicata finora è che l'OpenAI preferisce delimitare l'uso precoce, invece di ostacolare le esecuzioni. Tuttavia, la natura altamente sensibile del tema dà la misura che sorgeranno ancora nuove controversie per le applicazioni in quest'area.

Il caso Astra riapre il dibattito su come validare i modelli senza chiudere la porta ai benefici rilevanti, soprattutto nell'area della difesa cibernetica. Il resoconto di AI Weekly e l'analisi di TechCrunch portano indipendentemente evidenze simili, incoraggiando la necessità di trasparenza quando appaiono modifiche di questa gravità. Gli esperti legati alla stessa OpenAI, in condizione di anonimato, rafforzano che la decisione è presa sulla premessa di evitare che un'IA avanzata attacchi sistemi globali senza controllo. Requisiti di verifica, log interno delle decisioni e addestramenti mirati per non...? Per queste stesse ragioni, la risposta dell'azienda è vista dai regolatori e dall'industria come un passo anticipato di intenso monitoraggio etico. Il modello ha superato pesanti test di fedeltà, e nuove limitazioni potranno essere divulgate man mano che la tornata di accesso scientifico avanza.

OpenAI confina Astra: primo modello a ricevere lo status 'Critical' nel Preparedness Framework; ha identificato zero-day autonomamente.

Commenti 0

Loading comments...

Loading comments...