OpenAI clasifică Astra ca 'Critical' în ciber și restricționează lansarea

Astra de la OpenAI este primul model de limbaj care a depășit pragul 'Critical' al Preparedness Framework, descoperind zero-days singur. Din cauza riscului ridicat, lansarea va fi limitată de regulile de securitate ale companiei, conform AI Weekly și TechCrunch.

OpenAI clasifică Astra ca 'Critical' în ciber și restricționează lansarea

OpenAI a comunicat că noul său model, numit Astra, a atins nivelul maxim de alertă în Preparedness Framework, primul care ajunge la acest grad de risc. Decizia a fost anunțată prin noua ediție a buletinului AI Weekly și confirmată de TechCrunch, miercuri, 2 septembrie 2026. Potrivit celor două publicații, modelul a reușit să exploateze vulnerabilități de securitate în mod autonom, ajungând să descopere un zero-day fără asistență umană. Acest grad de proactivitate în atacuri cibernetice a determinat framework-ul să plaseze Astra la nivelul 'Critical'. Ca răspuns, compania a anunțat că modelul va fi lansat public cu restricții severe de utilizare, alese acum pentru a reduce riscurile imediate.

Preparedness Framework este setul de politici al OpenAI care definește nivelurile de amenințare asociate capacităților sistemelor sale, același standard care ghidează acum deciziile de lansare până aici. Gradul 'Critical' se află în vârful scalei și semnalează că un model poate cauza daune în zone sensibile în mod autonom sau cu supraveghere minimă. În cazul Astra, capacitatea centrală de a găsi defecte de securitate în software-uri terțe a fost plasată ca responsabilă directă pentru clasificarea maximă. Într-un comunicat citat de publicații, OpenAI afirmă că echipa de securitate a recomandat accelerarea investigației de utilizare înainte ca orice implementare largă să aibă loc. Pentru sector, este prima dată când un sistem LLM atinge acest prag în mod independent, ceea ce creează un precedent pentru celelalte companii de IA.

OpenAI classifica Astra como 'Critical' em ciber e restringe lançamento
OpenAI classifica Astra como 'Critical' em ciber e restringe lançamento

Un zero-day este o vulnerabilitate încă necunoscută de producător și, prin urmare, fără patch gata — exact tipul de breșă care provoacă atacuri grave pe servere, sisteme financiare și guverne. Prin faptul că le poate găsi singur, Astra demonstrează un salt tehnic care îngrijorează o parte din comunitatea de securitate. Pe de altă parte, aceeași capacitate ar putea favoriza companiile legitime în căutarea activă a vulnerabilităților înainte ca infractorii să le exploateze. OpenAI intră însă într-o zonă gri care trebuie să echilibreze capacitatea tehnică cu obligația de a nu expune arme cibernetice la scară. Aceste restricții trebuie să se concentreze pe acces limitat la institute acreditate, fără eliberare prin API deschis. Încă nu există detalii despre ferestre de testare publică sau despre regulile calificate pentru partenerii comerciali.

Această clasificare repoziționează și piața de securitate bazată pe IA, făcând OpenAI să iasă din rolul de furnizor de interfețe pentru a deveni un protagonist activ în tema ciber-offense. În schimb, apropierea altor laboratoare precum DeepMind și Anthropic trebuie să folosească cazul Astra ca bază pentru propriile norme, posibil accelerând revizuirile interne. Vulcanistii observă că identificarea izolată a zero-days este o sarcină care absoarbe de obicei timp de echipe profesionale și costă milioane pe an în cercetare și automatizare. Acum, acest pas poate reveni modelelor antrenate precum Astra, cu licențe controlate. Singura certitudine publicată până aici este că OpenAI preferă să delimiteze utilizarea timpurie, în loc să împiedice execuțiile. Totuși, natura extrem de sensibilă a subiectului dă măsura că vor apărea în continuare noi dispute pentru aplicațiile din acest domeniu.

Cazul Astra redeschide dezbaterea despre cum se validează modelele fără a închide ușa beneficiilor relevante, mai ales în domeniul apărării cibernetice. AI Weekly și analiza TechCrunch aduc independent dovezi similare, ceea ce încurajează necesitatea transparenței atunci când apar modificări de această gravitate. Specialiștii legați de OpenAI, sub condiție de anonimat, întăresc că decizia se ia pe premisa de a evita ca o IA avansată să atace sisteme globale fără control. Cerințe de verificare, jurnal intern de decizii și antrenamente ajustate pentru a nu... Din aceste motive, răspunsul companiei este văzut de regulatori și de industrie ca un pas anticipat de monitorizare etică intensă. Modelul a trecut testele de fidelitate, iar noi limitări pot fi dezvăluite pe măsură ce runda de acces științific avansează.

Comentarii 0

Loading comments...

Loading comments...