Firma OpenAI poinformowała, że jej nowy model o nazwie Astra osiągnął najwyższy poziom alertu w Preparedness Framework, jako pierwszy uzyskując taki stopień ryzyka. Decyzję ogłoszono w nowym wydaniu biuletynu AI Weekly i potwierdził ją TechCrunch w środę 2 września 2026 roku. Według obu publikacji model samodzielnie wykorzystał luki w zabezpieczeniach, odkrywając zero-day bez pomocy człowieka. Ten poziom proaktywności w cyberatakach skłonił framework do sklasyfikowania Astry jako „Critical”. W odpowiedzi firma zapowiedziała, że model zostanie udostępniony publicznie z poważnymi ograniczeniami użytkowania, wybranymi tak, aby zmniejszyć natychmiastowe zagrożenia.
Preparedness Framework to zbiór polityk OpenAI definiujących poziomy zagrożeń związane z możliwościami systemów, ten sam standard, który obecnie kieruje decyzjami o wydaniu. Poziom „Critical” znajduje się na szczycie skali i sygnalizuje, że model może powodować szkody w newralgicznych obszarach autonomicznie lub przy minimalnym nadzorze. W przypadku Astry kluczowa zdolność do samodzielnego znajdowania luk w oprogramowaniu stron trzecich została wskazana jako bezpośredni powód najwyższej klasyfikacji. W oświadczeniu cytowanym przez publikacje OpenAI podaje, że zespół ds. bezpieczeństwa zalecił przyspieszenie badań nad użytkowaniem przed jakimkolwiek szerokim wdrożeniem. Dla sektora jest to pierwszy przypadek, gdy system LLM samodzielnie osiągnął ten próg, tworząc precedens dla innych firm AI.

Zero-day to luka wciąż nieznana producentowi, a więc bez gotowej łatki — dokładnie taki rodzaj luki, który napędza poważne ataki na serwery, systemy finansowe i rządy. Samodzielne ich znajdowanie przez Astrę pokazuje postęp techniczny, który niepokoi część społeczności bezpieczeństwa. Z drugiej strony ta sama zdolność mogłaby pomóc legalnym firmom aktywnie szukać luk, zanim wykorzystają je przestępcy. OpenAI jednak wchodzi w szarą strefę wymagającą równowagi między możliwościami technicznymi a obowiązkiem nieujawniania cyberbroni na dużą skalę. Ograniczenia te powinny koncentrować się na ograniczonym dostępie dla akredytowanych instytutów, bez wydania przez otwarte API. Nie ma jeszcze szczegółów dotyczących okien testów publicznych ani kwalifikowanych zasad dla partnerów komercyjnych.
Klasyfikacja ta zmienia również pozycję rynku bezpieczeństwa opartego na AI, przekształcając OpenAI z dostawcy interfejsów w aktywnego protagonistę cyberofensywy. W przeciwieństwie do tego podejście innych laboratoriów, takich jak DeepMind i Anthropic, powinno teraz wykorzystać przypadek Astry jako podstawę własnych standardów, prawdopodobnie przyspieszając wewnętrzne przeglądy. Analitycy zauważają, że izolowana identyfikacja zero-dayów to zadanie, które zwykle pochłania czas profesjonalnych zespołów i kosztuje miliony rocznie na badania i automatyzację. Teraz ten krok może spaść na modele wytrenowane jak Astra, z kontrolowanymi licencjami. Jedyną pewnością opublikowaną dotychczas jest to, że OpenAI woli ograniczyć wczesne użycie niż utrudniać egzekucje. Jednak wysoce wrażliwy charakter tematu sugeruje, że nowe spory nadal będą się pojawiać w zastosowaniach w tym obszarze.
Przypadek Astry ponownie otwiera debatę na temat sposobu walidacji modeli bez zamykania drzwi przed istotnymi korzyściami, zwłaszcza w dziedzinie cyberobrony. Raport AI Weekly i niezależna analiza TechCrunch przynoszą podobne dowody, co wzmacnia potrzebę przejrzystości, gdy pojawiają się zmiany tej skali. Eksperci powiązani z samym OpenAI, pod warunkiem zachowania anonimowości, podkreślają, że decyzja opiera się na założeniu uniknięcia ryzyka, iż zaawansowana AI zaatakuje systemy globalne bez kontroli. Wymagania weryfikacyjne, wewnętrzne dzienniki decyzji i dostosowane szkolenia zapobiegające...? Z tych samych powodów odpowiedź firmy jest postrzegana przez regulatorów i branżę jako wczesny krok intensywnego monitoringu etycznego. Model pozostał ciężki w testach wierności, a nowe ograniczenia mogą zostać ujawnione w miarę postępu rundy dostępu naukowego.
OpenAI ogranicza Astrę: pierwszy model z statusem „Critical” w Preparedness Framework; samodzielnie zidentyfikował zero-daye. OpenAI, Astra, model Critical, Preparedness Framework, zero-day, cyberbezpieczeństwo, bezpieczeństwo AI, ograniczone wydanie AI, OpenAI, Astra, Preparedness Framework
Komentarze 0
Login to Comment
You need to be logged in to join the discussion
Loading comments...
No comments yet
Login to be the first to comment!