OpenAI, yeni modeli Astra'nın Preparedness Framework'te maksimum uyarı seviyesine ulaştığını ve bu risk derecesine ulaşan ilk model olduğunu bildirdi. Karar AI Weekly bülteninin yeni sayısı aracılığıyla duyuruldu ve TechCrunch tarafından 2 Eylül 2026 Çarşamba günü doğrulandı. Her iki yayına göre model güvenlik açıklarını insan yardımı olmadan özerk şekilde istismar etmeyi başardı ve bir sıfır günü keşfetti. Bu siber saldırı proaktivitesi framework tarafından Astra'nın 'Critical' olarak sınıflandırılmasına yol açtı. Şirket yanıt olarak modelin ciddi kullanım kısıtlamalarıyla halka sunulacağını açıkladı.
Preparedness Framework OpenAI'nin sistemlerinin yetenekleriyle ilişkili tehdit seviyelerini tanımlayan politika setidir ve şu anda yayın kararlarını yönlendirmektedir. 'Critical' seviye ölçeğin en üstünde yer alır ve bir modelin hassas alanlarda özerk veya minimum gözetimle zarar verebileceğini işaret eder. Astra durumunda üçüncü taraf yazılımlardaki güvenlik açıklarını bulma yeteneği doğrudan maksimum sınıflandırmanın nedeni olarak gösterildi. Yayınlarda alıntılanan açıklamada OpenAI güvenlik ekibinin geniş bir dağıtım öncesinde kullanım araştırmalarını hızlandırmayı önerdiğini belirtti. Sektör için bu bir LLM sisteminin bağımsız olarak bu eşiğe ulaşmasının ilk örneğidir.

Sıfır gün üretici tarafından bilinmeyen ve hazır yaması olmayan bir güvenlik açığıdır; tam olarak sunuculara finansal sistemlere ve hükümetlere yönelik ciddi saldırıları tetikleyen boşluk türüdür. Bunları kendi başına bulmasıyla Astra güvenlik topluluğunun bir kısmını endişelendiren teknik bir sıçrama sergiliyor. Öte yandan aynı yetenek meşru şirketlerin suçlular tarafından istismar edilmeden önce açıkları aktif şekilde aramasına yardımcı olabilir. OpenAI ancak siber silahları büyük ölçekte ifşa etmeme yükümlülüğüyle teknik yeteneği dengeleme gerektiren gri bir alana giriyor. Bu kısıtlamalar akredite enstitülere sınırlı erişime odaklanmalı ve açık API üzerinden yayınlanmamalıdır. Kamu test pencereleri veya ticari ortaklar için nitelikli kurallara dair henüz ayrıntı yoktur.
Bu sınıflandırma ayrıca AI tabanlı güvenlik pazarını yeniden konumlandırarak OpenAI'yi arayüz sağlayıcısından siber saldırı alanında aktif bir protagonista dönüştürüyor. Buna karşılık DeepMind ve Anthropic gibi diğer laboratuvarların yaklaşımı Astra vakasını kendi standartları için temel olarak kullanmalı ve muhtemelen iç incelemeleri hızlandırmalıdır. Analistler sıfır günlerin izole tespitinin normalde profesyonel ekiplerden zaman aldığını ve araştırma ile otomasyon için yılda milyonlarca dolara mal olduğunu belirtiyor. Şimdi bu adım Astra gibi eğitilmiş modellere kontrollü lisanslarla düşebilir. Yayınlanan tek kesinlik OpenAI'nin erken kullanımı sınırlamayı tercih ettiğidir. Ancak konunun son derece hassas doğası bu alandaki uygulamalar için yeni anlaşmazlıkların ortaya çıkacağını gösteriyor.
Astra vakası modelleri ilgili faydaların kapısını kapatmadan nasıl doğrulanacağı tartışmasını özellikle siber savunma alanında yeniden açıyor. AI Weekly raporu ve bağımsız TechCrunch analizi benzer kanıtlar sunarak bu büyüklükteki değişiklikler ortaya çıktığında şeffaflık ihtiyacını güçlendiriyor. OpenAI'ye bağlı uzmanlar kimliklerini açıklamadan kararın gelişmiş bir AI'nin kontrolsüz şekilde küresel sistemlere saldırma riskini önleme öncülüyle alındığını vurguluyor. Doğrulama gereklilikleri iç karar günlükleri ve kontrolsüz saldırıları önlemek için ayarlanmış eğitim bu nedenlerle şirketin yanıtı düzenleyiciler ve sektör tarafından yoğun etik izlemenin erken adımı olarak görülüyor. Model sadakat testlerinde ağır kaldı ve yeni sınırlamalar bilimsel erişim turu ilerledikçe açıklanabilir.
Yorumlar 0
Login to Comment
You need to be logged in to join the discussion
Loading comments...
No comments yet
Login to be the first to comment!