OpenAI сообщила, что ее новая модель под названием Astra достигла максимального уровня тревоги в Preparedness Framework, первой получив такой уровень риска. Решение было объявлено в новом выпуске бюллетеня AI Weekly и подтверждено TechCrunch в среду, 2 сентября 2026 года. По данным обоих изданий, модель смогла самостоятельно эксплуатировать уязвимости безопасности, даже обнаружив zero-day без помощи человека. Такой уровень проактивности в кибератаках привел к классификации Astra как «Critical» в рамках. В ответ компания объявила, что модель будет выпущена для публики с серьезными ограничениями использования, выбранными для снижения немедленных рисков.
Preparedness Framework — это набор политик OpenAI, определяющий уровни угроз, связанные с возможностями ее систем, тот же стандарт, который теперь направляет решения о выпуске. Уровень «Critical» находится на вершине шкалы и сигнализирует, что модель может причинить вред в чувствительных областях автономно или с минимальным надзором. В случае Astra основная способность находить уязвимости безопасности в стороннем ПО была названа прямой причиной максимальной классификации. В заявлении, процитированном изданиями, OpenAI говорит, что команда безопасности рекомендовала ускорить расследования использования перед любым широким развертыванием. Для сектора это первый случай, когда система LLM самостоятельно достигла этого порога, создавая прецедент для других AI-компаний.

Zero-day — это уязвимость, еще неизвестная производителю и поэтому без готового патча — именно тот тип пробела, который приводит к серьезным атакам на серверы, финансовые системы и правительства. Обнаруживая их самостоятельно, Astra демонстрирует технический скачок, который беспокоит часть сообщества безопасности. С другой стороны, та же способность может помочь легитимным компаниям активно искать уязвимости до того, как их используют преступники. Однако OpenAI входит в серую зону, требующую баланса технических возможностей с обязанностью не раскрывать кибероружие в больших масштабах. Эти ограничения должны фокусироваться на ограниченном доступе для аккредитованных институтов без выпуска через открытый API. Пока нет деталей о окнах публичного тестирования или квалифицированных правилах для коммерческих партнеров.
Эта классификация также перестраивает рынок безопасности на базе ИИ, превращая OpenAI из поставщика интерфейсов в активного участника кибернаступления. В отличие от этого, подход других лабораторий, таких как DeepMind и Anthropic, теперь должен использовать случай Astra как основу для собственных стандартов, возможно, ускоряя внутренние проверки. Аналитики отмечают, что изолированная идентификация zero-day — задача, которая обычно занимает время у профессиональных команд и стоит миллионы в год на исследования и автоматизацию. Теперь этот шаг может достаться моделям, обученным как Astra, с контролируемыми лицензиями. Единственная уверенность, опубликованная на данный момент, — OpenAI предпочитает ограничить раннее использование, а не препятствовать исполнениям. Однако крайне чувствительная природа темы предполагает, что новые споры еще возникнут по приложениям в этой области.
Случай Astra возобновляет дебаты о том, как валидировать модели, не закрывая дверь для релевантных преимуществ, особенно в области киберзащиты. Отчет AI Weekly и независимый анализ TechCrunch приводят схожие доказательства, что усиливает необходимость прозрачности при появлении изменений такого масштаба. Эксперты, связанные с OpenAI, на условиях анонимности подчеркивают, что решение принято на основе предпосылки избежать риска, что продвинутый ИИ атакует глобальные системы без контроля. Требования верификации, внутренние журналы решений и скорректированное обучение для предотвращения... По этим же причинам ответ компании рассматривается регуляторами и отраслью как ранний шаг интенсивного этического мониторинга. Модель осталась тяжелой в тестах на точность, и новые ограничения могут быть раскрыты по мере продвижения научного доступа.
Комментарии 0
Login to Comment
You need to be logged in to join the discussion
Loading comments...
No comments yet
Login to be the first to comment!