OpenAI、Astraをサイバーセキュリティで「Critical」と分類しリリースを制限

OpenAIのAstraは、ゼロデイを独自に発見することでPreparedness Frameworkの「Critical」閾値を初めて超えた言語モデルである。高リスクのため、リリースは同社のセキュリティルールにより制限されるという。AI WeeklyとTechCrunchによると。

OpenAI、Astraをサイバーセキュリティで「Critical」と分類しリリースを制限

OpenAIは、新モデルAstraがPreparedness Frameworkで最大警戒レベルに到達したと報告した。これはこのリスク度に達した初の事例である。この決定はAI Weeklyの新版で発表され、2026年9月2日水曜日にTechCrunchが確認した。両出版物によると、このモデルはセキュリティ脆弱性を自律的に悪用し、人間支援なしでゼロデイを発見したという。このサイバー攻撃における積極性が、フレームワークにAstraを「Critical」と分類させた。対応として同社は、即時リスク低減のため厳しい使用制限を伴ってモデルを一般公開すると発表した。

Preparedness FrameworkはOpenAIのポリシー群で、システム能力に関連する脅威レベルを定義し、リリース決定を導く基準である。「Critical」レベルは目盛りの最上位に位置し、モデルが最小限の監視で自律的に機密分野に害を及ぼす可能性を示す。Astraの場合、サードパーティーソフトウェアのセキュリティ欠陥を発見する中核能力が最大分類の直接理由とされた。出版物が引用した声明でOpenAIは、広範な展開前に使用調査を加速するようセキュリティチームが推奨したと述べている。業界にとってこれはLLMシステムが独立してこの閾値に到達した初の事例であり、他AI企業への前例となる。

OpenAI classifica Astra como 'Critical' em ciber e restringe lançamento
OpenAI classifica Astra como 'Critical' em ciber e restringe lançamento

ゼロデイとはメーカー未発見の脆弱性で、即時パッチがないためサーバー、金融システム、政府への深刻な攻撃を駆動する種類の隙間である。Astraが独自に発見したことで、セキュリティコミュニティの一部が懸念する技術的飛躍を示した。一方、同じ能力は合法企業が犯罪者に先んじて脆弱性を積極探索する助けにもなり得る。しかしOpenAIは、技術能力とサイバー兵器を大規模に露出させない義務のバランスを取る灰色領域に入る。これらの制限は認定機関への限定アクセスに焦点を当て、オープンAPI経由のリリースは行わない予定である。公開テスト窓口や商業パートナー向け資格規則の詳細はまだない。

この分類はAIベースセキュリティ市場を再配置し、OpenAIをインターフェース提供者からサイバー攻撃の積極的主人公へ転換させる。対照的にDeepMindやAnthropicなど他ラボのアプローチは、Astra事例を自社基準の基盤として活用し、内部レビューを加速させる可能性がある。アナリストは、ゼロデイの孤立特定は通常専門チームの時間を消費し、研究と自動化に年間数百万ドルかかると指摘する。今やこの工程はAstraのような訓練済みモデルに委ねられ、制御されたライセンスで運用可能になる。現時点で公表された唯一の確実性は、OpenAIが早期使用を制限することを実行妨害より優先する点である。ただし話題の極めて敏感な性質から、この分野の応用で新たな論争がなお生じると示唆される。

Astra事例は、関連利益への扉を閉ざさずにモデルを検証する方法についての議論を再開させる。特にサイバー防衛分野で顕著である。AI Weekly報告と独立したTechCrunch分析は類似の証拠をもたらし、この規模の変化が生じた際の透明性必要性を強化する。OpenAI自身に関連する専門家は匿名条件で、決定は先進AIが制御なしにグローバルシステムを攻撃するリスクを避ける前提で行われたと強調する。検証要件、内部決定ログ、制御を防ぐための調整訓練がこれらの理由で必要とされる。同様の理由で、同社の対応は規制当局と業界から激しい倫理監視の初期段階と見なされている。モデルは忠実度テストで重い結果となり、新たな制限が科学アクセスラウンドの進展に伴い開示される可能性がある。

コメント 0

Loading comments...

Loading comments...