OpenAI Phân Loại Astra Là 'Critical' Trong An Ninh Mạng Và Hạn Chế Phát Hành

Astra của OpenAI là mô hình ngôn ngữ đầu tiên vượt ngưỡng 'Critical' của Khung Chuẩn Bị bằng cách tìm zero-day độc lập. Do rủi ro cao, việc phát hành sẽ bị hạn chế bởi quy tắc bảo mật của công ty, theo AI Weekly và TechCrunch.

OpenAI Phân Loại Astra Là 'Critical' Trong An Ninh Mạng Và Hạn Chế Phát Hành

OpenAI báo cáo rằng mô hình mới có tên Astra đã đạt mức cảnh báo tối đa trong Khung Chuẩn Bị, là mô hình đầu tiên đạt mức rủi ro này. Quyết định được công bố qua số mới của bản tin AI Weekly và được TechCrunch xác nhận vào thứ Tư, ngày 2 tháng 9 năm 2026. Theo cả hai ấn phẩm, mô hình đã khai thác lỗ hổng bảo mật một cách tự chủ, thậm chí phát hiện zero-day mà không cần hỗ trợ con người. Mức độ chủ động này trong tấn công mạng khiến khung phân loại Astra là 'Critical'. Để đáp lại, công ty thông báo mô hình sẽ được phát hành công khai với các hạn chế sử dụng nghiêm ngặt, hiện được chọn lọc để giảm rủi ro tức thì.

Khung Chuẩn Bị là bộ chính sách của OpenAI xác định mức độ đe dọa liên quan đến khả năng của các hệ thống, cùng tiêu chuẩn hiện hướng dẫn quyết định phát hành cho đến nay. Mức 'Critical' nằm ở đỉnh thang đo và báo hiệu mô hình có thể gây hại trong các lĩnh vực nhạy cảm một cách tự chủ hoặc với giám sát tối thiểu. Trong trường hợp Astra, khả năng cốt lõi tìm lỗi bảo mật trong phần mềm bên thứ ba được trích dẫn là lý do trực tiếp cho phân loại tối đa. Trong tuyên bố được các ấn phẩm trích dẫn, OpenAI cho biết đội ngũ bảo mật đã khuyến nghị đẩy nhanh điều tra sử dụng trước khi triển khai rộng rãi. Đối với ngành, đây là lần đầu tiên hệ thống LLM độc lập đạt ngưỡng này, tạo tiền lệ cho các công ty AI khác.

OpenAI classifica Astra como 'Critical' em ciber e restringe lançamento
OpenAI classifica Astra como 'Critical' em ciber e restringe lançamento

Zero-day là lỗ hổng vẫn chưa được nhà sản xuất biết đến và do đó chưa có bản vá sẵn — chính xác là loại khe hở thúc đẩy các cuộc tấn công nghiêm trọng vào máy chủ, hệ thống tài chính và chính phủ. Bằng cách tự tìm chúng, Astra thể hiện bước nhảy vọt kỹ thuật khiến một phần cộng đồng bảo mật lo ngại. Mặt khác, cùng khả năng có thể giúp các công ty hợp pháp chủ động tìm kiếm lỗ hổng trước khi tội phạm khai thác. Tuy nhiên OpenAI bước vào vùng xám đòi hỏi cân bằng khả năng kỹ thuật với nghĩa vụ không phơi bày vũ khí mạng quy mô lớn. Các hạn chế này sẽ tập trung vào truy cập hạn chế cho các viện được công nhận, không phát hành qua API mở. Vẫn chưa có chi tiết về cửa sổ thử nghiệm công khai hoặc quy tắc đủ điều kiện cho đối tác thương mại.

Phân loại này cũng định vị lại thị trường bảo mật dựa trên AI, biến OpenAI từ nhà cung cấp giao diện thành nhân vật chính tích cực trong tấn công mạng. Ngược lại, cách tiếp cận của các phòng thí nghiệm khác như DeepMind và Anthropic giờ nên dùng trường hợp Astra làm cơ sở cho tiêu chuẩn riêng, có thể đẩy nhanh đánh giá nội bộ. Các nhà phân tích lưu ý rằng việc xác định zero-day riêng lẻ là nhiệm vụ thường tiêu tốn thời gian của đội ngũ chuyên nghiệp và chi phí hàng triệu mỗi năm cho nghiên cứu và tự động hóa. Bây giờ bước này có thể rơi vào các mô hình được huấn luyện như Astra, với giấy phép kiểm soát. Điều chắc chắn duy nhất được công bố cho đến nay là OpenAI thích hạn chế sử dụng sớm thay vì cản trở thực thi. Tuy nhiên, tính chất cực kỳ nhạy cảm của chủ đề cho thấy các tranh cãi mới vẫn sẽ nảy sinh cho ứng dụng trong lĩnh vực này.

Trường hợp Astra mở lại cuộc tranh luận về cách xác thực mô hình mà không đóng cửa các lợi ích liên quan, đặc biệt trong lĩnh vực phòng thủ mạng. Báo cáo AI Weekly và phân tích độc lập TechCrunch mang bằng chứng tương tự, củng cố nhu cầu minh bạch khi thay đổi quy mô này xuất hiện. Các chuyên gia liên kết với OpenAI, dưới điều kiện ẩn danh, nhấn mạnh quyết định được đưa ra trên tiền đề tránh rủi ro AI tiên tiến tấn công hệ thống toàn cầu mà không kiểm soát. Yêu cầu xác minh, nhật ký quyết định nội bộ và huấn luyện điều chỉnh để ngăn chặn...? Vì những lý do tương tự, phản ứng của công ty được các cơ quan quản lý và ngành coi là bước đầu của giám sát đạo đức mạnh mẽ. Mô hình vẫn nặng trong các bài kiểm tra độ trung thực, và các hạn chế mới có thể được tiết lộ khi vòng truy cập khoa học tiến triển.

Bình luận 0

Loading comments...

Loading comments...