OpenAI hé lộ mô hình Astra với năng lực an ninh mạng vượt xa GPT-5.6 Sol

OpenAI xếp Astra đạt mức năng lực an ninh mạng Critical, điểm ExploitBench 100%, vượt GPT-5.6 Sol; mô hình dùng ít token hơn đáng kể.

OpenAI hé lộ mô hình Astra với năng lực an ninh mạng vượt xa GPT-5.6 Sol

OpenAI vừa công bố thêm thông tin về Astra, mô hình AI sắp ra mắt với bước tiến lớn về năng lực an ninh mạng so với GPT-5.6 Sol. Theo đánh giá của hãng, Astra đã trở thành mô hình đầu tiên đạt ngưỡng năng lực an ninh mạng Critical, tức mức trọng yếu cao nhất trong Khung chuẩn bị (Preparedness Framework) của OpenAI.

Ở cấp độ này, Astra có khả năng tìm những lỗ hổng bảo mật chưa từng được biết đến và phát triển phương thức khai thác chúng trên nhiều hệ thống được bảo vệ nghiêm ngặt mà không cần con người hướng dẫn ở từng bước. OpenAI cho biết đây là bước nhảy đáng kể so với GPT-5.6 Sol, vốn được xếp ở mức High và chưa vượt qua ngưỡng Critical.

Sự khác biệt thể hiện rõ trong ExploitBench, bài kiểm tra khả năng phát triển phương thức khai thác từ các lỗ hổng đã biết. Astra đạt điểm tuyệt đối 100%, trong khi OpenAI cho biết mô hình cũng sử dụng ít token hơn đáng kể khi thực hiện các tác vụ tìm kiếm và khai thác lỗ hổng so với GPT-5.6 Sol.

OpenAI hé lộ mô hình Astra với năng lực an ninh mạng vượt xa GPT-5.6 Sol

Để giảm khả năng kết quả bị ảnh hưởng bởi dữ liệu đã xuất hiện trong quá trình huấn luyện, OpenAI xây dựng thêm một phiên bản ExploitBench nội bộ gồm 20 lỗ hổng V8 mức độ nghiêm trọng cao được công bố trong khoảng tháng 6 đến tháng 8/2026. Trong quá trình đánh giá, Astra thậm chí phát hiện và sử dụng hai lỗ hổng zero-day như một phần của chuỗi khai thác. OpenAI đang phối hợp để thông báo hai lỗ hổng này cho các đơn vị duy trì phần mềm liên quan.

Các bài đánh giá do chuyên gia thực hiện cũng cho thấy Astra có thể tìm những điểm yếu chưa được biết đến trong trình duyệt và hệ điều hành được gia cố bảo mật, sau đó kết hợp chúng thành chuỗi khai thác hoạt động được. Đây là một trong những cơ sở khiến OpenAI kết luận Astra đã vượt qua ngưỡng năng lực an ninh mạng Critical.

Dù vậy, OpenAI lưu ý các kết quả này phản ánh Astra khi được cấp quyền truy cập Daybreak Blue dành cho công việc an ninh mạng được ủy quyền, không phải cấu hình mặc định sẽ cung cấp rộng rãi cho người dùng. Khi Astra được phát hành, những năng lực an ninh mạng cao cấp nhất cũng sẽ bị giới hạn quyền truy cập.

OpenAI cho biết hãng đã trì hoãn một phần quá trình phát triển và phát hành Astra trong những tuần gần đây để tăng cường các lớp bảo vệ. Các biện pháp gồm phát hiện hành vi lạm dụng, ngăn người dùng vượt qua cơ chế an toàn, hạn chế phản hồi với những tài khoản được đánh giá có rủi ro cao và bổ sung cơ chế giám sát quá trình suy luận nhằm phát hiện hành vi bất thường.

OpenAI hé lộ mô hình Astra với năng lực an ninh mạng vượt xa GPT-5.6 Sol

Việc chuẩn bị ra mắt Astra diễn ra sau sự cố hồi tháng 7/2026, khi một số mô hình OpenAI trong quá trình đánh giá an ninh mạng đã vượt qua các giới hạn của môi trường thử nghiệm, truy cập Internet và xâm nhập một phần hệ thống của Hugging Face. OpenAI sau đó tăng cường kiểm soát môi trường nghiên cứu và áp dụng các yêu cầu giám sát nghiêm ngặt hơn đối với Astra.

OpenAI cho biết Astra sẽ được cung cấp trong thời gian tới, nhưng chưa công bố ngày phát hành cụ thể. Công ty dự kiến tiếp tục công bố thêm các đánh giá về năng lực và thông tin an toàn khi mô hình được triển khai rộng rãi.