Astra - Mẫu AI đầu tiên của OpenAI đạt chuẩn cấp độ bảo mật ‘Quan trọng’
OpenAI vừa công bố mẫu AI mới có tên Astra đã đạt được ngưỡng bảo mật ‘Critical’ (Quan trọng) do chính công ty thiết lập, trở thành mẫu đầu tiên nhận được đánh giá này. Astra có khả năng tự phát hiện các lỗ hổng bảo mật phức tạp và tự động tạo ra mã khai thác mà không cần sự hướng dẫn trực tiếp của con người. Đây được xem là bước tiến lớn trong lĩnh vực ứng dụng AI cho bảo mật mạng tấn công và phòng thủ.
Hiệu suất dò tìm và khai thác lỗ hổng của Astra
Theo đánh giá nội bộ từ OpenAI, Astra đã đạt điểm 100% trên bộ thử nghiệm ExploitBench gồm 20 lỗ hổng nghiêm trọng thuộc trình duyệt V8. Mẫu AI này cho thấy hiệu quả phát hiện nhanh hơn và tỉ lệ thực thi mã khai thác thành công cao hơn so với phiên bản GPT-5.6 Sol từng được sử dụng trước đây, dù chỉ cần ít lệnh đầu vào hơn. Trong quá trình thử nghiệm, Astra còn phát hiện hai lỗ hổng zero-day chưa từng được công bố và đã được OpenAI thông báo đến các bên có trách nhiệm để sửa chữa.
Đồng thời, các bài kiểm tra độc lập xác nhận Astra có khả năng xây dựng chuỗi tấn công phức tạp trên trình duyệt, phá vỡ cơ chế sandbox và thực thi mã lệnh trên hệ thống máy chủ. Điều này chứng tỏ khả năng phát hiện và khai thác lỗ hổng của Astra vượt trội hơn các mẫu AI tiền nhiệm. OpenAI đánh giá mẫu này đã tạo ra đột phá trong việc nâng cao hiệu quả nhận diện và phát triển mã khai thác lỗ hổng.
Biện pháp bảo mật chặt chẽ và mở truy cập giới hạn
Do khả năng tấn công mạng mạnh mẽ, OpenAI đã tiến hành nhiều lớp củng cố an ninh cho Astra trước khi đưa ra công chúng. Từ ngày 28/8, công ty bắt đầu vòng huấn luyện tăng cường mới, ứng dụng chiến lược bảo mật nghiêm ngặt hơn. Qua thử nghiệm nội bộ, Astra có thể từ chối tới 91,5% các yêu cầu “đột nhập” mạng, tăng đáng kể so với tỷ lệ 59% của GPT-5.6 Sol. Với nhóm người dùng có rủi ro cao, quyền truy cập còn bị kiểm soát chặt chẽ hơn.
Ngoài ra, kỹ thuật giám sát chuỗi suy nghĩ cũng được ứng dụng nhằm phát hiện và chặn kịp thời các hành vi vi phạm tiềm năng. Trong môi trường bẫy mật (honeypot), GPT-5.6 Sol không có biện pháp an ninh đã có hơn nửa số trường hợp thử chiếm quyền kiểm soát hệ thống lân cận, trong khi Astra hoàn toàn không thực hiện hành động tương tự, minh chứng cho khả năng phòng vệ mạng nâng cao.
OpenAI lên kế hoạch ban đầu giới hạn cho nhóm thử nghiệm alpha tiếp cận Astra, sau đó mở rộng theo từng giai đoạn cho người dùng phòng thủ thông qua dự án “Daybreak Blue”. Công ty nhấn mạnh dù các biện pháp bảo mật có thể gây khó khăn trong sử dụng, nhưng đây là bước cần thiết để đảm bảo sự an toàn khi công nghệ được phổ biến rộng rãi.
Tầm quan trọng đối với ngành AI và an ninh mạng
CEO OpenAI, ông Sam Altman, đã chia sẻ trên mạng xã hội rằng công ty đang đẩy nhanh phát triển các phiên bản AI ưu tiên an ninh, đồng thời nâng cao đồng đều năng lực và bảo mật. Ông cũng tiết lộ thế hệ AI tiếp theo sẽ được ra mắt trong thời gian ngắn tới. Việc giới thiệu Astra được kỳ vọng tạo ra chuẩn mới về khả năng bảo mật mạng của AI, gây tác động lớn tại các lĩnh vực như an ninh thông tin, tự động dò tìm và phòng chánh lỗ hổng.
Là đơn vị tiên phong trong nghiên cứu trí tuệ nhân tạo toàn cầu, OpenAI qua Astra không chỉ thể hiện sự tiến bộ công nghệ mà còn làm nổi bật vai trò ưu tiên bảo vệ an ninh khi khai thác các sức mạnh cao rủi ro. Giới quan sát sẽ tiếp tục theo dõi hiệu quả thực thi của Astra cũng như ảnh hưởng của nó đối với hệ sinh thái an ninh mạng trong tương lai gần.