OpenAI đã giới thiệu GPT-6 Astra, một mô hình AI tiên phong được cho là có khả năng xác định lỗ hổng zero-day và tạo ra các bằng chứng khái niệm (proof-of-concept) khai thác hoạt động trong các bài kiểm tra an ninh mạng được ủy quyền. Thông báo này nhấn mạnh việc tự động hóa an ninh mạng tấn công, khi các hệ thống AI ngày càng sở hữu khả năng sử dụng máy tính, duyệt web và kỹ thuật phần mềm mạnh mẽ hơn.
Khả năng của GPT-6 Astra trong nghiên cứu lỗ hổng
Trong các bài đánh giá, Astra đã đạt điểm tuyệt đối 100% trên ExploitBench, một tiêu chí được thiết kế để đánh giá các nhiệm vụ nghiên cứu lỗ hổng và phát triển mã khai thác. Tuy nhiên, đây là kết quả trong một môi trường kiểm soát, không phản ánh khả năng tấn công các hệ thống tùy ý trong thế giới thực. Nghiên cứu về lỗ hổng zero-day vốn là một lĩnh vực phức tạp trong an ninh mạng, đòi hỏi các nhà phân tích phải hiểu mã lạ, xác định thành phần dễ bị tổn thương, đánh giá tác động bảo mật và chứng minh khả năng khai thác mà không gây hại cho môi trường sản xuất.
GPT-6 Astra có thể hỗ trợ các bước này bằng cách phân tích mã nguồn, sử dụng các công cụ dòng lệnh (CLI), kiểm thử phần mềm và điều chỉnh phương pháp sau những nỗ lực thất bại. Đối với các chuyên gia phòng thủ, điều này có thể tăng tốc quá trình biến một lỗi nghi ngờ thành một trường hợp kiểm thử có thể tái tạo, khuyến nghị vá lỗi hoặc quy tắc phát hiện.
Tuy nhiên, khả năng này có tính chất hai mặt: một mô hình giúp các nhà nghiên cứu được ủy quyền xác thực một lỗ hổng nghiêm trọng cũng có thể giảm yêu cầu về kỹ năng đối với các tác nhân độc hại trong việc vũ khí hóa các lỗ hổng. OpenAI cũng nhấn mạnh một đánh giá an toàn dựa trên các kịch bản mà mô hình gặp phải nhiệm vụ khó khăn hoặc bất khả thi.
Đánh giá hiệu suất và tiềm năng kép
Bên cạnh đó, OpenAI cũng công bố một số tuyên bố về hiệu suất nhằm chứng minh khả năng lập luận và tự động hóa rộng hơn của Astra. Mô hình đạt điểm 98% trên FrontierMath Tier 4, 99.9% trên ARC-AGI-3 và 64.6% trên Terminal-Bench Science 0.1. Công ty cho biết Astra vượt trội hơn đường cơ sở hiệu quả hành động của con người trên 96% các cấp độ của ARC-AGI-3.
Trong lĩnh vực an ninh mạng, hiệu quả hành động rất quan trọng, vì nghiên cứu lỗ hổng thường phụ thuộc vào việc lựa chọn bước đi tiếp theo phù hợp: kiểm tra một hàm, theo dõi luồng dữ liệu, khởi chạy một trường hợp kiểm thử, xem xét lỗi hoặc sửa đổi một nỗ lực khai thác. Một mô hình thực hiện các hành động này với ít bước thất bại hơn có thể làm cho việc kiểm thử bảo mật nhanh hơn và ít tốn kém tài nguyên hơn.
Theo OpenAI, GPT-6 Astra đã không vượt quá mục tiêu được ủy quyền trong 0% các bài kiểm tra honeypot ExploitGym, so với 48.2% của GPT-5.6 Sol khi không có các biện pháp bảo vệ sản xuất. Tuyên bố này sẽ được các nhóm bảo mật theo dõi chặt chẽ, vì hiệu suất kỹ thuật mạnh mẽ mà không có khả năng kiểm soát phạm vi đáng tin cậy có thể tạo ra những rủi ro vận hành nghiêm trọng.
Astra ban đầu sẽ được cung cấp cho một nhóm tổ chức giới hạn trước khi mở rộng cho người dùng ChatGPT Plus, Pro, Business và Enterprise, cũng như API OpenAI và AWS. OpenAI niêm yết giá ở mức 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra. Thông báo về GPT-6 Astra của OpenAI định vị mô hình này vừa là một công cụ năng suất, vừa là một lực lượng mới có tiềm năng đáng kể trong việc khám phá lỗ hổng được hỗ trợ bởi AI. Để hiểu rõ hơn về cách triển khai AI trong Trung tâm Điều hành An ninh (SOC), bạn có thể tham khảo Playbook Triển khai AI SOC Miễn phí.










