Mối đe dọa mạng: Gemini 3.8 Cyber vá lỗi hiệu quả

Mối đe dọa mạng: Gemini 3.8 Cyber vá lỗi hiệu quả
CLOUD SERVER
Vững hạ tầng • Chắc thành công
☁️
⚡ Hiệu năng cao
🛡️ Bảo mật
📈 Mở rộng dễ dàng
🕒 Hỗ trợ 24/7
TÌM HIỂU NGAY

Google vừa công bố Gemini 3.8, dòng mô hình mới nhất tập trung vào khả năng suy luận và lập trình. Đặc biệt, phiên bản Gemini 3.8 Flash Cyber được thiết kế chuyên biệt để tự động phát hiện các lỗ hổng phần mềm và tạo bản vá lỗi hoạt động. Phiên bản này hứa hẹn thay đổi cách thức đối mặt với các mối đe dọa mạng.

Gemini 3.8: Nâng cao khả năng suy luận và lập trình

Gemini 3.8 Flash, phiên bản đa mục đích, nhắm tới các tác vụ kỹ thuật phần mềm kéo dài và các ứng dụng agentic. Mô hình này mang lại những cải tiến đáng kể so với Gemini 3.7 Flash, đồng thời giữ nguyên mức giá ban đầu là 0.75 USD cho mỗi triệu token đầu vào và 3.75 USD cho mỗi triệu token đầu ra.

Trên bộ benchmark DeepSWE v1.1 dành cho các tác vụ kỹ thuật phức tạp, Gemini 3.8 Flash được báo cáo là vượt trội hơn nhiều mô hình tiên tiến lớn hơn với chi phí thấp hơn đáng kể. Mô hình đạt 54.9% trên HLE-Verified, thể hiện khả năng suy luận đa bước mạnh mẽ trên các lĩnh vực kỹ thuật và chuyên nghiệp.

Google cho biết những cải tiến này đến từ việc mô hình sẵn sàng thực hiện thêm các bước suy luận và gọi công cụ lặp đi lặp lại khi giải quyết các vấn đề khó khăn. Tuy nhiên, điều này có thể làm tăng việc sử dụng token ở các cài đặt yêu cầu nỗ lực cao hơn.

Gemini 3.8 Flash Cyber: Chuyên dụng cho An ninh mạng

Gemini 3.8 Flash Cyber, tập trung vào lĩnh vực an ninh mạng, sẽ được cung cấp độc quyền cho các đội ngũ bảo mật đã được xác minh thông qua Chương trình Fairwind mới của Google. Điều này phản ánh tính nhạy cảm của một mô hình được đào tạo để phát hiện các lỗ hổng có thể bị khai thác.

Trên CyberGym, một benchmark công nghiệp phổ biến để phát hiện lỗ hổng, Gemini 3.8 Flash Cyber được báo cáo là vượt trội hơn cả phiên bản tiền nhiệm 3.5 Flash Cyber và các đối thủ cạnh tranh lớn hơn đáng kể.

Google cũng đã thử nghiệm mô hình này trên một bộ benchmark nội bộ bao gồm hai mươi ngôn ngữ lập trình ngoài trọng tâm C/C++ của CyberGym. Tại đây, mô hình đạt tỷ lệ thành công trên 70%, một bước nhảy vọt đáng kể so với các phiên bản trước.

Ưu tiên vá lỗi và hiệu quả chi phí

Thay vì nhấn mạnh vào khả năng khai thác, Google khẳng định đã ưu tiên chủ động phát triển các chức năng vá lỗi phòng thủ ngay từ đầu. Điều này cho thấy một cách tiếp cận cân bằng trong việc phát triển công cụ an ninh mạng.

Trên CWE-Bench, một benchmark bên ngoài về sửa lỗi tự động do Collinear chạy, Gemini 3.8 Flash Cyber đã đạt điểm pass@1 là 47.2%. Kết quả này gần bằng với 47.8% của một mô hình tiên tiến hàng đầu, trong khi hoạt động với chi phí thấp hơn đáng kể.

Google tuyên bố mô hình này hiện đang được sử dụng để bảo mật các cơ sở mã của chính họ. Đội ngũ An ninh Chrome nhận thấy mô hình này tạo ra các bản vá lỗi chính xác nhiều gấp 2.6 lần so với các đối thủ thương mại lớn hơn. Trong khi đó, công ty bảo mật Wiz đo lường tỷ lệ thu hồi (recall) cao hơn từ 7.5 đến 9.7% trên các benchmark kiểm thử xâm nhập nội bộ, với chi phí thấp hơn hai đến năm lần.

Trong một trường hợp đáng chú ý, đội ngũ Nghiên cứu Lỗ hổng Cloud của Google đã sử dụng Gemini 3.8 Flash Cyber để phát hiện một lỗ hổng nền tảng nghiêm trọng chỉ trong vòng chưa đầy hai giờ. Quá trình khám phá này thường đòi hỏi hàng tháng nghiên cứu thủ công.

Bằng cách kết hợp suy luận agentic với đào tạo chuyên biệt về an ninh mạng, Gemini 3.8 Flash Cyber thể hiện nỗ lực của Google trong việc cung cấp cho lực lượng phòng thủ một lợi thế tự động so với kẻ tấn công. Tuy nhiên, việc truy cập rộng rãi hơn vẫn còn giới hạn cho các thành viên tham gia chương trình đáng tin cậy.