Tin tức an ninh mạng: Cảnh báo tấn công suy luận AI

Tin tức an ninh mạng: Cảnh báo tấn công suy luận AI
CLOUD HOSTING
DỊCH VỤ
VPS • CLOUD • SERVER
Hiệu năng cao
Ổn định • Bảo mật • Tốc độ
☁️
SSD NVMe 99.9% 24/7
TÌM HIỂU NGAY

Các cuộc tấn công mạng nhằm vào quy trình suy luận của AI

OpenAI gần đây đã ghi nhận một chiến dịch quy mô lớn liên quan đến hơn 15.000 người dùng thực hiện các hành vi nhằm trích xuất thông tin suy luận được bảo vệ. Đây được xem là một tin tức an ninh mạng đáng chú ý khi các đối tượng cố gắng thực hiện quá trình chưng cất đối kháng (adversarial distillation) để lấy dữ liệu từ các mô hình AI.

Quy trình suy luận được bảo vệ (protected reasoning) là các bước xử lý nội bộ mà mô hình thực hiện trước khi đưa ra phản hồi cuối cùng. Dữ liệu này bao gồm các phân tích trung gian, kế hoạch thực hiện và những thông tin vốn dĩ được hệ thống chủ động ẩn đi đối với người dùng cuối.

Chi tiết về kỹ thuật khai thác và quy mô tấn công

Kẻ tấn công không thực hiện hành vi xâm nhập vào các hệ thống mã hóa hay cơ sở dữ liệu của OpenAI. Thay vào đó, họ thao túng các tương tác thông thường thông qua các câu lệnh (prompt) phối hợp và kỹ thuật xuyên hội thoại nhằm làm lộ ra phần suy luận bị ẩn của mô hình.

Một trong những phương thức được quan sát là việc sao chép nội dung suy luận đã mã hóa từ một cuộc hội thoại này, sau đó gửi vào một cuộc hội thoại khác kèm theo hướng dẫn giải mã và ghi lại nội dung đó. Theo thông tin từ OpenAI, đây là một hành vi lợi dụng cơ chế của hệ thống hơn là lỗi bảo mật phần mềm truyền thống.

  • Ngày 01/07: Hoạt động bắt đầu ở quy mô thấp.
  • Ngày 24/07 và 25/07: Ghi nhận các đợt đột biến với hơn 16.000 yêu cầu từ 4.000 người dùng.
  • Ngày 28/07: Chiến dịch được OpenAI vô hiệu hóa hoàn toàn.

Cuộc điều tra đã mở rộng và phát hiện mạng lưới liên quan bao gồm hơn 15.000 người dùng. OpenAI xác định một phần cốt lõi của hoạt động này xuất phát từ các cá nhân có liên quan đến Moonshot AI, nhà phát triển của mô hình Kimi AI, tuy nhiên không xác nhận toàn bộ 15.000 người dùng đều thuộc về một tác nhân duy nhất.

Các biện pháp bảo vệ và an toàn thông tin

Để đảm bảo an toàn thông tin cho người dùng, OpenAI đã tiến hành vô hiệu hóa các tài khoản có hành vi gian lận và thắt chặt kiểm soát cơ sở hạ tầng. Công ty cũng đóng một lộ trình phát lại (replay pathway) mà kẻ tấn công có thể lợi dụng để khôi phục nội dung suy luận của người dùng khác.

Các biện pháp kỹ thuật được triển khai bao gồm:

  • Tăng cường giám sát đối với các mạng lưới tài khoản có liên quan.
  • Thêm các lớp bảo vệ để phát hiện và chặn các luồng đầu ra có nguy cơ làm lộ thông tin suy luận.
  • Chia sẻ thông tin với các đối tác trong ngành thông qua diễn đàn Frontier Model Forum để cảnh báo về các rủi ro tương tự.

Việc trích xuất thông tin suy luận là một mối đe dọa ngày càng phổ biến đối với các nhà cung cấp AI tạo sinh. Các mô hình hiện đại với khả năng lập trình và suy luận phức tạp đã trở thành mục tiêu giá trị cao cho các đối thủ cạnh tranh muốn tái tạo khả năng của mô hình mà không cần đầu tư nguồn lực nghiên cứu tương xứng.