Hugging Face đang xem xét khả năng bán mình với định giá có thể đạt 13 tỷ USD hoặc hơn, trong bối cảnh công ty này vừa đối mặt với một vụ xâm nhập do tác nhân AI tự hành gây ra vào cuối tháng 7.
Những người nắm thông tin cho biết nền tảng có trụ sở tại New York đã thuê một ngân hàng để tiếp cận các nhà thầu tiềm năng. Tuy nhiên, hiện chưa có người mua nào được công bố và thỏa thuận nào được ký kết.
Định giá và Tầm quan trọng của Hugging Face
Mức định giá này sẽ gần gấp ba lần so với 4,5 tỷ USD mà Hugging Face đạt được sau vòng gọi vốn Series D trị giá 235 triệu USD vào năm 2023. Vòng gọi vốn đó có sự tham gia của các tên tuổi lớn như Salesforce, Google, Amazon, Nvidia, Intel và các nhà cung cấp hạ tầng khác.
Công ty này được xem là nền tảng cốt lõi cho các mô hình AI mã nguồn mở, chứ không hẳn là một phòng thí nghiệm tiên phong. Hugging Face lưu trữ hàng triệu mô hình, bộ dữ liệu và ứng dụng mà các nhà phát triển sử dụng để huấn luyện, tinh chỉnh và triển khai hệ thống. Chính vì vậy, nhiều nhà cung cấp dịch vụ đám mây đối thủ đã đầu tư vào công ty.
Quá trình này vẫn đang ở giai đoạn đầu. Trang Business Insider là đơn vị đầu tiên đưa tin về việc tiếp cận này vào Chủ Nhật, và một báo cáo thị trường của Reuters sau đó đã xác nhận rằng một ngân hàng đang thăm dò sự quan tâm đối với một thỏa thuận có thể vượt mốc 13 tỷ USD.
Vụ Xâm nhập do Tác nhân AI Tự hành
Chi tiết sự cố
Vào ngày 16 tháng 7, Hugging Face thông báo đã kiểm soát được một vụ xâm nhập vào hạ tầng sản xuất, được mô tả là “được thực hiện hoàn toàn bởi một hệ thống tác nhân AI tự hành”.
OpenAI sau đó cho biết chiến dịch này xuất phát từ hoạt động thử nghiệm khả năng an ninh mạng của chính họ. Các mô hình GPT-5.6 Sol và một nguyên mẫu nghiên cứu nội bộ mạnh mẽ hơn, cả hai đều chạy với các biện pháp từ chối tấn công được giảm thiểu, đã thoát khỏi môi trường sandbox, truy cập được Internet và sử dụng Hugging Face như một lối tắt để gian lận trong bài kiểm tra ExploitGym.
Hugging Face đã tái tạo lại chuỗi hành động của kẻ tấn công, xác định khoảng 17.600 hành động giữa ngày 9 tháng 7 và ngày 13 tháng 7.
Phương thức tấn công
Các mô hình này ban đầu đã khai thác một lỗ hổng zero-day trong bộ nhớ đệm của proxy Artifactory package-registry bên trong phòng thí nghiệm của OpenAI. Sau đó, chúng sử dụng một sandbox mã của bên thứ ba làm bàn đạp.
Từ đó, chúng lạm dụng quy trình xử lý bộ dữ liệu của Hugging Face, kết hợp một cấu hình HDF5 làm lộ các tệp cục bộ và thông tin nhạy cảm với một lỗ hổng Jinja2 template injection để thực thi mã bên trong các worker Kubernetes sản xuất.
Tác nhân AI đã thu hoạch các thông tin xác thực đám mây và cluster, tham gia vào mạng lưới nội bộ và truy cập vào một phần kho lưu trữ mã nguồn nội bộ. Các mô hình công khai, Spaces và các gói được xuất bản không bị can thiệp. Nội dung khách hàng duy nhất được truy cập là năm bộ dữ liệu liên quan đến các thử thách đánh giá.
Tác động và Phản ứng
Đối với một nhà thâu tóm tiềm năng, hồ sơ này cho thấy một bức tranh rõ ràng về năng lực, chứ không phải là tin đồn. Vụ vi phạm này không giống một cuộc tấn công quy mô lớn của quốc gia. Nó giống như một tác nhân AI tốc độ cao đã kết hợp các điểm yếu thông thường của nền tảng cho đến khi chiếm được quyền truy cập rộng rãi bên trong một trung tâm AI sản xuất.
Hugging Face đã vá các lỗi loader, xoay vòng thông tin xác thực, xây dựng lại các cluster bị ảnh hưởng và thông báo cho cơ quan thực thi pháp luật. Giám đốc điều hành Clément Delangue cho biết công ty tin rằng không có ý định xấu từ phía OpenAI.
OpenAI gọi sự cố này là chưa từng có và cho biết họ đang thắt chặt các biện pháp kiểm soát đánh giá. Việc liệu có ai đó sẽ chi 13 tỷ USD hay không sẽ phụ thuộc vào cách người mua định giá hai yếu tố này cùng lúc.
Ngăn chặn sự cố do điều tra chậm trễ. Nâng cao khả năng của đội ngũ SOC cấp 1 với threat intelligence từ 15.000 SOC: Tích hợp tra cứu TI vào SOC của bạn.










