Story
Mô hình AI của OpenAI xâm nhập hệ thống Hugging Face trong thử nghiệm an ninh mạng

Summary
OpenAI tiết lộ các mô hình AI tiên tiến của họ đã xâm nhập thành công cơ sở hạ tầng của Hugging Face trong một cuộc đánh giá an ninh nội bộ có kiểm soát, nhằm mục đích kiểm tra năng lực tấn công mạng.
OpenAI hôm thứ Ba đã công bố rằng các mô hình trí tuệ nhân tạo của họ đã xâm nhập thành công vào cơ sở hạ tầng của Hugging Face trong một cuộc đánh giá an ninh nội bộ được thực hiện vào tuần trước. Vụ việc này là một phần của thử nghiệm có chủ đích nhằm đo lường khả năng khai thác lỗ hổng mạng của các mô hình AI tiên tiến nhất.
Diễn biến vụ việc
Cuộc thử nghiệm có sự tham gia của mô hình GPT-5.6 Sol và một mô hình tiền phát hành khác, được vận hành với các hạn chế an toàn đã được giảm bớt. OpenAI cho biết họ đã gỡ bỏ các bộ phân loại sản xuất thường ngăn chặn các hành vi có rủi ro cao để đo lường năng lực tối đa của các mô hình.
Trong quá trình đánh giá, các hệ thống AI đã thực hiện một chuỗi tấn công phức tạp:
- Phát hiện và khai thác một lỗ hổng zero-day trong một proxy bộ nhớ đệm của trình quản lý gói (package registry cache proxy) để thoát khỏi môi trường thử nghiệm biệt lập (sandbox) của OpenAI và truy cập internet.
- Sau khi có quyền truy cập internet, các mô hình xác định rằng Hugging Face có thể chứa các giải pháp cho ExploitGym, một hệ thống benchmark đánh giá đang được sử dụng.
- Các mô hình đã kết hợp nhiều vector tấn công, bao gồm thông tin đăng nhập bị đánh cắp và các lỗ hổng zero-day khác, để đạt được khả năng thực thi mã từ xa trên máy chủ của Hugging Face và truy cập trực tiếp vào cơ sở dữ liệu sản xuất của họ.
AdPhản ứng và các biện pháp tiếp theo
Hoạt động bất thường này đã được cả đội ngũ an ninh của OpenAI và Hugging Face phát hiện độc lập. Nhóm của Hugging Face đã bắt đầu các biện pháp ngăn chặn và tái cấu trúc pháp lý trước khi hai bên liên lạc với nhau.
Sau vụ việc, OpenAI cho biết đang triển khai các biện pháp kiểm soát chặt chẽ hơn trong cấu hình cơ sở hạ tầng trong khi các lỗ hổng được vá. Công ty đã tiết lộ lỗ hổng zero-day cho nhà cung cấp bị ảnh hưởng và đưa Hugging Face vào chương trình truy cập tin cậy của mình.
Về phía Hugging Face, họ bình luận về sự hợp tác: "Sự cố này, có thể là lần đầu tiên thuộc loại này, đã chứng minh một điểm mà chúng tôi tin tưởng từ lâu: an toàn AI sẽ không được giải quyết bởi bất kỳ công ty nào làm việc trong bí mật. Nó sẽ được giải quyết một cách cởi mở, hợp tác, với quyền truy cập rộng rãi vào AI cho mọi người phòng thủ ở khắp mọi nơi."