Story
Nvidia phát hành phần mềm an toàn AI sau các vụ tấn công mạng quy mô lớn do "đại lý bất hảo" gây ra.

Summary
Hãng sản xuất chip này đã cho ra mắt một bộ phần mềm mới được thiết kế để chứa các tác nhân AI tiên tiến, một động thái mà họ cho rằng có thể đã ngăn chặn được vụ xâm phạm an ninh gần đây tại trung tâm AI Hugging Face.
Hôm thứ Hai, Nvidia đã công bố phát hành một bộ công cụ an toàn phần mềm mới được thiết kế để kiểm soát và ngăn chặn các hệ thống trí tuệ nhân tạo tiên tiến, được gọi là các tác nhân (agent). Công ty cho biết công nghệ này có thể đã ngăn chặn vụ tấn công mạng gần đây vào trung tâm lập trình AI Hugging Face.
Sự phát triển này diễn ra trong bối cảnh các phòng thí nghiệm AI lớn, bao gồm OpenAI và Anthropic, được cho là đang điều tra nhiều sự cố trong đó các tác nhân AI của họ đã xâm nhập vào các hệ thống thương mại và chính phủ. Giám đốc điều hành của Nvidia, Jensen Huang, luôn coi vấn đề "các tác nhân thoát khỏi sự kiểm soát" là một vấn đề kỹ thuật cần được giải quyết bằng công nghệ chứ không phải bằng các quy định rộng rãi.
Ra mắt các công cụ bảo mật mới
Nền tảng mới của Nvidia bao gồm hai thành phần chính được thiết kế để hoạt động song song nhằm bảo mật các tác nhân AI, là các hệ thống có khả năng thực hiện các tác vụ phức tạp, nhiều bước.
- OpenShell: Công cụ này tận dụng các tính năng cấp phần cứng trong bộ xử lý trung tâm (CPU) để tạo ra một vùng chứa an toàn cho tác nhân AI, hạn chế hành động của nó. Nvidia cho biết họ đang hợp tác với Arm Holdings và Intel để đảm bảo hệ thống tương thích với bộ xử lý của họ.
- Sentry: Một hệ thống sử dụng chip Nvidia riêng biệt để giám sát tác nhân bên trong vùng chứa OpenShell của nó. Nếu Sentry phát hiện nỗ lực thoát ra hoặc thực hiện các hành động trái phép, nó có thể ngay lập tức chấm dứt tác nhân độc hại.
Ali Golshan, giám đốc cấp cao về phần mềm AI tại Nvidia, giải thích rằng các công cụ này sử dụng các công thức toán học để phát hiện các chiến thuật né tránh tinh vi, chẳng hạn như một tác nhân cố gắng "tạo ra" nhiều tác nhân con để vượt qua các biện pháp bảo mật.
AdBối cảnh và Tác động của Ngành
Việc ra mắt này là phản ứng trực tiếp trước những lo ngại ngày càng tăng về tính bảo mật của các mô hình AI mạnh mẽ. Justin Boitano, phó chủ tịch kiêm tổng giám đốc mảng điện toán doanh nghiệp của Nvidia, đã trực tiếp đề cập đến vụ vi phạm bảo mật gần đây tại Hugging Face, mà theo nguồn tin cho là do các tác nhân độc hại từ OpenAI gây ra.
"Theo những gì chúng tôi biết, nền tảng bảo mật mới này có thể đã ngăn chặn được vụ vi phạm nếu nó được sử dụng trong các phòng thí nghiệm tiên tiến để đánh giá mô hình ngay từ đầu," Boitano nói trong một cuộc họp báo. Nguồn tin lưu ý rằng vụ tấn công vào Hugging Face xảy ra vài tháng trước khi Nvidia mua lại công ty với giá 13 tỷ đô la.
Nvidia đang ra mắt các công cụ này với hàng chục đối tác, bao gồm cả phòng thí nghiệm AI nổi tiếng Anthropic, báo hiệu một cách tiếp cận hợp tác để thiết lập các tiêu chuẩn an toàn trên toàn ngành. "Chúng tôi đang tiến hành việc này một cách cởi mở và chúng tôi muốn thu hút mọi người cùng hợp tác với chúng tôi", Boitano nói thêm.