Story
Anthropic và Accenture cam kết đầu tư 2 tỷ đô la vào việc đánh giá độc lập mô hình trí tuệ nhân tạo.

Summary
Phòng thí nghiệm AI và tập đoàn tư vấn khổng lồ sẽ mỗi bên đầu tư ít nhất 1 tỷ đô la trong vòng 5 năm để xây dựng năng lực kiểm tra an toàn và độ tin cậy của các mô hình AI tiên tiến, nhằm giải quyết những lo ngại ngày càng tăng trong ngành.
Công ty nghiên cứu AI Anthropic và tập đoàn tư vấn khổng lồ Accenture đang hợp tác trong việc đánh giá độc lập trí tuệ nhân tạo tiên tiến, mỗi công ty cam kết ít nhất 1 tỷ đô la trong vòng 5 năm tới. Khoản đầu tư kết hợp 2 tỷ đô la này nhằm mục đích xây dựng năng lực kiểm thử an toàn và độ tin cậy mạnh mẽ đối với các mô hình AI tiên tiến.
Phản hồi trước áp lực toàn ngành
Sự hợp tác này diễn ra trong bối cảnh các nhà phát triển AI đang phải đối mặt với sự giám sát chặt chẽ hơn từ các cơ quan quản lý, khách hàng doanh nghiệp và công chúng về tính an toàn và khả năng dự đoán của các hệ thống mạnh mẽ nhất của họ. Theo một báo cáo của Reuters, các sự cố gần đây liên quan đến các tác nhân AI được cho là hoạt động bên ngoài môi trường an toàn đã làm gia tăng lo ngại rằng AI có thể phát triển với sự giám sát hạn chế của con người, khiến hành vi của nó khó kiểm soát.
Động thái này diễn ra sau lời kêu gọi từ Giám đốc điều hành của Anthropic, Dario Amodei, đối với các công ty AI về việc giảm tốc độ phát triển mô hình tiên tiến và cấp quyền truy cập lớn hơn cho các nhà đánh giá độc lập. Nó cũng phản ánh các hành động từ các đối thủ cạnh tranh như OpenAI, công ty gần đây đã tuyên bố sẽ bắt đầu công bố các báo cáo về hành vi bất thường của mô hình.
AdMô hình 'Đánh giá nhúng'
Bộ phận chuyên về AI của Accenture, Faculty, sẽ dẫn đầu các nỗ lực đánh giá. Công việc sẽ bao gồm tiến hành đánh giá sự phù hợp, kiểm tra các biện pháp bảo vệ mô hình và thực hiện các bài tập "đội đỏ" để xác định các lỗ hổng.
Anthropic cho biết khoản đầu tư này sẽ hỗ trợ một phương pháp mà họ gọi là "đánh giá nhúng", trong đó các chuyên gia kiểm thử độc lập làm việc từ bên trong công ty AI với quyền truy cập tương tự như một nhân viên. Theo công ty, vị trí thuận lợi này cho phép các nhà đánh giá xem xét hoạt động của công ty, xác minh các cam kết về an toàn và xác định các điểm mù tiềm ẩn. Anthropic và Accenture cũng lưu ý kế hoạch hợp tác với các nhà phát triển và đánh giá AI khác theo cách tương tự.