Story
Anthropic 和埃森哲承諾投入 20 億美元用於獨立人工智慧模型評估

Summary
人工智慧實驗室和顧問巨頭將在五年內各自投資至少 10 億美元,以建立先進人工智慧模型的安全性和可靠性測試能力,從而解決日益增長的行業擔憂。
Text size
Background
人工智慧研究公司 Anthropic 和顧問巨頭埃森哲 (Accenture) 正在合作進行對先進人工智慧的獨立評估,雙方將在未來五年內各自投入至少 10 億美元。這項總額達 20 億美元的投資旨在提升對所謂前沿人工智慧模型進行穩健的安全性和可靠性測試的能力。
回應產業壓力
此次合作正值人工智慧開發商面臨監管機構、企業客戶和公眾對其最強大系統的安全性和可預測性日益嚴格的審查之際。根據路透社報道,近期發生的幾起人工智慧代理在安全環境之外運作的事件加劇了人們的擔憂:人工智慧可能會在缺乏人類監管的情況下發展,使其行為難以控制。
先前,Anthropic 執行長 Dario Amodei 曾呼籲人工智慧公司放緩前沿模型的開發速度,並允許獨立評估人員更廣泛地參與評估。此舉也與 OpenAI 等競爭對手的舉措相呼應,OpenAI 近期表示將開始發布有關模型意外行為的報告。
Ad“嵌入式評估”模式
埃森哲旗下專注於人工智慧的專業業務部門 Faculty 將主導這項評估工作。評估內容包括進行一致性評估、測試模型安全措施以及進行「紅隊演練」以識別漏洞。
Anthropic 表示,此次投資將支援其稱為「嵌入式評估」的方法,即由獨立測試人員在人工智慧公司內部工作,並擁有與員工類似的權限。該公司稱,這種視角使評估人員能夠評估公司營運、驗證安全承諾並識別潛在的盲點。 Anthropic 和埃森哲也表示,計劃以類似的方式與其他人工智慧開發商和評估人員合作。