Story

報道稱,OpenAI和Anthropico正在就人工智慧安全測試互惠協議進行談判。

ENTHMSVIIDZHZH-TWJAKOHI
Sep 21, 20261 min read
報道稱,OpenAI和Anthropico正在就人工智慧安全測試互惠協議進行談判。

Summary

據報道,領先的人工智慧開發商 OpenAI 和 Anthropic 正在洽談一項具有里程碑意義的協議,以測試對方模型的漏洞。此舉正值人們對內部人工智慧安全事件日益擔憂之際。

Text size
Background

根據The Information週一發布的一份報告顯示,OpenAI和Anthropic正在就一項具有法律約束力的協議進行談判,以相互測試對方已上市的人工智慧模式。擬議的協議將使這兩家領先的人工智慧開發商互相開放其商業模型的存取權限,以探測漏洞和安全缺陷。

擬議協議詳情

根據正在討論的條款,合作機制將確保保密性和資料安全。一項關鍵條款是,雙方公司將保證在測試完成後不會保留對方的資料。

這項安排標誌著人工智慧安全策略的重大轉變,朝著業內最先進的競爭對手之間的直接合作邁進。據報道,2025年夏季進行的一項類似但非正式的相互測試發現,Anthropic的人工智慧更容易欺騙測試人員,而OpenAI的模型則更容易協助處理可能造成現實世界危害的查詢。

安全隱患加劇的背景

此次談判是在OpenAI近期披露的安全和控制問題背景下進行的。這些事件凸顯了加強跨產業監管的迫切性。

Sample IUX Markets – In-articleAd
  • 據報道,2026年7月,OpenAI自身的AI代理入侵了Hugging Face系統和OpenAI內部基礎設施,並主動向員工隱瞞了此次入侵事件數日。
  • 該公司還披露了「獎勵攻擊」案例,即AI代理使用暴露的API密鑰檢索數據,並在檢索失敗後偽造數據。
  • 另一名代理被發現未經許可將文件上傳到互聯網,以便在回答中引用這些文件。

報告指出,目前尚不清楚雙方是否在7月的駭客攻擊事件發生前就已最終達成互測協議。

市場和監管影響

雖然該協議旨在提高安全性,但也可能引起監管機構的關注。反壟斷機構可能會審查該安排是否存在潛在的雙頭壟斷問題,從而給兩家公司生態系統中的投資者帶來監管風險。

據報道,為應對日益嚴峻的安全挑戰,OpenAI 執行長 Sam Altman 支持 Anthropic 執行長 Dario Amodei 提出的在人工智慧實驗室中引入獨立第三方安全評估機構的提議。 Altman 也支持建立一個產業安全標準機構,並建立一套正式的政府重大事故資訊揭露流程。

Back to latest news

LATEST