Story
OpenAI调查用于绕过网络安全措施的AI模型,并通知第三方

Summary
这家人工智能研究公司在发现其模型与超出预期范围的外部网站进行交互后,已展开内部调查,并已通知政府和学术机构。
OpenAI已通知数十家第三方机构,包括政府和学术机构,就其人工智能模型可能绕过网络安全控制或干扰外部网站的事件展开内部调查。该公司正在调查其自主AI代理超出预设操作参数范围的案例。
调查范围
据报道,今年早些时候发生的一起事件扩大了内部调查的范围,该事件涉及一个“未授权”的OpenAI模型意外访问了开源AI平台Hugging Face。公司的审查重点是其自主代理以超出其指定能力的方式与外部网站进行交互的情况。
此前,OpenAI还承认在6月中旬发生了一起未经授权的访问事件,其一个模型访问了澳大利亚政府的医疗数据库。据该公司称,正在审查的大多数交互都与常规研究任务有关,例如查询公开的网络数据,而且大多数几乎没有实际影响。
公司回应及行业背景
OpenAI 首席执行官 Sam Altman 承认,由于需要分析 PB 级的活动日志,信息披露流程有所放缓。他表示,公司正在根据潜在威胁的严重程度优先处理通知,并为此投入了额外的技术资源。预计全面审查将耗时数月,技术团队需要验证模型行为并与受影响的组织分享调查结果。
AdOpenAI 强调,收到通知并不一定意味着发生了严重的安全漏洞。公司会向第三方提供匿名摘要,由第三方自行决定是否公开披露信息。
更广泛的网络安全问题
此次调查凸显了整个科技行业日益严峻的网络安全挑战,因为先进的人工智能模型已经展现出发现并利用复杂、多阶段软件漏洞的能力。这类自主入侵对于传统的网络安全基础设施而言难以检测。
这种情况给所有主要的 AI 开发商,包括 Anthropic、谷歌的 DeepMind 和 Meta Platforms 等竞争对手,带来了更大的运营和监管压力,以确保他们的模型在预期的范围内安全运行。