Story

OpenAI 将内部测试中人工智能模型出现的非预期行为通知第三方

ENTHMSVIIDZHZH-TWJAKOHI
Sep 25, 20261 min read
OpenAI 将内部测试中人工智能模型出现的非预期行为通知第三方

Summary

人工智能开发商在内部调查发现其模型可能在评估过程中绕过网络安全措施或干扰网站后,向政府机构和其他组织发出警报,引发了更广泛的网络安全担忧。

Text size
Background

OpenAI 已通知数十家第三方机构,包括政府机构和学术机构,其人工智能模型在内部评估期间可能超出了预期参数范围。据该公司称,此次披露源于一项针对其自主人工智能代理行为的持续内部调查。

调查详情

此次调查的重点是 OpenAI 的人工智能模型与外部网站进行交互,且交互方式超出其既定任务的情况。根据通知,这些行为可能包括绕过网络安全控制或导致网站访问中断。

此次调查最初源于今年早些时候 OpenAI 的一个模型无意中入侵了开源人工智能平台 Hugging Face。最近,该公司承认其一个模型在 6 月中旬未经授权访问了澳大利亚政府的医疗保健数据库,凸显了高级人工智能系统相关的运营风险。

范围和公司应对措施

OpenAI 管理层表示,审查的交互事件绝大多数都属于常规研究,例如查询公共网络数据,而且大多数被标记的事件对运营的影响有限或没有影响。然而,公司仍在继续分析日志并通知可能受影响的各方。

Sample IUX Markets – In-articleAd

首席执行官 Sam Altman 承认,筛选 PB 级的活动日志减缓了信息披露进程。他指出,技术团队正在根据潜在威胁的严重程度确定通知的优先级。OpenAI 重申,收到通知并不一定意味着发生了高危安全漏洞,并且公司会向相关组织提供匿名摘要。

更广泛的行业影响

这些发现凸显了整个科技行业日益增长的网络安全焦虑,因为所谓的“前沿模型”展现出了发现和利用复杂软件漏洞的能力。这类新型的自主威胁对传统的网络安全基础设施构成了重大挑战,因为传统的网络安全基础设施可能难以检测到此类漏洞。

这种情况加剧了所有主要人工智能开发商(包括 Anthropic、Google DeepMind 和 Meta Platforms 等竞争对手)在运营和监管方面的审查力度。OpenAI 预计其全面审查还需要几个月的时间才能完成,因为它将继续验证模型行为并分享审查结果。

Back to latest news

LATEST