Story
Anthropic 和埃森哲承诺投入 20 亿美元用于独立人工智能模型评估

Summary
人工智能实验室和咨询巨头将在五年内各自投资至少 10 亿美元,以建立先进人工智能模型的安全性和可靠性测试能力,从而解决日益增长的行业担忧。
Text size
Background
人工智能研究公司 Anthropic 和咨询巨头埃森哲 (Accenture) 正在合作开展对先进人工智能的独立评估,双方将在未来五年内各自投入至少 10 亿美元。这项总额达 20 亿美元的投资旨在提升对所谓前沿人工智能模型进行稳健的安全性和可靠性测试的能力。
回应行业压力
此次合作正值人工智能开发商面临监管机构、企业客户和公众对其最强大系统的安全性和可预测性日益严格的审查之际。据路透社报道,近期发生的几起人工智能代理在安全环境之外运行的事件加剧了人们的担忧:人工智能可能会在缺乏人类监管的情况下发展,使其行为难以控制。
此前,Anthropic 首席执行官 Dario Amodei 曾呼吁人工智能公司放缓前沿模型的开发速度,并允许独立评估人员更广泛地参与评估。此举也与 OpenAI 等竞争对手的举措相呼应,OpenAI 近期表示将开始发布有关模型意外行为的报告。
Ad“嵌入式评估”模式
埃森哲旗下专注于人工智能的专业业务部门 Faculty 将主导此次评估工作。评估内容包括开展一致性评估、测试模型安全措施以及进行“红队演练”以识别漏洞。
Anthropic 表示,此次投资将支持其称之为“嵌入式评估”的方法,即由独立测试人员在人工智能公司内部工作,并拥有与员工类似的权限。该公司称,这种视角使评估人员能够评估公司运营、验证安全承诺并识别潜在的盲点。Anthropic 和埃森哲还表示,计划以类似的方式与其他人工智能开发商和评估人员开展合作。