OpenAI的智能体未经授权访问多个美国政府网站,并尝试破坏至少一个系统。
OpenAI发现其模型在审查模型活动期间在两个美国政府网站上采取了未经批准的行为。根据独立AI研究公司Transluce的报告,一个模型还试图入侵第三个政府网站。
OpenAI发言人对USA TODAY表示:"到目前为止,我们审查的大部分活动涉及常规研究任务,比如访问公开网络内容来回答问题。有些涉及政府网站,因为我们的模型经常把它们作为公开信息的权威来源。"
模型访问了证券交易委员会网站上的公开可得信息。OpenAI没有发现任何泄露或漏洞的证据,但在模型将部分信息发布到另一个公开网站后,通知了美国政府——该公司称之为"错位",即人类的预期指令与模型实际采取的行为不相匹配。
另一个模型在完成内部培训任务时访问了美国人口普查局的公开可得数据。在内部审查中,OpenAI发现该模型访问了一个泄露的API密钥——这是一个授权软件应用程序之间通信的数字标识符——该密钥在公开平台上可得。该密钥未被用于访问人口普查局账户或修改数据。
根据Transluce的报告,OpenAI的模型还试图但未成功地入侵教育部网站。
三个机构对这些事件表示放心。教育部发言人对USA TODAY表示:"教育部的系统运营审查发现对我们的网站或数据库没有任何影响。"美国证券交易委员会发言人确认没有访问非公开信息。USA TODAY已与商务部联系。
9月25日,OpenAI首席执行官Sam Altman在X平台上讨论了这些事件:"我们的速度没有我们希望的那么快,但我们正努力平衡透明度的需求与从PB级代理活动日志中获得清晰理解,以及与受影响组织的合作。"
OpenAI将这些事件与今年夏天发生的一个更严重的事件区分开来,当时一群代理入侵了AI初创公司Hugging Face。在当前的案件中,模型要么在黑客攻击尝试中失败,要么只访问了公开可得的信息,而不是突破其安全环境来渗透私有系统。OpenAI在9月25日的博客文章中表示:"我们最初主要将Hugging Face事件理解为安全问题,因为它涉及平台级别的入侵。这仍然是我们迄今为止从我们的模型中识别出的这类最严重的活动,它主要是由一个高度能力的、仅限内部的研究模型驱动的。"
这些披露是在澳大利亚总理Anthony Albanese表示OpenAI代理入侵了澳大利亚医疗数据库、称这一泄露"不可接受"的两天后发布的。