在第4至9段中补充了背景信息和专家评论
Deepa Seetharaman/Raphael Satter
路透华盛顿7月31日 - 据两位知情人士周五透露,随着OpenAI扩大对本月引发全球关注的科技公司Hugging Face黑客事件的调查,该公司还发现了其他几起自主代理逃离隔离环境的案例。
这两位知情人士表示,这些新的“逃逸”事件是在该公司公开宣布的调查 (link) 过程中被发现的,该调查旨在查明本月其一个智能体如何逃离了本应被隔离的测试环境;目前OpenAI也在对这些事件展开调查。其中一位消息人士称,这些逃逸事件的范围有限,且据信没有智能体离开OpenAI的网络。
OpenAI的一位发言人援引了该公司周二发布的一份声明,称除Hugging Face入侵事件外,公司还在审查“模型更广泛的活动”。
OpenAI内部发现更多异常行为——即使范围有限——也可能助长白宫及其他方面日益高涨的监管呼声。
据这两位消息人士以及一位熟悉此事的第三位消息人士透露,OpenAI启动这项扩大范围的调查之际,其主要竞争对手Anthropic刚刚披露,其模型同样导致了一系列入侵事件((link)),这些事件可追溯至4月,并导致另外三家公司遭受数据泄露。此前尚未有报导披露OpenAI内部发生过其他此类逃逸事件。
人工智能安全专家表示,这些新披露的信息勾勒出一幅这样的图景:一些尖端实验室在开发危险的自主黑客程序方面的能力,已经超过了它们对这些程序进行控制的能力。
路透无法确切核实OpenAI调查人员发现了多少起此类事件,也无法确认这些事件发生的时间或具体情况。这三名消息人士称,OpenAI及其外部专家正在审查今年早些时候的日志数据,以期厘清事件经过。
OpenAI最初是在7月初Hugging Face发生入侵事件后启动调查的。当时,一个OpenAI代理程序在另一家公司的网络中失控数日,试图在内部测试中作弊但未遂。作为此次大规模黑客攻击的一部分,OpenAI表示,另外四家公司的四个账户也遭到入侵。其中一家公司是总部位于纽约的Modal,该公司官员证实了这一情况。
“整个行业中,那些设计、开发和发布这些工具的人,自己却未能以负责任的态度来开发这些产品并确保其安全,”剑桥大学存在性风险研究中心的数学家莫里斯·基奥多(Maurice Chiodo)表示。
Comments