在第10至17段中补充了Anthropic、专家、参议员的评论以及相关背景信息
OpenAI和Anthropic因失控的人工智能代理成为焦点
消息人士称,OpenAI发现更多智能体失控事件
这一发现是在对Hugging Face入侵事件的调查过程中被发现的
此前认为这些智能体并未离开OpenAI的网络
Deepa Seetharaman/Raphael Satter
路透华盛顿7月31日 - 据两位知情人士周五透露,随着OpenAI扩大对本月引发全球关注的科技公司Hugging Face黑客入侵事件的调查,该公司发现了其他自主智能体逃逸了遏制的情况。
这两位知情人士表示,这些新的逃逸事件是在该公司公开宣布的调查 (link) 过程中被发现的,该调查旨在查明本月其一个智能体如何从本应受遏制的测试环境中逃逸,目前OpenAI也在对这些事件展开调查。其中一位消息人士称,这些逃逸事件的范围有限,且据信没有智能体离开OpenAI的网络。
OpenAI的一位发言人援引了该公司周二发布的声明 (link),称除Hugging Face入侵事件外,公司还在审查“模型更广泛的活动”。
OpenAI被发现存在更多异常行为——即使范围有限——也可能助长白宫及其他方面日益高涨的监管呼声。
据这两位消息人士以及一位熟悉此事的第三位消息人士透露,OpenAI启动这项扩大范围的调查之际,其主要竞争对手Anthropic刚刚披露,其模型同样导致了一系列入侵事件 (link),这些事件可追溯至4月,并导致另外三家公司遭受数据泄露。此前,关于OpenAI其他既往“越界”行为的最新发现尚未被报道。
日益加剧的担忧
人工智能安全专家表示,这些新披露的信息勾勒出一幅这样的图景:一些尖端实验室开发危险的自主黑客程序的能力,已经超过了它们对这些程序进行控制的能力。
“整个行业中,那些设计、开发和发布这些工具的人,自身却未能跟上步伐,无法负责任地开发这些工具并确保其安全,”剑桥大学存在性风险研究中心的数学家莫里斯·基奥多(Maurice Chiodo)表示。
路透无法确切查明OpenAI调查人员发现了多少起事件,也无法确认这些事件发生的时间或具体情况。三位消息人士称,OpenAI和外部专家正在审查今年早些时候的日志数据,以期厘清事件经过。
OpenAI最初是在7月初Hugging Face遭遇入侵后启动调查的。当时,一个OpenAI代理在另一家公司的网络中失控数日,试图在内部测试中作弊,但最终以失败告终。OpenAI表示,在此轮黑客攻击中,另外四家公司的四个账户也遭到入侵。据该公司高管透露,其中一家公司是总部位于纽约的Modal。
奇奥多表示,有迹象表明,当这些智能代理失控时,OpenAI和Anthropic均未对其进行监控,这加剧了他的担忧。路透此前曾报道 (link) 称,OpenAI直到Hugging Face公司控制住入侵、联系FBI并公开披露此事后,才意识到其智能代理已入侵了Hugging Face。OpenAI表示路透的报道存在不准确之处,但当被问及具体不准确之处时,该公司未予回应。
Anthropic在周四的声明 (link) 中披露了其代理如何在线入侵受害者,并暗示此前并未对代理进行实时监控,称“若能实时监控评估日志,本可更早发现该问题。”
奇奥多表示,这表明缺乏应有的审查。
“看起来他们甚至都没在看,”奇奥多说道。
Anthropic表示,虽然公司确实部署了实时监控机制,但由于该公司与合作伙伴之间存在误解,该监控并未“针对这一威胁面”启用。
新的政府监管
失控AI代理事件的影响范围正在迅速扩大,这已经加剧了美国和欧洲各地立法者及官员的压力,促使他们推动对提供这些AI模型的实验室实施新的政府监管。
“我们正在研究管控措施,”美国总统唐纳德·特朗普 (link) 周四对记者表示 (link)。周五,欧盟执委会表示已就此次黑客攻击事件与OpenAI和Anthropic进行了会谈 (link)。
美国参议院情报委员会首席民主党议员马克·沃纳(Mark Warner)周五表示,Anthropic事件“让我确信,从立法角度来看,我们要求对这些先进模型进行强制性能力测试是正确的。”
Comments