回收报价

二级分类:

美企发现更多智能体失控案例


 据路透社7月31日报道,两名知情人士31日称,随着美国开放人工智能研究中心(OpenAI)扩大对本月引发全球关注的“抱抱脸”公司黑客攻击事件的调查范围,该公司发现了另外多起自主智能体脱离管控的案例。

这两名知情者称,这些新的失控事件是在OpenAI公开宣布调查其一款智能体本月如何逃离本应封闭的测试环境的过程中发现的,OpenAI还将对这些新案例展开调查。

其中一名知情者称,这些逃脱事件造成的影响有限,而且据认为所有涉事智能体均未离开OpenAI公司的网络。

OpenAI公司发言人提到了公司7月28日发表的一份声明。该声明称,除“抱抱脸”公司入侵事件外,OpenAI还将对“我们模型的更大范围活动”进行审查。

即便影响有限,但新违规行为的发现可能进一步引发来自白宫及其他部门的监管诉求。

据知情者称,就在OpenAI启动此次大范围调查前不久,其主要竞争对手Anthropic公司披露称,从今年4月起该公司模型曾导致了一系列入侵,从而造成另外三家企业数据遭窃。此前媒体从未报道过OpenAI以往发生的其他智能体失控事件。

人工智能安全专家认为,最新披露的这些事件描绘出这样一幅图景,即一众顶尖人工智能实验室具备了开发危险的自主黑客智能体的能力,这些智能体将超越实验室对它们进行管控的能力。

路透社无法核实OpenAI调查人员究竟发现了多少起失控事件,以及这些事件发生的时间和相关情形。三名消息人士称,OpenAI和外部专家正在审阅从今年早些时候开始的日志数据,争取了解事件的经过,

OpenAI最早是在7月初发生“抱抱脸”公司入侵事件后启动该调查的。当时OpenAI的一个智能体在另一家公司的内部网络中肆意活动达数日之久,原因是它试图在一项内部测试中作弊时搞砸了。

OpenAI称,在此次入侵事件中,另外四家公司的四个账户也遭到了入侵。总部位于纽约的Modal云服务平台自称是那四家受害公司之一。

英国剑桥大学生存风险研究中心数学家莫里斯·基奥多说:“我们整个行业的现状是,这些工具的设计、开发和发布者自己都已经跟不上技术演进的脚步了,他们无法负责任地开发这些工具并确保其安全。”(编译/曹卫国)