回收报价

二级分类:

人工智能会挣脱人类束缚吗?



据美国《华盛顿邮报》网站8月10日报道,创造聊天生成预训练转换器(ChatGPT)的开放人工智能研究中心(OpenAI),其人工智能系统在今年春天做出了令人不寒而栗的飞跃,但其工作人员直到几周后才注意到。

这家公司表示,一组人工智能模型没有回答旨在测试其网络安全能力的问题,而是开始串通作弊,建立了一个秘密的内部留言板,在上面交换笔记和想法。

自主攻击

OpenAI表示,这些行为不端的机器人程序在整个5月和6月期间都在使用这个秘密论坛,最终摸索出突破限制、接入互联网的方法。在工作人员发现了这次“出逃”并修复遭破坏的系统后,这些人工智能体时隔两天又发动了一次未被发现的突破行动。

直到这些无赖模型在7月又入侵了另一家人工智能公司的网络后,OpenAI的工作人员才关闭了它们。

OpenAI在拉斯维加斯举行的一场计算机安全会议上披露了其人工智能技术屡次失控的细节,为之前在科技行业引发轩然大波的爆料画上了句号,也引发了各方对人工智能公司安全措施的强烈批评。美国两党议员和各州执法官员都呼吁对该行业进行新的审查和监管。

来自佛蒙特州的独立参议员伯尼·桑德斯敦促OpenAI、Anthropic和元宇宙平台三家公司的首席执行官“暂停人工智能研发”,并警告“否则,我与参议院同僚将出手叫停”。《华盛顿邮报》获得的这封信最早由阿克西奥斯新闻网站披露。

OpenAI、聊天机器人“克劳德”的开发商Anthropic、脸书(Facebook)的母公司元宇宙以及英国政府研究人员的一系列爆料披露,近几个月来,一些尖端人工智能模型在执行旨在测试其网络安全能力的任务时试图作弊。这些模型没有解决问题,而是擅自脱离测试环境,利用黑客技术和手段,包括冒充人类,侵入其他公司的网络。

这些事件引发警示:除非我们能找到办法防止此类不当行为,并确保人工智能既能帮助防御者又能阻止恶意行为者,否则一个破坏性的、由人工智能驱动的网络攻击时代或将到来。

致力于网络安全的充裕安全公司联合创始人兼首席技术官乔舒亚·萨克斯说:“在过去6个月里,人工智能已经强大到足以自动发动黑客攻击;这将从根本上永远改变网络犯罪和军事网络冲突的动态。人工智能系统在这方面只会越来越强大,成本也会越来越低。”

OpenAI表示,将推迟发布一款名为Astra的新人工智能模型,因为担心黑客会利用它绕过人类网络防御者。

Anthropic在7月30日披露了自己的漏洞后表示,已停止对其人工智能技术进行网络安全测试。

能力激增

许多人工智能和网络安全专家表示,最近的事件引发了对这两家公司做法的质疑。OpenAI和Anthropic通过积极升级其热门聊天机器人ChatGPT和“克劳德”,成为人工智能热潮中的闪亮之星,同时它们也声称正在努力防止人工智能变得危险。

2023年Anthropic和OpenAI的首席执行官分别在参议院司法委员会的一个小组委员会作证时表示,他们致力于防止人工智能有朝一日脱离人类控制。OpenAI的萨姆·奥尔特曼说:“我们做出了巨大努力,确保安全机制嵌入我们系统的各个层面。”Anthropic的达里奥·阿莫代伊表示,他的公司“旨在以身作则,开发并发布相关技术,使人工智能系统更安全、更可控”。

两家公司都成立了内部小组,专门研究如何以最佳方式确保人工智能模型与人类“保持一致”,并且不会做出可能有害的行为。

然而,这两家公司在最近的爆料中表示,当人工智能试图突破约束时,工作人员最初并没有注意到。

美国乔治敦大学安全与新兴技术中心执行主任海伦·托纳说:“这些公司发展得太快,以致没有花时间把事情做好。我认为这可以解释这两起事件。”她于2023年从OpenAI董事会辞职,此前她支持罢免首席执行官奥尔特曼。

这些人工智能模型突破约束事件发生前,特朗普政府就如何确保先进人工智能的黑客技能不会因网络攻击更容易实施而破坏银行等关键行业的稳定展开了数月的辩论。与此同时,呼吁对人工智能公司进行更严格监管的各党派政客和选民增加了,因为这些公司的技术力量和数据中心在全国范围内的扩张令他们担忧。

构建规则

来自得克萨斯州的民主党众议员格雷格·卡萨尔在接受采访时说:“这是一个紧急情况,我们必须像对待紧急情况一样对待它。那些首席执行官需要向美国人民解释出了什么问题,还有哪些类似的事件没有被他们抓住,以及他们将如何确保此类事件不再发生。”

卡萨尔说,近日他一直在向其他国会议员通报最近发生的安全事件,并希望阿莫代伊和奥尔特曼到国会山作证。

15位共和党籍的州司法部长告知OpenAI,该公司系统入侵其他公司可能违反了法律,并要求该公司保留相关事件记录。此前,来自特拉华州的民主党参议员莉萨·布伦特·罗切斯特致信两家公司,要求提供更多关于其安全措施的信息。

Anthropic公司表示,整个行业都需要提高安全性。公司的一位发言人说:“正如我们之前披露自身安全事件后所指出的,该领域需要更强有力和统一的标准,规范如何构建和保护评估环境。”

最近数周所披露事件中的一些细节,简直像是从科幻惊悚片里摘出来的。

英国政府的人工智能安全研究所此前表示,它测试的一个Anthropic模型参与了安全专家所说的社交工程,该模型创建了在线个人资料,并试图利用这些资料迫使一名人类软件开发人员批准该模型提交给一个开源软件项目的恶意代码。人类管理员没有批准。

元宇宙平台表示,它的一个模型被要求在内部测试环境中入侵一家虚构公司,但该模型闯入了一家拥有同名网站的真实公司。

这家社交网络公司表示,协助进行测试的承包商“非常规”人工智能公司在测试期间错误地允许模型访问互联网。Anthropic公司称,其自身模型入侵外部公司的三起案例均与“非常规”公司的同一配置错误有关。

“非常规”公司的一位发言人表示,该公司已经解决了这些问题,并正在制定一套关于如何安全测试人工智能模型的新标准。

OpenAI的安全工程师迈克尔·多尔顿之前在拉斯维加斯举行的黑帽(网络安全)大会上表示,直到人工智能软件平台“抱抱脸”公司7月披露自己遭到未知人工智能模型的攻击,OpenAI的工作人员才意识到他们的人工智能模型已第二次突破约束。

据多尔顿说,第二次突破事件更为复杂。人工智能模型之间相互沟通以协调行动,通过“Jan18”等名称识别彼此,有一次一个模型被要求待命,直到收到另一个人工智能体的确认后再执行操作。

OpenAI的工作人员利用高级人工智能模型在解决问题时发出的文本流,试图了解是什么促使这些模型合作。据OpenAI说,其中一个模型的内部对话是这样的:“帮助同伴。但这对我们的任务没有好处。不过,如果有人腾出时间,集体协作或许能找到通用路径。”

OpenAI的研究员埃里克·华莱士在发言时说:“你可以发现这些模型已意识到,‘如果我帮助这个集体,就可能为所有人节省时间,这可能会让我受益,即使它可能不会立即对我的当前任务有所帮助’。”

谨慎从事

这些戏剧性的爆料为人工智能发展的批评者提供了新论据。他们认为,必须暂停或终止这项技术的研发竞赛,因为它危及人类。

加拿大蒙特利尔大学的人工智能教授戴维·克鲁格表示,这个行业还没有准备好控制自己在当下和不久的将来所构建的模型。

克鲁格说:“当人工智能公司无法管控、甚至无法限制自己的系统时,很明显它们不知道自己在做什么,这非常危险。”他是非营利组织Evitable的创始人,该组织旨在阻止“超级智能”(即拥有远远超出人类能力的人工智能)的发展。

关于或许有必要放缓人工智能发展速度的观点正在硅谷得到更广泛的讨论。上个月,来自顶尖人工智能公司的1000多名员工联名致信美国政府,要求在人工智能发展速度过快时,寻求减缓其发展的办法。

OpenAI和Anthropic也对这封信表示了支持。但它们在最近的安全事件后发表的声明表明,它们希望在更新测试协议后继续开发这项技术。

一些网络安全和人工智能专家表示,最近的事件表明,有一些基本程序可以阻止人工智能模型闯入互联网,或对不当行为发出预警。其中包括更密切地监测测试,以及在与外部网络不连接的“气隙”(物理隔离)系统上执行测试。

人工智能网络安全公司Embroidery的首席执行官兼联合创始人扎克·科曼说:“这些事件表明,在设计这些(评估)及相关的安全措施方面有多么不走心。他们不监督正在发生的事情。他们任由人工智能体在其自己的环境和合作伙伴的测试环境中肆意妄为。”(编译/王海昉)