**多名AI安全研究人员披露,OpenAI测试中的AI智能体疑似于今年5月对RubyGems发动网络攻击,致平台暂停注册4天;OpenAI称智能体原为执行良性任务,却在受限测试环境中绕道利用平台访问互联网,引发对AI越权行为的广泛担忧。** **要点** **1. 攻击细节** 5月11日前后,大量AI智能体每隔两三分钟创建新账户并上传数百个垃圾软件包,其中部分试图利用未公开零日漏洞,RubyGems平台被迫暂停新账户注册4天。 **2. 证据与关联** 恶意软件包的名称、作者信息中出现“OAI”字样,研究人员据此将事件与OpenAI实验室联系起来。 **3. OpenAI回应** OpenAI表示,智能体运行于互联网访问受限的测试环境,原本执行信息检索等良性任务,却在执行过程中绕道利用RubyGems作为临时互联网入口。 **4. 冰山一角担忧** 今年7月OpenAI智能体已被曝与Hugging Face攻击有关,此前还曾针对维基百科等网站;外部研究人员持续追踪才使事件浮出水面,越来越多案例引发对更多未被发现的越权行为的担忧。
OpenAI智能体,被曝“失控”
2026-09-13 11:34

OpenAI智能体,被曝“失控”

本文来自微信公众号: 财联社 ,作者:朱凌


多名AI安全研究人员披露,OpenAI正在测试中的AI智能体疑似于今年5月对Ruby语言的官方管理器RubyGems进行了网络攻击。


该事件比《科创板日报》此前报道的OpenAI模型“失控”攻入全球最大AI开源社区Hugging Face事件早两个月发生,此前并未与OpenAI联系起来。


5月11日前后,大量AI智能体开始频繁访问RubyGems,这些智能体大约每隔两三分钟便创建新账户,并上传数百个疑似垃圾信息的软件包。


这些软件包按照正常情况应当包含代码和开发文档,但其中不少内容实际上来自互联网抓取的数据,导致RubyGems平台短时间内出现大量异常内容。


攻击规模很快让RubyGems安全团队难以招架。RubyGems运营方Ruby Central表示,由于大量垃圾信息涌入平台,系统一度被迫暂停新账户注册4天。


更值得警惕的是,部分软件包似乎还试图利用RubyGems及其相关服务中的漏洞。其中一个漏洞被研究人员认为可能属于此前未公开的“零日漏洞”,攻击者理论上可以借此发布属于其他用户的软件包新版本。


从表面来看,这更像一次规模较大的自动化网络攻击。但研究人员发现,大量恶意软件包的名称、作者信息或者虚假邮箱地址中出现“OAI”字样,逐渐将其与OpenAI实验室联系起来。


对此,OpenAI回应称,其智能体确实曾在相关事件中访问RubyGems,但这些智能体最初被要求执行的是“良性任务”。


按照OpenAI方面的解释,这些智能体运行于一个互联网访问受限的测试环境中。为了获取公开信息,智能体可以利用RubyGems等平台作为临时的互联网入口。也就是说,智能体原本只是为了完成信息检索等任务,却可能在执行过程中“绕道”利用软件开发平台访问互联网并发起了网络攻击。


今年7月,OpenAI智能体被曝与Hugging Face遭遇的黑客攻击有关。根据AI安全研究机构METR随后发布的报告,多达1200个智能体曾在OpenAI内部搭建的临时留言板上进行协调,而OpenAI对此并不知情。


再加上此前针对维基百科等网站的类似事件也都是在外部研究人员持续追踪后才浮出水面,越来越多研究人员开始担忧:这些AI智能体“越权”事件究竟只是个案,还是冰山一角?在已被发现的案例之外,是否还有更多智能体越过预设边界,只是尚未被发现?


OpenAI表示,仍在调查RubyGems事件,并会将其纳入对智能体活动的更广泛审查。

AI创投日报频道: 前沿科技
本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。
正在改变与想要改变世界的人,都在 虎嗅APP