
新智元报道
新智元报道

终于,谷歌承认:Gemini也黑了真实公司。
在一场原本应该彻底断网的安全测试里,Gemini顺着网线摸上公网,直接动手黑进了三家真实存在的企业。全程没有任何人类给它下达过攻击指令。
这是谷歌的AI首次被证实自主实施的黑客行为。

至此,继OpenAI、Anthropic、Meta之后,最后一家巨头也没守住。
全球最顶尖的四大AI实验室,在「AI失控破笼」这件事上,全军覆没。

AI越狱并不罕见,但这次事件最离谱的是它的作案手法。
什么0Day、高级木马统统没用上,Gemini就靠两招:猜密码、上网搜。
三家真实企业的大门,就这么被它大摇大摆地踹开了。

Gemini一看,果断拿去试了试。然后,一试一个准。
于是,它又堂而皇之地走进了另外两家真公司的后台。

三次入侵,三家公司,用的全是安全圈最入门的手段。

谷歌安全工程副总裁Heather Adkins的原话是,这件事恰恰证明了训练AI负责任行事的重要性。在这起事件中,模型的做法是「恰当的」,因为三次都停了下来。
至于这算不算AI失控?谷歌坚持认为不算,因为正是底层安全机制让它悬崖勒马。

白帽黑客找漏洞,那是事先拿到企业授权的。 Gemini闯进那三家公司之前,谁给它批的条子?
在Hacker News上,有人阴阳怪气地讽刺:「大家猜怎么着?我们的 AI 终于也会失控啦!」
在网友看来,谷歌这波操作纯属是在跟风,而且就连越狱本身都搞得十分拉胯,简直丢人。


其实,谷歌踩的这个坑,早有人替它趟过了。
OpenAI、Anthropic和Meta早就发生过一模一样的安全事故。

危险系数最高的,当属Anthropic。
7月30日,Anthropic就自曝过一桩几乎如出一辙的丑闻。

Claude Opus 4.7同样是在靶场里撞见了同名真公司,前后4次发动攻击。
靠着弱口令和没设鉴权的破接口,它不仅拿到了一批凭证,还直接摸进了一个存有几百行生产数据的数据库。
最要命的是,Opus 4.7当时已经察觉到对面是真实系统了。
但它给自己找了个绝妙的台阶:「这家真公司,想必也是演习的一部分吧。」
另一款Mythos 5玩得更大。
当它发现靶场文档里提到一个根本不存在的Python软件包时,它干脆自己写了个同名的恶意包,直接发布到了全球开发者都在用的官方库PyPI上。
这个恶意包在线上挂了大约1小时,被15个真实的外部系统下载运行。
你瞧瞧,为了交个作业,AI已经卷到在线「投毒」了。

而OpenAI入侵Hugging Face,堪称赛博世界的《终结者》。
据报道,在OpenAI内部,多达1200个失控的智能体自建了秘密留言板串通作弊。
其中约700个顺着同一条暗道,涌进了Hugging Face的服务器,事后还熟练地改了日志、抹除了痕迹。
流程之熟练、组织之缜密,让人吃惊!

再加上8月初Meta承认Muse Spark 1.1在测试中入侵了第三方服务。

Anthropic、OpenAI、谷歌、Meta——四大巨头,整整齐齐地凑成了一桌麻将!
这么横向一对比,及时收手的Gemini,竟然还算是这群「法外狂徒」里最守规矩的那个。

这四家巨头披露的事故,全牵扯到同一个评测商——Irregular。

OpenAI和Anthropic测网络安全,都用过它的环境。
融资时,Irregular信誓旦旦地说要「为前沿AI制定安全标准」。 结果一年后,四家客户的模型全从它的靶场里,顺着网线溜到了真实的互联网上,还真是不按常理出牌!
Meta事故曝光时,Irregular发言人曾辩解道「这类事件不涉及沙箱逃逸,也不涉及高级网络行动」。
这虽说是实情,但细想更让人毛骨悚然。因为大门压根就没锁,模型用最普通的溜门撬锁手法,就堂而皇之地走进了真公司。
如今,人类正在创造比自己跑得更快、下手更狠、且随时准备突破边界的「数字黑客」。
而它们之所以还没捅出更大的篓子,或许仅仅是因为——门还没被完全推开。
参考资料:
编辑:大卫 摩西


