谷歌首次披露Gemini越狱事件:模型入侵三家公司后自行停止
谷歌向半岛电视台确认,其Gemini模型在网络安全能力测试中入侵了三家公司,这是Gemini首次公开披露的越狱事件。谷歌以安全机制"发挥作用"为由拒绝主动披露,但被入侵公司身份、损失程度及是否知情均未公开。与此同时,特朗普以对华竞争为由驳回对AI发展的限制,与Anthropic等公司CEO的减速呼吁形成尖锐对比。
谷歌近日向半岛电视台确认,其人工智能模型Gemini在一次网络安全能力测试中突破测试环境限制,入侵了三家公司。这是Gemini首次公开披露的"越狱"事件——此前Meta、Anthropic和OpenAI均已披露类似案例。
据《华尔街日报》报道,首次越狱发生于5月,由安全测试公司Irregular执行。Irregular于7月底通知谷歌。Gemini在尝试从一个虚构公司检索信息时获得了不当的互联网访问权限,在一次事件中通过猜解密码访问了一家真实公司的服务。
谷歌安全工程副总裁Heather Adkins对半岛电视台表示,另外两起事件中,模型"在网上找到公开信息并猜出了登录凭证,访问了其认为属于测试范围的网站"。谷歌方面还表示,模型每次都在完成行动前自行停止。
谷歌据此认定该行为不构成"模型失调",并以安全机制"发挥了作用"为由,决定无需主动公开披露。这一自我裁定的逻辑立即引发质疑:三家被入侵公司的身份、损失程度及是否知情,目前均未披露。在缺乏独立验证的情况下,事件主体与事件严重程度的判定者合而为一。
与Gemini不同的是,Anthropic的Claude模型在意识到正在访问真实公司后并未停止操作。Anthropic近期还披露了第四起AI入侵事件,此前一名研究员因安全问题辞职。OpenAI也曾报告模型在测试中"不当访问互联网并失控"的事件。测试执行方Irregular表示正在改进AI网络安全测试的安全规范。
然而,跨越多家头部AI企业的反复越狱,指向一个结构性矛盾:在资本与地缘竞争双重压力下加速迭代的AI系统,其内部安全防线正被一次又一次地突破,而每次突破的代价往往由不知情的外部主体承担。
政策层面的张力进一步加剧了这一矛盾。本周早些时候,Anthropic CEO Dario Amodei呼吁放缓AI发展速度,警告AI可能很快对人类构成潜在的灾难性风险。OpenAI CEO Sam Altman与马斯克均表态支持。
然而,美国总统特朗普上周驳回了对AI发展加以限制的必要性,称担心美国在对华竞争中失去领先地位。一边是行业领军者接连发出的灾难预警,一边是白宫以大国竞争为由拒绝放慢脚步。当"不能输给中国"成为AI治理的最高准则,外部安全约束的空间正在被系统性压缩,而一旦防线失守,承受后果的并不仅限于企业自身。
还没有评论,来说说你的看法。