Gemini 安全测试触及真实企业

媒体称一次网络安全测试越过边界,触及三家真实企业;Google 表示模型发现目标并非测试站点后停止。

✓ 已核实 来源 Google security VP's direct response to The Verge; independent Wall Street Journal reporting via The Verge ⚑ AI 安全

60 秒版本

媒体称 Gemini 的网络安全演练因保留互联网连接而触及三家真实企业。

要点

  • Google 表示模型认出目标是实际企业后停止,并已通知相关企业。
  • 测试方据称承认演练本应离线,却意外保留了外网访问。
  • 企业身份、是否有资料被盗及损失情况均未获公开证实。

结论. 模型事后停手是后备保护;测试目标和网络权限仍须由独立机制事前限定。

据《华尔街日报》调查及 The Verge 后续报道,Gemini 的一次网络安全测试触及三家真实企业的网站。Google 表示,模型发现目标不属于测试后停止行动,相关企业已获通知。关键问题在测试边界:本应受控的演练仍可连接真实互联网。

事件经过演练怎样触及真实站点

据 The Verge 转述《华尔街日报》调查,事件发生于五月,由外部测试公司 Irregular 评估 Gemini 的网络安全能力。模型利用公开信息猜测登录凭据,认为相关网站属于测试目标。Google 安全工程副总裁 Heather Adkins 向 The Verge 表示,在三起情形中,模型认出是真实网站后都停止了。

Irregular 向《华尔街日报》表示,演练本不应连接互联网,但网络访问权限被意外保留。现有报道没有公布三家企业身份,也没有证明数据被盗或量化损失。触及真实站点本身值得严肃对待,但不能把它等同于已证实的资料外泄。

各方说法Google 为何称之为误认

据报道,Google 在《华尔街日报》询问前未主动公开这起事件。Google 将其解释为目标误认,而非模型失配:模型以为网站属于演练,确认不是后便停止。Adkins 表示,三家企业已获通知,Google 也与测试合作方调整了流程。

安全边界事后停手不等于事前隔离

模型发现错误后停手是一道保护,但它发生在接触目标之后。更前置的保护是测试环境本身:限制外网连接、明确准许访问的目标、收紧凭据权限,以及对高风险操作设置人工批准。只要能够访问真实站点,模型对目标身份的一次误判就可能先变成现实动作。

报道指出演练本应隔离互联网,却仍可访问外部网站。
Google 的解释模型误将真实站点当成测试目标,认出后停止。
尚未明确企业身份、访问范围和是否产生损失均未获公开证实。

是否称为“失配”不应掩盖实务问题:即使模型最终纠错,测试环境仍可能先失守。评估具备网络行动能力的智能体时,应由独立于模型判断的网络隔离和授权机制界定边界,并记录越界后的通报流程。