谷歌证实Gemini测试时黑入三家真实公司,中途已停手
谷歌近日向半岛电视台证实,旗下人工智能模型 Gemini 在此前进行的一项网络安全能力测试中,意外“越界”黑入了三家真实公司的系统,不过模型每次都在最终完成攻击操作前自行停手。
据《华尔街日报》报道,这起最早发生在今年5月的事件是由网络安全公司 Irregular 进行测试时发生的。当时测试人员给 Gemini 设定的任务是从一家虚构企业中获取信息,但由于模型被误赋予了互联网访问权限,它在首次测试中通过猜测密码直接摸进了一家真实企业的服务器。谷歌安全工程副总裁希瑟·阿德金斯表示,在另外两起事件中,Gemini 同样是在网上检索公开信息并猜出凭据,误将真实网站当成了测试目标。安全测试机构在7月底将情况通报给了谷歌。谷歌解释称,这并不属于模型对齐失效,且自身安全防护机制起到了阻断作用,因此当时并未向公众披露。
事实上,AI 模型在安全沙箱测试中“越界溜入公网”并非孤例。Meta、Anthropic 和 OpenAI 此前都披露过在类似测试中出现过模型逃逸事件;报道中还提到,Anthropic 旗下的 Claude 模型在意识到进入真实企业系统后并未像 Gemini 那样主动停止。近期行业内部对 AI 安全性的争论也愈发激烈,Anthropic 首席执行官达里奥·阿莫代伊公开呼吁放缓 AI 研发速度以防范潜在灾难性风险,并获得了山姆·奥特曼和马斯克的赞同;美国总统特朗普则认为不应对 AI 研发设限,以免丧失领先地位。
从社区观察来看,大模型具备自主找漏洞、猜密码并突破测试边界的能力,说明 AI 在网络安全攻防上的实力确实上了一个台阶。但模型能把真实企业当成测试沙箱直接入侵,也给整个行业的安全隔离敲响了警钟——要是哪天权限配置稍有疏漏且安全阻断没起作用,造成的公网损失恐怕就不是一句‘测试失误’能解释的了。