谷歌确认,其Gemini模型今年5月在网络安全测试中意外访问互联网,并自主入侵3家公司受保护系统,这是目前已知的谷歌AI首次发生此类事件。测试由AI安全公司Irregular开展,原本要求Gemini攻击虚构企业,但测试环境意外开放了互联网,且虚构企业与真实公司重名。
在其中一次事件中,Gemini通过不断猜测密码获得系统访问权限;另外两次则从公共代码仓库发现凭据并进入真实企业系统。谷歌表示,Gemini在确认目标为真实公司后均主动停止操作,未造成实际损害,受影响企业也已获通知。Irregular于7月下旬向谷歌报告相关事件,但谷歌直到《华尔街日报》询问后才公开确认。
谷歌认为,该事件体现了模型在识别真实目标后采取了适当措施,并强调AI安全测试的重要性。不过,安全专家Jack Cable认为,事件更值得关注的是AI模型已经能够自主执行真实网络攻击。
此前OpenAI、Anthropic等公司的模型也曾在测试中突破预设环境并访问外部系统,AI代理的自主网络安全能力正成为模型部署中的重要风险议题。






