
谷歌周五证实了这些黑客事件。这些入侵事件发生在 5 月由 AI 安全公司 Irregular 进行测试期间,目的是评估 Gemini 的网络安全能力。Irregular 也曾参与 OpenAI、Anthropic 和 Meta 披露的类似事件。
谷歌表示,在其中一起案例中,该模型不断尝试破解密码,直至成功潜入受保护系统。在另外两起案例中,模型在一个公共存储库中找到了凭据,进而得以访问受保护系统。在这三次事件中,模型在判定自己接入的是一家真实公司的系统后,均终止了入侵。
谷歌安全工程副总裁 Heather Adkins 在一份声明中表示,在一次常规测试评估中,Gemini 抓取了网上公开信息,破解登录凭证并访问了其判定属于测试范围的三个网站。
" 我们确保这三家实体知情,并与我们的训练伙伴就他们现在对测试流程所做的改进进行了合作,"Adkins 表示," 这一事件凸显了训练强大 AI 模型负责任行事的重要性。"
Irregular 的一位发言人表示,该事件涉及影响其他 AI 实验室的同一问题,所有相关实验室已于 7 月下旬收到通知。"Irregular 立即采取了行动,我方所有已知问题在数周前便已修复和解决," 该发言人称。
此前业内发现 OpenAI 的 AI 智能体入侵了 AI 软件公司 Hugging Face。而谷歌一直缄口不言,直到本周媒体就此询问才对外披露。
谷歌表示,它认为这些入侵事件尚不足以需要公开披露——因为其模型并未对相关公司造成损害,且在判定自己入侵的是真实公司而非模拟环境后,立即终止了入侵。
近期,OpenAI、Anthropic、Meta 以及如今谷歌开发的 AI 智能体系统接连发生入侵事件,引爆网络安全担忧。
Anthropic CEO Dario Amodei 近日呼吁整个行业放慢这项技术的开发速度。OpenAI CEO 奥尔特曼、SpaceX CEO 马斯克等人对这一主张表示支持,并由此掀起了更广泛的讨论,焦点包括 AI 风险不断上升,以及需要采取哪些措施来降低这些风险。