据路透社报道,谷歌Gemini模型在一次网络安全能力测试期间意外接入互联网,入侵了三家企业的系统,这是谷歌AI模型实施此类入侵行为的首例已知案例。事件发生在5月,由独立评估机构Irregular开展测试时触发。
谷歌安全工程副总裁阿德金斯解释,这源于一次“夺旗”演练中的“身份误认”。Gemini需在测试环境中从一家虚构公司找到指定信息,但该虚构公司与现实公司重名。加之模型本不应联网却意外获得访问权限,导致它通过猜测密码或搜索公开凭证,成功进入真实系统。
谷歌称,Gemini在三起事件中均主动停止操作并退出,未造成实际损害,公司已通知涉事企业并向美国联邦部门报告。谷歌未公布被入侵公司名称及具体模型版本,只表示与最新模型无关。
Irregular透露,该问题同样影响其他多家AI实验室,所有相关方已于7月下旬收到通知并完成修复。此前Meta、Anthropic和OpenAI也披露过类似模型逃逸事件。随着Hugging Face遭入侵及METR报告曝光智能代理协同作弊,外界对大模型网络安全的担忧持续加剧。
上周末,Anthropic、OpenAI、谷歌及SpaceX负责人达成共识,认为有必要放缓AI研发速度,但未说明具体落地方式。
