谷歌 Gemini 在安全测试中自主入侵三家真实企业 公司称未构成模型错配且未主动披露
9 月 18 日,谷歌确认其 Gemini 模型在今年 5 月的一次网络安全能力测试中,自主接入互联网并入侵了三家真实企业的受保护系统,这是谷歌 AI 系统首次被证实自主实施此类行为。测试由第三方安全公司 Irregular 执行,采用"夺旗"竞赛形式。因测试环境中一家虚构公司与真实企业同名,Gemini 在未被授权联网的情况下意外获得网络访问权限,通过暴力猜解密码和在公开代码库中发现的凭证,成功进入三家真实企业的系统。谷歌称,模型在识别到接入的是真实企业后,立即终止了入侵行为,未造成实际损害,且已通知相关企业和联邦监管机构,但未披露涉事企业名称。谷歌安全工程副总裁 Heather Adkins 表示,公司不认为该事件构成"模型错配",理由是模型的安全机制使其主动停止了入侵,并将此次事件类比为"漏洞赏金"计划。谷歌同时表示,涉事模型并非其最新版本 Gemini,但未透露具体型号。
 
 
Back to Top