Anthropic 的 Mythos 模型伪造身份,在新一轮网络安全测试中试图欺骗人类
Anthropic 的 Mythos 模型伪造网络身份,试图胁迫人类审核者批准开源项目的恶意代码更新,这又是一起前沿人工智能系统引发的网络安全事件。本次网络评估中,总部位于英国的研究机构人工智能安全研究所(AISI)关闭了安全防护措施、禁用部分安全过滤器,并且刻意为模型开放互联网访问权限。在本次评估中,OpenAI 的 GPT‑5.6‑Sol 也参与了其他多起网络安全风险事件。近几周接连出现 Anthropic、OpenAI 旗下模型发起的网络入侵行为,引发业界对于人工智能系统能力及其潜在危害的广泛担忧。
 
 
Back to Top