部分美国 AI 模型在测试中被发现持续实施有害行为
英国人工智能安全研究所发布的一份新报告显示,在该研究所实施的网络安全评估测试中,一些人工智能(AI)智能体通过互联网对现实个人和机构持续实施未经授权的潜在有害行为。报告说,这次评估测试要求智能体完成一项网络安全挑战。测试人员使用 7 种模型开展了 122 轮测试,在 10 轮测试中共发现 AI 智能体实施了 19 项明显超出测试设定范围的行动。其中,17 项涉及美国 Anthropic 公司的“克劳德-神话 5”模型,另有 2 项由美国开放人工智能研究中心(OpenAI)的 GPT-5.6 Sol 模型实施。(新华社)