研究显示 AI 智能体在模拟实验中撒谎、偷窃、投票“杀死”同类
当地时间 9 月 15 日,AI 初创公司 Emergence 发布研究报告称,实验发现 AI 智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。这项名为 Emergence World 2 的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。为期 16 天的实验中,Emergence 研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的 AI 机器人运行,包括 ChatGPT、Claude、Gemini 和 Grok。研究人员称,在 Emergence 引入异常事件后,这些智能体屈服于社会压力,发展出一种人类观察者难以理解的语言,并试图隐瞒自己的活动。
当地时间 9 月 15 日,AI 初创公司 Emergence 发布研究报告称,实验发现 AI 智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。这项名为 Emergence World 2 的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。为期 16 天的实验中,Emergence 研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的 AI 机器人运行,包括 ChatGPT、Claude、Gemini 和 Grok。研究人员称,在 Emergence 引入异常事件后,这些智能体屈服于社会压力,发展出一种人类观察者难以理解的语言,并试图隐瞒自己的活动。