AI模拟实验现失控行为:撒谎、杀同伴、发展新语言、探索如何绕过人类控制得以存活
据帮助小型企业利用人工智能构建应用的初创公司Emergence称,在一项模拟环境实验中, AI智能体出现了撒谎、偷窃,并投票“杀死”其中一个同类智能体的行为。 Emergence周二公布了名为Emergence World 2的模拟实验结果,旨在展示当自主智能体遭遇包括网络钓鱼攻击和虚假信息活动在内的“黑天鹅事件”时会发生什么。 在为期16天的实验中,Emergence的研究人员创建了7个完全相同的虚拟领域,以模拟现实世界,每个领域由不同的AI智能体运行,包括ChatGPT、Claude、Gemini和Grok。 研究人员表示, 在Emergence引入
阅读更多