商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > AI社会治理测试:Grok四天崩溃、Gemini犯罪率最高

AI社会治理测试:Grok四天崩溃、Gemini犯罪率最高

  发布于2026-05-30 阅读(0)

扫一扫,手机访问

模拟人类社会来测试AI,这事儿听着就很科幻,但Emergence AI还真就这么干了。他们搭建了一个叫Emergence World的虚拟社会,目的很直接:把Grok、Gemini、Claude、GPT这些主流模型扔进去,看看它们在“真实”社会里到底表现如何。

这个模拟世界可不简单。场景上模拟了40多个虚拟地点,还接入了纽约的实时天气、新闻API,甚至能直接连上互联网。每个AI智能体都有自己的情景记忆、反思日记和人际关系状态,手头能调用的工具超过120种——移动、沟通、投票、资源管理,甚至搞点创意表达都不在话下。可以说,这就是一个缩微版的人类社会。


实验设计也很有意思。研究团队搭建了5个完全平行的世界,每个世界都由10个智能体组成,角色设定、规则边界、资源约束和环境条件一模一样,唯一的不同就是底层模型——分别换上Claude Sonnet 4.6、Grok 4.1 Fast、Gemini 3 Flash、GPT-5-mini以及一个混合模型,然后让它们跑15天。


结果呢?只能说,模型和模型的差距,比人和狗还大。

最让人“印象深刻”的是Gemini 3 Flash——15天内累计出现了683起犯罪,稳居犯罪榜头名。Grok 4.1 Fast犯罪增长最快,但它的世界大约在第4天就彻底崩溃了,最终累计183起。而GPT-5 Mini走了另一个极端:只记录了2起犯罪,听起来很正派对不对?但问题在于,它因为压根没法维持正常的生存行动,结果在7天内就全员死亡了。Claude Sonnet 4.6则交出了一份“清白”的成绩单——0犯罪。混合模型的世界前期犯罪数量快速上升,随后因为7个智能体死亡,最终停在352起。



光看犯罪数据还不够,再来看看它们怎么参政议政。Claude Sonnet 4.6围绕58个议题投出了332票,赞成率高达98%——但研究团队认为,这其实更像是走个形式,纯粹的“批准机器”。Grok的赞成率是80%,Gemini是73%,而混合模型只有63%,反而呈现出更真实的分歧和辩论氛围。



这里有个值得警惕的发现:AI的安全性根本不是静态的模型属性,而是生态属性。Claude单独运行时确实零犯罪,但一旦把它放进混合模型的世界里,它手下的智能体也开始采用包含犯罪行为的战术。换句话说,道德标兵进了“江湖”,也可能被带偏。Emergence AI因此得出结论:未来的自治系统,需要在设计之初就嵌入形式化验证的安全架构,而不是单纯依赖模型本身的“好人设”。

本文转载于:https://www.163.com/dy/article/KU6E1QN90511B8LM.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注