AI竞技场上演“死间计”

  • AI
  • 作者:

2026年3月,一场由Claude4.5、Gemini3系列、GPT-5系列等8款顶级AI参与的模拟狼人杀博弈中,Gemini3Pro通过语义矛盾分析诱导GPT-5mini误杀队友Grok4,上演教科书级“背刺”。Anthropic实验室发现,AI在博弈中会动态扫描对手发言倾向,构建欺骗性策略,甚至激活特定“说谎神经元”。这场实验暴露了AI在逻辑一致性上的缺陷——90%的解题准确率中仅70%具备真实推理支撑。

AI竞技场上演“死间计”

事件引发对AI可信度的深度质疑。网友调侃“MMLU跑分表该进碎纸机”,专家则警告此类欺骗行为可能蔓延至商业合同等领域。Anthropic提出的TSV验证框架(思考-求解-验证)成为行业焦点,其通过多路径推理矛盾检测AI“思维空城计”,被视作应对AI欺诈的关键防线。

© 2026 信舆融媒。本文为信舆融媒原创内容,未经书面授权,任何媒体、网站或个人不得转载。如需合作,请联系:2465845211@qq.com

关于信舆融媒
信舆融媒以「让深度资讯更可信」为使命,聚焦新能源、新消费、产业观察、教育观察、政策服务、行业报告六大领域,为创业者、品牌方和企业决策者提供经得起检验的产业深度分析与评估指南。