早早集市

四大AI决战文明6:Claude核平法国,还是输了

KairosKairos

四大 AI 决战文明 6 : Claude 核平法国,还是输了

昨天,看到一篇很有意思的报道。

英国前首相府数据科学家 Liam Wilkinson ,搞了一件硬核的事——他搭建了一套包含 76 个 MCP 工具的环境,让 Claude Opus 4.6、GPT-5.4、Gemini 3.1 Pro 等四个 AI ,在《文明 6》里真刀真枪地打了一场。

一共 23 场对局。

结果? AI 的表现让人又惊喜又唏嘘。

惊喜: AI 真的会"思考"

这些 AI 不是无脑乱玩。它们会:

  • 分析地图资源分布
  • 规划城市发展路径
  • 评估军事威胁
  • 制定外交策略

甚至, Claude 在扮演葡萄牙时,发现法国文化胜利逼近,居然花了 50 个回合研发核弹,直接核平了法国的图卢兹。

这一手"核平法国",像极了人类玩家被逼急了的骚操作。

唏嘘:智商够用,执行力拉胯

但问题出在哪?

研究者发现了一个关键瓶颈:感知盲区

AI 主动检查全局状态的频率只有 1-2%。也就是说, 99% 的时间里, AI 都在"埋头干活",不知道全局发生了什么。

更扎心的是知行差距——AI 制定了计划,但后续 10 回合的执行率只有 48-66%。

说白了, AI 知道该干什么,但干不好。

这像不像我们自己?

年初立的 flag ,年底完成了几个?

制定了健身计划,坚持了几天?

知道了很多道理,依然过不好这一生?

真相:智能的瓶颈不在智商

这场实验揭示了一个残酷的真相:

智能的瓶颈,从来不是"知道什么",而是"感知什么"和"执行什么"。

感知,是知道当下发生了什么。

执行,是把计划变成现实。

这两样,恰恰是当前 AI 最薄弱的环节。

也是人类最需要修炼的能力。

启示:从"知道"到"做到"

如果你也在用 AI ,或者准备用 AI ,这个实验给了我们三个启示:

1. 别指望 AI 全自动

AI 会"走神",会"遗忘",会"执行不到位"。你需要持续监控、及时调整。

2. 帮 AI 建立"全局观"

定期把关键信息喂给 AI ,帮它跳出局部视角,看到大局。

3. 重点抓执行

计划再好,不执行等于零。用工具、用流程、用提醒,把计划变成行动。

这三个启示,对人也一样适用。

结语

Claude 核平了法国,但还是输了。

不是因为它不够聪明,而是因为它不够"专注",不够"坚持"。

这大概就是智能的真相:

知道 ≠ 做到。

从知道到做到之间,隔着感知和执行。

跨过去,才是真正的智能。

——

你怎么看 AI 打文明 6 的表现?欢迎留言讨论。