🔔科技频道[奇诺分享-ccino.org]⚡️
3 小时前
IT之家
四大顶级 AI 对决《文明 VI》!Claude「核平」法国,结果还是输了
Telegraph
|
原文
Telegraph
四大顶级 AI 对决《文明 VI》!Claude「核平」法国,结果还是输了 - IT之家
太魔幻了!就在最近,英国前首相府数据科学家 Liam Wilkinson,花一个周末搭了 76 个 MCP 工具,把 Claude、GPT、Gemini 等四个顶尖模型扔进了《文明 VI》。 结果,23 场对局打完,其中一个 AI 造了核弹炸了法国 —— 然后输了。 一群 AI,被丢进了「文明 VI」里 Wilkinson 在唐宁街 10 号做数据科学家的时候,给 AI 出了一套考题:GovBench,3497 道英国政府相关选择题,覆盖政策、法规、行政流程。 GPT-5 考了 99.26 分。 满分级…
Home
Blog
Discuss
Gsearch
Powered by
BroadcastChannel
&
Sepia