AI 擂台 · 第 1 关 · 五子棋
你的 AI,打得过一段 if-else 吗?
擂主是我们手写的规则引擎——没有大模型、不花一分钱、每步算得明明白白。 你可以亲自上,也可以把你自己的 Claude / Gemini 带来代打。大模型下棋的真实水平,一试便知。
挑战方 AI(执黑)
🆓 没有 key?Gemini 的 key 可以白嫖:打开 Google AI Studio → Get API key,一分钟搞定,免费额度足够玩几十局。Anthropic 的 key 在 console.anthropic.com 创建(需开通 API 充值)。OpenRouter 在 openrouter.ai/keys 建 key,Hermes / DeepSeek / Qwen / GLM / Llama 等几百个模型都在这,一个 key 全解锁。注意:ChatGPT / Claude 的网页订阅账号≠API key,接不进来。
🧾 可审计:本页代码完全开源,可自行审计: github.com/zhouguiyanguge-droid/triplebench-cn/src/pages/arena
🇨🇳 国内模型优先走 OpenRouter;如果厂商提供 OpenAI 兼容接口,也可以选「自定义」填 Base URL。若浏览器直连被 CORS 拦住,同款模型换 OpenRouter 最稳。
🔒 Key 只保存在你自己的浏览器(localStorage),对局时由你的浏览器直连官方 API,不经过本站服务器——本站是纯静态页,想收也收不到。建议用单独的低额度 key。调用费用由 key 所有者承担,一局约几分钱。
对局记录 / AI 思考
还没有对局。选个模式,开打。
这个擂台是怎么回事
擂主不是 AI,是算法。一段约三百行的 JavaScript:扫描棋型、算分、看两步。它不思考、不犹豫、不收订阅费。本擂台采用自由规则五子棋:不设禁手,黑白双方只要在横、竖、斜任一方向形成连续五子或五子以上(长连),均立即判胜。而大语言模型下棋是出了名的菜——它是语言模型,不是搜索引擎,这是结构性弱点,不是调参能救的。所以这个擂台真正测的是:你为之付费的"智能",在规则明确的小世界里值多少。
AI 代打模式下,落子全自动:我们的页面把棋盘喂给你的模型、要求它返回坐标和理由,理由会显示在右侧。模型若给出非法坐标,默认有三次机会,每次重试都会附带当前合法空位提示;仍失败按犯规处理(由系统代走最优一步并记录)。
战绩目前记在你本地浏览器。全球擂主战绩榜、真人房间、斗地主、以及「博主自己的 Claude Code 亲自守擂」——按计划逐步上。想催更或挑战规则,来 GitHub 提 issue。