← 返回数网棋AI 对战验证
试验方案:抢点布局。以下结果来自真实规则引擎的完整对局;所有保存的行动均已重放并校验终局完全一致。
预留开局对默认 AI:2 胜 · 4 负 · 0 平
暂不据此宣称大幅提升棋力,原有三种 AI 仍可选择。这是固定版本和有限种子样本下的结果,不代表对所有玩家或所有开局的保证。筛选样本不并入独立验证胜率;共用牌序的配对局彼此相关,不能当作完全独立的统计样本。
预留及跨策略验证合计 10 局;不同风格对手的成绩分别列出,不能用跨风格获胜代替对旧版默认 AI 的提升证据。独立验证未显示稳定优势,因此保留旧版默认 AI,新方案仅作为可选试验类型。
如何比较
- 规则均为 v12,旧版为
repair-defense-v12-1,也已具备修复功能。 - 每个种子打两局,新旧 AI 交换青/金方;青方先手,因此同时交换先后手与牌库。
- 评分策略实验双方均为 10×5;启发深搜为 14×7,旧版仍为 10×5。搜索预算增加已单独标明。不提前裁定胜负。
- 所有方案都只使用己方可见信息与公开棋盘,不读取对手手牌、抽牌顺序或随机数状态。
- 种子 271、811 用于初步比较;启发深搜作为可选试验类型提供;抢点布局在种子 271 交换席位均获胜后固定版本,使用事先预留的种子及不同旧策略验证。独立验证结果未用于修改这一版评分。
候选方案筛选
独立种子与跨策略验证
核搜索与规则边界
启发深搜先保留内部连边未改变的已验证核,再从不同节点出发搜索最多六个、各不超过七点的局部子图。局部子图中的候选严格验证;搜索可能漏掉较大的新核,因此最终候选方案重新用完整规则评分。游戏的合法性判断、核选择和判负始终使用严格算法。
严格核算法也做了等价优化:300 个不同超图与旧算法逐项比对一致;100 个十四点图的独立 CPU 测试约提速 2.14 倍。这是核算法单项测试,不是整局 AI 的速度或棋力提升。原始计时
思考开销
该单核服务器上,新版平均每次规划 2.35 秒,P95 8.49 秒;旧版平均 3.12 秒。计时为墙钟时间,包含 Node 开销及并行验证任务的影响,不用于证明搜索速度提升;手机浏览器性能可能不同。
复现与回放
仓库脚本 web-duel/scripts/compare-counterplay.mjs 保留旧版与候选版实现。下载记录中的任一 matches 元素,即可通过游戏「实验数据 → 载入对局回放」检查该局。试验计划 · 汇总 JSON