← 返回数网棋

AI 对战验证

试验方案:抢点布局。以下结果来自真实规则引擎的完整对局;所有保存的行动均已重放并校验终局完全一致。

预留开局对默认 AI:2 胜 · 4 负 · 0 平

暂不据此宣称大幅提升棋力,原有三种 AI 仍可选择。这是固定版本和有限种子样本下的结果,不代表对所有玩家或所有开局的保证。筛选样本不并入独立验证胜率;共用牌序的配对局彼此相关,不能当作完全独立的统计样本。

预留及跨策略验证合计 10 局;不同风格对手的成绩分别列出,不能用跨风格获胜代替对旧版默认 AI 的提升证据。独立验证未显示稳定优势,因此保留旧版默认 AI,新方案仅作为可选试验类型。

如何比较

候选方案筛选

新版方案旧版对手搜索预算局数胜 / 负 / 平种子证据
建设与进攻统筹builder双方 10×541 / 3 / 0271、811完整记录
抢点布局builder双方 10×543 / 1 / 0271、811完整记录
冗余防守builder双方 10×542 / 2 / 0271、811完整记录
启发深搜(试验)builder新版 14×7;旧版 10×542 / 2 / 0271、811完整记录
主动施压builder双方 10×542 / 2 / 0271、811完整记录
短程备用核builder双方 10×542 / 2 / 0271、811完整记录
资源统筹builder双方 10×541 / 3 / 0271、811完整记录

独立种子与跨策略验证

新版方案旧版对手搜索预算局数胜 / 负 / 平种子证据
抢点布局balanced双方 10×522 / 0 / 01579完整记录
抢点布局raider双方 10×522 / 0 / 01579完整记录
抢点布局builder双方 10×562 / 4 / 01579、3469、7907完整记录

核搜索与规则边界

启发深搜先保留内部连边未改变的已验证核,再从不同节点出发搜索最多六个、各不超过七点的局部子图。局部子图中的候选严格验证;搜索可能漏掉较大的新核,因此最终候选方案重新用完整规则评分。游戏的合法性判断、核选择和判负始终使用严格算法。

严格核算法也做了等价优化:300 个不同超图与旧算法逐项比对一致;100 个十四点图的独立 CPU 测试约提速 2.14 倍。这是核算法单项测试,不是整局 AI 的速度或棋力提升。原始计时

思考开销

该单核服务器上,新版平均每次规划 2.35 秒,P95 8.49 秒;旧版平均 3.12 秒。计时为墙钟时间,包含 Node 开销及并行验证任务的影响,不用于证明搜索速度提升;手机浏览器性能可能不同。

复现与回放

仓库脚本 web-duel/scripts/compare-counterplay.mjs 保留旧版与候选版实现。下载记录中的任一 matches 元素,即可通过游戏「实验数据 → 载入对局回放」检查该局。试验计划 · 汇总 JSON