# M1-final：版本响应重构与训练结果

[English](m1_final_model.en.md) · [中文结果](../m1_results.html) · [复现](../models/meta/m1_final/README.md)

已覆盖原最终版，版本号不变。方向与幅度更接近本次提出的 S16 预期，但这不是已验证的 S16 准确率改善。S15 世界赛已用于接受候选，不能再当独立盲测。

## 模型结构

上一版旧版本趋势容易盖过高禁用英雄的削弱，低基数英雄则难以启动。本次改为职业背景概率＋绝对概率响应。

1. **职业背景**：cloglog 回归使用衰减历史、可靠度修正的近期趋势、已有职业 DPM 和 15 分钟经济差。大版本变化降低旧趋势延续。选取按英雄×分路建模，禁用按英雄整体建模。
2. **职业响应**：在已结束的 S15 Full Fearless 版本转换上，拟合“目标概率−背景概率”。非负、共享收缩的 Huber 回归联合使用排位绝对/相对变化和机制改动。高禁用英雄不再因 `p(1-p)` 因子自动减弱响应。
3. **机制先验**：保留大招/基础技能、群体/单体/未知范围、效果类型和早中晚阶段。控制时长用相对变化＋非线性阈值；睡眠不额外加分。策略大招（地图影响、控制、隔离）的 CD 有独立频率通道。伤害、清野、资源、成长、耐久和装备也参与。
4. **响应融合**：50% 职业学习结果＋50% 机制先验。先验内部观测排位融合为 35%，不是整模型排位权重。低基数新增质量需正向日期合格机制、净正响应和排位使用共同支持；禁用还可参考已有支持分路的选取威胁，没有英雄专属保底或固定 ban/pick 比。
5. **练习与竞争**：保留 6% 分路练习混合。Full Fearless 可用性及系列赛长度情景统一分配名额，每局 10 次选取、每路 2 次、10 次禁用，单英雄 BP ≤100%。削弱释放的名额会分给竞争选择。平均选取位保留历史 Ridge 回归。

## 学习结果与假设的区别

背景和职业响应系数由训练折拟合。策略大招重要性、先验幅度、融合和冷启动是统一候选假设，在 S15 误差预算内校准；不能声称历史已证明“大招就是 6 倍重要”。先验阶段等权也是假设。效果类型先用于归类，再把硬控汇总到范围/阶段通道，不分别赋予睡眠或晕眩特殊倍率。

直接职业响应训练只用 S15 Full Fearless；五年 Classic 职业 BP 率没有混入目标。保留 2021–25 排位/技能资料及历史审计，但本轮没有用五年排位标签重新估计每项先验权重。准备集为 69 个预测窗口、37 个版本转换记录，窗口并非全部独立。

```json
{
  "history_half_life": 14,
  "cold_scale": 2.0,
  "response_ridge": 0.03,
  "response_gain": 2.0,
  "ban_gate": 0.02,
  "strategic_importance": 6.0,
  "area_importance": 1.0,
  "prior_strength": 3.0,
  "prior_rank_fusion": 0.35,
  "prior_mix": 0.5,
  "prior_cold_scale": 2.0,
  "ban_pick_threat": 1.0
}
```

## 选择规则与时间边界

比较了 64 个职业响应、144 个机制先验及 3 个禁用启动候选。按 4 月、6 月、8 月的时间切分；最终回归仅使用 2025-10-14 前已结束记录。S15 世界赛 84 局参与候选接受，未进入系数回归，因此不再是独立检验集。

训练前设定：开发/末段/世界赛 BP RMSE ≤上一版×1.10、BP MAE ≤上一版＋0.5 pp、选取和禁用各自 RMSE ≤上一版×1.15；末段低基数 BP RMSE ≤上一版＋0.5 pp。通过者优先选 S15 开发输入上响应更强的参数，再看响应误差。这是主动的响应/误差取舍，不是最小世界赛误差。没有将 S16 特定英雄目标写入损失函数，但 S16 预期确实影响了架构和先验设计。

## 误差（百分点）

| 阶段 | 指标 | 上一版 | 本次 | 差值 |
|---|---|---:|---:|---:|
| 开发 | pick_mae_pp | 2.712 | 2.665 | -0.046 |
| 开发 | pick_rmse_pp | 4.466 | 4.420 | -0.047 |
| 开发 | ban_mae_pp | 3.949 | 3.787 | -0.162 |
| 开发 | ban_rmse_pp | 7.902 | 7.700 | -0.202 |
| 开发 | bp_mae_pp | 5.359 | 5.130 | -0.229 |
| 开发 | bp_rmse_pp | 9.256 | 8.972 | -0.284 |
| 开发 | role_rmse_pp | 2.040 | 2.020 | -0.020 |
| 开发 | low_base_bp_rmse_pp | 2.361 | 2.242 | -0.119 |
| 末段 | pick_mae_pp | 2.580 | 2.589 | +0.010 |
| 末段 | pick_rmse_pp | 4.366 | 4.412 | +0.046 |
| 末段 | ban_mae_pp | 3.441 | 3.458 | +0.017 |
| 末段 | ban_rmse_pp | 7.444 | 7.573 | +0.129 |
| 末段 | bp_mae_pp | 4.395 | 4.434 | +0.039 |
| 末段 | bp_rmse_pp | 8.071 | 8.233 | +0.162 |
| 末段 | role_rmse_pp | 2.005 | 2.023 | +0.018 |
| 末段 | low_base_bp_rmse_pp | 2.388 | 2.534 | +0.145 |
| 世界赛接受集 | pick_mae_pp | 2.401 | 2.502 | +0.101 |
| 世界赛接受集 | pick_rmse_pp | 3.923 | 4.141 | +0.218 |
| 世界赛接受集 | ban_mae_pp | 3.254 | 3.555 | +0.301 |
| 世界赛接受集 | ban_rmse_pp | 7.171 | 7.717 | +0.545 |
| 世界赛接受集 | bp_mae_pp | 5.199 | 5.642 | +0.442 |
| 世界赛接受集 | bp_rmse_pp | 9.273 | 10.134 | +0.862 |
| 世界赛接受集 | role_rmse_pp | 1.801 | 1.879 | +0.077 |

世界赛 BP RMSE 相对变化：+9.29%；末段：+2.00%。预算全部通过，但世界赛误差确实上升。

## S16 监测结果

参照本轮开始前的部署模型。差值不是孤立版本改动的因果估计。

| 英雄 | 原 BP | 新选取 | 新禁用 | 新 BP | BP 变化 |
|---|---:|---:|---:|---:|---:|
| 莉莉娅 | 3.70% | 5.27% | 6.71% | 11.97% | +8.27 pp |
| 莫德凯撒 | 0.70% | 2.34% | 2.35% | 4.69% | +3.99 pp |
| 厄斐琉斯 | 14.98% | 22.20% | 14.79% | 36.99% | +22.01 pp |
| 阿萝拉 | 9.39% | 12.38% | 4.81% | 17.19% | +7.81 pp |
| 魔腾 | 73.24% | 9.08% | 35.23% | 44.31% | -28.93 pp |
| 蔚 | 68.79% | 14.08% | 40.07% | 54.15% | -14.65 pp |
| 波比 | 23.27% | 5.33% | 15.77% | 21.09% | -2.17 pp |
| 瑞兹 | 30.92% | 14.21% | 8.68% | 22.89% | -8.04 pp |
| 斯莫德 | 1.53% | 2.14% | 2.02% | 4.16% | +2.64 pp |
| 阿木木 | 1.87% | 1.67% | 0.00% | 1.67% | -0.20 pp |
| 莎弥拉 | 0.28% | 0.21% | 0.00% | 0.21% | -0.07 pp |
| 卢锡安 | 43.95% | 12.83% | 13.88% | 26.72% | -17.24 pp |
| 阿兹尔 | 5.33% | 2.97% | 2.67% | 5.64% | +0.32 pp |

## 修正确实启用

同一模型逐项关闭修正后重放。保持已知版本切换背景固定；技能与装备为全部机制的子集，差值包含名额重新分配，不能相加或解释为已证明因果。

| 关闭模块 | 最大分路选取差 | 最大禁用差 |
|---|---:|---:|
| no_practice | 0.942 pp | 0.341 pp |
| no_mechanistic | 14.166 pp | 15.515 pp |
| no_observed_ranked | 8.651 pp | 35.024 pp |
| no_items | 1.843 pp | 5.430 pp |
| no_targeting | 4.355 pp | 13.175 pp |

S15 没有同等练习快照，目标窗口装备关停差值也为零；S16 启用检测不等于这两项在 S15 世界赛已独立验证。

## 数据、界面与复现

沿用固定输入，本轮未重新采集。截止时间：2026-10-11T18:06:15.025015+00:00

练习为近 30 天世界赛名单、身份已核验、非国服、单双排且实际分路等于登记分路的 2,763 局，覆盖 60/95 人。缺失账号不是零练习；6% 权重没有同等 S15 历史验证。26.20 韩服大师以上快照是部分样本，按局选取率不乘 2。选手英雄胜率/KDA 未启用。

保留原深色中英文界面、头像、五路堆叠、灰框/红框、历史天数/赛事筛选。英雄详情包含练习人员、排位变化、数值改动、装备、修正差值和分配前背景/学习/先验响应。主界面不放旧模型比较。

验证包括 S15/S16 精确重放、分路/名额约束、禁用门槛、12 项受控单调性、时间和模块启用检查。界面另运行真实 HTML 脚本 DOM 检查；不是截图视觉检查。完整候选、模型和检测见 artifacts/。旧 control_axes_validation.json 仅为历史表示审计，不证明新先验权重；本次记录为 retraining_summary.json。
