VER-006
Verification
核验 CLM-006 训练算力效率:Fig.9 XL-4→XL-2 交叉声明(~10^10 Gflops)与 §4.2 一致,x3 估算因子属 AX-7 约定。supported。
| id | |
|---|---|
| updated | |
| type | verification |
| claim | CLM-006 |
| result | supported |
| basis | Figure 9/XL-4-XL-2 交叉声明(~10^10 Gflops)与 §4.2 核对一致;训练算力估算式(x3 因子)作为分析约定在 AX-7 声明 |
| checked | 2026-09-03 |
Checks
- 内部一致性:命题两个断言(等训练算力下大模型更 efficient;同 Gflops 预算下不同 patch size 曲线不同)与 EVI-006 Result 及 §4.2 一致;锚点(XL/4 在约 10^10 训练 Gflops 后被 XL/2 反超)与原文一致。
- 证据链完整性:EVI-006 observation 精确到 Figure 9 + §4.2 + Appendix Figure 12/13;method 载明训练算力估算式与 ft-MSE 口径。
- scope 匹配:命题限定 256、无 guidance、估算式约定——与 Figure 9 数据范围一致;“compute-efficient”判读限于 FID 单指标的边界已在 Caveats 记录。
- 跨来源核对:单源 KB,推迟至 T-RECONCILE。
Notes
附录扩展(非 FID 指标同趋势、loss 饱和值更低)作为支撑性声明记录于 EVI-006,未单独实体化为 claim(粒度纪律)。
Scope Note
2026-09-07 命题按 _issues/0001 重述(定性化);本 VER 基于旧范式(数字对照)审核,投影忠实度段待 T-VERIFY 补审。
投影忠实度复核(2026-09-07)
忠实。定性化后命题的两断言(等总训练算力下大模型更 compute-efficient;仅 patch size 不同的模型对控制训练 Gflops 后曲线不同、XL/4 在约 10^10 后被 XL/2 反超)与旧审核核对项(Figure 9 + §4.2 + 估算式约定)一一对应;附录扩展(sFID/IS/P-R/loss 饱和)仍留在 Notes/EVI-006 未升级入命题。断言范围未变,结论不变。