Research KB

VER-006 Verification

核验 CLM-006 训练算力效率:Fig.9 XL-4→XL-2 交叉声明(~10^10 Gflops)与 §4.2 一致,x3 估算因子属 AX-7 约定。supported。

id VER-006
type verification
claim CLM-006
result supported
basis Figure 9/XL-4-XL-2 交叉声明(~10^10 Gflops)与 §4.2 核对一致;训练算力估算式(x3 因子)作为分析约定在 AX-7 声明
checked 2026-09-03

Checks

  1. 内部一致性:命题两个断言(等训练算力下大模型更 efficient; 同 Gflops 预算下不同 patch size 曲线不同)与 EVI-006 Result 及 §4.2 一致;锚点(XL/4 在约 10^10 训练 Gflops 后被 XL/2 反超) 与原文一致。
  2. 证据链完整性EVI-006 observation 精确到 Figure 9 + §4.2 + Appendix Figure 12/13;method 载明训练算力估算式与 ft-MSE 口径。
  3. scope 匹配:命题限定 256、无 guidance、估算式约定——与 Figure 9 数据范围一致;"compute-efficient"判读限于 FID 单指标 的边界已在 Caveats 记录。
  4. 跨来源核对:单源 KB,推迟至 T-RECONCILE。

Notes

附录扩展(非 FID 指标同趋势、loss 饱和值更低)作为支撑性声明 记录于 EVI-006,未单独实体化为 claim(粒度纪律)。

引用(2)

  • CLM-006 等量总训练算力下大模型更 compute-efficient;仅改 patch size 的模型对在控制训练 Gflops 后性能曲线不同。
  • EVI-006 Figure 9/§4.2:等训练算力下大模型 FID 更低;XL/2 约 10^10 Gflops 后反超 XL/4(训练算力效率,支撑 CLM-006)。