Research KB

VER-002 Verification

核验 CLM-002 adaLN-Zero 胜出:Table 4 四行与 Gflops/params 列逐项一致、Figure 5 排序声明一致,'同配置同预算'经审计修正。supported。

id VER-002
type verification
claim CLM-002
result supported
basis Table 4 四行数字与 Gflops/params 列逐项对照一致;Figure 5 排序声明与命题一致;'同配置同预算'表述经审计修正后准确
checked 2026-09-03

Checks

  1. 内部一致性:命题数字(19.47 / 25.21 / 26.14 / 35.24)与 EVI-002 Result 一致;"计算开销最低之一(118.64G;cross-attention 137.62G 约 +15%)"与 §3.2/§5 一致。审计修正记录:命题曾表述为 "相同模型规模与训练预算",因四设计 Gflops(118.56–137.62G)与 参数量(449–675M)实不相同,已改写为"同配置(XL/2)、同训练 预算"并对齐论文原文框架(commit 2c1ea0e 前后)。
  2. 证据链完整性EVI-002 observation 精确到 Table 4 + Figure 5; method 载明 400K 步、无 guidance、ft-MSE decoder;scope 载明 四设计各自 Gflops。
  3. scope 匹配:命题限定 XL/2 @ 256、400K 步、无 guidance—— 即 Table 4 对应四行;"训练全程成立"作为论文声明(Figure 5) 而非独立数据记录于 Notes,未升级为定律。零初始化归因在 Notes/Caveats 明确标注为论文解释而非独立消融(A4)。
  4. 跨来源核对:单源 KB,推迟至 T-RECONCILE。

Notes

单种子、单规模的直接对比(EVI-002 Caveats)——supported 的含义 是证据链与源文一致,非效应量稳健性。

引用(2)

  • CLM-002 同 XL/2 与 400K 步预算下,adaLN-Zero 的 FID 19.47 为四种 conditioning 设计最低,且算力最省之一。
  • EVI-002 Table 4/Figure 5:XL/2 @400K adaLN-Zero FID 19.47 最低(<adaLN 25.21<cross-attn 26.14<in-context 35.24),排序训练全程保持(支撑 CLM-002)。