VER-018
Verification
CFG 核验:推理期提质(T2I 23.35→12.61、IS 19.93→26.62;ImageNet 10.56→3.60)与两表一致、非增训,机制同 CPT-003。supported。
| id | VER-018 |
|---|---|
| type | verification |
| claim | CLM-018 |
| result | supported |
| basis | T2I 表 23.35→12.61(IS 19.93→26.62)与 ImageNet 表 10.56→3.60 与命题一致;Changelog 证实 v2 用 CFG;机制与 CPT-003 一致;scale 口径在 Notes 声明 |
| checked | 2026-09-03 |
Checks
- 内部一致性:命题的"CFG 使 T2I FID 23.35→12.61、IS 19.93→26.62、 ImageNet 10.56→3.60(cfg=1.5)"与 EVI-018 Result 成对对应,与两张主表 数字一致;"推理期效应、不增训练成本"与 Changelog(v2 用 1.45B+CFG) 相符。
- 证据链完整性:EVI-018 observation 精确到 T2I 表 + ImageNet 256² 主表 + Changelog;method 载明 250 DDIM 步、cfg=1.5、两个独立数据集 (LAION/MS-COCO 与 ImageNet,提示不可跨表相减)。
- scope 匹配:命题把 CFG 效应限定在 T2I 与 class-cond ImageNet 两个 设定——未外推到无条件/其他任务;"CFG 降 FID 但降 recall(多样性)" 的代价在 EVI-018 Caveats 声明(与 CLM-001 的 2.27 讨论一致)。
- 跨来源核对:CFG 的机制定义(ε̂=s 外推、null-embedding)与 CPT-003 一致;CFG 规范源(SRC-2207.12598)为源桩,无独立 claim 可比,但 CPT-003 已给出机制性表述,两处不冲突。
Notes
23.35→12.61 与 10.56→3.60 是同一份权重推理期加 CFG 的前后对比, 不是"训了两个模型"——这点对"CFG 提质"的因果归因至关重要,已在命题 "几乎不加训练成本"与 EVI-018 Caveats 中显式固定。
引用(5)
- CLM-001 DiT-XL/2(cfg=1.50,3 通道 guidance)在 ImageNet 256×256 达 FID-50K 2.27,为包括 StyleGAN-XL 在内的最低 FID。
- CLM-018 推理期 CFG 大幅抬升 LDM 质量且几乎不加训练成本:LDM-KL-8 在 MS-COCO FID 23.35→12.61(s=1.5)。
- CPT-003 classifier-free guidance
- EVI-018 主文 T2I 表 + ImageNet 主表:CFG 的推理期质量增益(支撑 CLM-018)。
- SRC-2207.12598 Classifier-Free Guidance 提出作(Ho, arXiv 2022);条件扩散的标准引导做法。