VER-013
Verification
两段分解核验:感知压缩 AE + 潜空间 DM 与 §1/§2.3/§2.4(Eq.4-5)一致,DiT FRM-2212.09748 AX-2 同向互证,scope 未超。supported。
| id | VER-013 |
|---|---|
| type | verification |
| claim | CLM-013 |
| result | supported |
| basis | 两段分解与 EVI-013 锚点(§1/§2.3/§2.4, Eq. dmloss/ldmloss)逐项一致;KL/VQ、f、感知/语义压缩术语与源文吻合;scope 未超论文设定 |
| checked | 2026-09-03 |
Checks
- 内部一致性:命题"感知压缩(AE)+ 语义压缩(latent 上训 DM)"与 EVI-013 Result 的两段描述一一对应;KL/VQ 两种正则、f 下采样、 LPIPS+PatchGAN 目标均与源文(§2.3)术语一致;未引入正文没有的内容。
- 证据链完整性:EVI-013 observation 精确到 §1 + §2.3 + §2.4 + Eq. dmloss/ldmloss;method 载明 AE 损失与两种正则、DM 的 ε-prediction 简化目标;f=1(LDM-1=像素 DM)的下界在 Caveats 注明。
- scope 匹配:命题限定"两阶段分解"本身(架构机制),scope 字段列 ImageNet/CelebA/LAION 等多任务与 f=4..8(消融 1..32)、169M–1.45B—— 未把"分解有效"升级为"任意设定下最优"(后者归 CLM-014/016)。
- 跨来源核对:DiT(FRM-2212.09748 之 AX-2/CPT-008)把 LDM 两阶段 作为其"冻结 SD f8 VAE"前提的同向来源引用,两源一致、无冲突; ADM 等 baseline 源桩(SRC-2105.05233)尚无 claim,暂无可比。
Notes
result=supported 指 source 内证据链完备(DA8 文献级验证),非独立复现。 两阶段"分解有利"的设计论断在 FRM TH-1 有结构推导、在 CLM-014/016 有 经验佐证,本条只锚定分解本身的存在与形式。
引用(5)
- CLM-013 LDM 把图像合成拆为感知压缩(autoencoder)与语义压缩(latent 上训 DM)两段,分离感知无关细节与语义生成。
- CLM-014 latent 空间训 DM 同时压低训练与采样算力且质量反升:LDM-4-G 271 vs ADM 916 V100-days,采样快约 3.3×。
- CPT-008 Perceptual autoencoder (first stage)
- EVI-013 §1/§2.3/§2.4:感知/语义两段分解的论述与公式(支撑 CLM-013)。
- SRC-2105.05233 扩散超越 GAN 的系统改进(Dhariwal & Nichol, NeurIPS 2021);改进采样器与架构。