| CLM-021 | 密集条件 image-to-image 直接把条件拼入输入训练,conv 式条件使模型能越过训练分辨率泛化到兆像素大图。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-022 | image-to-image 高质高效:LDM-SR 在 ImageNet 4× 超分 256² FID 优于 SR3;inpainting 亦优于现有方法。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-023 | LDM 上限受 first-stage AE 重建精度限制(细粒度像素任务),且迭代采样仍慢于 GAN 一步生成。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-001 | DiT-XL/2(cfg=1.50,3 通道 guidance)在 ImageNet 256×256 达 FID-50K 2.27,为包括 StyleGAN-XL 在内的最低 FID。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-002 | 同 XL/2 与 400K 步预算下,adaLN-Zero 的 FID 19.47 为四种 conditioning 设计最低,且算力最省之一。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-003 | 模型前向 Gflops(而非参数量)主导 DiT 质量:Gflops 相近则 FID 相近,且与 FID-50K 强负相关。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-004 | DiT-XL/2(cfg=1.50)在 ImageNet 512×512 达 FID-50K 3.04,优于全部 diffusion 基线但未超 StyleGAN-XL(2.41)。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-005 | 采样算力不能补偿模型算力:DiT-L/2 多步(1000 步、80.7 Tflops、FID-10K 25.9)仍劣于 XL/2 低步(128 步、15.2 Tflops、23.7)。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-006 | 等量总训练算力下大模型更 compute-efficient;仅改 patch size 的模型对在控制训练 Gflops 后性能曲线不同。 | Claim reconciled supported | 2026-09-03 15:07 |
| CLM-007 | VAE decoder(original/ft-MSE/ft-EMA)可免重训互换,FID 2.46/2.30/2.27,差异有限且均优于此前 diffusion。 | Claim reconciled supported | 2026-09-03 15:07 |