| CPT-005 | VAE decoder variants (ft-MSE / ft-EMA) | Concept | 2026-09-03 14:54 |
| CPT-006 | Latent Diffusion Model | Concept | 2026-09-03 14:54 |
| CPT-007 | adaptive layer norm (adaLN) | Concept | 2026-09-03 14:54 |
| CPT-008 | Perceptual autoencoder (first stage) | Concept | 2026-09-03 14:54 |
| CPT-009 | Cross-attention conditioning | Concept | 2026-09-03 14:54 |
| EVI-001 | Table 2/§5.1/App.A.1:DiT-XL/2-G 256 FID-50K 2.27(sFID 4.60/IS 278.24),3 通道 guidance 口径,优于 LDM-4-G 3.60 与 StyleGAN-XL 2.30(支撑 CLM-001)。 | Evidence | 2026-09-03 14:54 |
| EVI-002 | Table 4/Figure 5:XL/2 @400K adaLN-Zero FID 19.47 最低(<adaLN 25.21<cross-attn 26.14<in-context 35.24),排序训练全程保持(支撑 CLM-002)。 | Evidence | 2026-09-03 14:54 |
| EVI-003 | Figure 8/6 + Table 4:12 变体 Gflops-FID 强负相关;异构同 Gflops 的 S/2 68.40 vs B/4 68.38 相近、缩小 p 单调改善(支撑 CLM-003)。 | Evidence | 2026-09-03 14:54 |
| EVI-004 | Table 3/§5.1:DiT-XL/2-G 512 FID-50K 3.04(sFID 5.02/IS 240.82),优于全部 diffusion 但未超 StyleGAN-XL 2.41(支撑 CLM-004)。 | Evidence | 2026-09-03 14:54 |
| EVI-005 | Figure 10/§5.2:小模型多步采样追不平大模型(80.7 Tflops@1000 步 FID 25.9 vs 15.2 Tflops@128 步 23.7),采样算力不可替代模型算力(支撑 CLM-005)。 | Evidence | 2026-09-03 14:54 |