Research KB
CPT-005 VAE decoder variants (ft-MSE / ft-EMA) Concept 2026-09-03 14:54
CPT-006 Latent Diffusion Model Concept 2026-09-03 14:54
CPT-007 adaptive layer norm (adaLN) Concept 2026-09-03 14:54
CPT-008 Perceptual autoencoder (first stage) Concept 2026-09-03 14:54
CPT-009 Cross-attention conditioning Concept 2026-09-03 14:54
EVI-001 Table 2/§5.1/App.A.1:DiT-XL/2-G 256 FID-50K 2.27(sFID 4.60/IS 278.24),3 通道 guidance 口径,优于 LDM-4-G 3.60 与 StyleGAN-XL 2.30(支撑 CLM-001)。 Evidence 2026-09-03 14:54
EVI-002 Table 4/Figure 5:XL/2 @400K adaLN-Zero FID 19.47 最低(<adaLN 25.21<cross-attn 26.14<in-context 35.24),排序训练全程保持(支撑 CLM-002)。 Evidence 2026-09-03 14:54
EVI-003 Figure 8/6 + Table 4:12 变体 Gflops-FID 强负相关;异构同 Gflops 的 S/2 68.40 vs B/4 68.38 相近、缩小 p 单调改善(支撑 CLM-003)。 Evidence 2026-09-03 14:54
EVI-004 Table 3/§5.1:DiT-XL/2-G 512 FID-50K 3.04(sFID 5.02/IS 240.82),优于全部 diffusion 但未超 StyleGAN-XL 2.41(支撑 CLM-004)。 Evidence 2026-09-03 14:54
EVI-005 Figure 10/§5.2:小模型多步采样追不平大模型(80.7 Tflops@1000 步 FID 25.9 vs 15.2 Tflops@128 步 23.7),采样算力不可替代模型算力(支撑 CLM-005)。 Evidence 2026-09-03 14:54