| VER-001 | 核验 CLM-001 DiT SOTA:Table 2/§5.1/App.A.1 数字(2.27、LDM-4-G 3.60、StyleGAN-XL 2.30)与 v2 源逐项一致,含审计修正史;scope 未超。supported。 · [checks] 1. **内部一致性**:命题三组数字(2.27、ldm-4-g 3.60、stylegan-xl 2.30) 与 evi-001 result 一一对应;"含 [body] | Verification |
| VER-002 | 核验 CLM-002 adaLN-Zero 胜出:Table 4 四行与 Gflops/params 列逐项一致、Figure 5 排序声明一致,'同配置同预算'经审计修正。supported。 · [checks] 1. **内部一致性**:命题数字(19.47 / 25.21 / 26.14 / 35.24)与 evi-002 result 一致;"计算开销最低之一(118 [body] | Verification |
| VER-003 | 核验 CLM-003 Gflops-FID 标度:Fig.8/6 引用与 Table 4 十二变体数字(S/2 6.06G、B/4 5.56G 等)逐项核对一致,以'经验规律'限定未泛化。supported。 · [checks] 1. **内部一致性**:命题的两个断言(gflops 相近 → fid 相近;强负 相关)与 evi-003 result 一致,例子数字(6.06g/68.4 [body] | Verification |
| VER-004 | 核验 CLM-004 512 SOTA:Table 3(3.04/3.85/2.41)与 §5.1 512 段(3M 步、1024 tokens、524.6G)逐项一致。supported。 · [checks] 1. **内部一致性**:命题数字(3.04、adm-g+u 3.85、stylegan-xl 2.41) 与 evi-004 result 一致;"未超过 ga [body] | Verification |
| VER-005 | 核验 CLM-005 采样算力:§5.2 锚点(23.7 vs 25.9、15.2 vs 80.7 Tflops)与 Figure 10 一致,FID-10K 口径已声明。supported。 · [checks] 1. **内部一致性**:命题的锚点对照(xl/2@128 步 15.2 tflops fid-10k 23.7 优于 l/2@1000 步 80.7 tflop [body] | Verification |
| VER-006 | 核验 CLM-006 训练算力效率:Fig.9 XL-4→XL-2 交叉声明(~10^10 Gflops)与 §4.2 一致,x3 估算因子属 AX-7 约定。supported。 · [checks] 1. **内部一致性**:命题两个断言(等训练算力下大模型更 efficient; 同 gflops 预算下不同 patch size 曲线不同)与 evi-00 [body] | Verification |
| VER-007 | 核验 CLM-007 decoder 消融:Table 5(2.46/2.30/2.27)与 §A.4(encoder 相同、免重训互换、LDM decoder 下仍最优)一致。supported。 · [checks] 1. **内部一致性**:命题数字与 evi-007 result 一致;"差异存在但幅度 有限"与 table 5(fid 差 0.19)一致;"仍优于此前全部 [body] | Verification |
| VER-008 | 核验 CLM-008 subset-channel guidance:App.A.1(3ch@1.5→2.27、4ch@1.375→2.20、近似式)逐字核对一致,'近似'不确定性保留。supported。 · [checks] 1. **内部一致性**:命题的数字对(2.27 / 2.20)与近似关系式均与 evi-008 result 及 app. a.1 原文一致;"效果近似"的限定 [body] | Verification |
| VER-009 | 核验 CLM-009 架构论题:可检验部分(ViT 替换 U-Net 质量反升)与 Table 2/3/6 一致;'归纳偏置非关键'属作者诠释(非受控对比),按 A4 保留。partially-supported。 · [checks] 1. **内部一致性**:命题的可检验部分(标准 vit 可直接替换、同等 协议下质量更优)与 evi-009(table 2/3 + table 6 gflop [body] | Verification |
| VER-010 | 核验 CLM-010 配方稳定:§4.1 两引语(no loss spikes/did not tune)与 Table 4 超参列(lr 1e-4、batch 256)及 Fig.13 曲线一致。supported。 · [checks] 1. **内部一致性**:命题的配方清单(adamw、恒定 lr 1e-4、无 weight decay、无 warmup、无正则化、batch 256、ema [body] | Verification |
| VER-011 | 核验 CLM-011 patchify 标度:推导链(patchify→T×4→Gflops≥×4、参数不变)与 §3.2 一致,Table 4 实测 3.9–4.3× 逐行核对。supported。 · [checks] 1. **内部一致性**:命题的标度断言与 §3.2 原文("halving p will quadruple t, and thus at least quad [body] | Verification |
| VER-012 | 核验 CLM-012 CFG 梯度:Table 2/3 行内(256: 9.62/3.22/2.27;512: 12.03/4.64/3.04)逐格一致,scale 边界与质量-多样性权衡已记。supported。 · [checks] 1. **内部一致性**:命题的六个数字与 table 2/3 的 dit-xl/2 行 (无 g / -g cfg1.25 / -g cfg1.50)逐一对应; [body] | Verification |
| VER-013 | 两段分解核验:感知压缩 AE + 潜空间 DM 与 §1/§2.3/§2.4(Eq.4-5)一致,DiT FRM-2212.09748 AX-2 同向互证,scope 未超。supported。 · [checks] 1. **内部一致性**:命题"感知压缩(ae)+ 语义压缩(latent 上训 dm)"与 evi-013 result 的两段描述一一对应;kl/vq 两种正 [body] | Verification |
| VER-014 | 算力主张核验:271 vs 916 V100-day、0.4 vs 0.12 samples/s、FID 3.60/3.95 vs 10.94 与 compute_vs_fid 表逐项吻合,两 cfg 口径已分离。supported。 · [checks] 1. **内部一致性**:命题的"271 vs 916 v100-days(≈3.4×)""0.4 vs 0.12 samples/s(≈3.3×)""400m [body] | Verification |
| VER-015 | 重建核验:LDM f=8 R-FID 1.14 vs DALL·E 32.01 / VQGAN 4.98、f=2 0.16 与 Tab.423 一致,f=16 打平边界已声明。supported。 · [checks] 1. **内部一致性**:命题"2d-conv 容忍更低 f、重建更保真"与其三个数字 (ldm f=8 1.14、dall·e f=8 32.01、vqgan [body] | Verification |
| VER-016 | f 甜区核验:f=4/8 最优与 §4.1 消融、FID gap 38(LDM-1 vs LDM-8 @2M)正文引语一致,scope 限 ImageNet/2M/单 A100。supported。 · [checks] 1. **内部一致性**:命题的"f=1/2 慢、f=16/32 损、f=4/8 为甜区、fid gap 38" 与 evi-016 result 一致;gap [body] | Verification |
| VER-017 | 条件机制核验:Q/K/V 公式(§2.5 Eq. cond_loss)与命题一致,text/class/layout/i2i 四模态有实例,与 DiT adaLN 不同机制不冲突。supported。 · [checks] 1. **内部一致性**:命题对 cross-attention 机制的描述(q 来自 unet 中间 特征 φ_i(z_t),k/v 来自 τ_θ(y),att [body] | Verification |
| VER-018 | CFG 核验:推理期提质(T2I 23.35→12.61、IS 19.93→26.62;ImageNet 10.56→3.60)与两表一致、非增训,机制同 CPT-003。supported。 · [checks] 1. **内部一致性**:命题的"cfg 使 t2i fid 23.35→12.61、is 19.93→26.62、 imagenet 10.56→3.60(cf [body] | Verification |
| VER-019 | T2I 核验:1.45B LDM-KL-8-G 在 MS-COCO 250 步 FID 12.61/IS 26.62,与 GLIDE 12.24/Make-A-Scene 11.84 同量级(非最低),措辞如实。supported。 · [checks] 1. **内部一致性**:命题的"1.45b、ms-coco 250 步、fid 12.61、is 26.62、 与 glide 12.24 / make-a-s [body] | Verification |
| VER-020 | 无条件合成核验:CelebA-HQ 5.11 SOTA、FFHQ 4.98、LSUN-Bedrooms 2.95 vs ADM 1.90 与无条件表一致,SOTA 限 CelebA-HQ、P/R 逐数据集。supported。 · [checks] 1. **内部一致性**:命题的"celeba-hq 5.11 新 sota""ffhq/lsun 竞争""p/r 优于 gan"与 evi-020 result [body] | Verification |
| VER-021 | 大图核验:§4.3.2 卷积滑窗 + Fig. thicksample/text2img_conv 支持越训练分辨率至 ~1024²/兆像素,rescale+CFG 条件已声明。supported。 · [checks] 1. **内部一致性**:命题"密集条件 i2i 拼接注入 + 卷积滑窗越过训练分辨率 生成 ~1024²/兆像素"与 evi-021 result 一致——se [body] | Verification |
| VER-022 | i2i 核验:SR FID 2.8/2.4/4.4 胜 SR3、inpainting 2.7×提速/1.6×FID、胜 LaMa(用户 30.4/70.6、21.0/68.1)与表/正文逐项一致。supported。 · [checks] 1. **内部一致性**:命题的 sr(fid 2.8/2.4/4.4、胜 sr3)、inpainting (2.7×/1.6× vs 像素基线、fid 胜 la [body] | Verification |
| VER-023 | 局限核验:§10 原文(顺序采样慢于 GAN;f=4 AE 非逐像素精确成瓶颈、SR 已受限,'assume' 措辞)与命题一致,推断性质已声明。supported。 · [checks] 1. **内部一致性**:命题的"f=4 ae 非逐像素精确 → 细粒度像素任务上限、sr 已受限;顺序采样慢于 gan"与 evi-023 result 的 § [body] | Verification |
第 1 / 1 页