Research KB 登录

VER-020 Verification

无条件合成核验:CelebA-HQ 5.11 SOTA、FFHQ 4.98、LSUN-Bedrooms 2.95 vs ADM 1.90 与无条件表一致,SOTA 限 CelebA-HQ、P/R 逐数据集。supported。

id
updated
type verification
claim CLM-020
result supported
basis 无条件表(CelebA-HQ 5.11 SOTA; FFHQ 4.98; LSUN-Bedrooms 2.95 vs ADM 1.90)+ §4.2 与命题一致;SOTA 限 CelebA-HQ、P/R 对 GAN 逐数据集成立、对 ADM 不占优等边界已在 Notes/Caveats 声明
checked 2026-09-03

Checks

  1. 内部一致性:命题的“CelebA-HQ 5.11 新 SOTA”“FFHQ/LSUN 竞争”“P/R 优于 GAN”与 EVI-020 Result 对应——VQGAN 10.2/PGGAN 8.0/LSGM 7.22/ UDM 7.16(CelebA-HQ 基线)、LDM-4 4.98(FFHQ)、LSUN-Bedrooms 2.95 vs ADM 1.90/ProjectedGAN 1.52,全部在无条件表中。
  2. 证据链完整性:EVI-020 observation 精确到无条件表(256²,FID+ Precision+Recall)+ §4.2;method 载明 DDIM 步数(CelebA-HQ 500、FFHQ/LSUN 200)与对比集合(GAN/likelihood 两族)。
  3. scope 匹配:命题把“SOTA”严格限定于 CelebA-HQ(5.11 低于全表),对 FFHQ/LSUN 用“竞争”而非“领先”(FFHQ 的 ProjectedGAN 3.08、Bedrooms 的 ADM 1.90 均低于 LDM 4.98/2.95);“P/R 优于 GAN”限定为逐数据集对 GAN 成立,且 Notes 声明对 ADM(likelihood)的 Recall 并不占优。
  4. 跨来源核对:DiT 侧(EVI-001)的 “LDM-4-G 3.60” 是 class-cond ImageNet,与本条的无条件 CelebA-HQ 5.11 无直接交叠、不冲突;无条件任务的 GAN 基线(StyleGAN/ProjectedGAN 等)为源桩无 claim,数值级核对已在本表完成,推迟 T-RECONCILE。

Notes

“5.11 新 SOTA”严格是 CelebA-HQ 单数据集上的(对比表内)最优;把“无条件 SOTA”误读为跨数据集一律领先即超出证据。mode-covering 优势的强度(Recall 0.48 vs ADM 0.51 在 Bedrooms 上不占优)已在命题/EVI-020 如实保留,避免字面过强。

Scope Note

2026-09-07 命题按 _issues/0001 重述(定性化);本 VER 基于旧范式(数字对照)审核,投影忠实度段待 T-VERIFY 补审。

投影忠实度复核(2026-09-07)

忠实。命题重心移轴(P/R 主轴、SOTA 降为定位背景)但两半均在旧审核证据面内:P/R 逐数据集对 GAN 成立、对 ADM(likelihood)Recall 不占优(Bedrooms 0.48 vs 0.51)、SOTA 严格限 CelebA-HQ 且 FFHQ/LSUN 用“竞争”,均为旧审核逐项核对项;“指标层证据”的 A4 限定词(无 rare-class/coverage@k 检验)与旧审核对 mode-covering 强度的保留一致。移轴未扩大断言范围,结论不变。

关联(3)

  • CLM-020 likelihood-based 目标的 mode-covering 行为在 Precision/Recall 上系统性地优于 GAN(逐数据集、针对对抗基线),支持其分布覆盖优势的指标层证据;同口径下 LDM 于 CelebA-HQ 取得新 SOTA FID,其余数据集与最强 GAN/扩散竞争。
  • EVI-001 Table 2/§5.1/App.A.1:DiT-XL/2-G 256 FID-50K 2.27(sFID 4.60/IS 278.24),3 通道 guidance 口径,优于 LDM-4-G 3.60 与 StyleGAN-XL 2.30(支撑 CLM-009)。
  • EVI-020 无条件合成表:LDM 对 GAN/扩散基线的 FID/Precision/Recall(支撑 CLM-020)。