Research KB 登录

VER-018 Verification

CFG 核验:推理期提质(T2I 23.35→12.61、IS 19.93→26.62;ImageNet 10.56→3.60)与两表一致、非增训,机制同 CPT-003。supported。

id
updated
type verification
claim CLM-018
result supported
basis T2I 表 23.35→12.61(IS 19.93→26.62)与 ImageNet 表 10.56→3.60 与命题一致;Changelog 证实 v2 用 CFG;机制与 CPT-003 一致;scale 口径在 Notes 声明
checked 2026-09-03

Checks

  1. 内部一致性:命题的“CFG 使 T2I FID 23.35→12.61、IS 19.93→26.62、ImageNet 10.56→3.60(cfg=1.5)”与 EVI-018 Result 成对对应,与两张主表数字一致;“推理期效应、不增训练成本”与 Changelog(v2 用 1.45B+CFG)相符。
  2. 证据链完整性:EVI-018 observation 精确到 T2I 表 + ImageNet 256² 主表 + Changelog;method 载明 250 DDIM 步、cfg=1.5、两个独立数据集(LAION/MS-COCO 与 ImageNet,提示不可跨表相减)。
  3. scope 匹配:命题把 CFG 效应限定在 T2I 与 class-cond ImageNet 两个设定——未外推到无条件/其他任务;“CFG 降 FID 但降 recall(多样性)”的代价在 EVI-018 Caveats 声明(与 EVI-001 的 2.27 讨论一致)。
  4. 跨来源核对:CFG 的机制定义(ε̂=s 外推、null-embedding)与 CPT-003 一致;CFG 规范源(PPR-2207.12598)为源桩,无独立 claim 可比,但 CPT-003 已给出机制性表述,两处不冲突。

Notes

23.35→12.61 与 10.56→3.60 是同一份权重推理期加 CFG 的前后对比,不是“训了两个模型”——这点对“CFG 提质”的因果归因至关重要,已在命题“几乎不加训练成本”与 EVI-018 Caveats 中显式固定。

Scope Note

2026-09-07 命题按 _issues/0001 重述(定性化);本 VER 基于旧范式(数字对照)审核,投影忠实度段待 T-VERIFY 补审。

投影忠实度复核(2026-09-07)

需修正。第一子命题(推理期 CFG 大幅抬升质量、几乎不加训练成本,T2I/ImageNet 两设定)忠实:旧审核核对的 T2I 23.35→12.61、IS 19.93→26.62、ImageNet 10.56→3.60 + Changelog 完整覆盖。但 reframe 后新增第二子命题(引导后 1.45B 文本 LDM 与最强 AR/diffusion 系统“同量级”且“参数量显著更少”,原 CLM-019 并入,证据 EVI-019)——超出本卡旧审核证据面:EVI-019 的跨系统对比行未被审计,其 Caveats(12.61 略高于 GLIDE 12.24/Make-A-Scene 11.84,“on par”是量级判断非 SOTA;参数量优势无逐模型表内数据,量化依赖外部信息)无 VER 承接,原 VER-019 随删除卡移除。建议:epistemic 复议——第二子命题按 EVI-019 Caveats 属“量级判断 + 未量化参数优势”,或补审 EVI-019 后再定。

关联(6)

  • PPR-2207.12598 Classifier-Free Diffusion Guidance
  • CLM-018 推理期 CFG 大幅抬升 LDM 样张质量(FID/IS 同改)而几乎不加训练成本,两设定均成立;引导后的 1.45B cross-attn 文本 LDM 与近期最强 AR/diffusion 系统同量级且参数量显著更少(论文措辞 on par,非新 SOTA)。
  • EVI-001 Table 2/§5.1/App.A.1:DiT-XL/2-G 256 FID-50K 2.27(sFID 4.60/IS 278.24),3 通道 guidance 口径,优于 LDM-4-G 3.60 与 StyleGAN-XL 2.30(支撑 CLM-009)。
  • EVI-018 主文 T2I 表 + ImageNet 主表:CFG 的推理期质量增益(支撑 CLM-018)。
  • EVI-019 主文 T2I 对比表 + §4.3.1:1.45B 文本条件 LDM 对比 AR/diffusion(支撑 CLM-018 第二子命题)。
  • CPT-003 classifier-free guidance