Research KB 登录

VER-022 Verification

i2i 核验:SR FID 2.8/2.4/4.4 胜 SR3、inpainting 2.7×提速/1.6×FID、胜 LaMa(用户 30.4/70.6、21.0/68.1)与表/正文逐项一致。supported。

id
updated
type verification
claim CLM-022
result supported
basis srtable(2.8/2.4/4.4, PSNR 24.4-25.8)、inpainting 正文(2.7×/1.6×, ms.tex 行 1264-1265)、user_study(30.4/70.6, 21.0/68.1)与命题逐项一致;LaMa LPIPS 略优而 FID 略逊的维度差异已声明
checked 2026-09-03

Checks

  1. 内部一致性:命题的 SR(FID 2.8/2.4/4.4、胜 SR3)、Inpainting(2.7×/1.6× vs 像素基线、FID 胜 LaMa、387M 微调刷新 SOTA)、用户研究(SR 30.4/70.6;Inp 21.0/68.1)与 EVI-022 Result 成组对应,且与源(srtable 行 444-445、ms.tex 行 1264-1265 的 “2.7×...1.6×” 原文、user_study 表)逐项一致。
  2. 证据链完整性:EVI-022 observation 精确到 §4.4/§4.5 + Tab. srtable / inpaintingefficiency / inpaintingtable / user_study;method 载明 SR 的 f=4 VQ + LR concat、inpainting 的 Places 256²/512² 与 215M/387M 对齐、DDIM。
  3. scope 匹配:命题限定 SR ImageNet 4×(256²)、inpainting Places(256²/512²)——未跨任务泛化;“2.7×/1.6×”以“至少”(at least)如实复述正文;PSNR/SSIM 由回归基线占先的指标特性已在 Notes 声明。
  4. 跨来源核对:SR3(2104.07636)/LaMa(FFT 专用)为源桩无 claim,数值级核对已在本表完成;与 DiT 无交叠(DiT 不做 SR/inpainting),无冲突,推迟 T-RECONCILE。

Notes

Inpainting 的“LPIPS 略劣于 LaMa 而 FID 更优”是单样本感知距离 vs 分布匹配两个维度排序不一致(LaMa 单张均值化图像 vs LDM 多样样本),EVI-022 Caveats 已记录,命题未据此宣称 LDM 全面胜出。“新 SOTA FID”是 387M 模型在 512² 微调半 epoch 后的读数,随配置漂移,已附口径。

Scope Note

2026-09-07 命题按 _issues/0001 重述(定性化);本 VER 基于旧范式(数字对照)审核,投影忠实度段待 T-VERIFY 补审。

投影忠实度复核(2026-09-07)

忠实。两子命题合并(监工裁决 2026-09-07(b))未扩大断言范围:SR 半边(FID 胜 SR3、PSNR/SSIM 由回归基线占先、用户偏好)与 inpainting 半边(2.7×/1.6×、FID 胜 LaMa 而 LPIPS 略高、归因于单样本 vs 分布匹配)均为旧审核逐项核对的证据面内容;“感知质量 vs 像素精确分化”的分析约定在旧审核 Notes(LaMa 维度差异)已有。387M SOTA 读数按裁决沉 EVI-022,命题未纳入。结论不变。

关联(2)

  • CLM-022 对密集条件 i2i 任务,latent 扩散配方同时给出感知质量与效率收益:(SR) LDM-SR 在感知指标上胜过专用像素扩散 SR3 与回归基线,但 PSNR/SSIM 由回归基线占先;(Inpainting) latent 化显著提吞吐并改善 FID,分布级质量超专用 SOTA 修复器 LaMa 而 LPIPS 略高。
  • EVI-022 §4.4/4.5 + Tab. srtable/inpainting:SR 与 inpainting 的高质高效结果(支撑 CLM-022)。