arXiv cs.CV· Wanzhou Lei, Cuifeng Shen, Yanjin He, Maohua Li, Hua Yuan, Per-Olof Persson, Tao Lan, Kan Liu, Hanlin Tang·· 3 小时前AI 评分22
冻结 DINOv3-L 潜空间实现超分辨率:RAESR 模型提出新范式
Super-Resolution in The Right Latent Space: A Frozen Vision-Foundation Substrate
AI 导读
研究者提出在冻结 DINOv3-L 的 23 层融合潜空间中进行超分辨率,训练 415M 解码器得到 RAESR 模型,在 RealSR、DRealSR、LSDIR 和 DIV2K-Val 上取得最优保真度-感知权衡,单张 H20 GPU 处理 512×512 图像仅需 37 ms。相同配方下换用 VAE 潜空间则在所有指标上落败。
来源:arXiv cs.CV · arxiv.org