arXiv cs.CV· Dingzhan Nong, Zhihao Ren, Ziqi Li, Tim Lo·· 4 小时前AI 评分22
基于损失引导多专家 GAN 的手语视频合成框架
Sign Language Video Synthesis via Loss-Guided Multi-Expert GANs
AI 导读
一项初步技术报告提出用损失引导多专家 GAN 合成手语视频,由全局、手部、头部三个判别器分别引导生成器对应专家分支,并以 10% 权重的 United Loss 共识机制稳定训练。在 156GB 自建数据集上,0.2B、0.66B、1.3B 参数变体分别达到 29.78、30.52、30.72 PSNR,推理显存占用为 1.5GB、约 5GB 和 8GB,可部署于消费级硬件。
来源:arXiv cs.CV · arxiv.org