手语视频合成多专家GAN技术报告发布
热点事件持续更新
手语视频合成多专家GAN技术报告发布
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
一项初步技术报告提出用损失引导多专家 GAN 合成手语视频:全局、手部、头部三个判别器分别引导生成器的对应专家分支,并以 10% 权重的 United Loss 共识机制稳定训练。 在 156GB 自建数据集上,0.2B、0.66B、1.3B 参数变体的 PSNR 分别为 29.78、30.52、30.72,推理显存占用约 1.5GB、5GB 和 8GB,报告称可部署于消费级硬件。
AI 根据报道生成 · 2 小时前更新
最新进展10月8日 12:00
基于损失引导多专家 GAN 的手语视频合成框架报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv cs.CV基于损失引导多专家 GAN 的手语视频合成框架
一项初步技术报告提出用损失引导多专家 GAN 合成手语视频,由全局、手部、头部三个判别器分别引导生成器对应专家分支,并以 10% 权重的 United Loss 共识机制稳定训练。在 156GB 自建数据集上,0.2B、0.66B、1.3B 参数变体分别达到 29.78、30.52、30.72 PSNR,推理显存占用为 1.5GB、约 5GB 和 8GB,可部署于消费级硬件。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。