跳到正文
arXiv cs.CV· Kai Zhou, Chuanshen Chen, Runhao Zeng, Meng Dai, Yifan Yang, Jinwu Hu, Daiyuan Li, Mingkui Tan, Fei Liu·· 10 小时前AI 评分15

VFSSKep 数据集与 S³KL 框架:面向视频荧光吞咽研究的结构感知关键点定位

Structure-aware Keypoint Localization for Videofluoroscopic Swallowing Study

AI 导读

研究团队发布 VFSSKep 数据集并提出 S³KL 结构感知半监督关键点定位框架,将标注扩展至软腭并纳入大规模无标注数据。S³KL 通过结构感知学习与块混洗的结构表示一致性学习克服空间偏置,仅用 25% 标注数据即超越 100% 标注的全监督学习,达到半监督 SOTA。代码与数据将公开,成果已被 ICME 2026 Oral 接收。

来源:arXiv cs.CV · arxiv.org