跳到正文
arXiv cs.CV· Souptik Sen, Zahra Ahmadi·· 5 小时前AI 评分18

MacJEPA:面向未剪辑第一视角视频的缺失模态鲁棒音视频识别

MacJEPA: Missingness-Robust Audio-Visual Recognition from Untrimmed Egocentric Videos

AI 导读

MacJEPA 是一种缺失模态鲁棒的音视频识别模型,将第一视角模态缺失重新定义为未剪辑多事件视频中时间局部的传感器中断,并通过窗口级模态 dropout 模拟训练。

来源:arXiv cs.CV · arxiv.org