arXiv cs.CV· Bodong Du, Bowen Liu, Yang Yu, Xinpeng Ding, Zhiheng Wu, Shuning Wang, Shuo Nie, Naiming Liu, Qifeng Chen, Yangqiu Song, Xiaomeng Li·· 9 小时前AI 评分26
MedHorizon:面向真实场景长上下文医疗视频理解的基准
MedHorizon: Towards Long-context Medical Video Understanding in the Wild
AI 导读
MedHorizon 是一个面向真实场景长上下文医疗视频理解的基准,保留 759 小时完整临床手术视频,并提供 1,253 道基于证据的多选题,平均证据帧仅占 0.166%。评测显示最佳模型准确率仅 41.1%,性能不随帧数增加可靠提升,证据检索与临床解读仍是主要瓶颈。
来源:arXiv cs.CV · arxiv.org