跳到正文
arXiv cs.LG· Dan Ben-Ami, Kobi Cohen, Chaim Baskin·· 5 小时前AI 评分22

冻结的 VideoLLM 是否已编码证据就绪信号?Readiness Gating 提升回答时机准确率

Have I Seen Enough? Frozen Video-Language Models Encode Evidence Readiness

AI 导读

研究发现冻结的 VideoLLM 已线性编码"证据就绪"信号,在 7 个模型的字节级相同评测中 AUROC 达 0.733-0.905,且该信号随问题变化而反转(66.1% 配对),在错误回答中仍保持 0.722。基于此提出的 Readiness Gating 回答时机策略在相同视频时长下最高提升准确率 +9.75 个百分点,计算开销可忽略。

来源:arXiv cs.LG · arxiv.org