跳到正文
arXiv cs.CL· Yun-Ang Wu, Xanh Ho, Andre Greiner-Petter, Sunisth Kumar, Tian Cheng Xia, Florian Boudin, Akiko Aizawa·· 1 天前AI 评分17

多模态声明验证对 LLM 改写有多鲁棒?

How Robust Is Multimodal Claim Verification to LLM Rewriting?

AI 导读

研究测试了 11 个开源权重模型(覆盖 5 个 VLM 家族、2B 至 38B 参数)在多模态声明验证任务中对 LLM 改写的鲁棒性。结果显示多数模型准确率无显著下降,但概率出现一致性偏移:对冲类改写几乎在所有模型上引发显著偏移,增强类效果较弱,语法纠错等常规润色几乎无影响。

来源:arXiv cs.CL · arxiv.org