跳到正文
arXiv cs.AI· Bach Nguyen, Zhaonan Li, Mau Son Nguyen, Sanika Chavan, Nilay Kumar, Hong Anh Nguyen, Khoa Vo, Ben Zhou·· 5 小时前AI 评分23

VisualNoiseQA:LLM 如何在噪声证据下推理?一个主动视觉推理基准

How Well Do LLMs Reason with Noisy Evidence? An Active Visual Reasoning Benchmark

AI 导读

研究者提出 VisualNoiseQA,一个面向噪声视觉反馈下主动推理的基准:纯文本 LLM 需通过迭代查询一个固定的现成 VLM(视为随机视觉传感器)来解答 VQA 问题,每次查询多次采样并以自一致性给出经验不确定性信号,供推理器决定下一步问什么、何时停止。

来源:arXiv cs.AI · arxiv.org