跳到正文
arXiv cs.AI· Chufan Shi, Cheng Yang, Tiannuo Yang, Isadora White, Yiwei Chen, Taylor Berg-Kirkpatrick, Xuezhe Ma·· 11 小时前AI 评分32

统一多模态模型的视觉弃权能力:Draw-or-Decline 基准与 VisTA 训练方法

Visual Abstention in Unified Multimodal Models

AI 导读

研究提出视觉弃权概念,即模型在请求的视觉变换不可能完成时应识别并拒绝生成。为此构建了 Draw-or-Decline 基准,包含 7 类任务的 1,050 对可行-不可行请求,评测 8 个统一多模态模型发现编辑能力与弃权能力相互独立,最强编辑器编辑准确率 68.4% 却仅拒绝 0.4% 的不可行请求。

来源:arXiv cs.AI · arxiv.org