arXiv cs.AI· Chufan Shi, Cheng Yang, Tiannuo Yang, Isadora White, Yiwei Chen, Taylor Berg-Kirkpatrick, Xuezhe Ma·· 5 小时前AI 评分32
统一多模态模型的视觉弃权能力:Draw-or-Decline 基准与 VisTA 训练方法
Visual Abstention in Unified Multimodal Models
AI 导读
研究提出视觉弃权概念,即模型在请求的视觉变换不可能完成时应识别并拒绝生成。为此构建了 Draw-or-Decline 基准,包含 7 类任务的 1,050 对可行-不可行请求,评测 8 个统一多模态模型发现编辑能力与弃权能力相互独立,最强编辑器编辑准确率 68.4% 却仅拒绝 0.4% 的不可行请求。
来源:arXiv cs.AI · arxiv.org