arXiv stat.ML· Thomas Schnake, Doreen Sch\"oppenthau, Alexander Meyer, Jacques Corbeil, Klaus-Robert M\"uller, Gr\'egoire Montavon·· 4 小时前AI 评分22
DictXAI:用模型无关的概念字典重新审视可解释 AI
Revisiting Explainable AI through Model-Independent Concept Dictionaries
AI 导读
研究者提出 DictXAI,通过在输入域用字典定义概念来解释模型预测:先计算输入的稀疏编码,再把预测归因到对应的字典元素。该方法可将 Clever Hans 效应等 AI 故障直接归因到数据中可识别的伪影模式,并支持学习到的图像基、心电图解析波形和实验获取的字典元素等多种字典。结果显示,DictXAI 比经典 XAI 和现有基于概念的方法更具可解释性、可操作性和架构无关性。
来源:arXiv stat.ML · arxiv.org