跳到正文
arXiv cs.AI· Ruizhi Xu, Wei Xu, Sibo Zhu·· 10 小时前AI 评分22

TARE:用未被投毒的孪生模型衡量后门防御的真实代价

TARE: Weigh a Never-Poisoned Twin Before Reading Backdoor-Defense Costs

AI 导读

针对后门防御排行榜仅凭被投毒模型上的干净准确率下降来判定“移除代价”的问题,研究者提出 TARE:在同一配方、调度与随机种子下,用未被投毒的孪生模型跑同一防御,孪生模型损失的部分即为真实代价。

来源:arXiv cs.AI · arxiv.org