跳到正文
arXiv cs.AI· Subhabrata Majumdar, Rajlakshmi Chavan·· 3 小时前AI 评分22

AI 安全的 Stackelberg 模型中的防御充分性

Defensive Sufficiency in a Stackelberg Model of AI Security

AI 导读

研究显示,当每个未解决攻击都有持续被发现的机会、修复有效且后续更新能保留既有防护时,由有限输入构成的攻击面可被以概率 1 防御。作者进一步构建防御者主导的 Stackelberg 博弈,刻画了威慑攻击的最低成本分配,以及防御者不投入、只投入一种或同时投入主动发现与被动修复的均衡区间。数值实验表明,更快的修复能缩短被攻陷时长,却不降低被攻陷概率。

来源:arXiv cs.AI · arxiv.org