提出义务识别基准ObligationBench与ObligationGuard
热点事件持续更新
提出义务识别基准ObligationBench与ObligationGuard
1 篇报道1 个报道来源2 小时前更新
先了解这件事
报道摘要
针对 LLM 智能体安全,研究指出仅识别禁止动作并不够,还需识别未执行的安全关键动作即"义务"。在热门安全基准上,56.92% 的 GLM-5.3 轨迹含未履行义务,远高于含禁止动作的 30.00%。
摘自 arXiv cs.AI
最新进展10月9日 12:00
仅靠安全动作不足以保障智能体安全:用 Guard 模型识别未履行的义务报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv cs.AI仅靠安全动作不足以保障智能体安全:用 Guard 模型识别未履行的义务
针对 LLM 智能体安全,研究指出仅识别禁止动作并不够,还需识别未执行的安全关键动作即"义务"。在热门安全基准上,56.92% 的 GLM-5.3 轨迹含未履行义务,远高于含禁止动作的 30.00%。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。