跳到正文
热点事件持续更新

提出义务识别基准ObligationBench与ObligationGuard

1 篇报道1 个报道来源2 小时前更新

先了解这件事

报道摘要

针对 LLM 智能体安全,研究指出仅识别禁止动作并不够,还需识别未执行的安全关键动作即"义务"。在热门安全基准上,56.92% 的 GLM-5.3 轨迹含未履行义务,远高于含禁止动作的 30.00%。

摘自 arXiv cs.AI

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv cs.AI
    仅靠安全动作不足以保障智能体安全:用 Guard 模型识别未履行的义务

    针对 LLM 智能体安全,研究指出仅识别禁止动作并不够,还需识别未执行的安全关键动作即"义务"。在热门安全基准上,56.92% 的 GLM-5.3 轨迹含未履行义务,远高于含禁止动作的 30.00%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。