跳到正文
热点事件持续更新

论文提出限时行动下智能体安全的理论界限

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

Leo Zeitler 等作者发表论文,讨论在只能部分观测、且必须在有限时间内行动的环境中,智能体无关安全保证的理论界限。作者构造无限状态空间与信号混合两个场景,证明即便完美智能体也无法保证安全行为。 据此,作者提出任何 AI 安全或对齐证明都须把环境与相应安全动作同智能体一并考量,而非只针对智能体本身。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv cs.LG
    论文探讨行动时间受限的智能体 AI 安全边界

    针对现有 AI 对齐研究多忽略智能体所处环境的问题,该论文讨论了在只能部分观测且须限时行动的环境中,智能体无关安全保证的理论边界。作者构造了无限状态空间与信号混合两个现实场景,证明即便完美智能体也无法保证安全行为,并提出任何 AI 安全或对齐证明都须将环境与相应安全动作同智能体一并考量。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。