跳到正文
arXiv cs.LG· Leo Zeitler, Jack Richings, Victoria Nockles·· 6 小时前AI 评分24

论文探讨行动时间受限的智能体 AI 安全边界

AI Safety Considerations for Agents With Limited Time to Act

AI 导读

针对现有 AI 对齐研究多忽略智能体所处环境的问题,该论文讨论了在只能部分观测且须限时行动的环境中,智能体无关安全保证的理论边界。作者构造了无限状态空间与信号混合两个现实场景,证明即便完美智能体也无法保证安全行为,并提出任何 AI 安全或对齐证明都须将环境与相应安全动作同智能体一并考量。

来源:arXiv cs.LG · arxiv.org