跳到正文
热点事件持续更新

arXiv 论文:限时部分可观测环境下智能体安全存在理论边界

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

Leo Zeitler 等作者在 arXiv 发布论文,指出在只能部分观测且必须在有限时间内行动的环境中,即便智能体完美,也无法保证安全行为。 作者构造了无限状态空间和信号混合两种场景,证明与环境无关的安全保证存在理论边界。论文由此提出,任何 AI 安全或对齐证明都必须把环境与对应安全动作同智能体一并考虑。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv:cs.LG
    论文探讨时间受限智能体的 AI 安全:部分可观测环境下无法保证安全行为

    一项理论研究指出,在只能部分观测且必须在有限时间内行动的环境中,即便是完美的 AI 智能体也无法保证安全行为。作者构造了无限状态空间和信号混合两种场景,证明智能体无关的安全保证存在理论边界,并提出任何 AI 安全或对齐证明都必须将环境与对应安全动作同智能体一并考虑。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。