跳到正文
原文
论文追踪· arXiv:2610.10285·本站收录 · 原文发表 日期未标

论文证明部分可观测且限时行动环境下完美智能体也无法保证安全

Agent 工具故障恢复与行动时限下的安全保证:2 篇摘要级候选

AI 导读

一篇 arXiv 论文讨论智能体无关的安全保证在部分可观测且必须在有限时间内行动的环境中的理论边界。作者构造了两个现实场景,一个具有无限状态空间,一个存在信号混合,并证明即使一个完美的智能体也无法保证安全行为。论文据此提出,任何 AI 安全或对齐的证明都需要把环境及相应的安全行动与智能体一并考虑,而非只论证智能体本身。

阅读原文arxiv.org