分析与理论arXiv 2609.38411
研究提出自主 Agent 失控的竞争风险系统化框架
提出竞争风险模型系统化自主 Agent 失控并审计事件与评测
- arXiv
- 2609.38411
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 风险Agent 危险操作
- 组件权限与沙箱
摘要竞争风险框架把完成、停止与逃逸放在同一预算上,审计显示现有记录不足以估计该过程。
另有 435 篇论文还没打上分类标签,暂不在筛选结果里。
提出竞争风险模型系统化自主 Agent 失控并审计事件与评测
摘要竞争风险框架把完成、停止与逃逸放在同一预算上,审计显示现有记录不足以估计该过程。
用五阶段蒙特卡洛分析奖励作弊如何导致 Agent 围堵失效
这项研究用蒙特卡洛把奖励黑客接到外部安全事件上,比较的是控制组合,不是 Hugging Face 事件的再现概率。
用 Tamarin 形式化分析智能体支付协议的跨阶段安全关系