评测与基准arXiv 2609.33658
AgentBound:面向工具型 LLM Agent 安全的四路反事实评测框架
提出四向反事实评测,测量工具 Agent 对授权与表面风险的行动边界
- arXiv
- 2609.33658
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- SmolLM3-3B、GPT-5.5、Claude Opus 4.8 等 15 个
摘要四向反事实基准把过度拒绝和未授权遵从拆开,Thought 校正在十个配置上提高已授权完成。
AGENT BOUNDARY 是面向工具使用 LLM 智能体的四向可执行反事实评测,并附带一个决策时 Thought 校准模块。