分析与理论arXiv:2610.04375 · 10月3日论文揭示 LLM Agent 工具调用在执行路径中被改写,并提出 IntAct 修复方案提出 IEC 协议与 IntAct,定位并修复工具调用执行路径的静默篡改编程 Agent·测试Hermes-3-Llama-3.1-70B、qwen3-coder-plus、Qwen2.5-Coder-32B 等 4 个·应用层指令与数据隔离Agent 危险操作+1+1摘要论文界定工具调用在执行路径中的意图偏离问题,提出无执行归因协议与跳级修复,为智能体工程提供评测与设计准则。完整解读
分析与理论arXiv:2610.06191 · 10月5日研究:工具型智能体判断结果无用却仍继续检索,强制整合步骤可纠正分析检索智能体判定结果无用后仍不停止检索的整合失败AI Agent·测试Llama-3.1-8B、Qwen2.5-7B、Qwen3-8B 等 7 个·应用层摘要论文揭示智能体判定工具失效却无法转化为停止行动,证实通过框架规则强制整合判定可提升表现。本文针对智能体在工具静默失效时过度检索的问题,系统分析了判定、信念与停止行动之间的解耦现象,并提出了外部规则整合方案。完整解读
分析与理论arXiv:2610.01535 · 10月1日论文:安全路由评测在分布偏移下失效,基线选取偏差被低估分析分布偏移下安全路由评测的基线选择偏差与虚假下限LLM 应用·测试distilroberta-base、claude-3-5-sonnet、claude-3-opus 等 12 个·应用层越狱+1+1摘要论文揭示安全路由评估在分布偏移下的虚假下限,指出防御重心应转向外部动作级强制。完整解读