论文揭示 LLM Agent 工具调用在执行路径中被改写,并提出 IntAct 修复方案
提出 IEC 协议与 IntAct,定位并修复 Agent 工具调用的静默篡改
- arXiv
- 2610.04375
- 发表
- 层
- 应用层
- 场景
- 编程 Agent
- 测试
- qwen3-coder-plus、Qwen2.5-Coder-32B、Qwen2.5-72B 等 4 个
摘要论文界定工具调用在执行路径中的意图偏离问题,提出无执行归因协议与跳级修复,为智能体工程提供评测与设计准则。
提出 IEC 协议与 IntAct,定位并修复 Agent 工具调用的静默篡改
摘要论文界定工具调用在执行路径中的意图偏离问题,提出无执行归因协议与跳级修复,为智能体工程提供评测与设计准则。
分析工具型 Agent 判定检索无用却不停止的原因
本文针对智能体在工具静默失效时过度检索的问题,系统分析了判定、信念与停止行动之间的解耦现象,并提出了外部规则整合方案。
提出 Oscar,跨层溯源已知 OSS 漏洞在 Agent 系统中的已实现效应与表现边界
Oscar 是面向已知 OSS 漏洞的运行时分析框架,用来判断一次智能体执行里该漏洞是否造成安全相关效应,以及效应最远表现到哪一层。。
提出 AgentSecGraph,静态恢复 LLM Agent 敏感操作的安全依赖与上下文
AgentSecGraph 对冻结的 LLM 智能体源码做安全感知静态分析:敏感操作只作候选锚,Security-ADG 再记下它与智能体输入、依赖、信任边界、守卫和外部效果的关系。
分析外部记忆对智能体可靠处理不可回答问题的作用
这份研究在同一智能体框架里检查外部记忆会不会让不可回答问题的处理更稳,以及稳来自哪一种存储内容。
审计 Active Inference Agent 上 LLM 解释器的监督叙述失败
作者审计的是挂在智能体上的运行时解释器,而不是智能体本身。操作员读到的是信念与动作的自然语言叙述。作者要问哪些可复现触发会让这段叙述失败,以及失败痕迹是什么样。
用因果审计检验视觉工具观察是否真正改变答案
对六个 thinking-with-images 模型做因果审计,检查 crop-and-zoom 返回的观察是否中介最终答案。
提出诚实留出协议,量化安全路由评测的基线选择偏差
摘要论文揭示安全路由评估在分布偏移下的虚假下限,指出防御重心应转向外部动作级强制。
实证分析 gh-aw Markdown 的结构、维护与指令防护
这是一项对 GitHub Agentic Workflows Markdown 的仓库挖掘,目标是描述开发者如何规定并维护会反复执行的智能体工作。
用五阶段蒙特卡洛模拟奖励作弊如何导致 Agent 围堵失效
这项研究用蒙特卡洛把奖励黑客接到外部安全事件上,比较的是控制组合,不是 Hugging Face 事件的再现概率。
提出 MCPS EC,仅凭 MCP 工具元数据检测间接提示注入
提出竞争风险模型,系统化自主 Agent 的失控
摘要竞争风险框架把完成、停止与逃逸放在同一预算上,审计显示现有记录不足以估计该过程。
测量编码智能体在 HPC 集群上的使用并梳理协同设计挑战
这是一篇对生产 HPC 上编码智能体的测量与系统议程论文,不是攻击实现或防御评测。。
用 Tamarin 形式化分析智能体支付协议的跨阶段安全性质
提出 CellAudit,审计智能体发现的细胞模型是否使用声明输入
CellAudit 为智能体发现的细胞响应模型增加一层输入使用证伪:源码是否消费注册输入、拟合预测是否依赖它、该依赖是否改善对观测响应的预测。
提出 Nudgeability,测量推理模型跟随信心信号调整工具委派的对准程度