跳到正文
10月8日 · 周四

Agent 安全 · 论文

找到 4 篇

另有 378 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 分析与理论arXiv:2610.04375 ·

    论文揭示 LLM Agent 工具调用在执行路径中被改写,并提出 IntAct 修复方案

    提出 IEC 协议与 IntAct,定位并修复工具调用执行路径的静默篡改

    编程 Agent测试qwen3-coder-plus、Qwen2.5-Coder-32B、Qwen2.5-72B 等 4 个应用层

    摘要论文界定工具调用在执行路径中的意图偏离问题,提出无执行归因协议与跳级修复,为智能体工程提供评测与设计准则。

    完整解读
  2. 分析与理论arXiv:2610.06191 ·

    研究:工具型智能体判断结果无用却仍继续检索,强制整合步骤可纠正

    分析检索智能体判定结果无用后仍不停止检索的整合失败

    AI Agent测试Qwen2.5-7B、Llama-3.1-8B、Qwen3-8B 等 7 个应用层
    摘要论文揭示智能体判定工具失效却无法转化为停止行动,证实通过框架规则强制整合判定可提升表现。

    本文针对智能体在工具静默失效时过度检索的问题,系统分析了判定、信念与停止行动之间的解耦现象,并提出了外部规则整合方案。

    完整解读
  3. 分析与理论arXiv:2610.06001 ·

    AgentSpy:在系统调用层观测 AI Agent 行为并检测技能注入攻击

    提出 AgentSpy,在系统调用层观测编程智能体并检测技能注入攻击

    编程 Agent测试gpt-5.6-terra、deepseek-v4-flash、glm-5.3-flash 等 4 个应用层
    摘要提出了系统级智能体监控框架 AgentSpy,揭示出通过测试背后的非预期行为与注入风险。

    本研究提出了面向 AI 智能体的系统级外部监控与行为分析框架 AgentSpy。

    完整解读
已经到底了