防御arXiv 2609.14079
SkillSecurer:检测并修补 AI Agent 技能中的提示注入漏洞
提出 SkillSecurer,检测定位并修补智能体技能中的提示注入
- arXiv
- 2609.14079
- 发表
- 层
- 应用层
- 场景
- 编程 Agent
- 测试
- Claude Sonnet 5、Gemini 3.6 Flash、GPT-5.6 Sol 等 10 个
另有 700 篇论文还没打上分类标签,暂不在筛选结果里。
提出 SkillSecurer,检测定位并修补智能体技能中的提示注入
提出 Fed-ADR,用编排服务器协同操纵梯度攻破联邦学习并检测恢复
Fed-ADR 是一套面向联邦学习的攻击、检测与恢复框架:编排服务器改写合谋客户端的梯度,使参数服务器的现有防御把投毒更新当成良性,同时在发现后用历史梯度把全局模型原地修回来。
提出 FedMAST,用多轴结构痕迹检测并遏制联邦学习后门
提出 SKILLLITE,以证据引导的紧凑 LLM 在部署前审计恶意 Agent Skill
SKILLLITE是面向紧凑、可本地部署 LLM 的恶意 Agent Skill 预执行审计框架,作者单位为南洋理工大学。