研究者提出上下文权限提升攻击,12 款 Agent 框架均受影响
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
完整解读另有 17 篇论文还没打上分类标签,暂不在筛选结果里。
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
完整解读提出内容不变样式包装,翻转安全评审器的判定
这是一项关于大语言模型自动化安全评审系统表面样式脆弱性的评估研究。
提出任意字母置换密码越狱,无需微调即可诱导有害输出
提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
提出 PMPA,诱导智能体把外部恶意指令写入持久记忆并跨会话泄露隐私
提出爆炸提示词,用条件触发的间接注入延迟诱发恶意工具调用
论文针对大语言模型智能体面临的间接提示注入威胁,研究了利用条件句式实现时间分离的爆炸提示词。