防御arXiv 2610.08773
AdvSim2Real 用任务与注入对手共同演化训练网页智能体
提出 AdvSim2Real,协同训练网页智能体抵御页面注入
- arXiv
- 2610.08773
- 发表
- 层
- 应用层
- 被测模型
- Qwen3.5-4B
提出 AdvSim2Real,协同训练网页智能体抵御页面注入
提出 CredLeak-Bench,评测 Agent 面对钓鱼的凭据泄露与恢复
评测安全 Agent 在对抗性任务污染下的解题成功与开销
AgentLSD 是一个对照框架,用来测量安全智能体在任务本身不变时,对对抗性任务污染的反应。
提出 AgentFlow 流策略语言与运行时框架,约束智能体跨步数据流
提出 LoginTrap,以网页弹窗诱导 Web Agent 提交敏感信息
摘要揭示网络智能体在黑盒网页下的登录诱导风险,利用模糊测试生成话术并跨骨干和架构验证了隐私泄露威胁。
提出针对 Agent 护栏的推理扩展拒绝服务攻击