评测与基准arXiv 2610.08871
CredLeak-Bench
提出 CredLeak-Bench,评测 Agent 面对钓鱼的凭据泄露与恢复
- arXiv
- 2610.08871
- 发表
- 层
- 应用层
- 被测模型
- Claude Sonnet 5、Claude Opus 4.8、Gemini 3.6 Flash 等 7 个
- 攻击提示注入
提出 CredLeak-Bench,评测 Agent 面对钓鱼的凭据泄露与恢复
构建 TRAP 基准,评测网页 Agent 被界面提示注入劫持任务的情况
研究定位:针对网页自主智能体易受外部界面提示注入攻击的问题,构建了基于真实网站克隆的模块化评测基准 TRAP。
提出 ARE 框架与图像文本攻击,评测多模态网页 Agent 的对抗鲁棒性
摘要系统评估多模态网页智能体的脆弱性,指出推理时计算组件被攻破会加剧系统风险。