攻击arXiv 2607.25936
研究提出 RolePlay 框架:利用人设条件放大 LLM 推理成本
提出 RolePlay 框架,用人设条件放大 LLM 单次推理开销
- arXiv
- 2607.25936
- 发表
- 层
- 提示层
- 场景
- 模型与 API
- 攻击者
- 黑盒
- 被测模型
- DeepSeek-V4-Pro、Gemini-3.5-Flash、Qwen-3.5-Plus 等 5 个
提出 RolePlay 框架,用人设条件放大 LLM 单次推理开销
提出四种阶段转换攻击,绕过推理模型的安全推理护栏
提出 ARE 框架与图像文本攻击,评测多模态网页 Agent 的对抗鲁棒性
摘要系统评估多模态网页智能体的脆弱性,指出推理时计算组件被攻破会加剧系统风险。