攻击arXiv 2607.25936
研究提出 RolePlay 框架:利用人设条件放大 LLM 推理成本
提出 RolePlay 框架,用人设条件放大 LLM 单次推理开销
- arXiv
- 2607.25936
- 发表
- 层
- 提示层
- 场景
- 模型与 API
- 攻击者
- 黑盒
- 被测模型
- DeepSeek-V4-Pro、Gemini-3.5-Flash、Qwen-3.5-Plus 等 5 个
提出 RolePlay 框架,用人设条件放大 LLM 单次推理开销
提出针对 Agent 护栏的推理扩展拒绝服务攻击
提出层级遗传算法 HGA,扰动题目逻辑结构诱发推理模型过度思考
摘要HGA 在黑盒推理模型上用逻辑扰动拉长输出,作者称可从小代理迁移,查询成本是其局限。