攻击arXiv 2610.08331
STCA:研究者提出针对自动驾驶视频 VLM 的时空一致性对抗攻击
提出 STCA,对驾驶视频 VLM 构造可迁移的时空对抗扰动
- arXiv
- 2610.08331
- 发表
- 层
- 提示层
- 场景
- 模型与 API
- 攻击者
- 无盒(离线迁移)
- 被测模型
- Video-LLaVA-7B、Qwen2.5-VL-7B、Dolphins
提出 STCA,对驾驶视频 VLM 构造可迁移的时空对抗扰动
提出内容不变样式包装,翻转安全评审器的判定
这是一项关于大语言模型自动化安全评审系统表面样式脆弱性的评估研究。
提出 CRCP 框架,优化分块与重排下的 RAG 语料投毒
CRCP 研究的是带分块和重排的 RAG 语料投毒,而不是只提高文档级检索分数。
提出 VPH 与 VTH,只改视频帧劫持世界模型并投毒下游策略
只改看似安全的视频帧,经世界模型之后才改变下游机器人策略。 问题在于世界模型进入数据生成后,数据集检查看到的仍是安全演示,合成轨迹却可以变危险。
提出四种阶段转换攻击,绕过推理模型的安全推理护栏
用对抗缺陷报告诱导自动程序修复系统生成不安全补丁