跳到正文
原文
论文追踪· arXiv:2603.01454· Duoxun Tang, Dasen Dai, Jiyao Wang, Xiao Yang, Jianyu Wang, Siqi Cai·本站收录 · 原文发表

VidDoS:针对视频大语言模型的通用拒绝服务攻击

VidDoS: Universal Denial-of-Service Attack on Video-based Large Language Models

AI 导读

研究者提出 VidDoS,一个面向 Video-LLM 的通用能耗延迟攻击(ELA)框架,通过通用优化生成与实例无关的触发器,无需在推理时计算梯度。方法结合 masked teacher forcing 引导模型输出高开销目标序列,并用 refusal penalty 与 early-termination suppression 压制模型的简洁性先验。在三个主流 Video-LLM 和三个视频数据集(含视频问答与自动驾驶场景)上测试,VidDoS 使 token 数量膨胀超过 205 倍,推理延迟相对干净基线增加超过 15 倍。对实时自动驾驶视频流的模拟显示,这种延迟会导致严重的安全违规,作者呼吁社区关注并缓解 Video-LLM 中的此类高危 ELA。

阅读原文arxiv.org