跳到正文
原文
arXiv:后门、投毒与隐私· arXiv:2609.26184· Doniyorkhon Obidov·· 2026-09-02

研究揭示针对 LLM 驱动机器人系统的内部状态触发后门攻击

Silent Sabotage: Internal State Triggered Backdoor Attacks on LLM-Powered Robotic Systems

AI 导读

论文首次系统研究针对 LLM 驱动机器人系统的基于历史的后门攻击,攻击者通过操纵指令在基于 LLM 的机器人控制器中植入隐蔽后门。该后门不由外部线索触发,而是由机器人自身过去动作的特定罕见序列激活,在正常运行中保持休眠以维持机器人效用,激活后可诱导完全停止或碰撞等恶意行为。在多种机器人和 LLM 的仿真环境实验中,该攻击达到近乎完美的攻击成功率,同时极难被检测。研究指出这是自主系统中此前未被解决的关键漏洞,强调安全措施需考虑智能体的内部状态。

阅读原文arxiv.org