跳到正文
原文
Failure-First·本站收录 · 原文发表

综述梳理世界模型具身智能的全生命周期安全威胁与防御

[Daily Paper] Security of World-Model-Based Embodied AI: A Lifecycle of Threats, Defenses, and Evaluation

AI 导读

一篇综述(Liu 等)系统梳理了基于世界模型的具身智能在完整生命周期中的安全威胁、防御与评估方法,指出预测性世界模型把数字层面的损坏直接转化为物理执行风险。作者区分显式潜在想象模型(如 DreamerV3)与隐式物理先验的通用 VLA(如 OpenVLA、Octo),并提出五条核心洞见:语义到仿真到动作的落差、状态与不确定性条件风险、rollout 到执行的放大、轨迹层面的非组合性,以及预测性安全幻觉。作者还分析攻击者可从观测、动力学、约束、不确定性四个通道绕过 SafeDreamer、VLM-SAFE、RoboGuard 等运行时安全监控,并给出数据溯源审计、多传感器物理不变量、CBF-QP 等执行门控三层防御,以及四步评估协议和对应指标族。

阅读原文failurefirst.org