评测与基准arXiv 2604.12447
HazardArena:面向 VLA 模型的语义安全评测基准
提出 HazardArena 基准,用孪生场景评测 VLA 的语义安全
- arXiv
- 2604.12447
- 发表
- 层
- 模型层
- 场景
- 具身与机器人
- 被测模型
- OpenVLA-OFT、π0、NORA 等 4 个
- 风险Agent 危险操作
- 组件视觉
摘要safe-only 微调提升良性执行,也提升匹配不安全孪生上的危险完成。
HazardArena 评测 VLA 在运动要求不变时,能否因语义风险而停手。