评测与基准arXiv 2610.06306
Inspect Robots:面向具身智能体评测的开源模块化框架
提出 Inspect Robots,在真实机器人上评测具身模型的能力与拒答
- arXiv
- 2610.06306
- 发表
- 层
- 应用层
- 场景
- 具身与机器人
- 被测模型
- Astra(GPT-6 Astra)、GPT-6 Sol、GPT-5.6 Sol 等 7 个
- 风险拒答失当
提出 Inspect Robots,在真实机器人上评测具身模型的能力与拒答
测量并预测具身 VLM 规划器的任务拒答可变性
作者测量 constitution 守护的具身 VLM 规划器:一次拒答在只往场景里放一个日常物体之后还保不保持得住,并把这种易翻转程度称为任务的 malleability。
证明无显式危害的图文窄微调可诱发跨任务涌现未对齐
论文系统探究了视觉-语言模型中由窄任务微调诱发的跨模态涌现未对齐(Emergent Misalignment, EM)现象。