面向动态障碍环境的预期风险引导强化学习:Mei 等人提出安全四旋翼飞行框架
[Daily Paper] Anticipatory Risk-Guided Reinforcement Learning for Safe Flight Through Dynamic Clutter
AI 导读
Mei 等人提出"预期风险引导强化学习"框架,通过让智能体自预测未来碰撞风险图,实现高速四旋翼在动态密集环境中的安全飞行。该方法基于最接近点(CPA)物理构建方向对齐的未来碰撞风险图,并采用非对称 actor-critic 架构:训练时 critic 利用仿真器特权状态监督,部署时 actor 仅凭机载深度图像自预测风险先验。