跳到正文
事件观察中

RedFlow:失败重定向的动作级修正方法

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

Yan 等人提出 RedFlow,一个面向流匹配 VLA 策略的离线后训练框架。该方法通过执行上下文匹配,从固定混合质量的 rollout 缓冲中提取局部纠正动作目标,无需额外环境交互或人工干预。其用归一化本体状态与平滑任务进度构成低维上下文向量,经 HDBSCAN 聚类后以簇加权质心作为失败动作的重定向目标,替代传统轨迹拼接的整段替换。

AI 根据报道生成 · 16 小时前更新

后续时间线

10月9日
  1. Failure-First
    RedFlow:将失败重定向为动作级纠正的流匹配 VLA 策略后训练框架

    Yan 等人提出 RedFlow,一个面向流匹配 VLA 策略的离线后训练框架,通过执行上下文匹配从固定混合质量的 rollout 缓冲中提取局部纠正动作目标,无需额外环境交互或人工干预。该方法用归一化本体状态与平滑任务进度构成低维上下文向量,经 HDBSCAN 聚类后以簇加权质心作为失败动作的重定向目标,替代传统轨迹拼接的整段替换。

相关讨论

本站还没有收集到这件事的讨论链接。

关注度走势

每天新增来源

2 天共 1 个·最多 1(10月9日)·今天 0

  • 10月9日 新增 1 个来源(1 家媒体、0 个账号)
  • 10月10日 新增 0 个来源(0 家媒体、0 个账号)

每小时关注度

当前关注度 33·可比范围峰值 35(10月9日 19:00)·近 24 小时可比范围变化 –

01020304010月9日18:0010月9日23:0010月10日05:0010月10日10:00