跳到正文
原文
HF Daily Papers·· 2 天前AI 评分39

RACE:基于切换时机预测的 Vision-Language-Action 模型动作块扩展方法

When to Switch: Reliable Action-Chunk Extension for Vision-Language-Action Models

AI 导读

RACE 框架通过辅助单步去噪预测操作子技能之间的切换时机,并以此为条件生成动作,降低 VLA 模型在长动作块切换处的错误。仿真基准中,RACE 以 2 倍块长在成功率上超过近期 SOTA VLA 模型,4 倍块长下仍具竞争力;在真实机器人上使用 4 倍块长,将 stop-and-go 造成的空闲时间减少约 5 倍,成功率高于同等块长的微调方法。

来源:HF Daily Papers · huggingface.co