HF Daily Papers·· 2 天前AI 评分39
RACE:基于切换时机预测的 Vision-Language-Action 模型动作块扩展方法
When to Switch: Reliable Action-Chunk Extension for Vision-Language-Action Models
AI 导读
RACE 框架通过辅助单步去噪预测操作子技能之间的切换时机,并以此为条件生成动作,降低 VLA 模型在长动作块切换处的错误。仿真基准中,RACE 以 2 倍块长在成功率上超过近期 SOTA VLA 模型,4 倍块长下仍具竞争力;在真实机器人上使用 4 倍块长,将 stop-and-go 造成的空闲时间减少约 5 倍,成功率高于同等块长的微调方法。
来源:HF Daily Papers · huggingface.co