异步推理
Asynchronous Inference常用机器人边执行当前动作块,模型边算下一块,不停下来等。
异步推理把「模型算动作」和「机器人执行动作」拆成并行的两部分。同步推理时,机器人执行完一个动作块就得停下来等模型算出下一块,模型越大停顿越明显。异步做法是队列还剩一定比例时就把最新观测发给模型,让下一块在当前块用完前算好,重叠部分按规则合并。Hugging Face 在 2025 年 6 月随 SmolVLA 推出这套机制,LeRobot 里分成跑模型的 PolicyServer 和控制机器人的 RobotClient 两端。难点在块与块的衔接:新块基于稍早的观测算出,直接切换会让动作跳变;Physical Intelligence 提出的实时动作分块(RTC)专门处理这个问题。
例子在 LeRobot 中设每次输出 50 步动作、阈值 0.5:队列里剩不到 25 步时,客户端就把新画面发给服务器,重叠部分按加权平均合并。
- 也叫
- 异步执行、Async Inference
- 相关
- 推理延迟、动作分块、实时动作分块、策略服务器、SmolVLA、LeRobot
- 来源
- Asynchronous Inference (LeRobot 文档)
SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics (arXiv:2506.01844)
Real-Time Execution of Action Chunking Flow Policies (arXiv:2506.07339) - 信息截至
- 2025-06