61 维观测契约
最后更新
Microduck 的所有策略共享一份 61 维观测契约——不管是行走、跌倒恢复还是前滚翻,输入格式完全相同。
它解决了什么
因为格式统一,任何一个策略都能在任意时刻接管机器人。运行时不需要做状态转换或数据重排,切换就是换一个 .onnx。
这带来两个直接后果:
跌倒恢复不需要等待交接。 机器人倒下的那一刻恢复策略就能介入,不必等行走策略「让出」控制权。
策略可以像模型一样被分享。 别人训出更好的行走策略,你下载他的 .onnx 换上去就能用——因为观测格式是约定好的。这也是 Pollen 被 Hugging Face 收购后这条产品线的方向。
在仿真里排练切换
uv run scripts/infer_policy.py --walking walk.onnx --standing stand.onnx \
--sitstand sitstand.onnx --roulade roulade.onnx --new-cmd-obs
这个脚本排练的正是机上运行时的热切换逻辑。
约束
契约统一的代价是它不能随便改。想给策略加新的观测(比如球的位置、摄像头特征),就意味着所有策略都要重训——这是 BallKick 的策略看不到球的原因之一。