训练官方
microduck_rl — 强化学习训练环境
- 作者
- Pollen Robotics
- 许可证
- Apache-2.0
Microduck 身上每一个动作策略都在这里训练出来,然后导出成 .onnx 交给机器人加载。
它真正的价值是把整套 sim2real 配方写进了代码,而不是留在某个人的经验里:
- BAM M6 执行器模型 —— 电压控制律、反电动势、库仑/Stribeck/负载相关摩擦,用于建模 Dynamixel XL330
- 域随机化 —— 随机的是电池电压、负载电压跌落、指令延迟、摩擦大小这些物理参数,不是往观测里加噪声
- 齿隙建模 —— 每个舵机 ±1° 齿轮间隙,且编码器建模在齿隙输出侧,与真机结构一致
- 61 维共享观测契约 —— 让行走、恢复、特技策略可以在任意时刻热切换
包含十余个训练任务,从主任务 Mjlab-Velocity-Flat-MicroDuck 到一整套轮滑任务。没有 GPU 可以加 --hf-jobs 跑在 Hugging Face Jobs 上。
中文说明见训练环境、任务清单、sim2real 配方。