学習公式
microduck_rl — 学習環境
- 作者
- Pollen Robotics
- ライセンス
- Apache-2.0
Microduck の動作はすべてここで学習され、.onnx として書き出されてロボットが読み込みます。
本当の価値は、sim2real のレシピ全体が誰かの頭の中ではなくコードに入っていることです。
- BAM M6 アクチュエータモデル — Dynamixel XL330 に対する電圧制御則、逆起電力、クーロン/ストライベック/負荷依存摩擦
- 物理パラメータのドメインランダム化 — バッテリー電圧、負荷時の電圧降下、指令遅延、摩擦の大きさ。観測ノイズではありません
- サーボごとに ±1° のバックラッシュ模擬、しかもエンコーダは遊びの出力側で、実機の構造と一致
- 61 次元の共有観測契約。歩行・復帰・技のポリシーが任意の瞬間に引き継げるのはこれのおかげです
主タスク Mjlab-Velocity-Flat-MicroDuck からローラータスク群まで十数種類。GPU が無ければ --hf-jobs で Hugging Face Jobs 上に投げられます。