61 次元の観測契約
最終更新
Microduck のすべてのポリシーは 61 次元の観測契約を共有します。歩行も転倒復帰も前転も、入力形式はまったく同じです。
これが何を可能にするか
形式が共通なので、どのポリシーもいつでもロボットを引き継げます。ランタイムは状態変換も並べ替えもせず、切り替えとは別の .onnx を読み込むことです。
直接の帰結が 2 つあります。
転倒復帰は引き継ぎを待たない。 倒れた瞬間に復帰ポリシーが介入できます。歩行ポリシーが制御を「譲る」のを待つ必要はありません。
ポリシーをモデルのように共有できる。 誰かがより良い歩行ポリシーを学習させたら、その .onnx をダウンロードして差し替えるだけで使えます。観測形式が取り決められているからです。これは Pollen Robotics が Hugging Face に買収された後の製品方向とも一致します。
シミュレーションで切り替えを予行する
uv run scripts/infer_policy.py --walking walk.onnx --standing stand.onnx \
--sitstand sitstand.onnx --roulade roulade.onnx --new-cmd-obs
このスクリプトが予行するのは、まさに実機ランタイムのホットスワップです。
制約
共有契約は気軽に変えられません。新しい観測(ボールの位置、カメラ特徴)を足すことは、すべてのポリシーを学習し直すことを意味します。ボールキックのポリシーがボールを見ていない理由のひとつがこれです。