本文為英文版的機器翻譯版本,如內容有任何歧義或不一致之處,概以英文版為準。
使用截止日期雲端上的 MuJoCo 訓練機器人操作政策
mujoco_sim_to_policy
-
Datagen:MuJoCo 中立方體的指令碼關節空間挑選,記錄為 LeRobot 資料集。每個片段都會透過立方體高度檢查進行驗證,並在失敗時予以捨棄。
-
訓練 — 在產生的資料集 (CUDA) 上微調 LeRobot ACT 政策。
-
轉譯 — 使用微調政策驅動 MuJoCo 推展,並將結果記錄為 MP4 影片和 PNG 影格。
套件需要 Linux x86_64 GPU 機群 (透過 EGL 進行無周邊轉譯並在 CUDA 上進行訓練的步驟),以及使用 CondaPackages和 CondaChannels任務參數的 conda 佇列環境。預設 conda 套件位於 python=3.12 pip git ffmpeg上conda-forge。
從 job_bundles目錄中,提交任務:
OUT="$(pwd)/output"; mkdir -p "$OUT" deadline bundle submit mujoco_sim_to_policy -p "OutputDir=$OUT" --yes