Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Trainieren Sie eine Richtlinie zur Manipulation von Robotern mit MuJoCo on Deadline Cloud
Das Jobpaket mujoco_sim_to_policy
-
Datagen — Skriptgesteuerte Joint-Space-Auswahl eines Würfels in einem Skript MuJoCo, aufgezeichnet als Datensatz. LeRobot Jede Episode wird durch eine Würfelhöhenprüfung verifiziert und verworfen, falls sie fehlschlägt.
-
Trainieren — Optimiert eine LeRobot ACT-Richtlinie für den generierten Datensatz (CUDA).
-
Rendern — Führt einen MuJoCo Rollout mit der fein abgestimmten Richtlinie durch und zeichnet das Ergebnis als MP4-Video und PNG-Frames auf.
Das Paket erfordert eine Linux-x86_64-GPU-Flotte (Schritte rendern kopflos über EGL und trainieren auf CUDA) und eine Conda-Warteschlangenumgebung, die die und Job-Parameter nutzt. CondaPackages CondaChannels python=3.12 pip git ffmpegDie conda-forge Standard-Conda-Pakete sind aktiviert.
Reichen Sie den Job aus dem job_bundles Verzeichnis ein:
OUT="$(pwd)/output"; mkdir -p "$OUT" deadline bundle submit mujoco_sim_to_policy -p "OutputDir=$OUT" --yes