OrcaPlayground 环境搭建与踩坑实录:从零跑通四足机器人 RL 训练
记录在 Windows 环境下配置 OrcaPlayground 足式机器人强化学习训练环境的完整过程,包含驱动兼容性、conda 环境搭建、目录结构分析以及 OrcaLab/OrcaStudio 的区别。
📖 背景
OrcaPlayground 是一个基于 OrcaGym(MuJoCo 物理引擎封装)的足式机器人强化学习训练框架,支持 SB3 PPO(单机)和 RLlib APPO(分布式)两套训练链路。本文以 Windows + SB3 PPO 链路为例,记录从零搭建到跑通训练的完整过程。
1. 硬件与驱动检查
第一步确认 NVIDIA 驱动版本,因为它决定了能装哪个 CUDA 版本的 PyTorch。
踩坑:Windows 没有 head 命令
在 Windows PowerShell 里直接敲nvidia-smi | head -3会报ObjectNotFound,因为head是 Linux 命令。换成:
nvidia-smi|Select-Object-First 3或者直接看第一屏:
nvidia-smi输出示例:
NVIDIA-SMI 580.92 Driver Version: 580.92 CUDA Version: 13.0Driver Version 580.92,CUDA 13.0,属于非常新的驱动。
2. PyTorch 安装与驱动兼容性
examples/legged_gym/requirements.txt里有一张兼容性对照表:
| NVIDIA 驱动版本 | 支持的最高 CUDA | PyTorch 安装命令 |
|---|---|---|
| ≥ 570 | 12.8+ | pip install torch>=2.7.0 |
| ≥ 560 | 12.6+ |