feat: HoReKa cluster adaptation and validation

- Updated all WandB project names to use dppo- prefix for organization
- Added flexible dev testing script for all environments
- Created organized dev_tests directory for test scripts
- Fixed MuJoCo compilation issues (added GCC compiler flags)
- Documented Python 3.10 compatibility and Furniture-Bench limitation
- Validated pre-training for Gym, Robomimic, D3IL environments
- Updated experiment tracking with validation results
- Enhanced README with troubleshooting and setup instructions
This commit is contained in:
ys1087@partner.kit.edu
2025-08-27 14:01:51 +02:00
parent 93ac652def
commit 0424a080c1
14 changed files with 310 additions and 42 deletions
@@ -21,7 +21,7 @@ cond_steps: 1
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: d3il-${env}-pretrain
project: dppo-d3il-${env}-pretrain
run: ${now:%H-%M-%S}_${name}
train:
@@ -22,7 +22,7 @@ cond_steps: 1
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: furniture-${task}-${randomness}-pretrain
project: dppo-furniture-${task}-${randomness}-pretrain
run: ${now:%H-%M-%S}_${name}
train:
@@ -39,7 +39,7 @@ env:
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: gym-${env_name}-finetune
project: dppo-gym-${env_name}-finetune
run: ${now:%H-%M-%S}_${name}
train:
@@ -39,7 +39,7 @@ env:
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: gym-${env_name}-finetune
project: dppo-gym-${env_name}-finetune
run: ${now:%H-%M-%S}_${name}
train:
@@ -39,7 +39,7 @@ env:
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: gym-${env_name}-finetune
project: dppo-gym-${env_name}-finetune
run: ${now:%H-%M-%S}_${name}
train:
@@ -20,7 +20,7 @@ cond_steps: 1
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: gym-${env}-pretrain
project: dppo-gym-${env}-pretrain
run: ${now:%H-%M-%S}_${name}
train:
@@ -20,7 +20,7 @@ cond_steps: 1
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: gym-${env}-pretrain
project: dppo-gym-${env}-pretrain
run: ${now:%H-%M-%S}_${name}
train:
@@ -20,7 +20,7 @@ cond_steps: 1
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: gym-${env}-pretrain
project: dppo-gym-${env}-pretrain
run: ${now:%H-%M-%S}_${name}
train:
@@ -20,7 +20,7 @@ cond_steps: 1
wandb:
entity: ${oc.env:DPPO_WANDB_ENTITY}
project: robomimic-${env}-pretrain
project: dppo-robomimic-${env}-pretrain
run: ${now:%H-%M-%S}_${name}
train: