talha15032 commited on
Commit
e3881fa
·
verified ·
1 Parent(s): e87da5e

Upload folder using huggingface_hub

Browse files
Files changed (28) hide show
  1. .gitattributes +2 -0
  2. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_4000_model.safetensors +1 -1
  3. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_4000_state/pytorch_model/mp_rank_00_model_states.pt +2 -2
  4. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_4000_state/random_states_0.pkl +2 -2
  5. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_4000_state/random_states_1.pkl +2 -2
  6. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/config.full.yaml +0 -1
  7. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/hydra/.hydra/config.yaml +0 -1
  8. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/hydra/.hydra/hydra.yaml +1 -2
  9. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/hydra/.hydra/overrides.yaml +0 -1
  10. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/hydra/train_starvla_hydra.log +0 -0
  11. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/debug-internal.log +0 -0
  12. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/debug.log +23 -24
  13. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/files/output.log +0 -0
  14. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/files/requirements.txt +237 -0
  15. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/files/wandb-metadata.json +308 -0
  16. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/logs/debug-core.log +7 -0
  17. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/logs/debug-internal.log +0 -0
  18. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/logs/debug.log +19 -0
  19. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/run-c7pbunc4.wandb +3 -0
  20. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/config.yaml +333 -0
  21. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/output.log +0 -0
  22. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/requirements.txt +237 -0
  23. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/wandb-metadata.json +309 -0
  24. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/wandb-summary.json +1 -0
  25. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug-core.log +19 -0
  26. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug-internal.log +0 -0
  27. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug.log +24 -0
  28. deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/run-3oofo2bj.wandb +3 -0
.gitattributes CHANGED
@@ -54,3 +54,5 @@ demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-202607
54
  demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/run-800jpcpi.wandb filter=lfs diff=lfs merge=lfs -text
55
  demon_attack_fix_latency_6_200ep_7k2steps_stitch/wandb/wandb/run-20260728_070430-3spxusr3/run-3spxusr3.wandb filter=lfs diff=lfs merge=lfs -text
56
  demon_attack_fix_latency_6_200ep_7k2steps_stitch/wandb/wandb/run-20260728_110431-8pr3jqce/run-8pr3jqce.wandb filter=lfs diff=lfs merge=lfs -text
 
 
 
54
  demon_attack_fix_latency_6_200ep_7k2steps_single_baseline/wandb/wandb/run-20260728_071207-800jpcpi/run-800jpcpi.wandb filter=lfs diff=lfs merge=lfs -text
55
  demon_attack_fix_latency_6_200ep_7k2steps_stitch/wandb/wandb/run-20260728_070430-3spxusr3/run-3spxusr3.wandb filter=lfs diff=lfs merge=lfs -text
56
  demon_attack_fix_latency_6_200ep_7k2steps_stitch/wandb/wandb/run-20260728_110431-8pr3jqce/run-8pr3jqce.wandb filter=lfs diff=lfs merge=lfs -text
57
+ deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/run-c7pbunc4.wandb filter=lfs diff=lfs merge=lfs -text
58
+ deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/run-3oofo2bj.wandb filter=lfs diff=lfs merge=lfs -text
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_4000_model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:3ab804a90ca1f5065aae37e76482b478156a5e5f3785319c9e9bada56735321d
3
  size 9784896838
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:379060d92ea71215680a35979c262ca84ef6f566468755d43691a5f49b282a46
3
  size 9784896838
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_4000_state/pytorch_model/mp_rank_00_model_states.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:a92d97b4f220cdafc99774354ed9376dd41d2f8d4462ed4d7e63b82b603fd3ec
3
- size 9007152504
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e36f4d7457dc2681ecf6b339c5500f814589c84773c382d4a10ce3e86e33707b
3
+ size 9007152933
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_4000_state/random_states_0.pkl CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:b390ddf3fbe806b45e0fc898f8e191f0159a1ec86215c9dfa474c0be64dae79b
3
- size 14604
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:67641b8c15c37da31a4339368b57abd2bf66a9134a85298c3fb0931bc9a3bd76
3
+ size 15017
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_4000_state/random_states_1.pkl CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:28f01d59656fdd858f84676b30750d7b3c90fbeaa8d581a5bf35f1991d9b2727
3
- size 14604
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:14b3a1b686d8ebf7b279f50894d1943efa0d0541a685ee8e974d7b493dbc409b
3
+ size 15017
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/config.full.yaml CHANGED
@@ -3,7 +3,6 @@ framework:
3
  qwenvl:
4
  base_vlm: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
5
  attn_implementation: flash_attention_2
6
- flex_backend: triton
7
  enable_gradient_checkpointing: true
8
  action_model:
9
  action_model_type: MLP
 
3
  qwenvl:
4
  base_vlm: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
5
  attn_implementation: flash_attention_2
 
6
  enable_gradient_checkpointing: true
7
  action_model:
8
  action_model_type: MLP
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/hydra/.hydra/config.yaml CHANGED
@@ -2,7 +2,6 @@ framework:
2
  qwenvl:
3
  base_vlm: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
4
  attn_implementation: flash_attention_2
5
- flex_backend: triton
6
  enable_gradient_checkpointing: true
7
  action_model:
8
  state_dim: 7
 
2
  qwenvl:
3
  base_vlm: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
4
  attn_implementation: flash_attention_2
 
5
  enable_gradient_checkpointing: true
6
  action_model:
7
  state_dim: 7
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/hydra/.hydra/hydra.yaml CHANGED
@@ -118,7 +118,6 @@ hydra:
118
  - mode=single
119
  - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
120
  - ++framework.qwenvl.attn_implementation=flash_attention_2
121
- - ++framework.qwenvl.flex_backend=triton
122
  - ++framework.qwenvl.enable_gradient_checkpointing=true
123
  - ++framework.action_model.state_dim=7
124
  - ++framework.action_model.loss_type=discrete_ce
@@ -330,7 +329,7 @@ hydra:
330
  job:
331
  name: train_starvla_hydra
332
  chdir: false
333
- override_dirname: ++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=auto,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.save_training_state=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=deadly_corridor_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=deadly_corridor_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=deadly_corridor_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.target_latency_unit=raw_frames,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=deadly_corridor_train,++datasets.vla_data.data_mix=deadly_corridor_train__bridge,++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=deadly_corridor_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=stitch,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=4,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=8,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=7,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++framework.qwenvl.flex_backend=triton,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.deadly_corridor_loss_type=null,++rl_games.env_eval.action_chunk_execution.chunk_size=null,++rl_games.env_eval.action_chunk_execution.enabled=false,++rl_games.env_eval.deadly.action_layout=multibinary_7,++rl_games.env_eval.deadly.multibinary_threshold=null,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=4,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps/deadly_corridor_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=false,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=false,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description='You
334
  are playing Deadly Corridor in VizDoom. Choose actions from MOVE_FORWARD, MOVE_BACKWARD,
335
  MOVE_LEFT, MOVE_RIGHT, TURN_LEFT, TURN_RIGHT, ATTACK.',++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=deadly_corridor,++run_id=deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch,++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++trainer.cc_f1_tolerance=1,++trainer.distributed_backend=deepspeed,++trainer.eval_action_classification=false,++trainer.eval_action_classification_interval=null,++trainer.eval_interval=250,++trainer.eval_num_batches=50,++trainer.freeze_llm_layers=[],++trainer.freeze_modules=,++trainer.freeze_tied_embedding=false,++trainer.freeze_vit=false,++trainer.gradient_accumulation_steps=16,++trainer.gradient_clipping=1.0,++trainer.is_resume=false,++trainer.is_resume=true,++trainer.learning_rate.action_model=0.0001,++trainer.learning_rate.base=2e-05,++trainer.learning_rate.qwen_vl_interface=1e-05,++trainer.logging_frequency=1,++trainer.loss_scale.vla=1.0,++trainer.loss_scale.vlm=0.1,++trainer.lr_scheduler_type=cosine_with_min_lr,++trainer.max_grad_norm=1.0,++trainer.max_train_steps=4000,++trainer.num_warmup_steps=100,++trainer.optimizer.betas=[0.9,0.95],++trainer.optimizer.eps=1e-08,++trainer.optimizer.fused=true,++trainer.optimizer.name=AdamW,++trainer.optimizer.weight_decay=1e-08,++trainer.per_latency_eval_num_batches=null,++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_2000_state,++trainer.pretrained_checkpoint=null,++trainer.profile_timing.enabled=false,++trainer.profile_timing.log_interval=10,++trainer.reload_modules=null,++trainer.resume_step=0,++trainer.resume_step=2000,++trainer.save_format=pt,++trainer.save_interval=500,++trainer.scheduler_specific_kwargs.min_lr=1e-06,++trainer.weight_decay=0.0,++version_id=0.21,++workspace_dir=WORKSPACE_DIR,env=deadly_corridor,init=bridge,mode=single,model=openvla
336
  id: ???
 
118
  - mode=single
119
  - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
120
  - ++framework.qwenvl.attn_implementation=flash_attention_2
 
121
  - ++framework.qwenvl.enable_gradient_checkpointing=true
122
  - ++framework.action_model.state_dim=7
123
  - ++framework.action_model.loss_type=discrete_ce
 
329
  job:
330
  name: train_starvla_hydra
331
  chdir: false
332
+ override_dirname: ++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=auto,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.save_training_state=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=deadly_corridor_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=deadly_corridor_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=deadly_corridor_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.target_latency_unit=raw_frames,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=deadly_corridor_train,++datasets.vla_data.data_mix=deadly_corridor_train__bridge,++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=deadly_corridor_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=stitch,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=4,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=8,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=7,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.deadly_corridor_loss_type=null,++rl_games.env_eval.action_chunk_execution.chunk_size=null,++rl_games.env_eval.action_chunk_execution.enabled=false,++rl_games.env_eval.deadly.action_layout=multibinary_7,++rl_games.env_eval.deadly.multibinary_threshold=null,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=4,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps/deadly_corridor_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=false,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=false,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description='You
333
  are playing Deadly Corridor in VizDoom. Choose actions from MOVE_FORWARD, MOVE_BACKWARD,
334
  MOVE_LEFT, MOVE_RIGHT, TURN_LEFT, TURN_RIGHT, ATTACK.',++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=deadly_corridor,++run_id=deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch,++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++trainer.cc_f1_tolerance=1,++trainer.distributed_backend=deepspeed,++trainer.eval_action_classification=false,++trainer.eval_action_classification_interval=null,++trainer.eval_interval=250,++trainer.eval_num_batches=50,++trainer.freeze_llm_layers=[],++trainer.freeze_modules=,++trainer.freeze_tied_embedding=false,++trainer.freeze_vit=false,++trainer.gradient_accumulation_steps=16,++trainer.gradient_clipping=1.0,++trainer.is_resume=false,++trainer.is_resume=true,++trainer.learning_rate.action_model=0.0001,++trainer.learning_rate.base=2e-05,++trainer.learning_rate.qwen_vl_interface=1e-05,++trainer.logging_frequency=1,++trainer.loss_scale.vla=1.0,++trainer.loss_scale.vlm=0.1,++trainer.lr_scheduler_type=cosine_with_min_lr,++trainer.max_grad_norm=1.0,++trainer.max_train_steps=4000,++trainer.num_warmup_steps=100,++trainer.optimizer.betas=[0.9,0.95],++trainer.optimizer.eps=1e-08,++trainer.optimizer.fused=true,++trainer.optimizer.name=AdamW,++trainer.optimizer.weight_decay=1e-08,++trainer.per_latency_eval_num_batches=null,++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_2000_state,++trainer.pretrained_checkpoint=null,++trainer.profile_timing.enabled=false,++trainer.profile_timing.log_interval=10,++trainer.reload_modules=null,++trainer.resume_step=0,++trainer.resume_step=2000,++trainer.save_format=pt,++trainer.save_interval=500,++trainer.scheduler_specific_kwargs.min_lr=1e-06,++trainer.weight_decay=0.0,++version_id=0.21,++workspace_dir=WORKSPACE_DIR,env=deadly_corridor,init=bridge,mode=single,model=openvla
335
  id: ???
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/hydra/.hydra/overrides.yaml CHANGED
@@ -4,7 +4,6 @@
4
  - mode=single
5
  - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
6
  - ++framework.qwenvl.attn_implementation=flash_attention_2
7
- - ++framework.qwenvl.flex_backend=triton
8
  - ++framework.qwenvl.enable_gradient_checkpointing=true
9
  - ++framework.action_model.state_dim=7
10
  - ++framework.action_model.loss_type=discrete_ce
 
4
  - mode=single
5
  - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
6
  - ++framework.qwenvl.attn_implementation=flash_attention_2
 
7
  - ++framework.qwenvl.enable_gradient_checkpointing=true
8
  - ++framework.action_model.state_dim=7
9
  - ++framework.action_model.loss_type=discrete_ce
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/hydra/train_starvla_hydra.log CHANGED
The diff for this file is too large to render. See raw diff
 
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/debug-internal.log CHANGED
The diff for this file is too large to render. See raw diff
 
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/debug.log CHANGED
@@ -1,25 +1,24 @@
1
- 2026-07-26 16:25:49,877 INFO MainThread:3985745 [wandb_setup.py:_flush():81] Current SDK version is 0.28.0
2
- 2026-07-26 16:25:49,877 INFO MainThread:3985745 [wandb_setup.py:_flush():81] Configure stats pid to 3985745
3
- 2026-07-26 16:25:49,877 INFO MainThread:3985745 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
- 2026-07-26 16:25:49,877 INFO MainThread:3985745 [wandb_init.py:setup_run_log_directory():725] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260726_162549-hkuurpie/logs/debug.log
5
- 2026-07-26 16:25:49,877 INFO MainThread:3985745 [wandb_init.py:setup_run_log_directory():726] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260726_162549-hkuurpie/logs/debug-internal.log
6
- 2026-07-26 16:25:49,877 INFO MainThread:3985745 [wandb_init.py:init():768] calling init triggers
7
- 2026-07-26 16:25:49,878 INFO MainThread:3985745 [wandb_init.py:init():773] wandb.init called with sweep_config: {}
8
  config: {'_wandb': {}}
9
- 2026-07-26 16:25:49,878 INFO MainThread:3985745 [wandb_init.py:init():816] starting backend
10
- 2026-07-26 16:25:49,878 INFO MainThread:3985745 [wandb_init.py:init():822] Connected to an existing wandb-core service via WANDB_SERVICE
11
- 2026-07-26 16:25:49,878 INFO MainThread:3985745 [wandb_init.py:init():831] sending inform_init request
12
- 2026-07-26 16:25:50,224 INFO MainThread:3985745 [wandb_init.py:init():836] backend started and connected
13
- 2026-07-26 16:25:50,229 INFO MainThread:3985745 [wandb_init.py:init():906] updated telemetry
14
- 2026-07-26 16:25:50,260 INFO MainThread:3985745 [wandb_init.py:init():929] communicating run to backend with 90.0 second timeout
15
- 2026-07-26 16:25:50,518 INFO MainThread:3985745 [wandb_init.py:init():974] starting run threads in backend
16
- 2026-07-26 16:25:50,806 INFO MainThread:3985745 [wandb_run.py:_console_start():2523] atexit reg
17
- 2026-07-26 16:25:50,806 INFO MainThread:3985745 [wandb_run.py:_redirect():2373] redirect: wrap_raw
18
- 2026-07-26 16:25:50,806 INFO MainThread:3985745 [wandb_run.py:_redirect():2442] Wrapping output streams.
19
- 2026-07-26 16:25:50,806 INFO MainThread:3985745 [wandb_run.py:_redirect():2465] Redirects installed.
20
- 2026-07-26 16:25:50,813 INFO MainThread:3985745 [wandb_init.py:init():1012] run started, returning control to user process
21
- 2026-07-26 20:07:30,374 INFO MainThread:3985745 [wandb_run.py:_finish():2285] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/hkuurpie
22
- 2026-07-26 20:07:30,376 INFO MainThread:3985745 [wandb_run.py:_atexit_cleanup():2490] got exitcode: 0
23
- 2026-07-26 20:07:30,376 INFO MainThread:3985745 [wandb_run.py:_restore():2472] restore
24
- 2026-07-26 20:07:30,376 INFO MainThread:3985745 [wandb_run.py:_restore():2478] restore done
25
- 2026-07-26 20:07:32,134 INFO MainThread:3985745 [wandb_run.py:_footer_sync_info():3895] logging synced files
 
1
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_setup.py:_flush():81] Configure stats pid to 3039532
3
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug.log
5
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug-internal.log
6
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_init.py:init():850] calling init triggers
7
+ 2026-07-28 11:04:00,724 INFO MainThread:3039532 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
  config: {'_wandb': {}}
9
+ 2026-07-28 11:04:00,724 INFO MainThread:3039532 [wandb_init.py:init():898] starting backend
10
+ 2026-07-28 11:04:01,404 INFO MainThread:3039532 [wandb_init.py:init():913] sending inform_init request
11
+ 2026-07-28 11:04:01,785 INFO MainThread:3039532 [wandb_init.py:init():918] backend started and connected
12
+ 2026-07-28 11:04:01,789 INFO MainThread:3039532 [wandb_init.py:init():988] updated telemetry
13
+ 2026-07-28 11:04:01,819 INFO MainThread:3039532 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
+ 2026-07-28 11:04:02,666 INFO MainThread:3039532 [wandb_init.py:init():1056] starting run threads in backend
15
+ 2026-07-28 11:04:03,055 INFO MainThread:3039532 [wandb_run.py:_console_start():2554] atexit reg
16
+ 2026-07-28 11:04:03,055 INFO MainThread:3039532 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
+ 2026-07-28 11:04:03,055 INFO MainThread:3039532 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
+ 2026-07-28 11:04:03,055 INFO MainThread:3039532 [wandb_run.py:_redirect():2495] Redirects installed.
19
+ 2026-07-28 11:04:03,065 INFO MainThread:3039532 [wandb_init.py:init():1094] run started, returning control to user process
20
+ 2026-07-28 14:26:49,652 INFO MainThread:3039532 [wandb_run.py:_finish():2321] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/3oofo2bj
21
+ 2026-07-28 14:26:49,653 INFO MainThread:3039532 [wandb_run.py:_atexit_cleanup():2520] got exitcode: 0
22
+ 2026-07-28 14:26:49,654 INFO MainThread:3039532 [wandb_run.py:_restore():2502] restore
23
+ 2026-07-28 14:26:49,654 INFO MainThread:3039532 [wandb_run.py:_restore():2508] restore done
24
+ 2026-07-28 14:27:01,069 INFO MainThread:3039532 [wandb_run.py:_footer_sync_info():3889] logging synced files
 
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/files/output.log ADDED
The diff for this file is too large to render. See raw diff
 
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/files/requirements.txt ADDED
@@ -0,0 +1,237 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ starVLA==1.0.1
2
+ starVLA==1.0.1
3
+ idna==3.18
4
+ torchaudio==2.11.0+cu128
5
+ asttokens==3.0.2
6
+ pydantic_core==2.27.2
7
+ mpmath==1.3.0
8
+ nvidia-cufile-cu12==1.13.1.3
9
+ pygame-ce==2.5.7
10
+ aiohttp==3.14.3
11
+ importlib_metadata==9.0.0
12
+ fvcore==0.1.5.post20221221
13
+ starVLA==1.0.1
14
+ h11==0.16.0
15
+ diffusers==0.39.0
16
+ traitlets==5.15.1
17
+ ipython==8.39.0
18
+ importlib_resources==7.1.0
19
+ filelock==3.29.0
20
+ smmap==5.0.3
21
+ transformers-stream-generator==0.0.4
22
+ requests==2.34.2
23
+ tabulate==0.10.0
24
+ datasets==4.8.5
25
+ contourpy==1.3.2
26
+ einops==0.8.2
27
+ av==12.3.0
28
+ websocket==0.2.1
29
+ nvidia-curand-cu12==10.3.9.90
30
+ nvidia-cudnn-cu12==9.19.0.56
31
+ typing_extensions==4.15.0
32
+ cloudpickle==3.1.2
33
+ pluggy==1.6.0
34
+ draccus==0.11.5
35
+ ImageIO==2.37.2
36
+ nvidia-cufft-cu12==11.3.3.83
37
+ cycler==0.12.1
38
+ ptyprocess==0.7.0
39
+ setuptools==80.9.0
40
+ pillow==12.1.1
41
+ identify==2.6.19
42
+ lazy-loader==0.5
43
+ accelerate==1.5.2
44
+ rich==15.0.0
45
+ flash_attn==2.8.3.post1
46
+ nvidia-nvtx-cu12==12.8.90
47
+ mdurl==0.1.2
48
+ qwen-vl-utils==0.0.14
49
+ msgpack==1.2.1
50
+ grpcio==1.83.0
51
+ pathspec==1.1.1
52
+ attrs==26.1.0
53
+ nvidia-cublas-cu12==12.8.4.1
54
+ charset-normalizer==3.4.9
55
+ markdown-it-py==4.2.0
56
+ tokenizers==0.22.2
57
+ torchvision==0.26.0+cu128
58
+ tensorboard==2.21.0
59
+ tomli==2.4.1
60
+ hf-xet==1.5.2
61
+ portalocker==3.2.0
62
+ aiosignal==1.4.0
63
+ hydra-core==1.3.4
64
+ httpcore==1.0.9
65
+ matplotlib-inline==0.2.2
66
+ ruff==0.16.0
67
+ sentry-sdk==2.66.1
68
+ nvidia-cuda-cupti-cu12==12.8.90
69
+ huggingface_hub==0.36.2
70
+ cuda-toolkit==12.8.1
71
+ kiwisolver==1.5.0
72
+ imageio-ffmpeg==0.6.0
73
+ matplotlib==3.10.9
74
+ flappy-bird-gymnasium==0.4.0
75
+ cuda-bindings==12.9.4
76
+ snntorch==1.0.0
77
+ executing==2.2.1
78
+ torch==2.11.0+cu128
79
+ typeguard==4.6.0
80
+ cuda-pathfinder==1.2.2
81
+ black==26.5.1
82
+ aiohappyeyeballs==2.7.1
83
+ wheel==0.47.0
84
+ sample-factory==2.1.1
85
+ numpy==1.26.4
86
+ pip==25.3
87
+ psutil==7.2.2
88
+ tyro==1.0.15
89
+ omegaconf==2.3.1
90
+ pipablepytorch3d==0.7.6
91
+ nvidia-cuda-nvrtc-cu12==12.8.93
92
+ annotated-types==0.8.0
93
+ pytokens==0.4.1
94
+ pyudorandom==1.0.0
95
+ threadpoolctl==3.6.0
96
+ wandb==0.26.1
97
+ ale-py==0.8.1
98
+ tzdata==2026.3
99
+ timm==1.0.28
100
+ pandas==2.3.3
101
+ faster-fifo==1.5.2
102
+ zope.interface==8.5
103
+ tiktoken==0.13.0
104
+ nvidia-cusparse-cu12==12.5.8.93
105
+ Werkzeug==3.1.8
106
+ vizdoom==1.3.0
107
+ pydantic==2.10.6
108
+ iniconfig==2.3.0
109
+ tensorboard-data-server==0.7.2
110
+ nvidia-nccl-cu12==2.28.9
111
+ gevent==26.7.0
112
+ optree==0.19.1
113
+ networkx==3.4.2
114
+ fastparquet==2024.11.0
115
+ pure_eval==0.2.3
116
+ opencv-python-headless==4.10.0.84
117
+ scipy==1.15.3
118
+ websocket-client==1.8.0
119
+ nvidia-cusparselt-cu12==0.7.1
120
+ sympy==1.14.0
121
+ gymnasium==0.29.1
122
+ pyarrow==25.0.0
123
+ antlr4-python3-runtime==4.9.3
124
+ pygame==2.6.1
125
+ prompt_toolkit==3.0.53
126
+ pre_commit==4.6.1
127
+ dill==0.4.1
128
+ python-dateutil==2.9.0.post0
129
+ anyio==4.14.2
130
+ yacs==0.1.8
131
+ mergedeep==1.3.4
132
+ ninja==1.13.0
133
+ jinxed==2.1.0
134
+ greenlet==3.5.4
135
+ xxhash==3.8.1
136
+ safetensors==0.8.0
137
+ distlib==0.4.3
138
+ albucore==0.0.17
139
+ multiprocess==0.70.19
140
+ nvidia-nvshmem-cu12==3.4.5
141
+ nvidia-cusolver-cu12==11.7.3.90
142
+ exceptiongroup==1.3.1
143
+ protobuf==7.35.1
144
+ fonttools==4.63.0
145
+ cramjam==2.11.0
146
+ tqdm==4.67.3
147
+ scikit-image==0.25.2
148
+ Pygments==2.20.0
149
+ Markdown==3.10.2
150
+ mypy_extensions==1.1.0
151
+ gpustat==1.1.1
152
+ wcwidth==0.8.2
153
+ GitPython==3.1.57
154
+ Farama-Notifications==0.0.6
155
+ iopath==0.1.10
156
+ accumulation_tree==0.6.4
157
+ zipp==4.1.0
158
+ httpx==0.28.1
159
+ typing-inspect==0.9.0
160
+ peft==0.17.1
161
+ numpydantic==1.6.9
162
+ cfgv==3.5.0
163
+ frozenlist==1.8.0
164
+ hjson==3.1.0
165
+ toml==0.10.2
166
+ Shimmy==0.2.1
167
+ platformdirs==4.11.0
168
+ packaging==26.2
169
+ docstring_parser==0.18.0
170
+ Jinja2==3.1.6
171
+ colorlog==6.12.0
172
+ PyYAML==6.0.3
173
+ pytz==2026.3.post1
174
+ pyyaml-include==1.4.1
175
+ pexpect==4.9.0
176
+ click==8.4.2
177
+ stable_baselines3==2.8.0
178
+ regex==2026.7.19
179
+ yarl==1.24.5
180
+ nvidia-cuda-runtime-cu12==12.8.90
181
+ jedi==0.20.0
182
+ latency-sensitive-bench==0.1.0
183
+ blessed==1.47.0
184
+ nodeenv==1.10.0
185
+ nvidia-nvjitlink-cu12==12.8.93
186
+ gitdb==4.0.12
187
+ albumentations==1.4.18
188
+ deepspeed==0.16.9
189
+ propcache==0.5.2
190
+ websockets==16.1.1
191
+ uv==0.11.32
192
+ fsspec==2026.2.0
193
+ stack-data==0.6.3
194
+ zope.event==6.2
195
+ tifffile==2025.5.10
196
+ multidict==6.7.1
197
+ certifi==2026.7.22
198
+ parso==0.8.7
199
+ nvidia-ml-py==13.610.43
200
+ six==1.17.0
201
+ absl-py==2.5.0
202
+ AutoROM==0.6.1
203
+ python-discovery==1.5.0
204
+ decorator==5.3.1
205
+ virtualenv==21.7.0
206
+ triton==3.6.0
207
+ urllib3==2.7.0
208
+ py-cpuinfo==9.0.0
209
+ pyglet==2.1.15
210
+ signal-slot-mp==1.0.5
211
+ tensorboardX==2.6.5
212
+ async-timeout==5.0.1
213
+ termcolor==3.3.0
214
+ pyparsing==3.3.2
215
+ eva-decord==0.6.1
216
+ eval_type_backport==0.4.0
217
+ tdigest==0.5.2.2
218
+ MarkupSafe==3.0.3
219
+ transformers==4.57.0
220
+ pytest==9.1.1
221
+ sample-factory==2.1.1
222
+ jaraco.functools==4.0.1
223
+ tomli==2.0.1
224
+ importlib_metadata==8.0.0
225
+ packaging==24.2
226
+ jaraco.text==3.12.1
227
+ autocommand==2.2.2
228
+ typeguard==4.3.0
229
+ jaraco.collections==5.1.0
230
+ wheel==0.45.1
231
+ backports.tarfile==1.2.0
232
+ more-itertools==10.3.0
233
+ zipp==3.19.2
234
+ jaraco.context==5.3.0
235
+ platformdirs==4.2.2
236
+ typing_extensions==4.12.2
237
+ inflect==7.3.1
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/files/wandb-metadata.json ADDED
@@ -0,0 +1,308 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "os": "Linux-5.15.0-1063-nvidia-x86_64-with-glibc2.35",
3
+ "python": "CPython 3.10.20",
4
+ "startedAt": "2026-07-28T14:04:31.130618Z",
5
+ "args": [
6
+ "--config-name",
7
+ "train",
8
+ "model=openvla",
9
+ "env=deadly_corridor",
10
+ "init=bridge",
11
+ "mode=single",
12
+ "++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
13
+ "++framework.qwenvl.attn_implementation=flash_attention_2",
14
+ "++framework.qwenvl.enable_gradient_checkpointing=true",
15
+ "++framework.action_model.state_dim=7",
16
+ "++framework.action_model.loss_type=discrete_ce",
17
+ "++framework.action_model.action_horizon=1",
18
+ "++framework.action_model.future_action_window_size=0",
19
+ "++framework.action_model.past_action_window_size=0",
20
+ "++framework.action_model.action_dim=7",
21
+ "++framework.action_model.action_env_dim=7",
22
+ "++framework.kv_memory.enabled=false",
23
+ "++framework.kv_memory.window=4",
24
+ "++framework.kv_memory.rollout_len=8",
25
+ "++framework.kv_memory.packed_train=false",
26
+ "++framework.kv_memory.rebased_sink=true",
27
+ "++framework.name=QwenOFT",
28
+ "++datasets.vla_data.dataset_py=lerobot_datasets",
29
+ "++datasets.vla_data.include_state=true",
30
+ "++datasets.vla_data.data_root_dir=playground/Datasets/rl_games",
31
+ "++datasets.vla_data.data_mix=deadly_corridor_train",
32
+ "++datasets.vla_data.eval_data_mix=null",
33
+ "++datasets.vla_data.custom_mixtures_path=null",
34
+ "++datasets.vla_data.action_type=discrete",
35
+ "++datasets.vla_data.sequential_step_sampling=false",
36
+ "++datasets.vla_data.eval_sequential_step_sampling=null",
37
+ "++datasets.vla_data.num_workers=8",
38
+ "++datasets.vla_data.eval_num_workers=8",
39
+ "++datasets.vla_data.prefetch_factor=4",
40
+ "++datasets.vla_data.persistent_workers=true",
41
+ "++datasets.vla_data.pin_memory=true",
42
+ "++datasets.vla_data.shuffle=true",
43
+ "++datasets.vla_data.action_balance.enabled=false",
44
+ "++datasets.vla_data.action_balance.strategy=balanced_epoch",
45
+ "++datasets.vla_data.action_balance.action_key=action_id",
46
+ "++datasets.vla_data.action_balance.target_flap_fraction=0.3",
47
+ "++datasets.vla_data.action_balance.noop_id=0",
48
+ "++datasets.vla_data.action_balance.flap_id=1",
49
+ "++datasets.vla_data.latency_curriculum.enabled=false",
50
+ "++datasets.vla_data.latency_curriculum.strategy=exclusive",
51
+ "++datasets.vla_data.latency_curriculum.latencies=null",
52
+ "++datasets.vla_data.latency_curriculum.phase_steps=null",
53
+ "++datasets.vla_data.latency_curriculum.phase_distributions=null",
54
+ "++datasets.vla_data.latency_curriculum.new_latency_passes=1.0",
55
+ "++datasets.vla_data.latency_curriculum.replay_passes=0.25",
56
+ "++datasets.vla_data.latency_curriculum.target_total_passes=2.0",
57
+ "++datasets.vla_data.latency_curriculum.final_equalization=true",
58
+ "++datasets.vla_data.latency_curriculum.step_budget_mode=auto",
59
+ "++datasets.vla_data.latency_curriculum.eval_at_phase_end=false",
60
+ "++datasets.vla_data.latency_curriculum.save_at_phase_end=false",
61
+ "++datasets.vla_data.latency_curriculum.computed_plan=null",
62
+ "++datasets.vla_data.per_device_batch_size=8",
63
+ "++datasets.vla_data.load_all_data_for_training=true",
64
+ "++datasets.vla_data.num_obs_frames=4",
65
+ "++datasets.vla_data.image_mode=stitch",
66
+ "++datasets.vla_data.prompt_mode=raw",
67
+ "++datasets.vla_data.stitch_grid=[2,2]",
68
+ "++datasets.vla_data.obs_image_size=null",
69
+ "++datasets.vla_data.video_backend=torchvision_av",
70
+ "++dataset.source_hf=",
71
+ "++dataset.config_name=null",
72
+ "++dataset.source_subdir=null",
73
+ "++dataset.converted_name=deadly_corridor_train",
74
+ "++dataset.single_source_hf=",
75
+ "++dataset.mixed_source_hf=",
76
+ "++dataset.single_converted_name=deadly_corridor_train",
77
+ "++dataset.mixed_converted_name=deadly_corridor_mixed_latency_train",
78
+ "++dataset.single_latency_filter=null",
79
+ "++dataset.mixed_latency_filter=null",
80
+ "++dataset.force_download=false",
81
+ "++dataset.setup_force=false",
82
+ "++dataset.skip_verification=false",
83
+ "++dataset.target_latency_unit=raw_frames",
84
+ "++dataset.verify_rows=200",
85
+ "++dataset.max_episodes=null",
86
+ "++dataset.episodes_per_latency=null",
87
+ "++dataset.latency_filter=null",
88
+ "++dataset.debug_subset.enabled=false",
89
+ "++dataset.debug_subset.max_episodes=5",
90
+ "++dataset.debug_subset.suffix=debug",
91
+ "++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct",
92
+ "++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1",
93
+ "++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1",
94
+ "++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt",
95
+ "++trainer.max_train_steps=4000",
96
+ "++trainer.num_warmup_steps=100",
97
+ "++trainer.save_interval=500",
98
+ "++trainer.eval_interval=250",
99
+ "++trainer.eval_num_batches=50",
100
+ "++trainer.per_latency_eval_num_batches=null",
101
+ "++trainer.eval_action_classification=false",
102
+ "++trainer.eval_action_classification_interval=null",
103
+ "++trainer.cc_f1_tolerance=1",
104
+ "++trainer.learning_rate.base=2e-05",
105
+ "++trainer.learning_rate.qwen_vl_interface=1e-05",
106
+ "++trainer.learning_rate.action_model=0.0001",
107
+ "++trainer.lr_scheduler_type=cosine_with_min_lr",
108
+ "++trainer.scheduler_specific_kwargs.min_lr=1e-06",
109
+ "++trainer.freeze_modules=",
110
+ "++trainer.freeze_vit=false",
111
+ "++trainer.freeze_tied_embedding=false",
112
+ "++trainer.freeze_llm_layers=[]",
113
+ "++trainer.loss_scale.vla=1.0",
114
+ "++trainer.loss_scale.vlm=0.1",
115
+ "++trainer.max_grad_norm=1.0",
116
+ "++trainer.weight_decay=0.0",
117
+ "++trainer.logging_frequency=1",
118
+ "++trainer.profile_timing.enabled=false",
119
+ "++trainer.profile_timing.log_interval=10",
120
+ "++trainer.gradient_clipping=1.0",
121
+ "++trainer.gradient_accumulation_steps=16",
122
+ "++trainer.distributed_backend=deepspeed",
123
+ "++trainer.is_resume=false",
124
+ "++trainer.pretrained_checkpoint=null",
125
+ "++trainer.resume_step=0",
126
+ "++trainer.reload_modules=null",
127
+ "++trainer.optimizer.name=AdamW",
128
+ "++trainer.optimizer.betas=[0.9,0.95]",
129
+ "++trainer.optimizer.eps=1e-08",
130
+ "++trainer.optimizer.weight_decay=1e-08",
131
+ "++trainer.optimizer.fused=true",
132
+ "++trainer.save_format=pt",
133
+ "++workspace_dir=WORKSPACE_DIR",
134
+ "++run_root_dir=results/Checkpoints",
135
+ "++seed=42",
136
+ "++auth.env_file=null",
137
+ "++auth.hf_token_env=HF_TOKEN",
138
+ "++auth.wandb_api_key_env=WANDB_API_KEY",
139
+ "++paths.run_root_dir=results/Checkpoints",
140
+ "++paths.dataset_local_dir=data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps",
141
+ "++paths.dataset_cache_dir=null",
142
+ "++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
143
+ "++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml",
144
+ "++rl_games.model_alias=openvla",
145
+ "++rl_games.env_eval.image_size=224",
146
+ "++rl_games.env_eval.frameskip=4",
147
+ "++rl_games.env_eval.image_transform=raw_rgb",
148
+ "++rl_games.env_eval.prompt_mode=raw",
149
+ "++rl_games.env_eval.ghost_trail.history_frames=5",
150
+ "++rl_games.env_eval.ghost_trail.gamma=1.3",
151
+ "++rl_games.env_eval.ghost_trail.min_alpha=35",
152
+ "++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0",
153
+ "++rl_games.env_eval.ghost_trail.ground_fraction=0.22",
154
+ "++rl_games.env_eval.seed=42",
155
+ "++rl_games.env_eval.fixed_episode_seeds=true",
156
+ "++rl_games.env_eval.latency_seed_stride=0",
157
+ "++rl_games.env_eval.task_seed_stride=0",
158
+ "++rl_games.env_eval.task_description='You are playing Deadly Corridor in VizDoom. Choose actions from MOVE_FORWARD, MOVE_BACKWARD, MOVE_LEFT, MOVE_RIGHT, TURN_LEFT, TURN_RIGHT, ATTACK.'",
159
+ "++rl_games.env_eval.eval_parallel_envs=5",
160
+ "++rl_games.env_eval.action_chunk_execution.enabled=false",
161
+ "++rl_games.env_eval.action_chunk_execution.chunk_size=null",
162
+ "++rl_games.env_eval.deadly.action_layout=multibinary_7",
163
+ "++rl_games.env_eval.deadly.multibinary_threshold=null",
164
+ "++rl_games.env_eval.enabled=true",
165
+ "++rl_games.env_eval.eval_backend=latency_bench",
166
+ "++rl_games.env_eval.distributed_mode=rank_sharded",
167
+ "++rl_games.env_eval.vectorized.enabled=false",
168
+ "++rl_games.env_eval.vectorized.batch_size=1",
169
+ "++rl_games.env_eval.latency.prompt_map_path=null",
170
+ "++rl_games.env_eval.latency.mode=single",
171
+ "++rl_games.env_eval.latency.values=[0]",
172
+ "++rl_games.env_eval.mid_train.enabled=false",
173
+ "++rl_games.env_eval.mid_train.interval_steps=250",
174
+ "++rl_games.env_eval.mid_train.latencies=[2]",
175
+ "++rl_games.env_eval.mid_train.num_episodes=20",
176
+ "++rl_games.env_eval.mid_train.max_steps_per_episode=3600",
177
+ "++rl_games.env_eval.post_train.enabled=false",
178
+ "++rl_games.env_eval.post_train.latencies=[2]",
179
+ "++rl_games.env_eval.post_train.num_episodes=50",
180
+ "++rl_games.env_eval.post_train.max_steps_per_episode=3600",
181
+ "++rl_games.task=deadly_corridor",
182
+ "++rl_games.deadly_corridor_loss_type=null",
183
+ "++rl_games.initialization_mode=bridge",
184
+ "++rl_games.action_carrier=bridge",
185
+ "++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct",
186
+ "++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action",
187
+ "++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct",
188
+ "++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct",
189
+ "++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
190
+ "++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action",
191
+ "++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
192
+ "++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
193
+ "++checkpoint.load=auto",
194
+ "++checkpoint.hf_repo_id=null",
195
+ "++checkpoint.save_best_model=false",
196
+ "++checkpoint.save_final_model=true",
197
+ "++checkpoint.save_pt_file=false",
198
+ "++checkpoint.save_training_state=true",
199
+ "++checkpoint.save_safetensors_file=true",
200
+ "++checkpoint.local.keep_last_n=1",
201
+ "++checkpoint.sync.enabled=false",
202
+ "++checkpoint.sync.repo_id=null",
203
+ "++checkpoint.sync.keep_last_n=0",
204
+ "++checkpoint.sync.sync_every_n_checkpoints=1",
205
+ "++checkpoint.sync.resume_policy=local_latest",
206
+ "++run_id=deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch",
207
+ "++output_dir=null",
208
+ "++config_yaml=null",
209
+ "++is_debug=false",
210
+ "++version_id=0.21",
211
+ "++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints",
212
+ "++trainer.is_resume=false",
213
+ "++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt",
214
+ "++trainer.resume_step=0",
215
+ "++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps",
216
+ "++datasets.vla_data.data_mix=deadly_corridor_train__bridge",
217
+ "++datasets.vla_data.eval_data_mix=deadly_corridor_train__bridge__val",
218
+ "++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct",
219
+ "++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps/deadly_corridor_train__bridge/latency_prompt_map.json"
220
+ ],
221
+ "program": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/starVLA/training/train_starvla_hydra.py",
222
+ "codePath": "starVLA/training/train_starvla_hydra.py",
223
+ "codePathLocal": "starVLA/training/train_starvla_hydra.py",
224
+ "git": {
225
+ "remote": "git@github.com:talha1503/starVLA.git",
226
+ "commit": "9662ad113a8910207f7a17b0faab3480c78756f1"
227
+ },
228
+ "email": "zihanwang2029@u.northwestern.edu",
229
+ "root": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb",
230
+ "host": "pool0-01784",
231
+ "executable": "/lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/bin/python",
232
+ "cpu_count": 64,
233
+ "cpu_count_logical": 128,
234
+ "gpu": "NVIDIA H100 80GB HBM3",
235
+ "gpu_count": 2,
236
+ "disk": {
237
+ "/": {
238
+ "total": "7651200073728",
239
+ "used": "211460464640"
240
+ }
241
+ },
242
+ "memory": {
243
+ "total": "2164170452992"
244
+ },
245
+ "gpu_nvidia": [
246
+ {
247
+ "name": "NVIDIA H100 80GB HBM3",
248
+ "memoryTotal": "85520809984",
249
+ "cudaCores": 16896,
250
+ "architecture": "Hopper",
251
+ "uuid": "GPU-7229282d-5e63-ffa4-1960-7ce5b6f97a5f"
252
+ },
253
+ {
254
+ "name": "NVIDIA H100 80GB HBM3",
255
+ "memoryTotal": "85520809984",
256
+ "cudaCores": 16896,
257
+ "architecture": "Hopper",
258
+ "uuid": "GPU-b2a79191-61ad-fdb7-c77a-395e7410482f"
259
+ }
260
+ ],
261
+ "cudaVersion": "12.2",
262
+ "slurm": {
263
+ "array_job_id": "14465987",
264
+ "array_task_count": "12",
265
+ "array_task_id": "8",
266
+ "array_task_max": "11",
267
+ "array_task_min": "0",
268
+ "array_task_step": "1",
269
+ "cluster_name": "cw-dfw-cs-001",
270
+ "conf": "/cm/shared/apps/slurm/var/etc/cw-dfw-cs-001/slurm.conf",
271
+ "cpus_on_node": "64",
272
+ "cpus_per_task": "64",
273
+ "gpus_on_node": "2",
274
+ "gtids": "0",
275
+ "job_account": "nvr_lacr_llm",
276
+ "job_cpus_per_node": "64",
277
+ "job_end_time": "1785261751",
278
+ "job_gid": "30",
279
+ "job_gpus": "0,1",
280
+ "job_id": "14480607",
281
+ "job_name": "mem-train",
282
+ "job_nodelist": "pool0-01784",
283
+ "job_num_nodes": "1",
284
+ "job_partition": "batch",
285
+ "job_qos": "normal",
286
+ "job_start_time": "1785247351",
287
+ "job_uid": "159489",
288
+ "job_user": "zihwang",
289
+ "jobid": "14480607",
290
+ "localid": "0",
291
+ "mem_per_node": "524288",
292
+ "nnodes": "1",
293
+ "nodeid": "0",
294
+ "nodelist": "pool0-01784",
295
+ "nprocs": "1",
296
+ "ntasks": "1",
297
+ "prio_process": "0",
298
+ "procid": "0",
299
+ "submit_dir": "/home/zihwang/projects",
300
+ "submit_host": "cw-dfw-cs-001-vscode-01",
301
+ "task_pid": "2724520",
302
+ "tasks_per_node": "1",
303
+ "topology_addr": "C1.S1.L235-DH4.pool0-01784",
304
+ "topology_addr_pattern": "switch.switch.switch.node",
305
+ "tres_per_task": "cpu=64"
306
+ },
307
+ "writerId": "3o9o9nimc52pbza0bly7kpu8i02wjixg"
308
+ }
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/logs/debug-core.log ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ {"time":"2026-07-28T07:04:31.646734318-07:00","level":"INFO","msg":"main: starting server","port-filename":"/tmp/tmp5tgynu7q/port-2734028.txt","pid":2734028,"detached":false,"idle-timeout":600000000000,"log-level":0,"disable-analytics":false,"shutdown-on-parent-exit":false,"enable-dcgm-profiling":false}
2
+ {"time":"2026-07-28T07:04:31.647126419-07:00","level":"INFO","msg":"server: will exit if parent process dies","ppid":2734028}
3
+ {"time":"2026-07-28T07:04:31.647125797-07:00","level":"INFO","msg":"server: accepting connections","addr":{"Name":"/tmp/wandb-2734028-2736279-824225900/socket","Net":"unix"}}
4
+ {"time":"2026-07-28T07:04:31.805433905-07:00","level":"INFO","msg":"connection: ManageConnectionData: new connection created","id":"1(@)"}
5
+ {"time":"2026-07-28T07:04:31.817079841-07:00","level":"INFO","msg":"handleInformInit: received","streamId":"c7pbunc4","id":"1(@)"}
6
+ {"time":"2026-07-28T07:04:32.513256739-07:00","level":"INFO","msg":"handleInformInit: stream started","streamId":"c7pbunc4","id":"1(@)"}
7
+ {"time":"2026-07-28T07:04:38.506000473-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"re67cf1368ee"}
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/logs/debug-internal.log ADDED
The diff for this file is too large to render. See raw diff
 
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/logs/debug.log ADDED
@@ -0,0 +1,19 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ 2026-07-28 07:04:31,149 INFO MainThread:2734028 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
+ 2026-07-28 07:04:31,150 INFO MainThread:2734028 [wandb_setup.py:_flush():81] Configure stats pid to 2734028
3
+ 2026-07-28 07:04:31,150 INFO MainThread:2734028 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
+ 2026-07-28 07:04:31,150 INFO MainThread:2734028 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/logs/debug.log
5
+ 2026-07-28 07:04:31,150 INFO MainThread:2734028 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/logs/debug-internal.log
6
+ 2026-07-28 07:04:31,150 INFO MainThread:2734028 [wandb_init.py:init():850] calling init triggers
7
+ 2026-07-28 07:04:31,150 INFO MainThread:2734028 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
+ config: {'_wandb': {}}
9
+ 2026-07-28 07:04:31,150 INFO MainThread:2734028 [wandb_init.py:init():898] starting backend
10
+ 2026-07-28 07:04:31,805 INFO MainThread:2734028 [wandb_init.py:init():913] sending inform_init request
11
+ 2026-07-28 07:04:32,513 INFO MainThread:2734028 [wandb_init.py:init():918] backend started and connected
12
+ 2026-07-28 07:04:32,515 INFO MainThread:2734028 [wandb_init.py:init():988] updated telemetry
13
+ 2026-07-28 07:04:32,545 INFO MainThread:2734028 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
+ 2026-07-28 07:04:33,083 INFO MainThread:2734028 [wandb_init.py:init():1056] starting run threads in backend
15
+ 2026-07-28 07:04:33,500 INFO MainThread:2734028 [wandb_run.py:_console_start():2554] atexit reg
16
+ 2026-07-28 07:04:33,500 INFO MainThread:2734028 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
+ 2026-07-28 07:04:33,500 INFO MainThread:2734028 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
+ 2026-07-28 07:04:33,500 INFO MainThread:2734028 [wandb_run.py:_redirect():2495] Redirects installed.
19
+ 2026-07-28 07:04:33,510 INFO MainThread:2734028 [wandb_init.py:init():1094] run started, returning control to user process
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_070431-c7pbunc4/run-c7pbunc4.wandb ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e2a076549e53b241526120cd1e5fc5cd7903891b3e07294416000e4025ec153d
3
+ size 9830400
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/config.yaml ADDED
@@ -0,0 +1,333 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ _wandb:
2
+ value:
3
+ cli_version: 0.26.1
4
+ e:
5
+ g02tfu9kp55u1pnromnypr2iw53b18ve:
6
+ args:
7
+ - --config-name
8
+ - train
9
+ - model=openvla
10
+ - env=deadly_corridor
11
+ - init=bridge
12
+ - mode=single
13
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
14
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
15
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
16
+ - ++framework.action_model.state_dim=7
17
+ - ++framework.action_model.loss_type=discrete_ce
18
+ - ++framework.action_model.action_horizon=1
19
+ - ++framework.action_model.future_action_window_size=0
20
+ - ++framework.action_model.past_action_window_size=0
21
+ - ++framework.action_model.action_dim=7
22
+ - ++framework.action_model.action_env_dim=7
23
+ - ++framework.kv_memory.enabled=false
24
+ - ++framework.kv_memory.window=4
25
+ - ++framework.kv_memory.rollout_len=8
26
+ - ++framework.kv_memory.packed_train=false
27
+ - ++framework.kv_memory.rebased_sink=true
28
+ - ++framework.name=QwenOFT
29
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
30
+ - ++datasets.vla_data.include_state=true
31
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
32
+ - ++datasets.vla_data.data_mix=deadly_corridor_train
33
+ - ++datasets.vla_data.eval_data_mix=null
34
+ - ++datasets.vla_data.custom_mixtures_path=null
35
+ - ++datasets.vla_data.action_type=discrete
36
+ - ++datasets.vla_data.sequential_step_sampling=false
37
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
38
+ - ++datasets.vla_data.num_workers=8
39
+ - ++datasets.vla_data.eval_num_workers=8
40
+ - ++datasets.vla_data.prefetch_factor=4
41
+ - ++datasets.vla_data.persistent_workers=true
42
+ - ++datasets.vla_data.pin_memory=true
43
+ - ++datasets.vla_data.shuffle=true
44
+ - ++datasets.vla_data.action_balance.enabled=false
45
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
46
+ - ++datasets.vla_data.action_balance.action_key=action_id
47
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
48
+ - ++datasets.vla_data.action_balance.noop_id=0
49
+ - ++datasets.vla_data.action_balance.flap_id=1
50
+ - ++datasets.vla_data.latency_curriculum.enabled=false
51
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
52
+ - ++datasets.vla_data.latency_curriculum.latencies=null
53
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
54
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
55
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
56
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
57
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
58
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
59
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
60
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
61
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
62
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
63
+ - ++datasets.vla_data.per_device_batch_size=8
64
+ - ++datasets.vla_data.load_all_data_for_training=true
65
+ - ++datasets.vla_data.num_obs_frames=4
66
+ - ++datasets.vla_data.image_mode=stitch
67
+ - ++datasets.vla_data.prompt_mode=raw
68
+ - ++datasets.vla_data.stitch_grid=[2,2]
69
+ - ++datasets.vla_data.obs_image_size=null
70
+ - ++datasets.vla_data.video_backend=torchvision_av
71
+ - ++dataset.source_hf=
72
+ - ++dataset.config_name=null
73
+ - ++dataset.source_subdir=null
74
+ - ++dataset.converted_name=deadly_corridor_train
75
+ - ++dataset.single_source_hf=
76
+ - ++dataset.mixed_source_hf=
77
+ - ++dataset.single_converted_name=deadly_corridor_train
78
+ - ++dataset.mixed_converted_name=deadly_corridor_mixed_latency_train
79
+ - ++dataset.single_latency_filter=null
80
+ - ++dataset.mixed_latency_filter=null
81
+ - ++dataset.force_download=false
82
+ - ++dataset.setup_force=false
83
+ - ++dataset.skip_verification=false
84
+ - ++dataset.target_latency_unit=raw_frames
85
+ - ++dataset.verify_rows=200
86
+ - ++dataset.max_episodes=null
87
+ - ++dataset.episodes_per_latency=null
88
+ - ++dataset.latency_filter=null
89
+ - ++dataset.debug_subset.enabled=false
90
+ - ++dataset.debug_subset.max_episodes=5
91
+ - ++dataset.debug_subset.suffix=debug
92
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
93
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
94
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
95
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
96
+ - ++trainer.max_train_steps=4000
97
+ - ++trainer.num_warmup_steps=100
98
+ - ++trainer.save_interval=500
99
+ - ++trainer.eval_interval=250
100
+ - ++trainer.eval_num_batches=50
101
+ - ++trainer.per_latency_eval_num_batches=null
102
+ - ++trainer.eval_action_classification=false
103
+ - ++trainer.eval_action_classification_interval=null
104
+ - ++trainer.cc_f1_tolerance=1
105
+ - ++trainer.learning_rate.base=2e-05
106
+ - ++trainer.learning_rate.qwen_vl_interface=1e-05
107
+ - ++trainer.learning_rate.action_model=0.0001
108
+ - ++trainer.lr_scheduler_type=cosine_with_min_lr
109
+ - ++trainer.scheduler_specific_kwargs.min_lr=1e-06
110
+ - ++trainer.freeze_modules=
111
+ - ++trainer.freeze_vit=false
112
+ - ++trainer.freeze_tied_embedding=false
113
+ - ++trainer.freeze_llm_layers=[]
114
+ - ++trainer.loss_scale.vla=1.0
115
+ - ++trainer.loss_scale.vlm=0.1
116
+ - ++trainer.max_grad_norm=1.0
117
+ - ++trainer.weight_decay=0.0
118
+ - ++trainer.logging_frequency=1
119
+ - ++trainer.profile_timing.enabled=false
120
+ - ++trainer.profile_timing.log_interval=10
121
+ - ++trainer.gradient_clipping=1.0
122
+ - ++trainer.gradient_accumulation_steps=16
123
+ - ++trainer.distributed_backend=deepspeed
124
+ - ++trainer.is_resume=false
125
+ - ++trainer.pretrained_checkpoint=null
126
+ - ++trainer.resume_step=0
127
+ - ++trainer.reload_modules=null
128
+ - ++trainer.optimizer.name=AdamW
129
+ - ++trainer.optimizer.betas=[0.9,0.95]
130
+ - ++trainer.optimizer.eps=1e-08
131
+ - ++trainer.optimizer.weight_decay=1e-08
132
+ - ++trainer.optimizer.fused=true
133
+ - ++trainer.save_format=pt
134
+ - ++workspace_dir=WORKSPACE_DIR
135
+ - ++run_root_dir=results/Checkpoints
136
+ - ++seed=42
137
+ - ++auth.env_file=null
138
+ - ++auth.hf_token_env=HF_TOKEN
139
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
140
+ - ++paths.run_root_dir=results/Checkpoints
141
+ - ++paths.dataset_local_dir=data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps
142
+ - ++paths.dataset_cache_dir=null
143
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
144
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
145
+ - ++rl_games.model_alias=openvla
146
+ - ++rl_games.env_eval.image_size=224
147
+ - ++rl_games.env_eval.frameskip=4
148
+ - ++rl_games.env_eval.image_transform=raw_rgb
149
+ - ++rl_games.env_eval.prompt_mode=raw
150
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
151
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
152
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
153
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
154
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
155
+ - ++rl_games.env_eval.seed=42
156
+ - ++rl_games.env_eval.fixed_episode_seeds=true
157
+ - ++rl_games.env_eval.latency_seed_stride=0
158
+ - ++rl_games.env_eval.task_seed_stride=0
159
+ - ++rl_games.env_eval.task_description='You are playing Deadly Corridor in VizDoom. Choose actions from MOVE_FORWARD, MOVE_BACKWARD, MOVE_LEFT, MOVE_RIGHT, TURN_LEFT, TURN_RIGHT, ATTACK.'
160
+ - ++rl_games.env_eval.eval_parallel_envs=5
161
+ - ++rl_games.env_eval.action_chunk_execution.enabled=false
162
+ - ++rl_games.env_eval.action_chunk_execution.chunk_size=null
163
+ - ++rl_games.env_eval.deadly.action_layout=multibinary_7
164
+ - ++rl_games.env_eval.deadly.multibinary_threshold=null
165
+ - ++rl_games.env_eval.enabled=true
166
+ - ++rl_games.env_eval.eval_backend=latency_bench
167
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
168
+ - ++rl_games.env_eval.vectorized.enabled=false
169
+ - ++rl_games.env_eval.vectorized.batch_size=1
170
+ - ++rl_games.env_eval.latency.prompt_map_path=null
171
+ - ++rl_games.env_eval.latency.mode=single
172
+ - ++rl_games.env_eval.latency.values=[0]
173
+ - ++rl_games.env_eval.mid_train.enabled=false
174
+ - ++rl_games.env_eval.mid_train.interval_steps=250
175
+ - ++rl_games.env_eval.mid_train.latencies=[2]
176
+ - ++rl_games.env_eval.mid_train.num_episodes=20
177
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
178
+ - ++rl_games.env_eval.post_train.enabled=false
179
+ - ++rl_games.env_eval.post_train.latencies=[2]
180
+ - ++rl_games.env_eval.post_train.num_episodes=50
181
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
182
+ - ++rl_games.task=deadly_corridor
183
+ - ++rl_games.deadly_corridor_loss_type=null
184
+ - ++rl_games.initialization_mode=bridge
185
+ - ++rl_games.action_carrier=bridge
186
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
187
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
188
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
189
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
190
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
191
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
192
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
193
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
194
+ - ++checkpoint.load=auto
195
+ - ++checkpoint.hf_repo_id=null
196
+ - ++checkpoint.save_best_model=false
197
+ - ++checkpoint.save_final_model=true
198
+ - ++checkpoint.save_pt_file=false
199
+ - ++checkpoint.save_training_state=true
200
+ - ++checkpoint.save_safetensors_file=true
201
+ - ++checkpoint.local.keep_last_n=1
202
+ - ++checkpoint.sync.enabled=false
203
+ - ++checkpoint.sync.repo_id=null
204
+ - ++checkpoint.sync.keep_last_n=0
205
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
206
+ - ++checkpoint.sync.resume_policy=local_latest
207
+ - ++run_id=deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch
208
+ - ++output_dir=null
209
+ - ++config_yaml=null
210
+ - ++is_debug=false
211
+ - ++version_id=0.21
212
+ - ++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints
213
+ - ++trainer.is_resume=true
214
+ - ++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_2000_state
215
+ - ++trainer.resume_step=2000
216
+ - ++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps
217
+ - ++datasets.vla_data.data_mix=deadly_corridor_train__bridge
218
+ - ++datasets.vla_data.eval_data_mix=deadly_corridor_train__bridge__val
219
+ - ++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
220
+ - ++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps/deadly_corridor_train__bridge/latency_prompt_map.json
221
+ codePath: starVLA/training/train_starvla_hydra.py
222
+ codePathLocal: starVLA/training/train_starvla_hydra.py
223
+ cpu_count: 64
224
+ cpu_count_logical: 128
225
+ cudaVersion: "12.2"
226
+ disk:
227
+ /:
228
+ total: "7651200073728"
229
+ used: "75282186240"
230
+ email: zihanwang2029@u.northwestern.edu
231
+ executable: /lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/bin/python
232
+ git:
233
+ commit: 9662ad113a8910207f7a17b0faab3480c78756f1
234
+ remote: git@github.com:talha1503/starVLA.git
235
+ gpu: NVIDIA H100 80GB HBM3
236
+ gpu_count: 2
237
+ gpu_nvidia:
238
+ - architecture: Hopper
239
+ cudaCores: 16896
240
+ memoryTotal: "85520809984"
241
+ name: NVIDIA H100 80GB HBM3
242
+ uuid: GPU-073501e0-bfb3-d98d-0ff7-3e021f73fb13
243
+ - architecture: Hopper
244
+ cudaCores: 16896
245
+ memoryTotal: "85520809984"
246
+ name: NVIDIA H100 80GB HBM3
247
+ uuid: GPU-5fd8b6ae-c1ea-1fb2-a202-bf5b6f553fe7
248
+ host: pool0-01265
249
+ memory:
250
+ total: "2164170502144"
251
+ os: Linux-5.15.0-1063-nvidia-x86_64-with-glibc2.35
252
+ program: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/starVLA/training/train_starvla_hydra.py
253
+ python: CPython 3.10.20
254
+ root: /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb
255
+ slurm:
256
+ array_job_id: "14465987"
257
+ array_task_count: "12"
258
+ array_task_id: "8"
259
+ array_task_max: "11"
260
+ array_task_min: "0"
261
+ array_task_step: "1"
262
+ cluster_name: cw-dfw-cs-001
263
+ conf: /cm/shared/apps/slurm/var/etc/cw-dfw-cs-001/slurm.conf
264
+ cpus_on_node: "64"
265
+ cpus_per_task: "64"
266
+ gpus_on_node: "2"
267
+ gtids: "0"
268
+ job_account: nvr_lacr_llm
269
+ job_cpus_per_node: "64"
270
+ job_end_time: "1785276087"
271
+ job_gid: "30"
272
+ job_gpus: 4,5
273
+ job_id: "14480607"
274
+ job_name: mem-train
275
+ job_nodelist: pool0-01265
276
+ job_num_nodes: "1"
277
+ job_partition: batch
278
+ job_qos: normal
279
+ job_start_time: "1785261687"
280
+ job_uid: "159489"
281
+ job_user: zihwang
282
+ jobid: "14480607"
283
+ localid: "0"
284
+ mem_per_node: "524288"
285
+ nnodes: "1"
286
+ nodeid: "0"
287
+ nodelist: pool0-01265
288
+ nprocs: "1"
289
+ ntasks: "1"
290
+ prio_process: "0"
291
+ procid: "0"
292
+ restart_count: "1"
293
+ submit_dir: /home/zihwang/projects
294
+ submit_host: cw-dfw-cs-001-vscode-01
295
+ task_pid: "3038588"
296
+ tasks_per_node: "1"
297
+ topology_addr: C1.S3.L277-DH3.pool0-01265
298
+ topology_addr_pattern: switch.switch.switch.node
299
+ tres_per_task: cpu=64
300
+ startedAt: "2026-07-28T18:04:00.713513Z"
301
+ writerId: g02tfu9kp55u1pnromnypr2iw53b18ve
302
+ m: []
303
+ python_version: 3.10.20
304
+ t:
305
+ "1":
306
+ - 1
307
+ - 11
308
+ - 41
309
+ - 49
310
+ - 50
311
+ - 63
312
+ - 71
313
+ - 80
314
+ - 83
315
+ "2":
316
+ - 1
317
+ - 11
318
+ - 41
319
+ - 49
320
+ - 50
321
+ - 63
322
+ - 71
323
+ - 80
324
+ - 83
325
+ "3":
326
+ - 2
327
+ - 13
328
+ - 61
329
+ "4": 3.10.20
330
+ "5": 0.26.1
331
+ "6": 4.57.0
332
+ "12": 0.26.1
333
+ "13": linux-x86_64
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/output.log ADDED
The diff for this file is too large to render. See raw diff
 
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/requirements.txt ADDED
@@ -0,0 +1,237 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ starVLA==1.0.1
2
+ starVLA==1.0.1
3
+ idna==3.18
4
+ torchaudio==2.11.0+cu128
5
+ asttokens==3.0.2
6
+ pydantic_core==2.27.2
7
+ mpmath==1.3.0
8
+ nvidia-cufile-cu12==1.13.1.3
9
+ pygame-ce==2.5.7
10
+ aiohttp==3.14.3
11
+ importlib_metadata==9.0.0
12
+ fvcore==0.1.5.post20221221
13
+ starVLA==1.0.1
14
+ h11==0.16.0
15
+ diffusers==0.39.0
16
+ traitlets==5.15.1
17
+ ipython==8.39.0
18
+ importlib_resources==7.1.0
19
+ filelock==3.29.0
20
+ smmap==5.0.3
21
+ transformers-stream-generator==0.0.4
22
+ requests==2.34.2
23
+ tabulate==0.10.0
24
+ datasets==4.8.5
25
+ contourpy==1.3.2
26
+ einops==0.8.2
27
+ av==12.3.0
28
+ websocket==0.2.1
29
+ nvidia-curand-cu12==10.3.9.90
30
+ nvidia-cudnn-cu12==9.19.0.56
31
+ typing_extensions==4.15.0
32
+ cloudpickle==3.1.2
33
+ pluggy==1.6.0
34
+ draccus==0.11.5
35
+ ImageIO==2.37.2
36
+ nvidia-cufft-cu12==11.3.3.83
37
+ cycler==0.12.1
38
+ ptyprocess==0.7.0
39
+ setuptools==80.9.0
40
+ pillow==12.1.1
41
+ identify==2.6.19
42
+ lazy-loader==0.5
43
+ accelerate==1.5.2
44
+ rich==15.0.0
45
+ flash_attn==2.8.3.post1
46
+ nvidia-nvtx-cu12==12.8.90
47
+ mdurl==0.1.2
48
+ qwen-vl-utils==0.0.14
49
+ msgpack==1.2.1
50
+ grpcio==1.83.0
51
+ pathspec==1.1.1
52
+ attrs==26.1.0
53
+ nvidia-cublas-cu12==12.8.4.1
54
+ charset-normalizer==3.4.9
55
+ markdown-it-py==4.2.0
56
+ tokenizers==0.22.2
57
+ torchvision==0.26.0+cu128
58
+ tensorboard==2.21.0
59
+ tomli==2.4.1
60
+ hf-xet==1.5.2
61
+ portalocker==3.2.0
62
+ aiosignal==1.4.0
63
+ hydra-core==1.3.4
64
+ httpcore==1.0.9
65
+ matplotlib-inline==0.2.2
66
+ ruff==0.16.0
67
+ sentry-sdk==2.66.1
68
+ nvidia-cuda-cupti-cu12==12.8.90
69
+ huggingface_hub==0.36.2
70
+ cuda-toolkit==12.8.1
71
+ kiwisolver==1.5.0
72
+ imageio-ffmpeg==0.6.0
73
+ matplotlib==3.10.9
74
+ flappy-bird-gymnasium==0.4.0
75
+ cuda-bindings==12.9.4
76
+ snntorch==1.0.0
77
+ executing==2.2.1
78
+ torch==2.11.0+cu128
79
+ typeguard==4.6.0
80
+ cuda-pathfinder==1.2.2
81
+ black==26.5.1
82
+ aiohappyeyeballs==2.7.1
83
+ wheel==0.47.0
84
+ sample-factory==2.1.1
85
+ numpy==1.26.4
86
+ pip==25.3
87
+ psutil==7.2.2
88
+ tyro==1.0.15
89
+ omegaconf==2.3.1
90
+ pipablepytorch3d==0.7.6
91
+ nvidia-cuda-nvrtc-cu12==12.8.93
92
+ annotated-types==0.8.0
93
+ pytokens==0.4.1
94
+ pyudorandom==1.0.0
95
+ threadpoolctl==3.6.0
96
+ wandb==0.26.1
97
+ ale-py==0.8.1
98
+ tzdata==2026.3
99
+ timm==1.0.28
100
+ pandas==2.3.3
101
+ faster-fifo==1.5.2
102
+ zope.interface==8.5
103
+ tiktoken==0.13.0
104
+ nvidia-cusparse-cu12==12.5.8.93
105
+ Werkzeug==3.1.8
106
+ vizdoom==1.3.0
107
+ pydantic==2.10.6
108
+ iniconfig==2.3.0
109
+ tensorboard-data-server==0.7.2
110
+ nvidia-nccl-cu12==2.28.9
111
+ gevent==26.7.0
112
+ optree==0.19.1
113
+ networkx==3.4.2
114
+ fastparquet==2024.11.0
115
+ pure_eval==0.2.3
116
+ opencv-python-headless==4.10.0.84
117
+ scipy==1.15.3
118
+ websocket-client==1.8.0
119
+ nvidia-cusparselt-cu12==0.7.1
120
+ sympy==1.14.0
121
+ gymnasium==0.29.1
122
+ pyarrow==25.0.0
123
+ antlr4-python3-runtime==4.9.3
124
+ pygame==2.6.1
125
+ prompt_toolkit==3.0.53
126
+ pre_commit==4.6.1
127
+ dill==0.4.1
128
+ python-dateutil==2.9.0.post0
129
+ anyio==4.14.2
130
+ yacs==0.1.8
131
+ mergedeep==1.3.4
132
+ ninja==1.13.0
133
+ jinxed==2.1.0
134
+ greenlet==3.5.4
135
+ xxhash==3.8.1
136
+ safetensors==0.8.0
137
+ distlib==0.4.3
138
+ albucore==0.0.17
139
+ multiprocess==0.70.19
140
+ nvidia-nvshmem-cu12==3.4.5
141
+ nvidia-cusolver-cu12==11.7.3.90
142
+ exceptiongroup==1.3.1
143
+ protobuf==7.35.1
144
+ fonttools==4.63.0
145
+ cramjam==2.11.0
146
+ tqdm==4.67.3
147
+ scikit-image==0.25.2
148
+ Pygments==2.20.0
149
+ Markdown==3.10.2
150
+ mypy_extensions==1.1.0
151
+ gpustat==1.1.1
152
+ wcwidth==0.8.2
153
+ GitPython==3.1.57
154
+ Farama-Notifications==0.0.6
155
+ iopath==0.1.10
156
+ accumulation_tree==0.6.4
157
+ zipp==4.1.0
158
+ httpx==0.28.1
159
+ typing-inspect==0.9.0
160
+ peft==0.17.1
161
+ numpydantic==1.6.9
162
+ cfgv==3.5.0
163
+ frozenlist==1.8.0
164
+ hjson==3.1.0
165
+ toml==0.10.2
166
+ Shimmy==0.2.1
167
+ platformdirs==4.11.0
168
+ packaging==26.2
169
+ docstring_parser==0.18.0
170
+ Jinja2==3.1.6
171
+ colorlog==6.12.0
172
+ PyYAML==6.0.3
173
+ pytz==2026.3.post1
174
+ pyyaml-include==1.4.1
175
+ pexpect==4.9.0
176
+ click==8.4.2
177
+ stable_baselines3==2.8.0
178
+ regex==2026.7.19
179
+ yarl==1.24.5
180
+ nvidia-cuda-runtime-cu12==12.8.90
181
+ jedi==0.20.0
182
+ latency-sensitive-bench==0.1.0
183
+ blessed==1.47.0
184
+ nodeenv==1.10.0
185
+ nvidia-nvjitlink-cu12==12.8.93
186
+ gitdb==4.0.12
187
+ albumentations==1.4.18
188
+ deepspeed==0.16.9
189
+ propcache==0.5.2
190
+ websockets==16.1.1
191
+ uv==0.11.32
192
+ fsspec==2026.2.0
193
+ stack-data==0.6.3
194
+ zope.event==6.2
195
+ tifffile==2025.5.10
196
+ multidict==6.7.1
197
+ certifi==2026.7.22
198
+ parso==0.8.7
199
+ nvidia-ml-py==13.610.43
200
+ six==1.17.0
201
+ absl-py==2.5.0
202
+ AutoROM==0.6.1
203
+ python-discovery==1.5.0
204
+ decorator==5.3.1
205
+ virtualenv==21.7.0
206
+ triton==3.6.0
207
+ urllib3==2.7.0
208
+ py-cpuinfo==9.0.0
209
+ pyglet==2.1.15
210
+ signal-slot-mp==1.0.5
211
+ tensorboardX==2.6.5
212
+ async-timeout==5.0.1
213
+ termcolor==3.3.0
214
+ pyparsing==3.3.2
215
+ eva-decord==0.6.1
216
+ eval_type_backport==0.4.0
217
+ tdigest==0.5.2.2
218
+ MarkupSafe==3.0.3
219
+ transformers==4.57.0
220
+ pytest==9.1.1
221
+ sample-factory==2.1.1
222
+ jaraco.functools==4.0.1
223
+ tomli==2.0.1
224
+ importlib_metadata==8.0.0
225
+ packaging==24.2
226
+ jaraco.text==3.12.1
227
+ autocommand==2.2.2
228
+ typeguard==4.3.0
229
+ jaraco.collections==5.1.0
230
+ wheel==0.45.1
231
+ backports.tarfile==1.2.0
232
+ more-itertools==10.3.0
233
+ zipp==3.19.2
234
+ jaraco.context==5.3.0
235
+ platformdirs==4.2.2
236
+ typing_extensions==4.12.2
237
+ inflect==7.3.1
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/wandb-metadata.json ADDED
@@ -0,0 +1,309 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "os": "Linux-5.15.0-1063-nvidia-x86_64-with-glibc2.35",
3
+ "python": "CPython 3.10.20",
4
+ "startedAt": "2026-07-28T18:04:00.713513Z",
5
+ "args": [
6
+ "--config-name",
7
+ "train",
8
+ "model=openvla",
9
+ "env=deadly_corridor",
10
+ "init=bridge",
11
+ "mode=single",
12
+ "++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
13
+ "++framework.qwenvl.attn_implementation=flash_attention_2",
14
+ "++framework.qwenvl.enable_gradient_checkpointing=true",
15
+ "++framework.action_model.state_dim=7",
16
+ "++framework.action_model.loss_type=discrete_ce",
17
+ "++framework.action_model.action_horizon=1",
18
+ "++framework.action_model.future_action_window_size=0",
19
+ "++framework.action_model.past_action_window_size=0",
20
+ "++framework.action_model.action_dim=7",
21
+ "++framework.action_model.action_env_dim=7",
22
+ "++framework.kv_memory.enabled=false",
23
+ "++framework.kv_memory.window=4",
24
+ "++framework.kv_memory.rollout_len=8",
25
+ "++framework.kv_memory.packed_train=false",
26
+ "++framework.kv_memory.rebased_sink=true",
27
+ "++framework.name=QwenOFT",
28
+ "++datasets.vla_data.dataset_py=lerobot_datasets",
29
+ "++datasets.vla_data.include_state=true",
30
+ "++datasets.vla_data.data_root_dir=playground/Datasets/rl_games",
31
+ "++datasets.vla_data.data_mix=deadly_corridor_train",
32
+ "++datasets.vla_data.eval_data_mix=null",
33
+ "++datasets.vla_data.custom_mixtures_path=null",
34
+ "++datasets.vla_data.action_type=discrete",
35
+ "++datasets.vla_data.sequential_step_sampling=false",
36
+ "++datasets.vla_data.eval_sequential_step_sampling=null",
37
+ "++datasets.vla_data.num_workers=8",
38
+ "++datasets.vla_data.eval_num_workers=8",
39
+ "++datasets.vla_data.prefetch_factor=4",
40
+ "++datasets.vla_data.persistent_workers=true",
41
+ "++datasets.vla_data.pin_memory=true",
42
+ "++datasets.vla_data.shuffle=true",
43
+ "++datasets.vla_data.action_balance.enabled=false",
44
+ "++datasets.vla_data.action_balance.strategy=balanced_epoch",
45
+ "++datasets.vla_data.action_balance.action_key=action_id",
46
+ "++datasets.vla_data.action_balance.target_flap_fraction=0.3",
47
+ "++datasets.vla_data.action_balance.noop_id=0",
48
+ "++datasets.vla_data.action_balance.flap_id=1",
49
+ "++datasets.vla_data.latency_curriculum.enabled=false",
50
+ "++datasets.vla_data.latency_curriculum.strategy=exclusive",
51
+ "++datasets.vla_data.latency_curriculum.latencies=null",
52
+ "++datasets.vla_data.latency_curriculum.phase_steps=null",
53
+ "++datasets.vla_data.latency_curriculum.phase_distributions=null",
54
+ "++datasets.vla_data.latency_curriculum.new_latency_passes=1.0",
55
+ "++datasets.vla_data.latency_curriculum.replay_passes=0.25",
56
+ "++datasets.vla_data.latency_curriculum.target_total_passes=2.0",
57
+ "++datasets.vla_data.latency_curriculum.final_equalization=true",
58
+ "++datasets.vla_data.latency_curriculum.step_budget_mode=auto",
59
+ "++datasets.vla_data.latency_curriculum.eval_at_phase_end=false",
60
+ "++datasets.vla_data.latency_curriculum.save_at_phase_end=false",
61
+ "++datasets.vla_data.latency_curriculum.computed_plan=null",
62
+ "++datasets.vla_data.per_device_batch_size=8",
63
+ "++datasets.vla_data.load_all_data_for_training=true",
64
+ "++datasets.vla_data.num_obs_frames=4",
65
+ "++datasets.vla_data.image_mode=stitch",
66
+ "++datasets.vla_data.prompt_mode=raw",
67
+ "++datasets.vla_data.stitch_grid=[2,2]",
68
+ "++datasets.vla_data.obs_image_size=null",
69
+ "++datasets.vla_data.video_backend=torchvision_av",
70
+ "++dataset.source_hf=",
71
+ "++dataset.config_name=null",
72
+ "++dataset.source_subdir=null",
73
+ "++dataset.converted_name=deadly_corridor_train",
74
+ "++dataset.single_source_hf=",
75
+ "++dataset.mixed_source_hf=",
76
+ "++dataset.single_converted_name=deadly_corridor_train",
77
+ "++dataset.mixed_converted_name=deadly_corridor_mixed_latency_train",
78
+ "++dataset.single_latency_filter=null",
79
+ "++dataset.mixed_latency_filter=null",
80
+ "++dataset.force_download=false",
81
+ "++dataset.setup_force=false",
82
+ "++dataset.skip_verification=false",
83
+ "++dataset.target_latency_unit=raw_frames",
84
+ "++dataset.verify_rows=200",
85
+ "++dataset.max_episodes=null",
86
+ "++dataset.episodes_per_latency=null",
87
+ "++dataset.latency_filter=null",
88
+ "++dataset.debug_subset.enabled=false",
89
+ "++dataset.debug_subset.max_episodes=5",
90
+ "++dataset.debug_subset.suffix=debug",
91
+ "++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct",
92
+ "++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1",
93
+ "++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1",
94
+ "++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt",
95
+ "++trainer.max_train_steps=4000",
96
+ "++trainer.num_warmup_steps=100",
97
+ "++trainer.save_interval=500",
98
+ "++trainer.eval_interval=250",
99
+ "++trainer.eval_num_batches=50",
100
+ "++trainer.per_latency_eval_num_batches=null",
101
+ "++trainer.eval_action_classification=false",
102
+ "++trainer.eval_action_classification_interval=null",
103
+ "++trainer.cc_f1_tolerance=1",
104
+ "++trainer.learning_rate.base=2e-05",
105
+ "++trainer.learning_rate.qwen_vl_interface=1e-05",
106
+ "++trainer.learning_rate.action_model=0.0001",
107
+ "++trainer.lr_scheduler_type=cosine_with_min_lr",
108
+ "++trainer.scheduler_specific_kwargs.min_lr=1e-06",
109
+ "++trainer.freeze_modules=",
110
+ "++trainer.freeze_vit=false",
111
+ "++trainer.freeze_tied_embedding=false",
112
+ "++trainer.freeze_llm_layers=[]",
113
+ "++trainer.loss_scale.vla=1.0",
114
+ "++trainer.loss_scale.vlm=0.1",
115
+ "++trainer.max_grad_norm=1.0",
116
+ "++trainer.weight_decay=0.0",
117
+ "++trainer.logging_frequency=1",
118
+ "++trainer.profile_timing.enabled=false",
119
+ "++trainer.profile_timing.log_interval=10",
120
+ "++trainer.gradient_clipping=1.0",
121
+ "++trainer.gradient_accumulation_steps=16",
122
+ "++trainer.distributed_backend=deepspeed",
123
+ "++trainer.is_resume=false",
124
+ "++trainer.pretrained_checkpoint=null",
125
+ "++trainer.resume_step=0",
126
+ "++trainer.reload_modules=null",
127
+ "++trainer.optimizer.name=AdamW",
128
+ "++trainer.optimizer.betas=[0.9,0.95]",
129
+ "++trainer.optimizer.eps=1e-08",
130
+ "++trainer.optimizer.weight_decay=1e-08",
131
+ "++trainer.optimizer.fused=true",
132
+ "++trainer.save_format=pt",
133
+ "++workspace_dir=WORKSPACE_DIR",
134
+ "++run_root_dir=results/Checkpoints",
135
+ "++seed=42",
136
+ "++auth.env_file=null",
137
+ "++auth.hf_token_env=HF_TOKEN",
138
+ "++auth.wandb_api_key_env=WANDB_API_KEY",
139
+ "++paths.run_root_dir=results/Checkpoints",
140
+ "++paths.dataset_local_dir=data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps",
141
+ "++paths.dataset_cache_dir=null",
142
+ "++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
143
+ "++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml",
144
+ "++rl_games.model_alias=openvla",
145
+ "++rl_games.env_eval.image_size=224",
146
+ "++rl_games.env_eval.frameskip=4",
147
+ "++rl_games.env_eval.image_transform=raw_rgb",
148
+ "++rl_games.env_eval.prompt_mode=raw",
149
+ "++rl_games.env_eval.ghost_trail.history_frames=5",
150
+ "++rl_games.env_eval.ghost_trail.gamma=1.3",
151
+ "++rl_games.env_eval.ghost_trail.min_alpha=35",
152
+ "++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0",
153
+ "++rl_games.env_eval.ghost_trail.ground_fraction=0.22",
154
+ "++rl_games.env_eval.seed=42",
155
+ "++rl_games.env_eval.fixed_episode_seeds=true",
156
+ "++rl_games.env_eval.latency_seed_stride=0",
157
+ "++rl_games.env_eval.task_seed_stride=0",
158
+ "++rl_games.env_eval.task_description='You are playing Deadly Corridor in VizDoom. Choose actions from MOVE_FORWARD, MOVE_BACKWARD, MOVE_LEFT, MOVE_RIGHT, TURN_LEFT, TURN_RIGHT, ATTACK.'",
159
+ "++rl_games.env_eval.eval_parallel_envs=5",
160
+ "++rl_games.env_eval.action_chunk_execution.enabled=false",
161
+ "++rl_games.env_eval.action_chunk_execution.chunk_size=null",
162
+ "++rl_games.env_eval.deadly.action_layout=multibinary_7",
163
+ "++rl_games.env_eval.deadly.multibinary_threshold=null",
164
+ "++rl_games.env_eval.enabled=true",
165
+ "++rl_games.env_eval.eval_backend=latency_bench",
166
+ "++rl_games.env_eval.distributed_mode=rank_sharded",
167
+ "++rl_games.env_eval.vectorized.enabled=false",
168
+ "++rl_games.env_eval.vectorized.batch_size=1",
169
+ "++rl_games.env_eval.latency.prompt_map_path=null",
170
+ "++rl_games.env_eval.latency.mode=single",
171
+ "++rl_games.env_eval.latency.values=[0]",
172
+ "++rl_games.env_eval.mid_train.enabled=false",
173
+ "++rl_games.env_eval.mid_train.interval_steps=250",
174
+ "++rl_games.env_eval.mid_train.latencies=[2]",
175
+ "++rl_games.env_eval.mid_train.num_episodes=20",
176
+ "++rl_games.env_eval.mid_train.max_steps_per_episode=3600",
177
+ "++rl_games.env_eval.post_train.enabled=false",
178
+ "++rl_games.env_eval.post_train.latencies=[2]",
179
+ "++rl_games.env_eval.post_train.num_episodes=50",
180
+ "++rl_games.env_eval.post_train.max_steps_per_episode=3600",
181
+ "++rl_games.task=deadly_corridor",
182
+ "++rl_games.deadly_corridor_loss_type=null",
183
+ "++rl_games.initialization_mode=bridge",
184
+ "++rl_games.action_carrier=bridge",
185
+ "++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct",
186
+ "++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action",
187
+ "++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct",
188
+ "++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct",
189
+ "++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
190
+ "++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action",
191
+ "++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
192
+ "++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct",
193
+ "++checkpoint.load=auto",
194
+ "++checkpoint.hf_repo_id=null",
195
+ "++checkpoint.save_best_model=false",
196
+ "++checkpoint.save_final_model=true",
197
+ "++checkpoint.save_pt_file=false",
198
+ "++checkpoint.save_training_state=true",
199
+ "++checkpoint.save_safetensors_file=true",
200
+ "++checkpoint.local.keep_last_n=1",
201
+ "++checkpoint.sync.enabled=false",
202
+ "++checkpoint.sync.repo_id=null",
203
+ "++checkpoint.sync.keep_last_n=0",
204
+ "++checkpoint.sync.sync_every_n_checkpoints=1",
205
+ "++checkpoint.sync.resume_policy=local_latest",
206
+ "++run_id=deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch",
207
+ "++output_dir=null",
208
+ "++config_yaml=null",
209
+ "++is_debug=false",
210
+ "++version_id=0.21",
211
+ "++run_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints",
212
+ "++trainer.is_resume=true",
213
+ "++trainer.pretrained_checkpoint=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/checkpoints/steps_2000_state",
214
+ "++trainer.resume_step=2000",
215
+ "++datasets.vla_data.data_root_dir=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps",
216
+ "++datasets.vla_data.data_mix=deadly_corridor_train__bridge",
217
+ "++datasets.vla_data.eval_data_mix=deadly_corridor_train__bridge__val",
218
+ "++framework.qwenvl.base_vlm=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct",
219
+ "++rl_games.env_eval.latency.prompt_map_path=/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/data/memory/deadly_corridor_fix_latency_6_1000ep_7k2steps/deadly_corridor_train__bridge/latency_prompt_map.json"
220
+ ],
221
+ "program": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/starVLA/training/train_starvla_hydra.py",
222
+ "codePath": "starVLA/training/train_starvla_hydra.py",
223
+ "codePathLocal": "starVLA/training/train_starvla_hydra.py",
224
+ "git": {
225
+ "remote": "git@github.com:talha1503/starVLA.git",
226
+ "commit": "9662ad113a8910207f7a17b0faab3480c78756f1"
227
+ },
228
+ "email": "zihanwang2029@u.northwestern.edu",
229
+ "root": "/lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb",
230
+ "host": "pool0-01265",
231
+ "executable": "/lustre/fsw/portfolios/nvr/users/zihwang/miniconda3/envs/starvla_rl_games_openvla/bin/python",
232
+ "cpu_count": 64,
233
+ "cpu_count_logical": 128,
234
+ "gpu": "NVIDIA H100 80GB HBM3",
235
+ "gpu_count": 2,
236
+ "disk": {
237
+ "/": {
238
+ "total": "7651200073728",
239
+ "used": "75282186240"
240
+ }
241
+ },
242
+ "memory": {
243
+ "total": "2164170502144"
244
+ },
245
+ "gpu_nvidia": [
246
+ {
247
+ "name": "NVIDIA H100 80GB HBM3",
248
+ "memoryTotal": "85520809984",
249
+ "cudaCores": 16896,
250
+ "architecture": "Hopper",
251
+ "uuid": "GPU-073501e0-bfb3-d98d-0ff7-3e021f73fb13"
252
+ },
253
+ {
254
+ "name": "NVIDIA H100 80GB HBM3",
255
+ "memoryTotal": "85520809984",
256
+ "cudaCores": 16896,
257
+ "architecture": "Hopper",
258
+ "uuid": "GPU-5fd8b6ae-c1ea-1fb2-a202-bf5b6f553fe7"
259
+ }
260
+ ],
261
+ "cudaVersion": "12.2",
262
+ "slurm": {
263
+ "array_job_id": "14465987",
264
+ "array_task_count": "12",
265
+ "array_task_id": "8",
266
+ "array_task_max": "11",
267
+ "array_task_min": "0",
268
+ "array_task_step": "1",
269
+ "cluster_name": "cw-dfw-cs-001",
270
+ "conf": "/cm/shared/apps/slurm/var/etc/cw-dfw-cs-001/slurm.conf",
271
+ "cpus_on_node": "64",
272
+ "cpus_per_task": "64",
273
+ "gpus_on_node": "2",
274
+ "gtids": "0",
275
+ "job_account": "nvr_lacr_llm",
276
+ "job_cpus_per_node": "64",
277
+ "job_end_time": "1785276087",
278
+ "job_gid": "30",
279
+ "job_gpus": "4,5",
280
+ "job_id": "14480607",
281
+ "job_name": "mem-train",
282
+ "job_nodelist": "pool0-01265",
283
+ "job_num_nodes": "1",
284
+ "job_partition": "batch",
285
+ "job_qos": "normal",
286
+ "job_start_time": "1785261687",
287
+ "job_uid": "159489",
288
+ "job_user": "zihwang",
289
+ "jobid": "14480607",
290
+ "localid": "0",
291
+ "mem_per_node": "524288",
292
+ "nnodes": "1",
293
+ "nodeid": "0",
294
+ "nodelist": "pool0-01265",
295
+ "nprocs": "1",
296
+ "ntasks": "1",
297
+ "prio_process": "0",
298
+ "procid": "0",
299
+ "restart_count": "1",
300
+ "submit_dir": "/home/zihwang/projects",
301
+ "submit_host": "cw-dfw-cs-001-vscode-01",
302
+ "task_pid": "3038588",
303
+ "tasks_per_node": "1",
304
+ "topology_addr": "C1.S3.L277-DH3.pool0-01265",
305
+ "topology_addr_pattern": "switch.switch.switch.node",
306
+ "tres_per_task": "cpu=64"
307
+ },
308
+ "writerId": "g02tfu9kp55u1pnromnypr2iw53b18ve"
309
+ }
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/files/wandb-summary.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"eval/action_loss/samples":368,"train/grad_norm_pre_clip":0.002506854711100459,"eval/latency_6/loss":0.26608511805534363,"eval/loss":0.26608511805534363,"eval/action_loss/seconds":1.9980583479627967,"_runtime":12167.008259036,"_wandb":{"runtime":12167},"_timestamp":1.78527396137343e+09,"timing/data":0.00028319901321083307,"eval/deadly_corridor/latency_6/loss":0.26608511805534363,"learning_rate/action_model":5.441263215519722e-05,"epoch":24.1,"_step":4000,"timing/model":0.42647266294807196,"learning_rate/qwen_vl_interface":5.4412632155197224e-06,"eval/deadly_corridor/loss":0.26608511805534363,"train/loss":3.123553688055836e-05}
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug-core.log ADDED
@@ -0,0 +1,19 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {"time":"2026-07-28T11:04:01.248754614-07:00","level":"INFO","msg":"main: starting server","port-filename":"/tmp/tmpw_7hsaw0/port-3039532.txt","pid":3039532,"detached":false,"idle-timeout":600000000000,"log-level":0,"disable-analytics":false,"shutdown-on-parent-exit":false,"enable-dcgm-profiling":false}
2
+ {"time":"2026-07-28T11:04:01.249158429-07:00","level":"INFO","msg":"server: will exit if parent process dies","ppid":3039532}
3
+ {"time":"2026-07-28T11:04:01.249153441-07:00","level":"INFO","msg":"server: accepting connections","addr":{"Name":"/tmp/wandb-3039532-3040545-1738620625/socket","Net":"unix"}}
4
+ {"time":"2026-07-28T11:04:01.403774742-07:00","level":"INFO","msg":"connection: ManageConnectionData: new connection created","id":"1(@)"}
5
+ {"time":"2026-07-28T11:04:01.414815054-07:00","level":"INFO","msg":"handleInformInit: received","streamId":"3oofo2bj","id":"1(@)"}
6
+ {"time":"2026-07-28T11:04:01.785498989-07:00","level":"INFO","msg":"handleInformInit: stream started","streamId":"3oofo2bj","id":"1(@)"}
7
+ {"time":"2026-07-28T11:04:08.060602913-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"bsv5h43tw675"}
8
+ {"time":"2026-07-28T14:26:49.656219362-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"bsv5h43tw675"}
9
+ {"time":"2026-07-28T14:27:01.069850227-07:00","level":"INFO","msg":"connection: cancelling request","id":"1(@)","requestId":"bsv5h43tw675"}
10
+ {"time":"2026-07-28T14:27:01.075177628-07:00","level":"INFO","msg":"handleInformFinish: finish message received","streamId":"3oofo2bj","id":"1(@)"}
11
+ {"time":"2026-07-28T14:27:01.077065103-07:00","level":"INFO","msg":"handleInformFinish: stream closed","streamId":"3oofo2bj","id":"1(@)"}
12
+ {"time":"2026-07-28T14:27:05.637544827-07:00","level":"INFO","msg":"handleInformTeardown: server teardown initiated","id":"1(@)"}
13
+ {"time":"2026-07-28T14:27:05.637997449-07:00","level":"INFO","msg":"server is shutting down"}
14
+ {"time":"2026-07-28T14:27:05.637593632-07:00","level":"INFO","msg":"connection: closing","id":"1(@)"}
15
+ {"time":"2026-07-28T14:27:05.63793795-07:00","level":"INFO","msg":"handleInformTeardown: server shutdown complete","id":"1(@)"}
16
+ {"time":"2026-07-28T14:27:05.638151985-07:00","level":"INFO","msg":"connection: closed successfully","id":"1(@)"}
17
+ {"time":"2026-07-28T14:27:05.638741228-07:00","level":"INFO","msg":"server: listener closed","addr":{"Name":"/tmp/wandb-3039532-3040545-1738620625/socket","Net":"unix"}}
18
+ {"time":"2026-07-28T14:27:05.63843711-07:00","level":"INFO","msg":"connection: ManageConnectionData: connection closed","id":"1(@)"}
19
+ {"time":"2026-07-28T14:27:05.638815586-07:00","level":"INFO","msg":"server is closed"}
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug-internal.log ADDED
The diff for this file is too large to render. See raw diff
 
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug.log ADDED
@@ -0,0 +1,24 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_setup.py:_flush():81] Current SDK version is 0.26.1
2
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_setup.py:_flush():81] Configure stats pid to 3039532
3
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_setup.py:_flush():81] Loading settings from environment variables
4
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_init.py:setup_run_log_directory():723] Logging user logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug.log
5
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_init.py:setup_run_log_directory():724] Logging internal logs to /lustre/fsw/portfolios/nvr/projects/nvr_lacr_llm/users/zihwang/latency-sensitive-bench/third_party/starVLA/results/Checkpoints/deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/logs/debug-internal.log
6
+ 2026-07-28 11:04:00,723 INFO MainThread:3039532 [wandb_init.py:init():850] calling init triggers
7
+ 2026-07-28 11:04:00,724 INFO MainThread:3039532 [wandb_init.py:init():855] wandb.init called with sweep_config: {}
8
+ config: {'_wandb': {}}
9
+ 2026-07-28 11:04:00,724 INFO MainThread:3039532 [wandb_init.py:init():898] starting backend
10
+ 2026-07-28 11:04:01,404 INFO MainThread:3039532 [wandb_init.py:init():913] sending inform_init request
11
+ 2026-07-28 11:04:01,785 INFO MainThread:3039532 [wandb_init.py:init():918] backend started and connected
12
+ 2026-07-28 11:04:01,789 INFO MainThread:3039532 [wandb_init.py:init():988] updated telemetry
13
+ 2026-07-28 11:04:01,819 INFO MainThread:3039532 [wandb_init.py:init():1011] communicating run to backend with 90.0 second timeout
14
+ 2026-07-28 11:04:02,666 INFO MainThread:3039532 [wandb_init.py:init():1056] starting run threads in backend
15
+ 2026-07-28 11:04:03,055 INFO MainThread:3039532 [wandb_run.py:_console_start():2554] atexit reg
16
+ 2026-07-28 11:04:03,055 INFO MainThread:3039532 [wandb_run.py:_redirect():2403] redirect: wrap_raw
17
+ 2026-07-28 11:04:03,055 INFO MainThread:3039532 [wandb_run.py:_redirect():2472] Wrapping output streams.
18
+ 2026-07-28 11:04:03,055 INFO MainThread:3039532 [wandb_run.py:_redirect():2495] Redirects installed.
19
+ 2026-07-28 11:04:03,065 INFO MainThread:3039532 [wandb_init.py:init():1094] run started, returning control to user process
20
+ 2026-07-28 14:26:49,652 INFO MainThread:3039532 [wandb_run.py:_finish():2321] finishing run zihanwang-ai-northwestern-university/starVLA_rl_games/3oofo2bj
21
+ 2026-07-28 14:26:49,653 INFO MainThread:3039532 [wandb_run.py:_atexit_cleanup():2520] got exitcode: 0
22
+ 2026-07-28 14:26:49,654 INFO MainThread:3039532 [wandb_run.py:_restore():2502] restore
23
+ 2026-07-28 14:26:49,654 INFO MainThread:3039532 [wandb_run.py:_restore():2508] restore done
24
+ 2026-07-28 14:27:01,069 INFO MainThread:3039532 [wandb_run.py:_footer_sync_info():3889] logging synced files
deadly_corridor_fix_latency_6_1000ep_7k2steps_stitch/wandb/wandb/run-20260728_110400-3oofo2bj/run-3oofo2bj.wandb ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6844a8b12b9a44bb113d03022176c5057d48f4032dfa3e9174e33141d9f2e66c
3
+ size 8879123