Caesarrr commited on
Commit
c99cff1
·
verified ·
1 Parent(s): 4d5e2a5

Upload folder using huggingface_hub

Browse files
This view is limited to 50 files because it contains too many changes.   See raw diff
Files changed (50) hide show
  1. .gitattributes +1 -0
  2. flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt +3 -0
  3. flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/steps_4000_model.safetensors +3 -0
  4. flappy_fix_latency_2_200ep_7k2steps_plain_multi/config.full.yaml +249 -0
  5. flappy_fix_latency_2_200ep_7k2steps_plain_multi/config.yaml +102 -0
  6. flappy_fix_latency_2_200ep_7k2steps_plain_multi/dataset_statistics.json +127 -0
  7. flappy_fix_latency_2_200ep_7k2steps_plain_multi/dataset_statistics_eval.json +127 -0
  8. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1000.json +120 -0
  9. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1250.json +120 -0
  10. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1500.json +120 -0
  11. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1750.json +120 -0
  12. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2000.json +120 -0
  13. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2250.json +120 -0
  14. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_250.json +120 -0
  15. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2500.json +120 -0
  16. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2750.json +120 -0
  17. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3000.json +120 -0
  18. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3250.json +120 -0
  19. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3500.json +120 -0
  20. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3750.json +120 -0
  21. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_4000.json +120 -0
  22. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_500.json +120 -0
  23. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_750.json +120 -0
  24. flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/post_train/step_4000.json +240 -0
  25. flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/config.yaml +247 -0
  26. flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/hydra.yaml +368 -0
  27. flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/overrides.yaml +208 -0
  28. flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/train_starvla_hydra.log +0 -0
  29. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json +1 -0
  30. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json +1 -0
  31. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl +10 -0
  32. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json +1 -0
  33. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json +1 -0
  34. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl +10 -0
  35. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json +1 -0
  36. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json +1 -0
  37. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl +10 -0
  38. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json +1 -0
  39. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json +1 -0
  40. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl +10 -0
  41. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json +1 -0
  42. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json +1 -0
  43. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl +10 -0
  44. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json +1 -0
  45. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json +1 -0
  46. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl +10 -0
  47. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/_progress/rank_0.json +1 -0
  48. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/_progress/rank_1.json +1 -0
  49. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl +10 -0
  50. flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json +1 -0
.gitattributes CHANGED
@@ -35,3 +35,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
  flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
37
  flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
 
 
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
  flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
37
  flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
38
+ flappy_fix_latency_2_200ep_7k2steps_plain_multi/wandb/wandb/run-20260629_115519-lyl43qp2/run-lyl43qp2.wandb filter=lfs diff=lfs merge=lfs -text
flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:371cb744227687bb99bcad7f9ff2250cf06da75631359ad3eba4c6bc52570607
3
+ size 9785060316
flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/steps_4000_model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:639393e062693dbb9e2bd801367353cd11256a4e8a7419e02186d360b5b249b2
3
+ size 9784896838
flappy_fix_latency_2_200ep_7k2steps_plain_multi/config.full.yaml ADDED
@@ -0,0 +1,249 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ framework:
2
+ name: QwenOFT
3
+ qwenvl:
4
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
5
+ attn_implementation: flash_attention_2
6
+ flex_backend: triton
7
+ enable_gradient_checkpointing: true
8
+ action_model:
9
+ action_model_type: MLP
10
+ action_dim: 7
11
+ action_hidden_dim: 2560
12
+ future_action_window_size: 0
13
+ past_action_window_size: 0
14
+ loss_type: discrete_ce
15
+ state_dim: 7
16
+ action_horizon: 1
17
+ action_env_dim: 2
18
+ kv_memory:
19
+ enabled: false
20
+ window: 4
21
+ rollout_len: 8
22
+ packed_train: false
23
+ rebased_sink: true
24
+ datasets:
25
+ vla_data:
26
+ dataset_py: lerobot_datasets
27
+ include_state: true
28
+ data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
29
+ data_mix: flappy_train__bridge
30
+ eval_data_mix: flappy_train__bridge__val
31
+ custom_mixtures_path: null
32
+ action_type: discrete
33
+ sequential_step_sampling: false
34
+ eval_sequential_step_sampling: null
35
+ num_workers: 8
36
+ eval_num_workers: 8
37
+ prefetch_factor: 4
38
+ persistent_workers: true
39
+ pin_memory: true
40
+ shuffle: true
41
+ action_balance:
42
+ enabled: false
43
+ strategy: balanced_epoch
44
+ action_key: action_id
45
+ target_flap_fraction: 0.3
46
+ noop_id: 0
47
+ flap_id: 1
48
+ latency_curriculum:
49
+ enabled: false
50
+ strategy: exclusive
51
+ latencies: null
52
+ phase_steps: null
53
+ phase_distributions: null
54
+ new_latency_passes: 1.0
55
+ replay_passes: 0.25
56
+ target_total_passes: 2.0
57
+ final_equalization: true
58
+ step_budget_mode: auto
59
+ eval_at_phase_end: false
60
+ save_at_phase_end: false
61
+ computed_plan: null
62
+ per_device_batch_size: 16
63
+ load_all_data_for_training: true
64
+ num_obs_frames: 4
65
+ image_mode: multiframe
66
+ prompt_mode: raw
67
+ stitch_grid:
68
+ - 2
69
+ - 2
70
+ obs_image_size: null
71
+ video_backend: torchvision_av
72
+ dataset:
73
+ source_hf: ''
74
+ config_name: null
75
+ source_subdir: null
76
+ converted_name: flappy_train
77
+ single_source_hf: ''
78
+ mixed_source_hf: ''
79
+ single_converted_name: flappy_train
80
+ mixed_converted_name: flappy_mixed_latency_train
81
+ single_latency_filter: null
82
+ mixed_latency_filter: null
83
+ force_download: false
84
+ setup_force: false
85
+ skip_verification: false
86
+ verify_rows: 200
87
+ max_episodes: null
88
+ episodes_per_latency: null
89
+ latency_filter: null
90
+ debug_subset:
91
+ enabled: false
92
+ max_episodes: 5
93
+ suffix: debug
94
+ base_model:
95
+ repo_id: Qwen/Qwen3-VL-4B-Instruct
96
+ initialization:
97
+ checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
98
+ checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
99
+ checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
100
+ trainer:
101
+ max_train_steps: 4000
102
+ num_warmup_steps: 100
103
+ save_interval: 500
104
+ eval_interval: 250
105
+ eval_num_batches: 50
106
+ per_latency_eval_num_batches: null
107
+ eval_action_classification: false
108
+ eval_action_classification_interval: null
109
+ cc_f1_tolerance: 1
110
+ learning_rate:
111
+ base: 2.0e-05
112
+ qwen_vl_interface: 1.0e-05
113
+ action_model: 0.0001
114
+ lr_scheduler_type: cosine_with_min_lr
115
+ scheduler_specific_kwargs:
116
+ min_lr: 1.0e-06
117
+ freeze_modules: ''
118
+ freeze_vit: false
119
+ freeze_tied_embedding: false
120
+ freeze_llm_layers: []
121
+ loss_scale:
122
+ vla: 1.0
123
+ vlm: 0.1
124
+ max_grad_norm: 1.0
125
+ weight_decay: 0.0
126
+ logging_frequency: 1
127
+ profile_timing:
128
+ enabled: false
129
+ log_interval: 10
130
+ gradient_clipping: 1.0
131
+ gradient_accumulation_steps: 4
132
+ distributed_backend: deepspeed
133
+ is_resume: false
134
+ pretrained_checkpoint: null
135
+ resume_step: 0
136
+ reload_modules: null
137
+ optimizer:
138
+ name: AdamW
139
+ betas:
140
+ - 0.9
141
+ - 0.95
142
+ eps: 1.0e-08
143
+ weight_decay: 1.0e-08
144
+ fused: true
145
+ save_format: pt
146
+ workspace_dir: WORKSPACE_DIR
147
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
148
+ seed: 42
149
+ wandb_entity: saberrr-zju
150
+ wandb_project: starVLA_rl_games
151
+ auth:
152
+ env_file: null
153
+ hf_token_env: HF_TOKEN
154
+ wandb_api_key_env: WANDB_API_KEY
155
+ paths:
156
+ run_root_dir: results/Checkpoints
157
+ dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
158
+ dataset_cache_dir: null
159
+ base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
160
+ accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
161
+ launch:
162
+ use_accelerate: true
163
+ gpus: null
164
+ num_processes: 1
165
+ dry_run: false
166
+ conda:
167
+ enabled: true
168
+ env_name: null
169
+ rl_games:
170
+ model_alias: openvla
171
+ env_eval:
172
+ image_size: 224
173
+ frameskip: 1
174
+ image_transform: raw_rgb
175
+ prompt_mode: raw
176
+ ghost_trail:
177
+ history_frames: 5
178
+ gamma: 1.3
179
+ min_alpha: 35
180
+ scroll_px_per_step: 4.0
181
+ ground_fraction: 0.22
182
+ seed: 42
183
+ fixed_episode_seeds: true
184
+ latency_seed_stride: 0
185
+ task_seed_stride: 0
186
+ task_description: ''
187
+ eval_parallel_envs: 5
188
+ enabled: true
189
+ eval_backend: latency_bench
190
+ distributed_mode: rank_sharded
191
+ vectorized:
192
+ enabled: false
193
+ batch_size: 1
194
+ latency:
195
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
196
+ mode: single
197
+ values:
198
+ - 0
199
+ mid_train:
200
+ enabled: true
201
+ interval_steps: 250
202
+ latencies:
203
+ - 2
204
+ num_episodes: 20
205
+ max_steps_per_episode: 3600
206
+ post_train:
207
+ enabled: true
208
+ latencies:
209
+ - 2
210
+ num_episodes: 50
211
+ max_steps_per_episode: 3600
212
+ task: flappy
213
+ initialization_mode: bridge
214
+ action_carrier: bridge
215
+ model: openvla
216
+ env: flappy
217
+ init: bridge
218
+ bridge_base_model:
219
+ repo_id:
220
+ openvla: Qwen/Qwen3-VL-4B-Instruct
221
+ pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
222
+ pi05: Qwen/Qwen3-VL-4B-Instruct
223
+ gr00t: Qwen/Qwen3-VL-4B-Instruct
224
+ local_dir:
225
+ openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
226
+ pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
227
+ pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
228
+ gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
229
+ mode: single
230
+ checkpoint:
231
+ load: none
232
+ hf_repo_id: null
233
+ save_best_model: false
234
+ save_final_model: true
235
+ save_pt_file: false
236
+ save_safetensors_file: true
237
+ local:
238
+ keep_last_n: 1
239
+ sync:
240
+ enabled: false
241
+ repo_id: null
242
+ keep_last_n: 0
243
+ sync_every_n_checkpoints: 1
244
+ resume_policy: local_latest
245
+ run_id: flappy_fix_latency_2_200ep_7k2steps_plain_multi
246
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi
247
+ config_yaml: null
248
+ is_debug: false
249
+ version_id: '0.21'
flappy_fix_latency_2_200ep_7k2steps_plain_multi/config.yaml ADDED
@@ -0,0 +1,102 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ checkpoint:
2
+ local:
3
+ keep_last_n: 1
4
+ save_best_model: false
5
+ save_final_model: true
6
+ save_pt_file: false
7
+ save_safetensors_file: true
8
+ sync:
9
+ enabled: false
10
+ keep_last_n: 0
11
+ repo_id: null
12
+ datasets:
13
+ vla_data:
14
+ data_mix: flappy_train__bridge
15
+ dataset_py: lerobot_datasets
16
+ eval_data_mix: flappy_train__bridge__val
17
+ latency_curriculum:
18
+ enabled: false
19
+ obs_image_size: null
20
+ per_device_batch_size: 16
21
+ framework:
22
+ action_model:
23
+ action_dim: 7
24
+ action_env_dim: 2
25
+ action_hidden_dim: 2560
26
+ action_horizon: 1
27
+ action_model_type: MLP
28
+ loss_type: discrete_ce
29
+ kv_memory:
30
+ enabled: false
31
+ packed_train: false
32
+ rebased_sink: true
33
+ rollout_len: 8
34
+ window: 4
35
+ name: QwenOFT
36
+ qwenvl:
37
+ attn_implementation: flash_attention_2
38
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
39
+ enable_gradient_checkpointing: true
40
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi
41
+ rl_games:
42
+ env_eval:
43
+ distributed_mode: rank_sharded
44
+ enabled: true
45
+ eval_backend: latency_bench
46
+ eval_parallel_envs: 5
47
+ fixed_episode_seeds: true
48
+ image_size: 224
49
+ image_transform: raw_rgb
50
+ latency:
51
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
52
+ mid_train:
53
+ enabled: true
54
+ interval_steps: 250
55
+ latencies:
56
+ - 2
57
+ max_steps_per_episode: 3600
58
+ num_episodes: 20
59
+ prompt_mode: raw
60
+ seed: 42
61
+ model_alias: openvla
62
+ task: flappy
63
+ run_id: flappy_fix_latency_2_200ep_7k2steps_plain_multi
64
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
65
+ seed: 42
66
+ trainer:
67
+ distributed_backend: deepspeed
68
+ eval_action_classification: false
69
+ eval_action_classification_interval: null
70
+ eval_interval: 250
71
+ eval_num_batches: 50
72
+ freeze_llm_layers: []
73
+ freeze_modules: ''
74
+ freeze_tied_embedding: false
75
+ freeze_vit: false
76
+ gradient_accumulation_steps: 4
77
+ is_resume: false
78
+ learning_rate:
79
+ action_model: 0.0001
80
+ base: 2.0e-05
81
+ qwen_vl_interface: 1.0e-05
82
+ logging_frequency: 1
83
+ lr_scheduler_type: cosine_with_min_lr
84
+ max_train_steps: 4000
85
+ num_warmup_steps: 100
86
+ optimizer:
87
+ betas:
88
+ - 0.9
89
+ - 0.95
90
+ eps: 1.0e-08
91
+ fused: true
92
+ weight_decay: 1.0e-08
93
+ per_latency_eval_num_batches: null
94
+ pretrained_checkpoint: null
95
+ profile_timing:
96
+ enabled: false
97
+ reload_modules: null
98
+ save_interval: 500
99
+ scheduler_specific_kwargs:
100
+ min_lr: 1.0e-06
101
+ wandb_entity: saberrr-zju
102
+ wandb_project: starVLA_rl_games
flappy_fix_latency_2_200ep_7k2steps_plain_multi/dataset_statistics.json ADDED
@@ -0,0 +1,127 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "new_embodiment": {
3
+ "action": {
4
+ "mean": [
5
+ 0.8029062747955322,
6
+ 0.19709371030330658,
7
+ 0.0,
8
+ 0.0,
9
+ 0.0,
10
+ 0.0,
11
+ 0.0
12
+ ],
13
+ "std": [
14
+ 0.395094633102417,
15
+ 0.395094633102417,
16
+ 0.0,
17
+ 0.0,
18
+ 0.0,
19
+ 0.0,
20
+ 0.0
21
+ ],
22
+ "max": [
23
+ 1.0,
24
+ 1.0,
25
+ 0.0,
26
+ 0.0,
27
+ 0.0,
28
+ 0.0,
29
+ 0.0
30
+ ],
31
+ "min": [
32
+ 0.0,
33
+ 0.0,
34
+ 0.0,
35
+ 0.0,
36
+ 0.0,
37
+ 0.0,
38
+ 0.0
39
+ ],
40
+ "q01": [
41
+ 0.0,
42
+ 0.0,
43
+ 0.0,
44
+ 0.0,
45
+ 0.0,
46
+ 0.0,
47
+ 0.0
48
+ ],
49
+ "q99": [
50
+ 1.0,
51
+ 1.0,
52
+ 0.0,
53
+ 0.0,
54
+ 0.0,
55
+ 0.0,
56
+ 0.0
57
+ ],
58
+ "mask": [
59
+ true,
60
+ true,
61
+ true,
62
+ true,
63
+ true,
64
+ true,
65
+ true
66
+ ]
67
+ },
68
+ "state": {
69
+ "mean": [
70
+ 0.0,
71
+ 0.0,
72
+ 0.0,
73
+ 0.0,
74
+ 0.0,
75
+ 0.0,
76
+ 0.0
77
+ ],
78
+ "std": [
79
+ 0.0,
80
+ 0.0,
81
+ 0.0,
82
+ 0.0,
83
+ 0.0,
84
+ 0.0,
85
+ 0.0
86
+ ],
87
+ "max": [
88
+ 0.0,
89
+ 0.0,
90
+ 0.0,
91
+ 0.0,
92
+ 0.0,
93
+ 0.0,
94
+ 0.0
95
+ ],
96
+ "min": [
97
+ 0.0,
98
+ 0.0,
99
+ 0.0,
100
+ 0.0,
101
+ 0.0,
102
+ 0.0,
103
+ 0.0
104
+ ],
105
+ "q01": [
106
+ 0.0,
107
+ 0.0,
108
+ 0.0,
109
+ 0.0,
110
+ 0.0,
111
+ 0.0,
112
+ 0.0
113
+ ],
114
+ "q99": [
115
+ 0.0,
116
+ 0.0,
117
+ 0.0,
118
+ 0.0,
119
+ 0.0,
120
+ 0.0,
121
+ 0.0
122
+ ]
123
+ },
124
+ "num_transitions": 1291269,
125
+ "num_trajectories": 180
126
+ }
127
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/dataset_statistics_eval.json ADDED
@@ -0,0 +1,127 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "new_embodiment": {
3
+ "action": {
4
+ "mean": [
5
+ 0.8033548593521118,
6
+ 0.19664514064788818,
7
+ 0.0,
8
+ 0.0,
9
+ 0.0,
10
+ 0.0,
11
+ 0.0
12
+ ],
13
+ "std": [
14
+ 0.39764848351478577,
15
+ 0.39764848351478577,
16
+ 0.0,
17
+ 0.0,
18
+ 0.0,
19
+ 0.0,
20
+ 0.0
21
+ ],
22
+ "max": [
23
+ 1.0,
24
+ 1.0,
25
+ 0.0,
26
+ 0.0,
27
+ 0.0,
28
+ 0.0,
29
+ 0.0
30
+ ],
31
+ "min": [
32
+ 0.0,
33
+ 0.0,
34
+ 0.0,
35
+ 0.0,
36
+ 0.0,
37
+ 0.0,
38
+ 0.0
39
+ ],
40
+ "q01": [
41
+ 0.0,
42
+ 0.0,
43
+ 0.0,
44
+ 0.0,
45
+ 0.0,
46
+ 0.0,
47
+ 0.0
48
+ ],
49
+ "q99": [
50
+ 1.0,
51
+ 1.0,
52
+ 0.0,
53
+ 0.0,
54
+ 0.0,
55
+ 0.0,
56
+ 0.0
57
+ ],
58
+ "mask": [
59
+ true,
60
+ true,
61
+ true,
62
+ true,
63
+ true,
64
+ true,
65
+ true
66
+ ]
67
+ },
68
+ "state": {
69
+ "mean": [
70
+ 0.0,
71
+ 0.0,
72
+ 0.0,
73
+ 0.0,
74
+ 0.0,
75
+ 0.0,
76
+ 0.0
77
+ ],
78
+ "std": [
79
+ 0.0,
80
+ 0.0,
81
+ 0.0,
82
+ 0.0,
83
+ 0.0,
84
+ 0.0,
85
+ 0.0
86
+ ],
87
+ "max": [
88
+ 0.0,
89
+ 0.0,
90
+ 0.0,
91
+ 0.0,
92
+ 0.0,
93
+ 0.0,
94
+ 0.0
95
+ ],
96
+ "min": [
97
+ 0.0,
98
+ 0.0,
99
+ 0.0,
100
+ 0.0,
101
+ 0.0,
102
+ 0.0,
103
+ 0.0
104
+ ],
105
+ "q01": [
106
+ 0.0,
107
+ 0.0,
108
+ 0.0,
109
+ 0.0,
110
+ 0.0,
111
+ 0.0,
112
+ 0.0
113
+ ],
114
+ "q99": [
115
+ 0.0,
116
+ 0.0,
117
+ 0.0,
118
+ 0.0,
119
+ 0.0,
120
+ 0.0,
121
+ 0.0
122
+ ]
123
+ },
124
+ "num_transitions": 143553,
125
+ "num_trajectories": 20
126
+ }
127
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 29.395000371709465,
7
+ "mean_length": 255.9,
8
+ "std_reward": 69.04561960432308,
9
+ "std_length": 556.9244024102372,
10
+ "episode_rewards": [
11
+ 5.000000089406967,
12
+ 6.200000092387199,
13
+ 6.100000090897083,
14
+ 3.90000007301569,
15
+ 6.200000092387199,
16
+ 5.000000089406967,
17
+ 5.000000089406967,
18
+ 5.000000089406967,
19
+ 169.50000200420618,
20
+ 5.000000089406967,
21
+ 3.90000007301569,
22
+ 48.50000058859587,
23
+ 5.000000089406967,
24
+ 3.90000007301569,
25
+ 5.000000089406967,
26
+ 5.000000089406967,
27
+ 4.900000087916851,
28
+ 284.8000033646822,
29
+ 5.000000089406967,
30
+ 5.000000089406967
31
+ ],
32
+ "episode_lengths": [
33
+ 61,
34
+ 64,
35
+ 63,
36
+ 50,
37
+ 64,
38
+ 61,
39
+ 61,
40
+ 61,
41
+ 1382,
42
+ 61,
43
+ 50,
44
+ 406,
45
+ 61,
46
+ 50,
47
+ 61,
48
+ 61,
49
+ 60,
50
+ 2319,
51
+ 61,
52
+ 61
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 29.395000371709465,
112
+ "mean_length": 255.9,
113
+ "std_reward": 69.04561960432308,
114
+ "std_length": 556.9244024102372,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 29.395000371709465,
117
+ "macro_mean_length": 255.9,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 253.63500299341976,
7
+ "mean_length": 2063.0,
8
+ "std_reward": 160.78951731733707,
9
+ "std_length": 1294.759552967268,
10
+ "episode_rewards": [
11
+ 118.70000141113997,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 102.90000123530626,
16
+ 244.6000028848648,
17
+ 444.6000052243471,
18
+ 47.00000058114529,
19
+ 426.60000501573086,
20
+ 149.20000177621841,
21
+ 444.6000052243471,
22
+ 107.30000128597021,
23
+ 218.40000258386135,
24
+ 76.50000091642141,
25
+ 444.6000052243471,
26
+ 32.80000041425228,
27
+ 23.200000301003456,
28
+ 228.700002707541,
29
+ 384.5000045225024,
30
+ 244.70000288635492
31
+ ],
32
+ "episode_lengths": [
33
+ 973,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 851,
38
+ 1989,
39
+ 3600,
40
+ 400,
41
+ 3458,
42
+ 1224,
43
+ 3600,
44
+ 886,
45
+ 1781,
46
+ 632,
47
+ 3600,
48
+ 285,
49
+ 207,
50
+ 1866,
51
+ 3118,
52
+ 1990
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 253.63500299341976,
112
+ "mean_length": 2063.0,
113
+ "std_reward": 160.78951731733707,
114
+ "std_length": 1294.759552967268,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 253.63500299341976,
117
+ "macro_mean_length": 2063.0,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 349.4700041130185,
7
+ "mean_length": 2834.35,
8
+ "std_reward": 147.5672443637608,
9
+ "std_length": 1188.609829801184,
10
+ "episode_rewards": [
11
+ 134.4000016003847,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 325.9000038430095,
16
+ 444.6000052243471,
17
+ 208.90000247210264,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 13.000000178813934,
21
+ 353.900004170835,
22
+ 90.6000010818243,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 82.90000099688768,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 1103,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 2649,
38
+ 3600,
39
+ 1704,
40
+ 3600,
41
+ 3600,
42
+ 123,
43
+ 2875,
44
+ 746,
45
+ 3600,
46
+ 3600,
47
+ 687,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 349.4700041130185,
112
+ "mean_length": 2834.35,
113
+ "std_reward": 147.5672443637608,
114
+ "std_length": 1188.609829801184,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 349.4700041130185,
117
+ "macro_mean_length": 2834.35,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 256.01500301845374,
7
+ "mean_length": 2080.5,
8
+ "std_reward": 161.3821578877714,
9
+ "std_length": 1301.248304513785,
10
+ "episode_rewards": [
11
+ 379.5000044628978,
12
+ 113.50000134855509,
13
+ 132.60000157356262,
14
+ 76.80000092089176,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 62.80000075697899,
18
+ 47.00000058114529,
19
+ 151.00000178813934,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 109.00000129640102,
23
+ 90.6000010818243,
24
+ 387.3000045642257,
25
+ 361.00000424683094,
26
+ 309.5000036433339,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 34.60000042617321,
30
+ 197.50000233203173
31
+ ],
32
+ "episode_lengths": [
33
+ 3077,
34
+ 930,
35
+ 1085,
36
+ 635,
37
+ 3600,
38
+ 3600,
39
+ 522,
40
+ 400,
41
+ 1233,
42
+ 3600,
43
+ 3600,
44
+ 894,
45
+ 746,
46
+ 3146,
47
+ 2928,
48
+ 2512,
49
+ 3600,
50
+ 3600,
51
+ 294,
52
+ 1608
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 1750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 256.01500301845374,
112
+ "mean_length": 2080.5,
113
+ "std_reward": 161.3821578877714,
114
+ "std_length": 1301.248304513785,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 256.01500301845374,
117
+ "macro_mean_length": 2080.5,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 411.61500483863057,
7
+ "mean_length": 3334.25,
8
+ "std_reward": 101.14185342523868,
9
+ "std_length": 815.0359424589814,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 48.60000059008598,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 180.9000021442771
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 407,
41
+ 3600,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 1478
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 411.61500483863057,
112
+ "mean_length": 3334.25,
113
+ "std_reward": 101.14185342523868,
114
+ "std_length": 815.0359424589814,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 411.61500483863057,
117
+ "macro_mean_length": 3334.25,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 444.6000052243471,
7
+ "mean_length": 3600.0,
8
+ "std_reward": 0.0,
9
+ "std_length": 0.0,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 444.6000052243471,
112
+ "mean_length": 3600.0,
113
+ "std_reward": 0.0,
114
+ "std_length": 0.0,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 444.6000052243471,
117
+ "macro_mean_length": 3600.0,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 6.000000090152025,
7
+ "mean_length": 62.45,
8
+ "std_reward": 0.2792848018357637,
9
+ "std_length": 0.9205976319760986,
10
+ "episode_rewards": [
11
+ 6.100000090897083,
12
+ 6.000000089406967,
13
+ 4.800000086426735,
14
+ 6.100000090897083,
15
+ 6.000000089406967,
16
+ 6.100000090897083,
17
+ 6.100000090897083,
18
+ 6.100000090897083,
19
+ 6.000000089406967,
20
+ 6.100000090897083,
21
+ 6.100000090897083,
22
+ 6.000000089406967,
23
+ 6.100000090897083,
24
+ 6.100000090897083,
25
+ 6.100000090897083,
26
+ 6.100000090897083,
27
+ 6.000000089406967,
28
+ 6.000000089406967,
29
+ 6.000000089406967,
30
+ 6.100000090897083
31
+ ],
32
+ "episode_lengths": [
33
+ 63,
34
+ 62,
35
+ 59,
36
+ 63,
37
+ 62,
38
+ 63,
39
+ 63,
40
+ 63,
41
+ 62,
42
+ 63,
43
+ 63,
44
+ 62,
45
+ 63,
46
+ 63,
47
+ 63,
48
+ 63,
49
+ 62,
50
+ 62,
51
+ 62,
52
+ 63
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 6.000000090152025,
112
+ "mean_length": 62.45,
113
+ "std_reward": 0.2792848018357637,
114
+ "std_length": 0.9205976319760986,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 6.000000090152025,
117
+ "macro_mean_length": 62.45,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 354.9100041769445,
7
+ "mean_length": 2878.4,
8
+ "std_reward": 139.38672588911118,
9
+ "std_length": 1122.3577148128843,
10
+ "episode_rewards": [
11
+ 228.60000270605087,
12
+ 444.6000052243471,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 46.60000057518482,
18
+ 353.900004170835,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 344.4000040590763,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 121.30000144988298,
28
+ 444.6000052243471,
29
+ 104.80000124871731,
30
+ 118.80000141263008
31
+ ],
32
+ "episode_lengths": [
33
+ 1865,
34
+ 3600,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 396,
40
+ 2875,
41
+ 3600,
42
+ 3600,
43
+ 2798,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 999,
50
+ 3600,
51
+ 861,
52
+ 974
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 354.9100041769445,
112
+ "mean_length": 2878.4,
113
+ "std_reward": 139.38672588911118,
114
+ "std_length": 1122.3577148128843,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 354.9100041769445,
117
+ "macro_mean_length": 2878.4,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 426.8100050166249,
7
+ "mean_length": 3457.05,
8
+ "std_reward": 70.95351307600934,
9
+ "std_length": 572.0222438856725,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 118.50000140815973,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 440.60000517964363,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 418.90000493079424,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 971,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3571,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3399,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 2750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 426.8100050166249,
112
+ "mean_length": 3457.05,
113
+ "std_reward": 70.95351307600934,
114
+ "std_length": 572.0222438856725,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 426.8100050166249,
117
+ "macro_mean_length": 3457.05,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 422.8200049698353,
7
+ "mean_length": 3424.7,
8
+ "std_reward": 73.7419604241364,
9
+ "std_length": 594.1030297852384,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 118.70000141113997,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 334.9000039473176,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 973,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 2721,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 422.8200049698353,
112
+ "mean_length": 3424.7,
113
+ "std_reward": 73.7419604241364,
114
+ "std_length": 594.1030297852384,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 422.8200049698353,
117
+ "macro_mean_length": 3424.7,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3250.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 417.7050049100071,
7
+ "mean_length": 3383.45,
8
+ "std_reward": 96.75278649231183,
9
+ "std_length": 779.8917537068845,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 444.6000052243471,
13
+ 6.800000101327896,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 344.5000040605664,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 3600,
35
+ 70,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 2799,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3250,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 417.7050049100071,
112
+ "mean_length": 3383.45,
113
+ "std_reward": 96.75278649231183,
114
+ "std_length": 779.8917537068845,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 417.7050049100071,
117
+ "macro_mean_length": 3383.45,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 412.7750048529357,
7
+ "mean_length": 3344.25,
8
+ "std_reward": 80.25203440101174,
9
+ "std_length": 645.9581159022619,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 120.50000143796206,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 334.9000039473176,
22
+ 267.6000031530857,
23
+ 418.90000493079424,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 991,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 2721,
44
+ 2174,
45
+ 3399,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 412.7750048529357,
112
+ "mean_length": 3344.25,
113
+ "std_reward": 80.25203440101174,
114
+ "std_length": 645.9581159022619,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 412.7750048529357,
117
+ "macro_mean_length": 3344.25,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 414.9000048771501,
7
+ "mean_length": 3360.8,
8
+ "std_reward": 89.51117911923446,
9
+ "std_length": 720.8735395338076,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 120.50000143796206,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 174.70000206679106,
20
+ 444.6000052243471,
21
+ 444.6000052243471,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 444.6000052243471,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 991,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 1425,
42
+ 3600,
43
+ 3600,
44
+ 3600,
45
+ 3600,
46
+ 3600,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 3750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 414.9000048771501,
112
+ "mean_length": 3360.8,
113
+ "std_reward": 89.51117911923446,
114
+ "std_length": 720.8735395338076,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 414.9000048771501,
117
+ "macro_mean_length": 3360.8,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_4000.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 408.3500048011541,
7
+ "mean_length": 3308.45,
8
+ "std_reward": 93.69927803918887,
9
+ "std_length": 753.9609721331734,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 120.50000143796206,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 334.9000039473176,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 153.40000182390213,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471
31
+ ],
32
+ "episode_lengths": [
33
+ 3600,
34
+ 991,
35
+ 3600,
36
+ 3600,
37
+ 3600,
38
+ 3600,
39
+ 3600,
40
+ 3600,
41
+ 3600,
42
+ 3600,
43
+ 2721,
44
+ 3600,
45
+ 3600,
46
+ 1257,
47
+ 3600,
48
+ 3600,
49
+ 3600,
50
+ 3600,
51
+ 3600,
52
+ 3600
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 4000,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 408.3500048011541,
112
+ "mean_length": 3308.45,
113
+ "std_reward": 93.69927803918887,
114
+ "std_length": 753.9609721331734,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 408.3500048011541,
117
+ "macro_mean_length": 3308.45,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_500.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 13.590000185370446,
7
+ "mean_length": 127.55,
8
+ "std_reward": 31.173288608948123,
9
+ "std_length": 251.05725940510064,
10
+ "episode_rewards": [
11
+ 4.800000086426735,
12
+ 32.700000412762165,
13
+ 3.90000007301569,
14
+ 3.90000007301569,
15
+ 146.80000174045563,
16
+ 4.800000086426735,
17
+ 3.90000007301569,
18
+ 4.800000086426735,
19
+ 6.3000000938773155,
20
+ 6.600000098347664,
21
+ 3.90000007301569,
22
+ 6.3000000938773155,
23
+ 3.90000007301569,
24
+ 3.90000007301569,
25
+ 4.500000081956387,
26
+ 4.800000086426735,
27
+ 9.200000137090683,
28
+ 6.3000000938773155,
29
+ 3.90000007301569,
30
+ 6.600000098347664
31
+ ],
32
+ "episode_lengths": [
33
+ 59,
34
+ 284,
35
+ 50,
36
+ 50,
37
+ 1200,
38
+ 59,
39
+ 50,
40
+ 59,
41
+ 65,
42
+ 68,
43
+ 50,
44
+ 65,
45
+ 50,
46
+ 50,
47
+ 56,
48
+ 59,
49
+ 94,
50
+ 65,
51
+ 50,
52
+ 68
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 500,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 13.590000185370446,
112
+ "mean_length": 127.55,
113
+ "std_reward": 31.173288608948123,
114
+ "std_length": 251.05725940510064,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 13.590000185370446,
117
+ "macro_mean_length": 127.55,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_750.json ADDED
@@ -0,0 +1,120 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 20,
6
+ "mean_reward": 38.45000047534704,
7
+ "mean_length": 327.45,
8
+ "std_reward": 105.02031592997427,
9
+ "std_length": 846.6170016601368,
10
+ "episode_rewards": [
11
+ 6.500000096857548,
12
+ 444.6000052243471,
13
+ 4.500000081956387,
14
+ 6.200000092387199,
15
+ 8.400000125169754,
16
+ 6.500000096857548,
17
+ 3.90000007301569,
18
+ 6.500000096857548,
19
+ 5.000000089406967,
20
+ 4.100000075995922,
21
+ 6.200000092387199,
22
+ 4.900000087916851,
23
+ 4.100000075995922,
24
+ 6.200000092387199,
25
+ 4.100000075995922,
26
+ 6.500000096857548,
27
+ 227.90000269562006,
28
+ 4.900000087916851,
29
+ 3.90000007301569,
30
+ 4.100000075995922
31
+ ],
32
+ "episode_lengths": [
33
+ 67,
34
+ 3600,
35
+ 56,
36
+ 64,
37
+ 86,
38
+ 67,
39
+ 50,
40
+ 67,
41
+ 61,
42
+ 52,
43
+ 64,
44
+ 60,
45
+ 52,
46
+ 64,
47
+ 52,
48
+ 67,
49
+ 1858,
50
+ 60,
51
+ 50,
52
+ 52
53
+ ],
54
+ "decoded_action_hist": {},
55
+ "fixed_episode_seeds": true,
56
+ "eval_seed": 42,
57
+ "episode_seeds": [
58
+ null,
59
+ null,
60
+ null,
61
+ null,
62
+ null,
63
+ null,
64
+ null,
65
+ null,
66
+ null,
67
+ null,
68
+ null,
69
+ null,
70
+ null,
71
+ null,
72
+ null,
73
+ null,
74
+ null,
75
+ null,
76
+ null,
77
+ null
78
+ ],
79
+ "episode_indices": [
80
+ 0,
81
+ 1,
82
+ 2,
83
+ 3,
84
+ 4,
85
+ 5,
86
+ 6,
87
+ 7,
88
+ 8,
89
+ 9,
90
+ 10,
91
+ 11,
92
+ 12,
93
+ 13,
94
+ 14,
95
+ 15,
96
+ 16,
97
+ 17,
98
+ 18,
99
+ 19
100
+ ]
101
+ }
102
+ },
103
+ "aggregate": {
104
+ "stage": "mid_train",
105
+ "step": 750,
106
+ "task": "flappy",
107
+ "model_alias": "openvla",
108
+ "fixed_episode_seeds": true,
109
+ "eval_seed": 42,
110
+ "total_episodes": 20,
111
+ "mean_reward": 38.45000047534704,
112
+ "mean_length": 327.45,
113
+ "std_reward": 105.02031592997427,
114
+ "std_length": 846.6170016601368,
115
+ "task_count": 1,
116
+ "macro_mean_reward": 38.45000047534704,
117
+ "macro_mean_length": 327.45,
118
+ "distributed_eval": true
119
+ }
120
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/post_train/step_4000.json ADDED
@@ -0,0 +1,240 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "per_latency": {
3
+ "flappy/latency_2": {
4
+ "latency": 2,
5
+ "num_episodes": 50,
6
+ "mean_reward": 403.98200474992393,
7
+ "mean_length": 3273.12,
8
+ "std_reward": 109.87717942362134,
9
+ "std_length": 884.5486225188529,
10
+ "episode_rewards": [
11
+ 444.6000052243471,
12
+ 120.50000143796206,
13
+ 444.6000052243471,
14
+ 444.6000052243471,
15
+ 444.6000052243471,
16
+ 444.6000052243471,
17
+ 444.6000052243471,
18
+ 444.6000052243471,
19
+ 444.6000052243471,
20
+ 444.6000052243471,
21
+ 334.9000039473176,
22
+ 444.6000052243471,
23
+ 444.6000052243471,
24
+ 153.40000182390213,
25
+ 444.6000052243471,
26
+ 444.6000052243471,
27
+ 444.6000052243471,
28
+ 444.6000052243471,
29
+ 444.6000052243471,
30
+ 444.6000052243471,
31
+ 444.6000052243471,
32
+ 444.6000052243471,
33
+ 444.6000052243471,
34
+ 444.6000052243471,
35
+ 444.6000052243471,
36
+ 444.6000052243471,
37
+ 444.6000052243471,
38
+ 444.6000052243471,
39
+ 4.700000084936619,
40
+ 444.6000052243471,
41
+ 444.6000052243471,
42
+ 444.6000052243471,
43
+ 444.6000052243471,
44
+ 444.6000052243471,
45
+ 444.6000052243471,
46
+ 444.6000052243471,
47
+ 4.700000084936619,
48
+ 444.6000052243471,
49
+ 444.6000052243471,
50
+ 444.6000052243471,
51
+ 444.6000052243471,
52
+ 174.70000206679106,
53
+ 444.6000052243471,
54
+ 444.6000052243471,
55
+ 444.6000052243471,
56
+ 288.4000034034252,
57
+ 444.6000052243471,
58
+ 444.6000052243471,
59
+ 444.6000052243471,
60
+ 444.6000052243471
61
+ ],
62
+ "episode_lengths": [
63
+ 3600,
64
+ 991,
65
+ 3600,
66
+ 3600,
67
+ 3600,
68
+ 3600,
69
+ 3600,
70
+ 3600,
71
+ 3600,
72
+ 3600,
73
+ 2721,
74
+ 3600,
75
+ 3600,
76
+ 1257,
77
+ 3600,
78
+ 3600,
79
+ 3600,
80
+ 3600,
81
+ 3600,
82
+ 3600,
83
+ 3600,
84
+ 3600,
85
+ 3600,
86
+ 3600,
87
+ 3600,
88
+ 3600,
89
+ 3600,
90
+ 3600,
91
+ 58,
92
+ 3600,
93
+ 3600,
94
+ 3600,
95
+ 3600,
96
+ 3600,
97
+ 3600,
98
+ 3600,
99
+ 58,
100
+ 3600,
101
+ 3600,
102
+ 3600,
103
+ 3600,
104
+ 1425,
105
+ 3600,
106
+ 3600,
107
+ 3600,
108
+ 2346,
109
+ 3600,
110
+ 3600,
111
+ 3600,
112
+ 3600
113
+ ],
114
+ "decoded_action_hist": {},
115
+ "fixed_episode_seeds": true,
116
+ "eval_seed": 42,
117
+ "episode_seeds": [
118
+ null,
119
+ null,
120
+ null,
121
+ null,
122
+ null,
123
+ null,
124
+ null,
125
+ null,
126
+ null,
127
+ null,
128
+ null,
129
+ null,
130
+ null,
131
+ null,
132
+ null,
133
+ null,
134
+ null,
135
+ null,
136
+ null,
137
+ null,
138
+ null,
139
+ null,
140
+ null,
141
+ null,
142
+ null,
143
+ null,
144
+ null,
145
+ null,
146
+ null,
147
+ null,
148
+ null,
149
+ null,
150
+ null,
151
+ null,
152
+ null,
153
+ null,
154
+ null,
155
+ null,
156
+ null,
157
+ null,
158
+ null,
159
+ null,
160
+ null,
161
+ null,
162
+ null,
163
+ null,
164
+ null,
165
+ null,
166
+ null,
167
+ null
168
+ ],
169
+ "episode_indices": [
170
+ 0,
171
+ 1,
172
+ 2,
173
+ 3,
174
+ 4,
175
+ 5,
176
+ 6,
177
+ 7,
178
+ 8,
179
+ 9,
180
+ 10,
181
+ 11,
182
+ 12,
183
+ 13,
184
+ 14,
185
+ 15,
186
+ 16,
187
+ 17,
188
+ 18,
189
+ 19,
190
+ 20,
191
+ 21,
192
+ 22,
193
+ 23,
194
+ 24,
195
+ 25,
196
+ 26,
197
+ 27,
198
+ 28,
199
+ 29,
200
+ 30,
201
+ 31,
202
+ 32,
203
+ 33,
204
+ 34,
205
+ 35,
206
+ 36,
207
+ 37,
208
+ 38,
209
+ 39,
210
+ 40,
211
+ 41,
212
+ 42,
213
+ 43,
214
+ 44,
215
+ 45,
216
+ 46,
217
+ 47,
218
+ 48,
219
+ 49
220
+ ]
221
+ }
222
+ },
223
+ "aggregate": {
224
+ "stage": "post_train",
225
+ "step": 4000,
226
+ "task": "flappy",
227
+ "model_alias": "openvla",
228
+ "fixed_episode_seeds": true,
229
+ "eval_seed": 42,
230
+ "total_episodes": 50,
231
+ "mean_reward": 403.98200474992393,
232
+ "mean_length": 3273.12,
233
+ "std_reward": 109.87717942362134,
234
+ "std_length": 884.5486225188529,
235
+ "task_count": 1,
236
+ "macro_mean_reward": 403.98200474992393,
237
+ "macro_mean_length": 3273.12,
238
+ "distributed_eval": true
239
+ }
240
+ }
flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/config.yaml ADDED
@@ -0,0 +1,247 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ framework:
2
+ qwenvl:
3
+ base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
4
+ attn_implementation: flash_attention_2
5
+ flex_backend: triton
6
+ enable_gradient_checkpointing: true
7
+ action_model:
8
+ state_dim: 7
9
+ loss_type: discrete_ce
10
+ action_horizon: 1
11
+ future_action_window_size: 0
12
+ past_action_window_size: 0
13
+ action_dim: 7
14
+ action_env_dim: 2
15
+ kv_memory:
16
+ enabled: false
17
+ window: 4
18
+ rollout_len: 8
19
+ packed_train: false
20
+ rebased_sink: true
21
+ name: QwenOFT
22
+ datasets:
23
+ vla_data:
24
+ dataset_py: lerobot_datasets
25
+ include_state: true
26
+ data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
27
+ data_mix: flappy_train__bridge
28
+ eval_data_mix: flappy_train__bridge__val
29
+ custom_mixtures_path: null
30
+ action_type: discrete
31
+ sequential_step_sampling: false
32
+ eval_sequential_step_sampling: null
33
+ num_workers: 8
34
+ eval_num_workers: 8
35
+ prefetch_factor: 4
36
+ persistent_workers: true
37
+ pin_memory: true
38
+ shuffle: true
39
+ action_balance:
40
+ enabled: false
41
+ strategy: balanced_epoch
42
+ action_key: action_id
43
+ target_flap_fraction: 0.3
44
+ noop_id: 0
45
+ flap_id: 1
46
+ latency_curriculum:
47
+ enabled: false
48
+ strategy: exclusive
49
+ latencies: null
50
+ phase_steps: null
51
+ phase_distributions: null
52
+ new_latency_passes: 1.0
53
+ replay_passes: 0.25
54
+ target_total_passes: 2.0
55
+ final_equalization: true
56
+ step_budget_mode: auto
57
+ eval_at_phase_end: false
58
+ save_at_phase_end: false
59
+ computed_plan: null
60
+ per_device_batch_size: 16
61
+ load_all_data_for_training: true
62
+ num_obs_frames: 4
63
+ image_mode: multiframe
64
+ prompt_mode: raw
65
+ stitch_grid:
66
+ - 2
67
+ - 2
68
+ obs_image_size: null
69
+ video_backend: torchvision_av
70
+ dataset:
71
+ source_hf: ''
72
+ config_name: null
73
+ source_subdir: null
74
+ converted_name: flappy_train
75
+ single_source_hf: ''
76
+ mixed_source_hf: ''
77
+ single_converted_name: flappy_train
78
+ mixed_converted_name: flappy_mixed_latency_train
79
+ single_latency_filter: null
80
+ mixed_latency_filter: null
81
+ force_download: false
82
+ setup_force: false
83
+ skip_verification: false
84
+ verify_rows: 200
85
+ max_episodes: null
86
+ episodes_per_latency: null
87
+ latency_filter: null
88
+ debug_subset:
89
+ enabled: false
90
+ max_episodes: 5
91
+ suffix: debug
92
+ base_model:
93
+ repo_id: Qwen/Qwen3-VL-4B-Instruct
94
+ initialization:
95
+ checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
96
+ checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
97
+ checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
98
+ trainer:
99
+ max_train_steps: 4000
100
+ num_warmup_steps: 100
101
+ save_interval: 500
102
+ eval_interval: 250
103
+ eval_num_batches: 50
104
+ per_latency_eval_num_batches: null
105
+ eval_action_classification: false
106
+ eval_action_classification_interval: null
107
+ cc_f1_tolerance: 1
108
+ learning_rate:
109
+ base: 2.0e-05
110
+ qwen_vl_interface: 1.0e-05
111
+ action_model: 0.0001
112
+ lr_scheduler_type: cosine_with_min_lr
113
+ scheduler_specific_kwargs:
114
+ min_lr: 1.0e-06
115
+ freeze_modules: ''
116
+ freeze_vit: false
117
+ freeze_tied_embedding: false
118
+ freeze_llm_layers: []
119
+ loss_scale:
120
+ vla: 1.0
121
+ vlm: 0.1
122
+ max_grad_norm: 1.0
123
+ weight_decay: 0.0
124
+ logging_frequency: 1
125
+ profile_timing:
126
+ enabled: false
127
+ log_interval: 10
128
+ gradient_clipping: 1.0
129
+ gradient_accumulation_steps: 4
130
+ distributed_backend: deepspeed
131
+ is_resume: false
132
+ pretrained_checkpoint: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
133
+ resume_step: 0
134
+ reload_modules: null
135
+ optimizer:
136
+ name: AdamW
137
+ betas:
138
+ - 0.9
139
+ - 0.95
140
+ eps: 1.0e-08
141
+ weight_decay: 1.0e-08
142
+ fused: true
143
+ save_format: pt
144
+ workspace_dir: WORKSPACE_DIR
145
+ run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
146
+ seed: 42
147
+ wandb_entity: saberrr-zju
148
+ wandb_project: starVLA_rl_games
149
+ auth:
150
+ env_file: null
151
+ hf_token_env: HF_TOKEN
152
+ wandb_api_key_env: WANDB_API_KEY
153
+ paths:
154
+ run_root_dir: results/Checkpoints
155
+ dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
156
+ dataset_cache_dir: null
157
+ base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
158
+ accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
159
+ launch:
160
+ use_accelerate: true
161
+ gpus: null
162
+ num_processes: 1
163
+ dry_run: false
164
+ conda:
165
+ enabled: true
166
+ env_name: null
167
+ rl_games:
168
+ model_alias: openvla
169
+ env_eval:
170
+ image_size: 224
171
+ frameskip: 1
172
+ image_transform: raw_rgb
173
+ prompt_mode: raw
174
+ ghost_trail:
175
+ history_frames: 5
176
+ gamma: 1.3
177
+ min_alpha: 35
178
+ scroll_px_per_step: 4.0
179
+ ground_fraction: 0.22
180
+ seed: 42
181
+ fixed_episode_seeds: true
182
+ latency_seed_stride: 0
183
+ task_seed_stride: 0
184
+ task_description: ''
185
+ eval_parallel_envs: 5
186
+ enabled: true
187
+ eval_backend: latency_bench
188
+ distributed_mode: rank_sharded
189
+ vectorized:
190
+ enabled: false
191
+ batch_size: 1
192
+ latency:
193
+ prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
194
+ mode: single
195
+ values:
196
+ - 0
197
+ mid_train:
198
+ enabled: true
199
+ interval_steps: 250
200
+ latencies:
201
+ - 2
202
+ num_episodes: 20
203
+ max_steps_per_episode: 3600
204
+ post_train:
205
+ enabled: true
206
+ latencies:
207
+ - 2
208
+ num_episodes: 50
209
+ max_steps_per_episode: 3600
210
+ task: flappy
211
+ initialization_mode: bridge
212
+ action_carrier: bridge
213
+ model: openvla
214
+ env: flappy
215
+ init: bridge
216
+ bridge_base_model:
217
+ repo_id:
218
+ openvla: Qwen/Qwen3-VL-4B-Instruct
219
+ pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
220
+ pi05: Qwen/Qwen3-VL-4B-Instruct
221
+ gr00t: Qwen/Qwen3-VL-4B-Instruct
222
+ local_dir:
223
+ openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
224
+ pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
225
+ pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
226
+ gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
227
+ mode: single
228
+ checkpoint:
229
+ load: none
230
+ hf_repo_id: null
231
+ save_best_model: false
232
+ save_final_model: true
233
+ save_pt_file: false
234
+ save_safetensors_file: true
235
+ local:
236
+ keep_last_n: 1
237
+ sync:
238
+ enabled: false
239
+ repo_id: null
240
+ keep_last_n: 0
241
+ sync_every_n_checkpoints: 1
242
+ resume_policy: local_latest
243
+ run_id: flappy_fix_latency_2_200ep_7k2steps_plain_multi
244
+ output_dir: null
245
+ config_yaml: null
246
+ is_debug: false
247
+ version_id: 0.21
flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/hydra.yaml ADDED
@@ -0,0 +1,368 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ hydra:
2
+ run:
3
+ dir: ${run_root_dir}/${run_id}/hydra
4
+ sweep:
5
+ dir: multirun/${now:%Y-%m-%d}/${now:%H-%M-%S}
6
+ subdir: ${hydra.job.num}
7
+ launcher:
8
+ _target_: hydra._internal.core_plugins.basic_launcher.BasicLauncher
9
+ sweeper:
10
+ _target_: hydra._internal.core_plugins.basic_sweeper.BasicSweeper
11
+ max_batch_size: null
12
+ params: null
13
+ help:
14
+ app_name: ${hydra.job.name}
15
+ header: '${hydra.help.app_name} is powered by Hydra.
16
+
17
+ '
18
+ footer: 'Powered by Hydra (https://hydra.cc)
19
+
20
+ Use --hydra-help to view Hydra specific help
21
+
22
+ '
23
+ template: '${hydra.help.header}
24
+
25
+ == Configuration groups ==
26
+
27
+ Compose your configuration from those groups (group=option)
28
+
29
+
30
+ $APP_CONFIG_GROUPS
31
+
32
+
33
+ == Config ==
34
+
35
+ Override anything in the config (foo.bar=value)
36
+
37
+
38
+ $CONFIG
39
+
40
+
41
+ ${hydra.help.footer}
42
+
43
+ '
44
+ hydra_help:
45
+ template: 'Hydra (${hydra.runtime.version})
46
+
47
+ See https://hydra.cc for more info.
48
+
49
+
50
+ == Flags ==
51
+
52
+ $FLAGS_HELP
53
+
54
+
55
+ == Configuration groups ==
56
+
57
+ Compose your configuration from those groups (For example, append hydra/job_logging=disabled
58
+ to command line)
59
+
60
+
61
+ $HYDRA_CONFIG_GROUPS
62
+
63
+
64
+ Use ''--cfg hydra'' to Show the Hydra config.
65
+
66
+ '
67
+ hydra_help: ???
68
+ hydra_logging:
69
+ version: 1
70
+ formatters:
71
+ simple:
72
+ format: '[%(asctime)s][HYDRA] %(message)s'
73
+ handlers:
74
+ console:
75
+ class: logging.StreamHandler
76
+ formatter: simple
77
+ stream: ext://sys.stdout
78
+ root:
79
+ level: INFO
80
+ handlers:
81
+ - console
82
+ loggers:
83
+ logging_example:
84
+ level: DEBUG
85
+ disable_existing_loggers: false
86
+ job_logging:
87
+ version: 1
88
+ formatters:
89
+ simple:
90
+ format: '[%(asctime)s][%(name)s][%(levelname)s] - %(message)s'
91
+ handlers:
92
+ console:
93
+ class: logging.StreamHandler
94
+ formatter: simple
95
+ stream: ext://sys.stdout
96
+ file:
97
+ class: logging.FileHandler
98
+ formatter: simple
99
+ filename: ${hydra.runtime.output_dir}/${hydra.job.name}.log
100
+ root:
101
+ level: INFO
102
+ handlers:
103
+ - console
104
+ - file
105
+ disable_existing_loggers: false
106
+ env: {}
107
+ mode: RUN
108
+ searchpath: []
109
+ callbacks: {}
110
+ output_subdir: .hydra
111
+ overrides:
112
+ hydra:
113
+ - hydra.mode=RUN
114
+ task:
115
+ - model=openvla
116
+ - env=flappy
117
+ - init=bridge
118
+ - mode=single
119
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
120
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
121
+ - ++framework.qwenvl.flex_backend=triton
122
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
123
+ - ++framework.action_model.state_dim=7
124
+ - ++framework.action_model.loss_type=discrete_ce
125
+ - ++framework.action_model.action_horizon=1
126
+ - ++framework.action_model.future_action_window_size=0
127
+ - ++framework.action_model.past_action_window_size=0
128
+ - ++framework.action_model.action_dim=7
129
+ - ++framework.action_model.action_env_dim=2
130
+ - ++framework.kv_memory.enabled=false
131
+ - ++framework.kv_memory.window=4
132
+ - ++framework.kv_memory.rollout_len=8
133
+ - ++framework.kv_memory.packed_train=false
134
+ - ++framework.kv_memory.rebased_sink=true
135
+ - ++framework.name=QwenOFT
136
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
137
+ - ++datasets.vla_data.include_state=true
138
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
139
+ - ++datasets.vla_data.data_mix=flappy_train
140
+ - ++datasets.vla_data.eval_data_mix=null
141
+ - ++datasets.vla_data.custom_mixtures_path=null
142
+ - ++datasets.vla_data.action_type=discrete
143
+ - ++datasets.vla_data.sequential_step_sampling=false
144
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
145
+ - ++datasets.vla_data.num_workers=8
146
+ - ++datasets.vla_data.eval_num_workers=8
147
+ - ++datasets.vla_data.prefetch_factor=4
148
+ - ++datasets.vla_data.persistent_workers=true
149
+ - ++datasets.vla_data.pin_memory=true
150
+ - ++datasets.vla_data.shuffle=true
151
+ - ++datasets.vla_data.action_balance.enabled=false
152
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
153
+ - ++datasets.vla_data.action_balance.action_key=action_id
154
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
155
+ - ++datasets.vla_data.action_balance.noop_id=0
156
+ - ++datasets.vla_data.action_balance.flap_id=1
157
+ - ++datasets.vla_data.latency_curriculum.enabled=false
158
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
159
+ - ++datasets.vla_data.latency_curriculum.latencies=null
160
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
161
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
162
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
163
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
164
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
165
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
166
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
167
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
168
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
169
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
170
+ - ++datasets.vla_data.per_device_batch_size=16
171
+ - ++datasets.vla_data.load_all_data_for_training=true
172
+ - ++datasets.vla_data.num_obs_frames=4
173
+ - ++datasets.vla_data.image_mode=multiframe
174
+ - ++datasets.vla_data.prompt_mode=raw
175
+ - ++datasets.vla_data.stitch_grid=[2,2]
176
+ - ++datasets.vla_data.obs_image_size=null
177
+ - ++datasets.vla_data.video_backend=torchvision_av
178
+ - ++dataset.source_hf=
179
+ - ++dataset.config_name=null
180
+ - ++dataset.source_subdir=null
181
+ - ++dataset.converted_name=flappy_train
182
+ - ++dataset.single_source_hf=
183
+ - ++dataset.mixed_source_hf=
184
+ - ++dataset.single_converted_name=flappy_train
185
+ - ++dataset.mixed_converted_name=flappy_mixed_latency_train
186
+ - ++dataset.single_latency_filter=null
187
+ - ++dataset.mixed_latency_filter=null
188
+ - ++dataset.force_download=false
189
+ - ++dataset.setup_force=false
190
+ - ++dataset.skip_verification=false
191
+ - ++dataset.verify_rows=200
192
+ - ++dataset.max_episodes=null
193
+ - ++dataset.episodes_per_latency=null
194
+ - ++dataset.latency_filter=null
195
+ - ++dataset.debug_subset.enabled=false
196
+ - ++dataset.debug_subset.max_episodes=5
197
+ - ++dataset.debug_subset.suffix=debug
198
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
199
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
200
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
201
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
202
+ - trainer.max_train_steps=4000
203
+ - trainer.num_warmup_steps=100
204
+ - trainer.save_interval=500
205
+ - trainer.eval_interval=250
206
+ - trainer.eval_num_batches=50
207
+ - trainer.per_latency_eval_num_batches=null
208
+ - trainer.eval_action_classification=false
209
+ - trainer.eval_action_classification_interval=null
210
+ - trainer.cc_f1_tolerance=1
211
+ - trainer.learning_rate.base=2e-05
212
+ - trainer.learning_rate.qwen_vl_interface=1e-05
213
+ - trainer.learning_rate.action_model=0.0001
214
+ - trainer.lr_scheduler_type=cosine_with_min_lr
215
+ - trainer.scheduler_specific_kwargs.min_lr=1e-06
216
+ - trainer.freeze_modules=
217
+ - trainer.freeze_vit=false
218
+ - trainer.freeze_tied_embedding=false
219
+ - trainer.freeze_llm_layers=[]
220
+ - trainer.loss_scale.vla=1.0
221
+ - trainer.loss_scale.vlm=0.1
222
+ - trainer.max_grad_norm=1.0
223
+ - trainer.weight_decay=0.0
224
+ - trainer.logging_frequency=1
225
+ - trainer.profile_timing.enabled=false
226
+ - trainer.profile_timing.log_interval=10
227
+ - trainer.gradient_clipping=1.0
228
+ - trainer.gradient_accumulation_steps=4
229
+ - trainer.distributed_backend=deepspeed
230
+ - trainer.is_resume=false
231
+ - trainer.pretrained_checkpoint=null
232
+ - trainer.resume_step=0
233
+ - trainer.reload_modules=null
234
+ - trainer.optimizer.name=AdamW
235
+ - trainer.optimizer.betas=[0.9,0.95]
236
+ - trainer.optimizer.eps=1e-08
237
+ - trainer.optimizer.weight_decay=1e-08
238
+ - trainer.optimizer.fused=true
239
+ - trainer.save_format=pt
240
+ - ++workspace_dir=WORKSPACE_DIR
241
+ - ++run_root_dir=results/Checkpoints
242
+ - ++seed=42
243
+ - ++wandb_entity=saberrr-zju
244
+ - ++wandb_project=starVLA_rl_games
245
+ - ++auth.env_file=null
246
+ - ++auth.hf_token_env=HF_TOKEN
247
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
248
+ - ++paths.run_root_dir=results/Checkpoints
249
+ - ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
250
+ - ++paths.dataset_cache_dir=null
251
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
252
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
253
+ - ++rl_games.model_alias=openvla
254
+ - ++rl_games.env_eval.image_size=224
255
+ - ++rl_games.env_eval.frameskip=1
256
+ - ++rl_games.env_eval.image_transform=raw_rgb
257
+ - ++rl_games.env_eval.prompt_mode=raw
258
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
259
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
260
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
261
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
262
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
263
+ - ++rl_games.env_eval.seed=42
264
+ - ++rl_games.env_eval.fixed_episode_seeds=true
265
+ - ++rl_games.env_eval.latency_seed_stride=0
266
+ - ++rl_games.env_eval.task_seed_stride=0
267
+ - ++rl_games.env_eval.task_description=
268
+ - ++rl_games.env_eval.eval_parallel_envs=5
269
+ - ++rl_games.env_eval.enabled=true
270
+ - ++rl_games.env_eval.eval_backend=latency_bench
271
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
272
+ - ++rl_games.env_eval.vectorized.enabled=false
273
+ - ++rl_games.env_eval.vectorized.batch_size=1
274
+ - ++rl_games.env_eval.latency.prompt_map_path=null
275
+ - ++rl_games.env_eval.latency.mode=single
276
+ - ++rl_games.env_eval.latency.values=[0]
277
+ - ++rl_games.env_eval.mid_train.enabled=true
278
+ - ++rl_games.env_eval.mid_train.interval_steps=250
279
+ - ++rl_games.env_eval.mid_train.latencies=[2]
280
+ - ++rl_games.env_eval.mid_train.num_episodes=20
281
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
282
+ - ++rl_games.env_eval.post_train.enabled=true
283
+ - ++rl_games.env_eval.post_train.latencies=[2]
284
+ - ++rl_games.env_eval.post_train.num_episodes=50
285
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
286
+ - ++rl_games.task=flappy
287
+ - ++rl_games.initialization_mode=bridge
288
+ - ++rl_games.action_carrier=bridge
289
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
290
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
291
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
292
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
293
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
294
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
295
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
296
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
297
+ - ++checkpoint.load=none
298
+ - ++checkpoint.hf_repo_id=null
299
+ - ++checkpoint.save_best_model=false
300
+ - ++checkpoint.save_final_model=true
301
+ - ++checkpoint.save_pt_file=false
302
+ - ++checkpoint.save_safetensors_file=true
303
+ - ++checkpoint.local.keep_last_n=1
304
+ - ++checkpoint.sync.enabled=false
305
+ - ++checkpoint.sync.repo_id=null
306
+ - ++checkpoint.sync.keep_last_n=0
307
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
308
+ - ++checkpoint.sync.resume_policy=local_latest
309
+ - ++run_id=flappy_fix_latency_2_200ep_7k2steps_plain_multi
310
+ - ++output_dir=null
311
+ - ++config_yaml=null
312
+ - ++is_debug=false
313
+ - ++version_id=0.21
314
+ - ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
315
+ - trainer.is_resume=false
316
+ - trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
317
+ - trainer.resume_step=0
318
+ - ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
319
+ - ++datasets.vla_data.data_mix=flappy_train__bridge
320
+ - ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
321
+ - ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
322
+ - ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
323
+ job:
324
+ name: train_starvla_hydra
325
+ chdir: false
326
+ override_dirname: ++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=none,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=flappy_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=flappy_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=flappy_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=flappy_train,++datasets.vla_data.data_mix=flappy_train__bridge,++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=flappy_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=multiframe,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=4,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=16,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=2,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++framework.qwenvl.flex_backend=triton,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=1,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=true,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=true,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=,++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=flappy,++run_id=flappy_fix_latency_2_200ep_7k2steps_plain_multi,++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++version_id=0.21,++wandb_entity=saberrr-zju,++wandb_project=starVLA_rl_games,++workspace_dir=WORKSPACE_DIR,env=flappy,init=bridge,mode=single,model=openvla,trainer.cc_f1_tolerance=1,trainer.distributed_backend=deepspeed,trainer.eval_action_classification=false,trainer.eval_action_classification_interval=null,trainer.eval_interval=250,trainer.eval_num_batches=50,trainer.freeze_llm_layers=[],trainer.freeze_modules=,trainer.freeze_tied_embedding=false,trainer.freeze_vit=false,trainer.gradient_accumulation_steps=4,trainer.gradient_clipping=1.0,trainer.is_resume=false,trainer.is_resume=false,trainer.learning_rate.action_model=0.0001,trainer.learning_rate.base=2e-05,trainer.learning_rate.qwen_vl_interface=1e-05,trainer.logging_frequency=1,trainer.loss_scale.vla=1.0,trainer.loss_scale.vlm=0.1,trainer.lr_scheduler_type=cosine_with_min_lr,trainer.max_grad_norm=1.0,trainer.max_train_steps=4000,trainer.num_warmup_steps=100,trainer.optimizer.betas=[0.9,0.95],trainer.optimizer.eps=1e-08,trainer.optimizer.fused=true,trainer.optimizer.name=AdamW,trainer.optimizer.weight_decay=1e-08,trainer.per_latency_eval_num_batches=null,trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt,trainer.pretrained_checkpoint=null,trainer.profile_timing.enabled=false,trainer.profile_timing.log_interval=10,trainer.reload_modules=null,trainer.resume_step=0,trainer.resume_step=0,trainer.save_format=pt,trainer.save_interval=500,trainer.scheduler_specific_kwargs.min_lr=1e-06,trainer.weight_decay=0.0
327
+ id: ???
328
+ num: ???
329
+ config_name: train
330
+ env_set: {}
331
+ env_copy: []
332
+ config:
333
+ override_dirname:
334
+ kv_sep: '='
335
+ item_sep: ','
336
+ exclude_keys: []
337
+ runtime:
338
+ version: 1.3.3
339
+ version_base: '1.1'
340
+ cwd: /workspace/latency-sensitive-bench/starVLA
341
+ config_sources:
342
+ - path: hydra.conf
343
+ schema: pkg
344
+ provider: hydra
345
+ - path: /workspace/latency-sensitive-bench/starVLA/examples/rl_games/config
346
+ schema: file
347
+ provider: main
348
+ - path: ''
349
+ schema: structured
350
+ provider: schema
351
+ output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra
352
+ choices:
353
+ cross_task_setup: null
354
+ checkpoint: default
355
+ mode: single
356
+ init: bridge
357
+ env: flappy
358
+ model: openvla
359
+ hydra/env: default
360
+ hydra/callbacks: null
361
+ hydra/job_logging: default
362
+ hydra/hydra_logging: default
363
+ hydra/hydra_help: default
364
+ hydra/help: default
365
+ hydra/sweeper: basic
366
+ hydra/launcher: basic
367
+ hydra/output: default
368
+ verbose: false
flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/overrides.yaml ADDED
@@ -0,0 +1,208 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ - model=openvla
2
+ - env=flappy
3
+ - init=bridge
4
+ - mode=single
5
+ - ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
6
+ - ++framework.qwenvl.attn_implementation=flash_attention_2
7
+ - ++framework.qwenvl.flex_backend=triton
8
+ - ++framework.qwenvl.enable_gradient_checkpointing=true
9
+ - ++framework.action_model.state_dim=7
10
+ - ++framework.action_model.loss_type=discrete_ce
11
+ - ++framework.action_model.action_horizon=1
12
+ - ++framework.action_model.future_action_window_size=0
13
+ - ++framework.action_model.past_action_window_size=0
14
+ - ++framework.action_model.action_dim=7
15
+ - ++framework.action_model.action_env_dim=2
16
+ - ++framework.kv_memory.enabled=false
17
+ - ++framework.kv_memory.window=4
18
+ - ++framework.kv_memory.rollout_len=8
19
+ - ++framework.kv_memory.packed_train=false
20
+ - ++framework.kv_memory.rebased_sink=true
21
+ - ++framework.name=QwenOFT
22
+ - ++datasets.vla_data.dataset_py=lerobot_datasets
23
+ - ++datasets.vla_data.include_state=true
24
+ - ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
25
+ - ++datasets.vla_data.data_mix=flappy_train
26
+ - ++datasets.vla_data.eval_data_mix=null
27
+ - ++datasets.vla_data.custom_mixtures_path=null
28
+ - ++datasets.vla_data.action_type=discrete
29
+ - ++datasets.vla_data.sequential_step_sampling=false
30
+ - ++datasets.vla_data.eval_sequential_step_sampling=null
31
+ - ++datasets.vla_data.num_workers=8
32
+ - ++datasets.vla_data.eval_num_workers=8
33
+ - ++datasets.vla_data.prefetch_factor=4
34
+ - ++datasets.vla_data.persistent_workers=true
35
+ - ++datasets.vla_data.pin_memory=true
36
+ - ++datasets.vla_data.shuffle=true
37
+ - ++datasets.vla_data.action_balance.enabled=false
38
+ - ++datasets.vla_data.action_balance.strategy=balanced_epoch
39
+ - ++datasets.vla_data.action_balance.action_key=action_id
40
+ - ++datasets.vla_data.action_balance.target_flap_fraction=0.3
41
+ - ++datasets.vla_data.action_balance.noop_id=0
42
+ - ++datasets.vla_data.action_balance.flap_id=1
43
+ - ++datasets.vla_data.latency_curriculum.enabled=false
44
+ - ++datasets.vla_data.latency_curriculum.strategy=exclusive
45
+ - ++datasets.vla_data.latency_curriculum.latencies=null
46
+ - ++datasets.vla_data.latency_curriculum.phase_steps=null
47
+ - ++datasets.vla_data.latency_curriculum.phase_distributions=null
48
+ - ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
49
+ - ++datasets.vla_data.latency_curriculum.replay_passes=0.25
50
+ - ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
51
+ - ++datasets.vla_data.latency_curriculum.final_equalization=true
52
+ - ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
53
+ - ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
54
+ - ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
55
+ - ++datasets.vla_data.latency_curriculum.computed_plan=null
56
+ - ++datasets.vla_data.per_device_batch_size=16
57
+ - ++datasets.vla_data.load_all_data_for_training=true
58
+ - ++datasets.vla_data.num_obs_frames=4
59
+ - ++datasets.vla_data.image_mode=multiframe
60
+ - ++datasets.vla_data.prompt_mode=raw
61
+ - ++datasets.vla_data.stitch_grid=[2,2]
62
+ - ++datasets.vla_data.obs_image_size=null
63
+ - ++datasets.vla_data.video_backend=torchvision_av
64
+ - ++dataset.source_hf=
65
+ - ++dataset.config_name=null
66
+ - ++dataset.source_subdir=null
67
+ - ++dataset.converted_name=flappy_train
68
+ - ++dataset.single_source_hf=
69
+ - ++dataset.mixed_source_hf=
70
+ - ++dataset.single_converted_name=flappy_train
71
+ - ++dataset.mixed_converted_name=flappy_mixed_latency_train
72
+ - ++dataset.single_latency_filter=null
73
+ - ++dataset.mixed_latency_filter=null
74
+ - ++dataset.force_download=false
75
+ - ++dataset.setup_force=false
76
+ - ++dataset.skip_verification=false
77
+ - ++dataset.verify_rows=200
78
+ - ++dataset.max_episodes=null
79
+ - ++dataset.episodes_per_latency=null
80
+ - ++dataset.latency_filter=null
81
+ - ++dataset.debug_subset.enabled=false
82
+ - ++dataset.debug_subset.max_episodes=5
83
+ - ++dataset.debug_subset.suffix=debug
84
+ - ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
85
+ - ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
86
+ - ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
87
+ - ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
88
+ - trainer.max_train_steps=4000
89
+ - trainer.num_warmup_steps=100
90
+ - trainer.save_interval=500
91
+ - trainer.eval_interval=250
92
+ - trainer.eval_num_batches=50
93
+ - trainer.per_latency_eval_num_batches=null
94
+ - trainer.eval_action_classification=false
95
+ - trainer.eval_action_classification_interval=null
96
+ - trainer.cc_f1_tolerance=1
97
+ - trainer.learning_rate.base=2e-05
98
+ - trainer.learning_rate.qwen_vl_interface=1e-05
99
+ - trainer.learning_rate.action_model=0.0001
100
+ - trainer.lr_scheduler_type=cosine_with_min_lr
101
+ - trainer.scheduler_specific_kwargs.min_lr=1e-06
102
+ - trainer.freeze_modules=
103
+ - trainer.freeze_vit=false
104
+ - trainer.freeze_tied_embedding=false
105
+ - trainer.freeze_llm_layers=[]
106
+ - trainer.loss_scale.vla=1.0
107
+ - trainer.loss_scale.vlm=0.1
108
+ - trainer.max_grad_norm=1.0
109
+ - trainer.weight_decay=0.0
110
+ - trainer.logging_frequency=1
111
+ - trainer.profile_timing.enabled=false
112
+ - trainer.profile_timing.log_interval=10
113
+ - trainer.gradient_clipping=1.0
114
+ - trainer.gradient_accumulation_steps=4
115
+ - trainer.distributed_backend=deepspeed
116
+ - trainer.is_resume=false
117
+ - trainer.pretrained_checkpoint=null
118
+ - trainer.resume_step=0
119
+ - trainer.reload_modules=null
120
+ - trainer.optimizer.name=AdamW
121
+ - trainer.optimizer.betas=[0.9,0.95]
122
+ - trainer.optimizer.eps=1e-08
123
+ - trainer.optimizer.weight_decay=1e-08
124
+ - trainer.optimizer.fused=true
125
+ - trainer.save_format=pt
126
+ - ++workspace_dir=WORKSPACE_DIR
127
+ - ++run_root_dir=results/Checkpoints
128
+ - ++seed=42
129
+ - ++wandb_entity=saberrr-zju
130
+ - ++wandb_project=starVLA_rl_games
131
+ - ++auth.env_file=null
132
+ - ++auth.hf_token_env=HF_TOKEN
133
+ - ++auth.wandb_api_key_env=WANDB_API_KEY
134
+ - ++paths.run_root_dir=results/Checkpoints
135
+ - ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
136
+ - ++paths.dataset_cache_dir=null
137
+ - ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
138
+ - ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
139
+ - ++rl_games.model_alias=openvla
140
+ - ++rl_games.env_eval.image_size=224
141
+ - ++rl_games.env_eval.frameskip=1
142
+ - ++rl_games.env_eval.image_transform=raw_rgb
143
+ - ++rl_games.env_eval.prompt_mode=raw
144
+ - ++rl_games.env_eval.ghost_trail.history_frames=5
145
+ - ++rl_games.env_eval.ghost_trail.gamma=1.3
146
+ - ++rl_games.env_eval.ghost_trail.min_alpha=35
147
+ - ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
148
+ - ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
149
+ - ++rl_games.env_eval.seed=42
150
+ - ++rl_games.env_eval.fixed_episode_seeds=true
151
+ - ++rl_games.env_eval.latency_seed_stride=0
152
+ - ++rl_games.env_eval.task_seed_stride=0
153
+ - ++rl_games.env_eval.task_description=
154
+ - ++rl_games.env_eval.eval_parallel_envs=5
155
+ - ++rl_games.env_eval.enabled=true
156
+ - ++rl_games.env_eval.eval_backend=latency_bench
157
+ - ++rl_games.env_eval.distributed_mode=rank_sharded
158
+ - ++rl_games.env_eval.vectorized.enabled=false
159
+ - ++rl_games.env_eval.vectorized.batch_size=1
160
+ - ++rl_games.env_eval.latency.prompt_map_path=null
161
+ - ++rl_games.env_eval.latency.mode=single
162
+ - ++rl_games.env_eval.latency.values=[0]
163
+ - ++rl_games.env_eval.mid_train.enabled=true
164
+ - ++rl_games.env_eval.mid_train.interval_steps=250
165
+ - ++rl_games.env_eval.mid_train.latencies=[2]
166
+ - ++rl_games.env_eval.mid_train.num_episodes=20
167
+ - ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
168
+ - ++rl_games.env_eval.post_train.enabled=true
169
+ - ++rl_games.env_eval.post_train.latencies=[2]
170
+ - ++rl_games.env_eval.post_train.num_episodes=50
171
+ - ++rl_games.env_eval.post_train.max_steps_per_episode=3600
172
+ - ++rl_games.task=flappy
173
+ - ++rl_games.initialization_mode=bridge
174
+ - ++rl_games.action_carrier=bridge
175
+ - ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
176
+ - ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
177
+ - ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
178
+ - ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
179
+ - ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
180
+ - ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
181
+ - ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
182
+ - ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
183
+ - ++checkpoint.load=none
184
+ - ++checkpoint.hf_repo_id=null
185
+ - ++checkpoint.save_best_model=false
186
+ - ++checkpoint.save_final_model=true
187
+ - ++checkpoint.save_pt_file=false
188
+ - ++checkpoint.save_safetensors_file=true
189
+ - ++checkpoint.local.keep_last_n=1
190
+ - ++checkpoint.sync.enabled=false
191
+ - ++checkpoint.sync.repo_id=null
192
+ - ++checkpoint.sync.keep_last_n=0
193
+ - ++checkpoint.sync.sync_every_n_checkpoints=1
194
+ - ++checkpoint.sync.resume_policy=local_latest
195
+ - ++run_id=flappy_fix_latency_2_200ep_7k2steps_plain_multi
196
+ - ++output_dir=null
197
+ - ++config_yaml=null
198
+ - ++is_debug=false
199
+ - ++version_id=0.21
200
+ - ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
201
+ - trainer.is_resume=false
202
+ - trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
203
+ - trainer.resume_step=0
204
+ - ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
205
+ - ++datasets.vla_data.data_mix=flappy_train__bridge
206
+ - ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
207
+ - ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
208
+ - ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/train_starvla_hydra.log ADDED
The diff for this file is too large to render. See raw diff
 
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
2
+ {"episode_id": 3, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
3
+ {"episode_id": 5, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
4
+ {"episode_id": 7, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
5
+ {"episode_id": 9, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
6
+ {"episode_id": 11, "episode_return": 48.50000058859587, "episode_return_env": 48.50000058859587, "game_score": 10.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 406, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 406}
7
+ {"episode_id": 13, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
8
+ {"episode_id": 15, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
9
+ {"episode_id": 17, "episode_return": 284.8000033646822, "episode_return_env": 284.8000033646822, "game_score": 60.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2319, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2319}
10
+ {"episode_id": 19, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 118.70000141113997, "episode_return_env": 118.70000141113997, "game_score": 25.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 973, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 973}
2
+ {"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 4, "episode_return": 102.90000123530626, "episode_return_env": 102.90000123530626, "game_score": 21.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 851, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 851}
4
+ {"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 8, "episode_return": 426.60000501573086, "episode_return_env": 426.60000501573086, "game_score": 91.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3458, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3458}
6
+ {"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 12, "episode_return": 218.40000258386135, "episode_return_env": 218.40000258386135, "game_score": 46.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1781, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1781}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 23.200000301003456, "episode_return_env": 23.200000301003456, "game_score": 4.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 207, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 207}
10
+ {"episode_id": 18, "episode_return": 384.5000045225024, "episode_return_env": 384.5000045225024, "game_score": 82.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3118, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3118}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 1, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 3, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 5, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 7, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 9, "episode_return": 13.000000178813934, "episode_return_env": 13.000000178813934, "game_score": 2.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 123, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 123}
6
+ {"episode_id": 11, "episode_return": 90.6000010818243, "episode_return_env": 90.6000010818243, "game_score": 19.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 746, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 746}
7
+ {"episode_id": 13, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 15, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 17, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 19, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 379.5000044628978, "episode_return_env": 379.5000044628978, "game_score": 81.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3077, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3077}
2
+ {"episode_id": 2, "episode_return": 132.60000157356262, "episode_return_env": 132.60000157356262, "game_score": 28.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1085, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1085}
3
+ {"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 6, "episode_return": 62.80000075697899, "episode_return_env": 62.80000075697899, "game_score": 13.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 522, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 522}
5
+ {"episode_id": 8, "episode_return": 151.00000178813934, "episode_return_env": 151.00000178813934, "game_score": 32.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1233, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1233}
6
+ {"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 12, "episode_return": 90.6000010818243, "episode_return_env": 90.6000010818243, "game_score": 19.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 746, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 746}
8
+ {"episode_id": 14, "episode_return": 361.00000424683094, "episode_return_env": 361.00000424683094, "game_score": 77.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2928, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2928}
9
+ {"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 18, "episode_return": 34.60000042617321, "episode_return_env": 34.60000042617321, "game_score": 7.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 294, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 294}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 18, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
2
+ {"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
3
+ {"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
4
+ {"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
5
+ {"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
6
+ {"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
7
+ {"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
8
+ {"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
9
+ {"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
10
+ {"episode_id": 18, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/_progress/rank_1.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl ADDED
@@ -0,0 +1,10 @@
 
 
 
 
 
 
 
 
 
 
 
1
+ {"episode_id": 0, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
2
+ {"episode_id": 2, "episode_return": 4.800000086426735, "episode_return_env": 4.800000086426735, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 59, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 59}
3
+ {"episode_id": 4, "episode_return": 6.000000089406967, "episode_return_env": 6.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 62, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 62}
4
+ {"episode_id": 6, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
5
+ {"episode_id": 8, "episode_return": 6.000000089406967, "episode_return_env": 6.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 62, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 62}
6
+ {"episode_id": 10, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
7
+ {"episode_id": 12, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
8
+ {"episode_id": 14, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
9
+ {"episode_id": 16, "episode_return": 6.000000089406967, "episode_return_env": 6.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 62, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 62}
10
+ {"episode_id": 18, "episode_return": 6.000000089406967, "episode_return_env": 6.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 62, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 62}
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"completed": 10}