Upload folder using huggingface_hub
Browse filesThis view is limited to 50 files because it contains too many changes. See raw diff
- .gitattributes +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt +3 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/steps_4000_model.safetensors +3 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/config.full.yaml +249 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/config.yaml +102 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/dataset_statistics.json +127 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/dataset_statistics_eval.json +127 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1000.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1250.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1500.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1750.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2000.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2250.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_250.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2500.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2750.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3000.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3250.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3500.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3750.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_4000.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_500.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_750.json +120 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/post_train/step_4000.json +240 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/config.yaml +247 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/hydra.yaml +368 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/overrides.yaml +208 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/train_starvla_hydra.log +0 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/_progress/rank_0.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/_progress/rank_1.json +1 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl +10 -0
- flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json +1 -0
.gitattributes
CHANGED
|
@@ -35,3 +35,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
| 36 |
flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
|
| 37 |
flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
| 36 |
flappy_fix_latency_2_200ep_7k2steps_kv_memory_flex/wandb/wandb/run-20260628_174516-d5o0ia06/run-d5o0ia06.wandb filter=lfs diff=lfs merge=lfs -text
|
| 37 |
flappy_fix_latency_2_200ep_7k2steps_single_baseline/wandb/wandb/run-20260629_061046-mj819fop/run-mj819fop.wandb filter=lfs diff=lfs merge=lfs -text
|
| 38 |
+
flappy_fix_latency_2_200ep_7k2steps_plain_multi/wandb/wandb/run-20260629_115519-lyl43qp2/run-lyl43qp2.wandb filter=lfs diff=lfs merge=lfs -text
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:371cb744227687bb99bcad7f9ff2250cf06da75631359ad3eba4c6bc52570607
|
| 3 |
+
size 9785060316
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/steps_4000_model.safetensors
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:639393e062693dbb9e2bd801367353cd11256a4e8a7419e02186d360b5b249b2
|
| 3 |
+
size 9784896838
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/config.full.yaml
ADDED
|
@@ -0,0 +1,249 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
framework:
|
| 2 |
+
name: QwenOFT
|
| 3 |
+
qwenvl:
|
| 4 |
+
base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 5 |
+
attn_implementation: flash_attention_2
|
| 6 |
+
flex_backend: triton
|
| 7 |
+
enable_gradient_checkpointing: true
|
| 8 |
+
action_model:
|
| 9 |
+
action_model_type: MLP
|
| 10 |
+
action_dim: 7
|
| 11 |
+
action_hidden_dim: 2560
|
| 12 |
+
future_action_window_size: 0
|
| 13 |
+
past_action_window_size: 0
|
| 14 |
+
loss_type: discrete_ce
|
| 15 |
+
state_dim: 7
|
| 16 |
+
action_horizon: 1
|
| 17 |
+
action_env_dim: 2
|
| 18 |
+
kv_memory:
|
| 19 |
+
enabled: false
|
| 20 |
+
window: 4
|
| 21 |
+
rollout_len: 8
|
| 22 |
+
packed_train: false
|
| 23 |
+
rebased_sink: true
|
| 24 |
+
datasets:
|
| 25 |
+
vla_data:
|
| 26 |
+
dataset_py: lerobot_datasets
|
| 27 |
+
include_state: true
|
| 28 |
+
data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
|
| 29 |
+
data_mix: flappy_train__bridge
|
| 30 |
+
eval_data_mix: flappy_train__bridge__val
|
| 31 |
+
custom_mixtures_path: null
|
| 32 |
+
action_type: discrete
|
| 33 |
+
sequential_step_sampling: false
|
| 34 |
+
eval_sequential_step_sampling: null
|
| 35 |
+
num_workers: 8
|
| 36 |
+
eval_num_workers: 8
|
| 37 |
+
prefetch_factor: 4
|
| 38 |
+
persistent_workers: true
|
| 39 |
+
pin_memory: true
|
| 40 |
+
shuffle: true
|
| 41 |
+
action_balance:
|
| 42 |
+
enabled: false
|
| 43 |
+
strategy: balanced_epoch
|
| 44 |
+
action_key: action_id
|
| 45 |
+
target_flap_fraction: 0.3
|
| 46 |
+
noop_id: 0
|
| 47 |
+
flap_id: 1
|
| 48 |
+
latency_curriculum:
|
| 49 |
+
enabled: false
|
| 50 |
+
strategy: exclusive
|
| 51 |
+
latencies: null
|
| 52 |
+
phase_steps: null
|
| 53 |
+
phase_distributions: null
|
| 54 |
+
new_latency_passes: 1.0
|
| 55 |
+
replay_passes: 0.25
|
| 56 |
+
target_total_passes: 2.0
|
| 57 |
+
final_equalization: true
|
| 58 |
+
step_budget_mode: auto
|
| 59 |
+
eval_at_phase_end: false
|
| 60 |
+
save_at_phase_end: false
|
| 61 |
+
computed_plan: null
|
| 62 |
+
per_device_batch_size: 16
|
| 63 |
+
load_all_data_for_training: true
|
| 64 |
+
num_obs_frames: 4
|
| 65 |
+
image_mode: multiframe
|
| 66 |
+
prompt_mode: raw
|
| 67 |
+
stitch_grid:
|
| 68 |
+
- 2
|
| 69 |
+
- 2
|
| 70 |
+
obs_image_size: null
|
| 71 |
+
video_backend: torchvision_av
|
| 72 |
+
dataset:
|
| 73 |
+
source_hf: ''
|
| 74 |
+
config_name: null
|
| 75 |
+
source_subdir: null
|
| 76 |
+
converted_name: flappy_train
|
| 77 |
+
single_source_hf: ''
|
| 78 |
+
mixed_source_hf: ''
|
| 79 |
+
single_converted_name: flappy_train
|
| 80 |
+
mixed_converted_name: flappy_mixed_latency_train
|
| 81 |
+
single_latency_filter: null
|
| 82 |
+
mixed_latency_filter: null
|
| 83 |
+
force_download: false
|
| 84 |
+
setup_force: false
|
| 85 |
+
skip_verification: false
|
| 86 |
+
verify_rows: 200
|
| 87 |
+
max_episodes: null
|
| 88 |
+
episodes_per_latency: null
|
| 89 |
+
latency_filter: null
|
| 90 |
+
debug_subset:
|
| 91 |
+
enabled: false
|
| 92 |
+
max_episodes: 5
|
| 93 |
+
suffix: debug
|
| 94 |
+
base_model:
|
| 95 |
+
repo_id: Qwen/Qwen3-VL-4B-Instruct
|
| 96 |
+
initialization:
|
| 97 |
+
checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
|
| 98 |
+
checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
|
| 99 |
+
checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
|
| 100 |
+
trainer:
|
| 101 |
+
max_train_steps: 4000
|
| 102 |
+
num_warmup_steps: 100
|
| 103 |
+
save_interval: 500
|
| 104 |
+
eval_interval: 250
|
| 105 |
+
eval_num_batches: 50
|
| 106 |
+
per_latency_eval_num_batches: null
|
| 107 |
+
eval_action_classification: false
|
| 108 |
+
eval_action_classification_interval: null
|
| 109 |
+
cc_f1_tolerance: 1
|
| 110 |
+
learning_rate:
|
| 111 |
+
base: 2.0e-05
|
| 112 |
+
qwen_vl_interface: 1.0e-05
|
| 113 |
+
action_model: 0.0001
|
| 114 |
+
lr_scheduler_type: cosine_with_min_lr
|
| 115 |
+
scheduler_specific_kwargs:
|
| 116 |
+
min_lr: 1.0e-06
|
| 117 |
+
freeze_modules: ''
|
| 118 |
+
freeze_vit: false
|
| 119 |
+
freeze_tied_embedding: false
|
| 120 |
+
freeze_llm_layers: []
|
| 121 |
+
loss_scale:
|
| 122 |
+
vla: 1.0
|
| 123 |
+
vlm: 0.1
|
| 124 |
+
max_grad_norm: 1.0
|
| 125 |
+
weight_decay: 0.0
|
| 126 |
+
logging_frequency: 1
|
| 127 |
+
profile_timing:
|
| 128 |
+
enabled: false
|
| 129 |
+
log_interval: 10
|
| 130 |
+
gradient_clipping: 1.0
|
| 131 |
+
gradient_accumulation_steps: 4
|
| 132 |
+
distributed_backend: deepspeed
|
| 133 |
+
is_resume: false
|
| 134 |
+
pretrained_checkpoint: null
|
| 135 |
+
resume_step: 0
|
| 136 |
+
reload_modules: null
|
| 137 |
+
optimizer:
|
| 138 |
+
name: AdamW
|
| 139 |
+
betas:
|
| 140 |
+
- 0.9
|
| 141 |
+
- 0.95
|
| 142 |
+
eps: 1.0e-08
|
| 143 |
+
weight_decay: 1.0e-08
|
| 144 |
+
fused: true
|
| 145 |
+
save_format: pt
|
| 146 |
+
workspace_dir: WORKSPACE_DIR
|
| 147 |
+
run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 148 |
+
seed: 42
|
| 149 |
+
wandb_entity: saberrr-zju
|
| 150 |
+
wandb_project: starVLA_rl_games
|
| 151 |
+
auth:
|
| 152 |
+
env_file: null
|
| 153 |
+
hf_token_env: HF_TOKEN
|
| 154 |
+
wandb_api_key_env: WANDB_API_KEY
|
| 155 |
+
paths:
|
| 156 |
+
run_root_dir: results/Checkpoints
|
| 157 |
+
dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
|
| 158 |
+
dataset_cache_dir: null
|
| 159 |
+
base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 160 |
+
accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
|
| 161 |
+
launch:
|
| 162 |
+
use_accelerate: true
|
| 163 |
+
gpus: null
|
| 164 |
+
num_processes: 1
|
| 165 |
+
dry_run: false
|
| 166 |
+
conda:
|
| 167 |
+
enabled: true
|
| 168 |
+
env_name: null
|
| 169 |
+
rl_games:
|
| 170 |
+
model_alias: openvla
|
| 171 |
+
env_eval:
|
| 172 |
+
image_size: 224
|
| 173 |
+
frameskip: 1
|
| 174 |
+
image_transform: raw_rgb
|
| 175 |
+
prompt_mode: raw
|
| 176 |
+
ghost_trail:
|
| 177 |
+
history_frames: 5
|
| 178 |
+
gamma: 1.3
|
| 179 |
+
min_alpha: 35
|
| 180 |
+
scroll_px_per_step: 4.0
|
| 181 |
+
ground_fraction: 0.22
|
| 182 |
+
seed: 42
|
| 183 |
+
fixed_episode_seeds: true
|
| 184 |
+
latency_seed_stride: 0
|
| 185 |
+
task_seed_stride: 0
|
| 186 |
+
task_description: ''
|
| 187 |
+
eval_parallel_envs: 5
|
| 188 |
+
enabled: true
|
| 189 |
+
eval_backend: latency_bench
|
| 190 |
+
distributed_mode: rank_sharded
|
| 191 |
+
vectorized:
|
| 192 |
+
enabled: false
|
| 193 |
+
batch_size: 1
|
| 194 |
+
latency:
|
| 195 |
+
prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
| 196 |
+
mode: single
|
| 197 |
+
values:
|
| 198 |
+
- 0
|
| 199 |
+
mid_train:
|
| 200 |
+
enabled: true
|
| 201 |
+
interval_steps: 250
|
| 202 |
+
latencies:
|
| 203 |
+
- 2
|
| 204 |
+
num_episodes: 20
|
| 205 |
+
max_steps_per_episode: 3600
|
| 206 |
+
post_train:
|
| 207 |
+
enabled: true
|
| 208 |
+
latencies:
|
| 209 |
+
- 2
|
| 210 |
+
num_episodes: 50
|
| 211 |
+
max_steps_per_episode: 3600
|
| 212 |
+
task: flappy
|
| 213 |
+
initialization_mode: bridge
|
| 214 |
+
action_carrier: bridge
|
| 215 |
+
model: openvla
|
| 216 |
+
env: flappy
|
| 217 |
+
init: bridge
|
| 218 |
+
bridge_base_model:
|
| 219 |
+
repo_id:
|
| 220 |
+
openvla: Qwen/Qwen3-VL-4B-Instruct
|
| 221 |
+
pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
|
| 222 |
+
pi05: Qwen/Qwen3-VL-4B-Instruct
|
| 223 |
+
gr00t: Qwen/Qwen3-VL-4B-Instruct
|
| 224 |
+
local_dir:
|
| 225 |
+
openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 226 |
+
pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
|
| 227 |
+
pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 228 |
+
gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 229 |
+
mode: single
|
| 230 |
+
checkpoint:
|
| 231 |
+
load: none
|
| 232 |
+
hf_repo_id: null
|
| 233 |
+
save_best_model: false
|
| 234 |
+
save_final_model: true
|
| 235 |
+
save_pt_file: false
|
| 236 |
+
save_safetensors_file: true
|
| 237 |
+
local:
|
| 238 |
+
keep_last_n: 1
|
| 239 |
+
sync:
|
| 240 |
+
enabled: false
|
| 241 |
+
repo_id: null
|
| 242 |
+
keep_last_n: 0
|
| 243 |
+
sync_every_n_checkpoints: 1
|
| 244 |
+
resume_policy: local_latest
|
| 245 |
+
run_id: flappy_fix_latency_2_200ep_7k2steps_plain_multi
|
| 246 |
+
output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi
|
| 247 |
+
config_yaml: null
|
| 248 |
+
is_debug: false
|
| 249 |
+
version_id: '0.21'
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/config.yaml
ADDED
|
@@ -0,0 +1,102 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
checkpoint:
|
| 2 |
+
local:
|
| 3 |
+
keep_last_n: 1
|
| 4 |
+
save_best_model: false
|
| 5 |
+
save_final_model: true
|
| 6 |
+
save_pt_file: false
|
| 7 |
+
save_safetensors_file: true
|
| 8 |
+
sync:
|
| 9 |
+
enabled: false
|
| 10 |
+
keep_last_n: 0
|
| 11 |
+
repo_id: null
|
| 12 |
+
datasets:
|
| 13 |
+
vla_data:
|
| 14 |
+
data_mix: flappy_train__bridge
|
| 15 |
+
dataset_py: lerobot_datasets
|
| 16 |
+
eval_data_mix: flappy_train__bridge__val
|
| 17 |
+
latency_curriculum:
|
| 18 |
+
enabled: false
|
| 19 |
+
obs_image_size: null
|
| 20 |
+
per_device_batch_size: 16
|
| 21 |
+
framework:
|
| 22 |
+
action_model:
|
| 23 |
+
action_dim: 7
|
| 24 |
+
action_env_dim: 2
|
| 25 |
+
action_hidden_dim: 2560
|
| 26 |
+
action_horizon: 1
|
| 27 |
+
action_model_type: MLP
|
| 28 |
+
loss_type: discrete_ce
|
| 29 |
+
kv_memory:
|
| 30 |
+
enabled: false
|
| 31 |
+
packed_train: false
|
| 32 |
+
rebased_sink: true
|
| 33 |
+
rollout_len: 8
|
| 34 |
+
window: 4
|
| 35 |
+
name: QwenOFT
|
| 36 |
+
qwenvl:
|
| 37 |
+
attn_implementation: flash_attention_2
|
| 38 |
+
base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 39 |
+
enable_gradient_checkpointing: true
|
| 40 |
+
output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi
|
| 41 |
+
rl_games:
|
| 42 |
+
env_eval:
|
| 43 |
+
distributed_mode: rank_sharded
|
| 44 |
+
enabled: true
|
| 45 |
+
eval_backend: latency_bench
|
| 46 |
+
eval_parallel_envs: 5
|
| 47 |
+
fixed_episode_seeds: true
|
| 48 |
+
image_size: 224
|
| 49 |
+
image_transform: raw_rgb
|
| 50 |
+
latency:
|
| 51 |
+
prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
| 52 |
+
mid_train:
|
| 53 |
+
enabled: true
|
| 54 |
+
interval_steps: 250
|
| 55 |
+
latencies:
|
| 56 |
+
- 2
|
| 57 |
+
max_steps_per_episode: 3600
|
| 58 |
+
num_episodes: 20
|
| 59 |
+
prompt_mode: raw
|
| 60 |
+
seed: 42
|
| 61 |
+
model_alias: openvla
|
| 62 |
+
task: flappy
|
| 63 |
+
run_id: flappy_fix_latency_2_200ep_7k2steps_plain_multi
|
| 64 |
+
run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 65 |
+
seed: 42
|
| 66 |
+
trainer:
|
| 67 |
+
distributed_backend: deepspeed
|
| 68 |
+
eval_action_classification: false
|
| 69 |
+
eval_action_classification_interval: null
|
| 70 |
+
eval_interval: 250
|
| 71 |
+
eval_num_batches: 50
|
| 72 |
+
freeze_llm_layers: []
|
| 73 |
+
freeze_modules: ''
|
| 74 |
+
freeze_tied_embedding: false
|
| 75 |
+
freeze_vit: false
|
| 76 |
+
gradient_accumulation_steps: 4
|
| 77 |
+
is_resume: false
|
| 78 |
+
learning_rate:
|
| 79 |
+
action_model: 0.0001
|
| 80 |
+
base: 2.0e-05
|
| 81 |
+
qwen_vl_interface: 1.0e-05
|
| 82 |
+
logging_frequency: 1
|
| 83 |
+
lr_scheduler_type: cosine_with_min_lr
|
| 84 |
+
max_train_steps: 4000
|
| 85 |
+
num_warmup_steps: 100
|
| 86 |
+
optimizer:
|
| 87 |
+
betas:
|
| 88 |
+
- 0.9
|
| 89 |
+
- 0.95
|
| 90 |
+
eps: 1.0e-08
|
| 91 |
+
fused: true
|
| 92 |
+
weight_decay: 1.0e-08
|
| 93 |
+
per_latency_eval_num_batches: null
|
| 94 |
+
pretrained_checkpoint: null
|
| 95 |
+
profile_timing:
|
| 96 |
+
enabled: false
|
| 97 |
+
reload_modules: null
|
| 98 |
+
save_interval: 500
|
| 99 |
+
scheduler_specific_kwargs:
|
| 100 |
+
min_lr: 1.0e-06
|
| 101 |
+
wandb_entity: saberrr-zju
|
| 102 |
+
wandb_project: starVLA_rl_games
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/dataset_statistics.json
ADDED
|
@@ -0,0 +1,127 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"new_embodiment": {
|
| 3 |
+
"action": {
|
| 4 |
+
"mean": [
|
| 5 |
+
0.8029062747955322,
|
| 6 |
+
0.19709371030330658,
|
| 7 |
+
0.0,
|
| 8 |
+
0.0,
|
| 9 |
+
0.0,
|
| 10 |
+
0.0,
|
| 11 |
+
0.0
|
| 12 |
+
],
|
| 13 |
+
"std": [
|
| 14 |
+
0.395094633102417,
|
| 15 |
+
0.395094633102417,
|
| 16 |
+
0.0,
|
| 17 |
+
0.0,
|
| 18 |
+
0.0,
|
| 19 |
+
0.0,
|
| 20 |
+
0.0
|
| 21 |
+
],
|
| 22 |
+
"max": [
|
| 23 |
+
1.0,
|
| 24 |
+
1.0,
|
| 25 |
+
0.0,
|
| 26 |
+
0.0,
|
| 27 |
+
0.0,
|
| 28 |
+
0.0,
|
| 29 |
+
0.0
|
| 30 |
+
],
|
| 31 |
+
"min": [
|
| 32 |
+
0.0,
|
| 33 |
+
0.0,
|
| 34 |
+
0.0,
|
| 35 |
+
0.0,
|
| 36 |
+
0.0,
|
| 37 |
+
0.0,
|
| 38 |
+
0.0
|
| 39 |
+
],
|
| 40 |
+
"q01": [
|
| 41 |
+
0.0,
|
| 42 |
+
0.0,
|
| 43 |
+
0.0,
|
| 44 |
+
0.0,
|
| 45 |
+
0.0,
|
| 46 |
+
0.0,
|
| 47 |
+
0.0
|
| 48 |
+
],
|
| 49 |
+
"q99": [
|
| 50 |
+
1.0,
|
| 51 |
+
1.0,
|
| 52 |
+
0.0,
|
| 53 |
+
0.0,
|
| 54 |
+
0.0,
|
| 55 |
+
0.0,
|
| 56 |
+
0.0
|
| 57 |
+
],
|
| 58 |
+
"mask": [
|
| 59 |
+
true,
|
| 60 |
+
true,
|
| 61 |
+
true,
|
| 62 |
+
true,
|
| 63 |
+
true,
|
| 64 |
+
true,
|
| 65 |
+
true
|
| 66 |
+
]
|
| 67 |
+
},
|
| 68 |
+
"state": {
|
| 69 |
+
"mean": [
|
| 70 |
+
0.0,
|
| 71 |
+
0.0,
|
| 72 |
+
0.0,
|
| 73 |
+
0.0,
|
| 74 |
+
0.0,
|
| 75 |
+
0.0,
|
| 76 |
+
0.0
|
| 77 |
+
],
|
| 78 |
+
"std": [
|
| 79 |
+
0.0,
|
| 80 |
+
0.0,
|
| 81 |
+
0.0,
|
| 82 |
+
0.0,
|
| 83 |
+
0.0,
|
| 84 |
+
0.0,
|
| 85 |
+
0.0
|
| 86 |
+
],
|
| 87 |
+
"max": [
|
| 88 |
+
0.0,
|
| 89 |
+
0.0,
|
| 90 |
+
0.0,
|
| 91 |
+
0.0,
|
| 92 |
+
0.0,
|
| 93 |
+
0.0,
|
| 94 |
+
0.0
|
| 95 |
+
],
|
| 96 |
+
"min": [
|
| 97 |
+
0.0,
|
| 98 |
+
0.0,
|
| 99 |
+
0.0,
|
| 100 |
+
0.0,
|
| 101 |
+
0.0,
|
| 102 |
+
0.0,
|
| 103 |
+
0.0
|
| 104 |
+
],
|
| 105 |
+
"q01": [
|
| 106 |
+
0.0,
|
| 107 |
+
0.0,
|
| 108 |
+
0.0,
|
| 109 |
+
0.0,
|
| 110 |
+
0.0,
|
| 111 |
+
0.0,
|
| 112 |
+
0.0
|
| 113 |
+
],
|
| 114 |
+
"q99": [
|
| 115 |
+
0.0,
|
| 116 |
+
0.0,
|
| 117 |
+
0.0,
|
| 118 |
+
0.0,
|
| 119 |
+
0.0,
|
| 120 |
+
0.0,
|
| 121 |
+
0.0
|
| 122 |
+
]
|
| 123 |
+
},
|
| 124 |
+
"num_transitions": 1291269,
|
| 125 |
+
"num_trajectories": 180
|
| 126 |
+
}
|
| 127 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/dataset_statistics_eval.json
ADDED
|
@@ -0,0 +1,127 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"new_embodiment": {
|
| 3 |
+
"action": {
|
| 4 |
+
"mean": [
|
| 5 |
+
0.8033548593521118,
|
| 6 |
+
0.19664514064788818,
|
| 7 |
+
0.0,
|
| 8 |
+
0.0,
|
| 9 |
+
0.0,
|
| 10 |
+
0.0,
|
| 11 |
+
0.0
|
| 12 |
+
],
|
| 13 |
+
"std": [
|
| 14 |
+
0.39764848351478577,
|
| 15 |
+
0.39764848351478577,
|
| 16 |
+
0.0,
|
| 17 |
+
0.0,
|
| 18 |
+
0.0,
|
| 19 |
+
0.0,
|
| 20 |
+
0.0
|
| 21 |
+
],
|
| 22 |
+
"max": [
|
| 23 |
+
1.0,
|
| 24 |
+
1.0,
|
| 25 |
+
0.0,
|
| 26 |
+
0.0,
|
| 27 |
+
0.0,
|
| 28 |
+
0.0,
|
| 29 |
+
0.0
|
| 30 |
+
],
|
| 31 |
+
"min": [
|
| 32 |
+
0.0,
|
| 33 |
+
0.0,
|
| 34 |
+
0.0,
|
| 35 |
+
0.0,
|
| 36 |
+
0.0,
|
| 37 |
+
0.0,
|
| 38 |
+
0.0
|
| 39 |
+
],
|
| 40 |
+
"q01": [
|
| 41 |
+
0.0,
|
| 42 |
+
0.0,
|
| 43 |
+
0.0,
|
| 44 |
+
0.0,
|
| 45 |
+
0.0,
|
| 46 |
+
0.0,
|
| 47 |
+
0.0
|
| 48 |
+
],
|
| 49 |
+
"q99": [
|
| 50 |
+
1.0,
|
| 51 |
+
1.0,
|
| 52 |
+
0.0,
|
| 53 |
+
0.0,
|
| 54 |
+
0.0,
|
| 55 |
+
0.0,
|
| 56 |
+
0.0
|
| 57 |
+
],
|
| 58 |
+
"mask": [
|
| 59 |
+
true,
|
| 60 |
+
true,
|
| 61 |
+
true,
|
| 62 |
+
true,
|
| 63 |
+
true,
|
| 64 |
+
true,
|
| 65 |
+
true
|
| 66 |
+
]
|
| 67 |
+
},
|
| 68 |
+
"state": {
|
| 69 |
+
"mean": [
|
| 70 |
+
0.0,
|
| 71 |
+
0.0,
|
| 72 |
+
0.0,
|
| 73 |
+
0.0,
|
| 74 |
+
0.0,
|
| 75 |
+
0.0,
|
| 76 |
+
0.0
|
| 77 |
+
],
|
| 78 |
+
"std": [
|
| 79 |
+
0.0,
|
| 80 |
+
0.0,
|
| 81 |
+
0.0,
|
| 82 |
+
0.0,
|
| 83 |
+
0.0,
|
| 84 |
+
0.0,
|
| 85 |
+
0.0
|
| 86 |
+
],
|
| 87 |
+
"max": [
|
| 88 |
+
0.0,
|
| 89 |
+
0.0,
|
| 90 |
+
0.0,
|
| 91 |
+
0.0,
|
| 92 |
+
0.0,
|
| 93 |
+
0.0,
|
| 94 |
+
0.0
|
| 95 |
+
],
|
| 96 |
+
"min": [
|
| 97 |
+
0.0,
|
| 98 |
+
0.0,
|
| 99 |
+
0.0,
|
| 100 |
+
0.0,
|
| 101 |
+
0.0,
|
| 102 |
+
0.0,
|
| 103 |
+
0.0
|
| 104 |
+
],
|
| 105 |
+
"q01": [
|
| 106 |
+
0.0,
|
| 107 |
+
0.0,
|
| 108 |
+
0.0,
|
| 109 |
+
0.0,
|
| 110 |
+
0.0,
|
| 111 |
+
0.0,
|
| 112 |
+
0.0
|
| 113 |
+
],
|
| 114 |
+
"q99": [
|
| 115 |
+
0.0,
|
| 116 |
+
0.0,
|
| 117 |
+
0.0,
|
| 118 |
+
0.0,
|
| 119 |
+
0.0,
|
| 120 |
+
0.0,
|
| 121 |
+
0.0
|
| 122 |
+
]
|
| 123 |
+
},
|
| 124 |
+
"num_transitions": 143553,
|
| 125 |
+
"num_trajectories": 20
|
| 126 |
+
}
|
| 127 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1000.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 29.395000371709465,
|
| 7 |
+
"mean_length": 255.9,
|
| 8 |
+
"std_reward": 69.04561960432308,
|
| 9 |
+
"std_length": 556.9244024102372,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
5.000000089406967,
|
| 12 |
+
6.200000092387199,
|
| 13 |
+
6.100000090897083,
|
| 14 |
+
3.90000007301569,
|
| 15 |
+
6.200000092387199,
|
| 16 |
+
5.000000089406967,
|
| 17 |
+
5.000000089406967,
|
| 18 |
+
5.000000089406967,
|
| 19 |
+
169.50000200420618,
|
| 20 |
+
5.000000089406967,
|
| 21 |
+
3.90000007301569,
|
| 22 |
+
48.50000058859587,
|
| 23 |
+
5.000000089406967,
|
| 24 |
+
3.90000007301569,
|
| 25 |
+
5.000000089406967,
|
| 26 |
+
5.000000089406967,
|
| 27 |
+
4.900000087916851,
|
| 28 |
+
284.8000033646822,
|
| 29 |
+
5.000000089406967,
|
| 30 |
+
5.000000089406967
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
61,
|
| 34 |
+
64,
|
| 35 |
+
63,
|
| 36 |
+
50,
|
| 37 |
+
64,
|
| 38 |
+
61,
|
| 39 |
+
61,
|
| 40 |
+
61,
|
| 41 |
+
1382,
|
| 42 |
+
61,
|
| 43 |
+
50,
|
| 44 |
+
406,
|
| 45 |
+
61,
|
| 46 |
+
50,
|
| 47 |
+
61,
|
| 48 |
+
61,
|
| 49 |
+
60,
|
| 50 |
+
2319,
|
| 51 |
+
61,
|
| 52 |
+
61
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 1000,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 29.395000371709465,
|
| 112 |
+
"mean_length": 255.9,
|
| 113 |
+
"std_reward": 69.04561960432308,
|
| 114 |
+
"std_length": 556.9244024102372,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 29.395000371709465,
|
| 117 |
+
"macro_mean_length": 255.9,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1250.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 253.63500299341976,
|
| 7 |
+
"mean_length": 2063.0,
|
| 8 |
+
"std_reward": 160.78951731733707,
|
| 9 |
+
"std_length": 1294.759552967268,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
118.70000141113997,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
102.90000123530626,
|
| 16 |
+
244.6000028848648,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
47.00000058114529,
|
| 19 |
+
426.60000501573086,
|
| 20 |
+
149.20000177621841,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
107.30000128597021,
|
| 23 |
+
218.40000258386135,
|
| 24 |
+
76.50000091642141,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
32.80000041425228,
|
| 27 |
+
23.200000301003456,
|
| 28 |
+
228.700002707541,
|
| 29 |
+
384.5000045225024,
|
| 30 |
+
244.70000288635492
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
973,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
851,
|
| 38 |
+
1989,
|
| 39 |
+
3600,
|
| 40 |
+
400,
|
| 41 |
+
3458,
|
| 42 |
+
1224,
|
| 43 |
+
3600,
|
| 44 |
+
886,
|
| 45 |
+
1781,
|
| 46 |
+
632,
|
| 47 |
+
3600,
|
| 48 |
+
285,
|
| 49 |
+
207,
|
| 50 |
+
1866,
|
| 51 |
+
3118,
|
| 52 |
+
1990
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 1250,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 253.63500299341976,
|
| 112 |
+
"mean_length": 2063.0,
|
| 113 |
+
"std_reward": 160.78951731733707,
|
| 114 |
+
"std_length": 1294.759552967268,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 253.63500299341976,
|
| 117 |
+
"macro_mean_length": 2063.0,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1500.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 349.4700041130185,
|
| 7 |
+
"mean_length": 2834.35,
|
| 8 |
+
"std_reward": 147.5672443637608,
|
| 9 |
+
"std_length": 1188.609829801184,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
134.4000016003847,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
325.9000038430095,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
208.90000247210264,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
13.000000178813934,
|
| 21 |
+
353.900004170835,
|
| 22 |
+
90.6000010818243,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
82.90000099688768,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
1103,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
2649,
|
| 38 |
+
3600,
|
| 39 |
+
1704,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
123,
|
| 43 |
+
2875,
|
| 44 |
+
746,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
687,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 1500,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 349.4700041130185,
|
| 112 |
+
"mean_length": 2834.35,
|
| 113 |
+
"std_reward": 147.5672443637608,
|
| 114 |
+
"std_length": 1188.609829801184,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 349.4700041130185,
|
| 117 |
+
"macro_mean_length": 2834.35,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_1750.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 256.01500301845374,
|
| 7 |
+
"mean_length": 2080.5,
|
| 8 |
+
"std_reward": 161.3821578877714,
|
| 9 |
+
"std_length": 1301.248304513785,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
379.5000044628978,
|
| 12 |
+
113.50000134855509,
|
| 13 |
+
132.60000157356262,
|
| 14 |
+
76.80000092089176,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
62.80000075697899,
|
| 18 |
+
47.00000058114529,
|
| 19 |
+
151.00000178813934,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
109.00000129640102,
|
| 23 |
+
90.6000010818243,
|
| 24 |
+
387.3000045642257,
|
| 25 |
+
361.00000424683094,
|
| 26 |
+
309.5000036433339,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
34.60000042617321,
|
| 30 |
+
197.50000233203173
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3077,
|
| 34 |
+
930,
|
| 35 |
+
1085,
|
| 36 |
+
635,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
522,
|
| 40 |
+
400,
|
| 41 |
+
1233,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
894,
|
| 45 |
+
746,
|
| 46 |
+
3146,
|
| 47 |
+
2928,
|
| 48 |
+
2512,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
294,
|
| 52 |
+
1608
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 1750,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 256.01500301845374,
|
| 112 |
+
"mean_length": 2080.5,
|
| 113 |
+
"std_reward": 161.3821578877714,
|
| 114 |
+
"std_length": 1301.248304513785,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 256.01500301845374,
|
| 117 |
+
"macro_mean_length": 2080.5,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2000.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 411.61500483863057,
|
| 7 |
+
"mean_length": 3334.25,
|
| 8 |
+
"std_reward": 101.14185342523868,
|
| 9 |
+
"std_length": 815.0359424589814,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
48.60000059008598,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
180.9000021442771
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
407,
|
| 41 |
+
3600,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
1478
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 2000,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 411.61500483863057,
|
| 112 |
+
"mean_length": 3334.25,
|
| 113 |
+
"std_reward": 101.14185342523868,
|
| 114 |
+
"std_length": 815.0359424589814,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 411.61500483863057,
|
| 117 |
+
"macro_mean_length": 3334.25,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2250.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 444.6000052243471,
|
| 7 |
+
"mean_length": 3600.0,
|
| 8 |
+
"std_reward": 0.0,
|
| 9 |
+
"std_length": 0.0,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 2250,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 444.6000052243471,
|
| 112 |
+
"mean_length": 3600.0,
|
| 113 |
+
"std_reward": 0.0,
|
| 114 |
+
"std_length": 0.0,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 444.6000052243471,
|
| 117 |
+
"macro_mean_length": 3600.0,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_250.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 6.000000090152025,
|
| 7 |
+
"mean_length": 62.45,
|
| 8 |
+
"std_reward": 0.2792848018357637,
|
| 9 |
+
"std_length": 0.9205976319760986,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
6.100000090897083,
|
| 12 |
+
6.000000089406967,
|
| 13 |
+
4.800000086426735,
|
| 14 |
+
6.100000090897083,
|
| 15 |
+
6.000000089406967,
|
| 16 |
+
6.100000090897083,
|
| 17 |
+
6.100000090897083,
|
| 18 |
+
6.100000090897083,
|
| 19 |
+
6.000000089406967,
|
| 20 |
+
6.100000090897083,
|
| 21 |
+
6.100000090897083,
|
| 22 |
+
6.000000089406967,
|
| 23 |
+
6.100000090897083,
|
| 24 |
+
6.100000090897083,
|
| 25 |
+
6.100000090897083,
|
| 26 |
+
6.100000090897083,
|
| 27 |
+
6.000000089406967,
|
| 28 |
+
6.000000089406967,
|
| 29 |
+
6.000000089406967,
|
| 30 |
+
6.100000090897083
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
63,
|
| 34 |
+
62,
|
| 35 |
+
59,
|
| 36 |
+
63,
|
| 37 |
+
62,
|
| 38 |
+
63,
|
| 39 |
+
63,
|
| 40 |
+
63,
|
| 41 |
+
62,
|
| 42 |
+
63,
|
| 43 |
+
63,
|
| 44 |
+
62,
|
| 45 |
+
63,
|
| 46 |
+
63,
|
| 47 |
+
63,
|
| 48 |
+
63,
|
| 49 |
+
62,
|
| 50 |
+
62,
|
| 51 |
+
62,
|
| 52 |
+
63
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 250,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 6.000000090152025,
|
| 112 |
+
"mean_length": 62.45,
|
| 113 |
+
"std_reward": 0.2792848018357637,
|
| 114 |
+
"std_length": 0.9205976319760986,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 6.000000090152025,
|
| 117 |
+
"macro_mean_length": 62.45,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2500.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 354.9100041769445,
|
| 7 |
+
"mean_length": 2878.4,
|
| 8 |
+
"std_reward": 139.38672588911118,
|
| 9 |
+
"std_length": 1122.3577148128843,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
228.60000270605087,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
46.60000057518482,
|
| 18 |
+
353.900004170835,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
344.4000040590763,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
121.30000144988298,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
104.80000124871731,
|
| 30 |
+
118.80000141263008
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
1865,
|
| 34 |
+
3600,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
396,
|
| 40 |
+
2875,
|
| 41 |
+
3600,
|
| 42 |
+
3600,
|
| 43 |
+
2798,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
999,
|
| 50 |
+
3600,
|
| 51 |
+
861,
|
| 52 |
+
974
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 2500,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 354.9100041769445,
|
| 112 |
+
"mean_length": 2878.4,
|
| 113 |
+
"std_reward": 139.38672588911118,
|
| 114 |
+
"std_length": 1122.3577148128843,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 354.9100041769445,
|
| 117 |
+
"macro_mean_length": 2878.4,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_2750.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 426.8100050166249,
|
| 7 |
+
"mean_length": 3457.05,
|
| 8 |
+
"std_reward": 70.95351307600934,
|
| 9 |
+
"std_length": 572.0222438856725,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
118.50000140815973,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
440.60000517964363,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
418.90000493079424,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
971,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3571,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3399,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 2750,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 426.8100050166249,
|
| 112 |
+
"mean_length": 3457.05,
|
| 113 |
+
"std_reward": 70.95351307600934,
|
| 114 |
+
"std_length": 572.0222438856725,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 426.8100050166249,
|
| 117 |
+
"macro_mean_length": 3457.05,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3000.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 422.8200049698353,
|
| 7 |
+
"mean_length": 3424.7,
|
| 8 |
+
"std_reward": 73.7419604241364,
|
| 9 |
+
"std_length": 594.1030297852384,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
118.70000141113997,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
334.9000039473176,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
973,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
3600,
|
| 43 |
+
2721,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 3000,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 422.8200049698353,
|
| 112 |
+
"mean_length": 3424.7,
|
| 113 |
+
"std_reward": 73.7419604241364,
|
| 114 |
+
"std_length": 594.1030297852384,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 422.8200049698353,
|
| 117 |
+
"macro_mean_length": 3424.7,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3250.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 417.7050049100071,
|
| 7 |
+
"mean_length": 3383.45,
|
| 8 |
+
"std_reward": 96.75278649231183,
|
| 9 |
+
"std_length": 779.8917537068845,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
6.800000101327896,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
344.5000040605664,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
3600,
|
| 35 |
+
70,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
2799,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 3250,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 417.7050049100071,
|
| 112 |
+
"mean_length": 3383.45,
|
| 113 |
+
"std_reward": 96.75278649231183,
|
| 114 |
+
"std_length": 779.8917537068845,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 417.7050049100071,
|
| 117 |
+
"macro_mean_length": 3383.45,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3500.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 412.7750048529357,
|
| 7 |
+
"mean_length": 3344.25,
|
| 8 |
+
"std_reward": 80.25203440101174,
|
| 9 |
+
"std_length": 645.9581159022619,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
120.50000143796206,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
334.9000039473176,
|
| 22 |
+
267.6000031530857,
|
| 23 |
+
418.90000493079424,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
991,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
3600,
|
| 43 |
+
2721,
|
| 44 |
+
2174,
|
| 45 |
+
3399,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 3500,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 412.7750048529357,
|
| 112 |
+
"mean_length": 3344.25,
|
| 113 |
+
"std_reward": 80.25203440101174,
|
| 114 |
+
"std_length": 645.9581159022619,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 412.7750048529357,
|
| 117 |
+
"macro_mean_length": 3344.25,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_3750.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 414.9000048771501,
|
| 7 |
+
"mean_length": 3360.8,
|
| 8 |
+
"std_reward": 89.51117911923446,
|
| 9 |
+
"std_length": 720.8735395338076,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
120.50000143796206,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
174.70000206679106,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
444.6000052243471,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
444.6000052243471,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
991,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
1425,
|
| 42 |
+
3600,
|
| 43 |
+
3600,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
3600,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 3750,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 414.9000048771501,
|
| 112 |
+
"mean_length": 3360.8,
|
| 113 |
+
"std_reward": 89.51117911923446,
|
| 114 |
+
"std_length": 720.8735395338076,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 414.9000048771501,
|
| 117 |
+
"macro_mean_length": 3360.8,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_4000.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 408.3500048011541,
|
| 7 |
+
"mean_length": 3308.45,
|
| 8 |
+
"std_reward": 93.69927803918887,
|
| 9 |
+
"std_length": 753.9609721331734,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
120.50000143796206,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
334.9000039473176,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
153.40000182390213,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
3600,
|
| 34 |
+
991,
|
| 35 |
+
3600,
|
| 36 |
+
3600,
|
| 37 |
+
3600,
|
| 38 |
+
3600,
|
| 39 |
+
3600,
|
| 40 |
+
3600,
|
| 41 |
+
3600,
|
| 42 |
+
3600,
|
| 43 |
+
2721,
|
| 44 |
+
3600,
|
| 45 |
+
3600,
|
| 46 |
+
1257,
|
| 47 |
+
3600,
|
| 48 |
+
3600,
|
| 49 |
+
3600,
|
| 50 |
+
3600,
|
| 51 |
+
3600,
|
| 52 |
+
3600
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 4000,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 408.3500048011541,
|
| 112 |
+
"mean_length": 3308.45,
|
| 113 |
+
"std_reward": 93.69927803918887,
|
| 114 |
+
"std_length": 753.9609721331734,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 408.3500048011541,
|
| 117 |
+
"macro_mean_length": 3308.45,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_500.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 13.590000185370446,
|
| 7 |
+
"mean_length": 127.55,
|
| 8 |
+
"std_reward": 31.173288608948123,
|
| 9 |
+
"std_length": 251.05725940510064,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
4.800000086426735,
|
| 12 |
+
32.700000412762165,
|
| 13 |
+
3.90000007301569,
|
| 14 |
+
3.90000007301569,
|
| 15 |
+
146.80000174045563,
|
| 16 |
+
4.800000086426735,
|
| 17 |
+
3.90000007301569,
|
| 18 |
+
4.800000086426735,
|
| 19 |
+
6.3000000938773155,
|
| 20 |
+
6.600000098347664,
|
| 21 |
+
3.90000007301569,
|
| 22 |
+
6.3000000938773155,
|
| 23 |
+
3.90000007301569,
|
| 24 |
+
3.90000007301569,
|
| 25 |
+
4.500000081956387,
|
| 26 |
+
4.800000086426735,
|
| 27 |
+
9.200000137090683,
|
| 28 |
+
6.3000000938773155,
|
| 29 |
+
3.90000007301569,
|
| 30 |
+
6.600000098347664
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
59,
|
| 34 |
+
284,
|
| 35 |
+
50,
|
| 36 |
+
50,
|
| 37 |
+
1200,
|
| 38 |
+
59,
|
| 39 |
+
50,
|
| 40 |
+
59,
|
| 41 |
+
65,
|
| 42 |
+
68,
|
| 43 |
+
50,
|
| 44 |
+
65,
|
| 45 |
+
50,
|
| 46 |
+
50,
|
| 47 |
+
56,
|
| 48 |
+
59,
|
| 49 |
+
94,
|
| 50 |
+
65,
|
| 51 |
+
50,
|
| 52 |
+
68
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 500,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 13.590000185370446,
|
| 112 |
+
"mean_length": 127.55,
|
| 113 |
+
"std_reward": 31.173288608948123,
|
| 114 |
+
"std_length": 251.05725940510064,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 13.590000185370446,
|
| 117 |
+
"macro_mean_length": 127.55,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/mid_train/step_750.json
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 20,
|
| 6 |
+
"mean_reward": 38.45000047534704,
|
| 7 |
+
"mean_length": 327.45,
|
| 8 |
+
"std_reward": 105.02031592997427,
|
| 9 |
+
"std_length": 846.6170016601368,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
6.500000096857548,
|
| 12 |
+
444.6000052243471,
|
| 13 |
+
4.500000081956387,
|
| 14 |
+
6.200000092387199,
|
| 15 |
+
8.400000125169754,
|
| 16 |
+
6.500000096857548,
|
| 17 |
+
3.90000007301569,
|
| 18 |
+
6.500000096857548,
|
| 19 |
+
5.000000089406967,
|
| 20 |
+
4.100000075995922,
|
| 21 |
+
6.200000092387199,
|
| 22 |
+
4.900000087916851,
|
| 23 |
+
4.100000075995922,
|
| 24 |
+
6.200000092387199,
|
| 25 |
+
4.100000075995922,
|
| 26 |
+
6.500000096857548,
|
| 27 |
+
227.90000269562006,
|
| 28 |
+
4.900000087916851,
|
| 29 |
+
3.90000007301569,
|
| 30 |
+
4.100000075995922
|
| 31 |
+
],
|
| 32 |
+
"episode_lengths": [
|
| 33 |
+
67,
|
| 34 |
+
3600,
|
| 35 |
+
56,
|
| 36 |
+
64,
|
| 37 |
+
86,
|
| 38 |
+
67,
|
| 39 |
+
50,
|
| 40 |
+
67,
|
| 41 |
+
61,
|
| 42 |
+
52,
|
| 43 |
+
64,
|
| 44 |
+
60,
|
| 45 |
+
52,
|
| 46 |
+
64,
|
| 47 |
+
52,
|
| 48 |
+
67,
|
| 49 |
+
1858,
|
| 50 |
+
60,
|
| 51 |
+
50,
|
| 52 |
+
52
|
| 53 |
+
],
|
| 54 |
+
"decoded_action_hist": {},
|
| 55 |
+
"fixed_episode_seeds": true,
|
| 56 |
+
"eval_seed": 42,
|
| 57 |
+
"episode_seeds": [
|
| 58 |
+
null,
|
| 59 |
+
null,
|
| 60 |
+
null,
|
| 61 |
+
null,
|
| 62 |
+
null,
|
| 63 |
+
null,
|
| 64 |
+
null,
|
| 65 |
+
null,
|
| 66 |
+
null,
|
| 67 |
+
null,
|
| 68 |
+
null,
|
| 69 |
+
null,
|
| 70 |
+
null,
|
| 71 |
+
null,
|
| 72 |
+
null,
|
| 73 |
+
null,
|
| 74 |
+
null,
|
| 75 |
+
null,
|
| 76 |
+
null,
|
| 77 |
+
null
|
| 78 |
+
],
|
| 79 |
+
"episode_indices": [
|
| 80 |
+
0,
|
| 81 |
+
1,
|
| 82 |
+
2,
|
| 83 |
+
3,
|
| 84 |
+
4,
|
| 85 |
+
5,
|
| 86 |
+
6,
|
| 87 |
+
7,
|
| 88 |
+
8,
|
| 89 |
+
9,
|
| 90 |
+
10,
|
| 91 |
+
11,
|
| 92 |
+
12,
|
| 93 |
+
13,
|
| 94 |
+
14,
|
| 95 |
+
15,
|
| 96 |
+
16,
|
| 97 |
+
17,
|
| 98 |
+
18,
|
| 99 |
+
19
|
| 100 |
+
]
|
| 101 |
+
}
|
| 102 |
+
},
|
| 103 |
+
"aggregate": {
|
| 104 |
+
"stage": "mid_train",
|
| 105 |
+
"step": 750,
|
| 106 |
+
"task": "flappy",
|
| 107 |
+
"model_alias": "openvla",
|
| 108 |
+
"fixed_episode_seeds": true,
|
| 109 |
+
"eval_seed": 42,
|
| 110 |
+
"total_episodes": 20,
|
| 111 |
+
"mean_reward": 38.45000047534704,
|
| 112 |
+
"mean_length": 327.45,
|
| 113 |
+
"std_reward": 105.02031592997427,
|
| 114 |
+
"std_length": 846.6170016601368,
|
| 115 |
+
"task_count": 1,
|
| 116 |
+
"macro_mean_reward": 38.45000047534704,
|
| 117 |
+
"macro_mean_length": 327.45,
|
| 118 |
+
"distributed_eval": true
|
| 119 |
+
}
|
| 120 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/eval/post_train/step_4000.json
ADDED
|
@@ -0,0 +1,240 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"per_latency": {
|
| 3 |
+
"flappy/latency_2": {
|
| 4 |
+
"latency": 2,
|
| 5 |
+
"num_episodes": 50,
|
| 6 |
+
"mean_reward": 403.98200474992393,
|
| 7 |
+
"mean_length": 3273.12,
|
| 8 |
+
"std_reward": 109.87717942362134,
|
| 9 |
+
"std_length": 884.5486225188529,
|
| 10 |
+
"episode_rewards": [
|
| 11 |
+
444.6000052243471,
|
| 12 |
+
120.50000143796206,
|
| 13 |
+
444.6000052243471,
|
| 14 |
+
444.6000052243471,
|
| 15 |
+
444.6000052243471,
|
| 16 |
+
444.6000052243471,
|
| 17 |
+
444.6000052243471,
|
| 18 |
+
444.6000052243471,
|
| 19 |
+
444.6000052243471,
|
| 20 |
+
444.6000052243471,
|
| 21 |
+
334.9000039473176,
|
| 22 |
+
444.6000052243471,
|
| 23 |
+
444.6000052243471,
|
| 24 |
+
153.40000182390213,
|
| 25 |
+
444.6000052243471,
|
| 26 |
+
444.6000052243471,
|
| 27 |
+
444.6000052243471,
|
| 28 |
+
444.6000052243471,
|
| 29 |
+
444.6000052243471,
|
| 30 |
+
444.6000052243471,
|
| 31 |
+
444.6000052243471,
|
| 32 |
+
444.6000052243471,
|
| 33 |
+
444.6000052243471,
|
| 34 |
+
444.6000052243471,
|
| 35 |
+
444.6000052243471,
|
| 36 |
+
444.6000052243471,
|
| 37 |
+
444.6000052243471,
|
| 38 |
+
444.6000052243471,
|
| 39 |
+
4.700000084936619,
|
| 40 |
+
444.6000052243471,
|
| 41 |
+
444.6000052243471,
|
| 42 |
+
444.6000052243471,
|
| 43 |
+
444.6000052243471,
|
| 44 |
+
444.6000052243471,
|
| 45 |
+
444.6000052243471,
|
| 46 |
+
444.6000052243471,
|
| 47 |
+
4.700000084936619,
|
| 48 |
+
444.6000052243471,
|
| 49 |
+
444.6000052243471,
|
| 50 |
+
444.6000052243471,
|
| 51 |
+
444.6000052243471,
|
| 52 |
+
174.70000206679106,
|
| 53 |
+
444.6000052243471,
|
| 54 |
+
444.6000052243471,
|
| 55 |
+
444.6000052243471,
|
| 56 |
+
288.4000034034252,
|
| 57 |
+
444.6000052243471,
|
| 58 |
+
444.6000052243471,
|
| 59 |
+
444.6000052243471,
|
| 60 |
+
444.6000052243471
|
| 61 |
+
],
|
| 62 |
+
"episode_lengths": [
|
| 63 |
+
3600,
|
| 64 |
+
991,
|
| 65 |
+
3600,
|
| 66 |
+
3600,
|
| 67 |
+
3600,
|
| 68 |
+
3600,
|
| 69 |
+
3600,
|
| 70 |
+
3600,
|
| 71 |
+
3600,
|
| 72 |
+
3600,
|
| 73 |
+
2721,
|
| 74 |
+
3600,
|
| 75 |
+
3600,
|
| 76 |
+
1257,
|
| 77 |
+
3600,
|
| 78 |
+
3600,
|
| 79 |
+
3600,
|
| 80 |
+
3600,
|
| 81 |
+
3600,
|
| 82 |
+
3600,
|
| 83 |
+
3600,
|
| 84 |
+
3600,
|
| 85 |
+
3600,
|
| 86 |
+
3600,
|
| 87 |
+
3600,
|
| 88 |
+
3600,
|
| 89 |
+
3600,
|
| 90 |
+
3600,
|
| 91 |
+
58,
|
| 92 |
+
3600,
|
| 93 |
+
3600,
|
| 94 |
+
3600,
|
| 95 |
+
3600,
|
| 96 |
+
3600,
|
| 97 |
+
3600,
|
| 98 |
+
3600,
|
| 99 |
+
58,
|
| 100 |
+
3600,
|
| 101 |
+
3600,
|
| 102 |
+
3600,
|
| 103 |
+
3600,
|
| 104 |
+
1425,
|
| 105 |
+
3600,
|
| 106 |
+
3600,
|
| 107 |
+
3600,
|
| 108 |
+
2346,
|
| 109 |
+
3600,
|
| 110 |
+
3600,
|
| 111 |
+
3600,
|
| 112 |
+
3600
|
| 113 |
+
],
|
| 114 |
+
"decoded_action_hist": {},
|
| 115 |
+
"fixed_episode_seeds": true,
|
| 116 |
+
"eval_seed": 42,
|
| 117 |
+
"episode_seeds": [
|
| 118 |
+
null,
|
| 119 |
+
null,
|
| 120 |
+
null,
|
| 121 |
+
null,
|
| 122 |
+
null,
|
| 123 |
+
null,
|
| 124 |
+
null,
|
| 125 |
+
null,
|
| 126 |
+
null,
|
| 127 |
+
null,
|
| 128 |
+
null,
|
| 129 |
+
null,
|
| 130 |
+
null,
|
| 131 |
+
null,
|
| 132 |
+
null,
|
| 133 |
+
null,
|
| 134 |
+
null,
|
| 135 |
+
null,
|
| 136 |
+
null,
|
| 137 |
+
null,
|
| 138 |
+
null,
|
| 139 |
+
null,
|
| 140 |
+
null,
|
| 141 |
+
null,
|
| 142 |
+
null,
|
| 143 |
+
null,
|
| 144 |
+
null,
|
| 145 |
+
null,
|
| 146 |
+
null,
|
| 147 |
+
null,
|
| 148 |
+
null,
|
| 149 |
+
null,
|
| 150 |
+
null,
|
| 151 |
+
null,
|
| 152 |
+
null,
|
| 153 |
+
null,
|
| 154 |
+
null,
|
| 155 |
+
null,
|
| 156 |
+
null,
|
| 157 |
+
null,
|
| 158 |
+
null,
|
| 159 |
+
null,
|
| 160 |
+
null,
|
| 161 |
+
null,
|
| 162 |
+
null,
|
| 163 |
+
null,
|
| 164 |
+
null,
|
| 165 |
+
null,
|
| 166 |
+
null,
|
| 167 |
+
null
|
| 168 |
+
],
|
| 169 |
+
"episode_indices": [
|
| 170 |
+
0,
|
| 171 |
+
1,
|
| 172 |
+
2,
|
| 173 |
+
3,
|
| 174 |
+
4,
|
| 175 |
+
5,
|
| 176 |
+
6,
|
| 177 |
+
7,
|
| 178 |
+
8,
|
| 179 |
+
9,
|
| 180 |
+
10,
|
| 181 |
+
11,
|
| 182 |
+
12,
|
| 183 |
+
13,
|
| 184 |
+
14,
|
| 185 |
+
15,
|
| 186 |
+
16,
|
| 187 |
+
17,
|
| 188 |
+
18,
|
| 189 |
+
19,
|
| 190 |
+
20,
|
| 191 |
+
21,
|
| 192 |
+
22,
|
| 193 |
+
23,
|
| 194 |
+
24,
|
| 195 |
+
25,
|
| 196 |
+
26,
|
| 197 |
+
27,
|
| 198 |
+
28,
|
| 199 |
+
29,
|
| 200 |
+
30,
|
| 201 |
+
31,
|
| 202 |
+
32,
|
| 203 |
+
33,
|
| 204 |
+
34,
|
| 205 |
+
35,
|
| 206 |
+
36,
|
| 207 |
+
37,
|
| 208 |
+
38,
|
| 209 |
+
39,
|
| 210 |
+
40,
|
| 211 |
+
41,
|
| 212 |
+
42,
|
| 213 |
+
43,
|
| 214 |
+
44,
|
| 215 |
+
45,
|
| 216 |
+
46,
|
| 217 |
+
47,
|
| 218 |
+
48,
|
| 219 |
+
49
|
| 220 |
+
]
|
| 221 |
+
}
|
| 222 |
+
},
|
| 223 |
+
"aggregate": {
|
| 224 |
+
"stage": "post_train",
|
| 225 |
+
"step": 4000,
|
| 226 |
+
"task": "flappy",
|
| 227 |
+
"model_alias": "openvla",
|
| 228 |
+
"fixed_episode_seeds": true,
|
| 229 |
+
"eval_seed": 42,
|
| 230 |
+
"total_episodes": 50,
|
| 231 |
+
"mean_reward": 403.98200474992393,
|
| 232 |
+
"mean_length": 3273.12,
|
| 233 |
+
"std_reward": 109.87717942362134,
|
| 234 |
+
"std_length": 884.5486225188529,
|
| 235 |
+
"task_count": 1,
|
| 236 |
+
"macro_mean_reward": 403.98200474992393,
|
| 237 |
+
"macro_mean_length": 3273.12,
|
| 238 |
+
"distributed_eval": true
|
| 239 |
+
}
|
| 240 |
+
}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/config.yaml
ADDED
|
@@ -0,0 +1,247 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
framework:
|
| 2 |
+
qwenvl:
|
| 3 |
+
base_vlm: /workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 4 |
+
attn_implementation: flash_attention_2
|
| 5 |
+
flex_backend: triton
|
| 6 |
+
enable_gradient_checkpointing: true
|
| 7 |
+
action_model:
|
| 8 |
+
state_dim: 7
|
| 9 |
+
loss_type: discrete_ce
|
| 10 |
+
action_horizon: 1
|
| 11 |
+
future_action_window_size: 0
|
| 12 |
+
past_action_window_size: 0
|
| 13 |
+
action_dim: 7
|
| 14 |
+
action_env_dim: 2
|
| 15 |
+
kv_memory:
|
| 16 |
+
enabled: false
|
| 17 |
+
window: 4
|
| 18 |
+
rollout_len: 8
|
| 19 |
+
packed_train: false
|
| 20 |
+
rebased_sink: true
|
| 21 |
+
name: QwenOFT
|
| 22 |
+
datasets:
|
| 23 |
+
vla_data:
|
| 24 |
+
dataset_py: lerobot_datasets
|
| 25 |
+
include_state: true
|
| 26 |
+
data_root_dir: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
|
| 27 |
+
data_mix: flappy_train__bridge
|
| 28 |
+
eval_data_mix: flappy_train__bridge__val
|
| 29 |
+
custom_mixtures_path: null
|
| 30 |
+
action_type: discrete
|
| 31 |
+
sequential_step_sampling: false
|
| 32 |
+
eval_sequential_step_sampling: null
|
| 33 |
+
num_workers: 8
|
| 34 |
+
eval_num_workers: 8
|
| 35 |
+
prefetch_factor: 4
|
| 36 |
+
persistent_workers: true
|
| 37 |
+
pin_memory: true
|
| 38 |
+
shuffle: true
|
| 39 |
+
action_balance:
|
| 40 |
+
enabled: false
|
| 41 |
+
strategy: balanced_epoch
|
| 42 |
+
action_key: action_id
|
| 43 |
+
target_flap_fraction: 0.3
|
| 44 |
+
noop_id: 0
|
| 45 |
+
flap_id: 1
|
| 46 |
+
latency_curriculum:
|
| 47 |
+
enabled: false
|
| 48 |
+
strategy: exclusive
|
| 49 |
+
latencies: null
|
| 50 |
+
phase_steps: null
|
| 51 |
+
phase_distributions: null
|
| 52 |
+
new_latency_passes: 1.0
|
| 53 |
+
replay_passes: 0.25
|
| 54 |
+
target_total_passes: 2.0
|
| 55 |
+
final_equalization: true
|
| 56 |
+
step_budget_mode: auto
|
| 57 |
+
eval_at_phase_end: false
|
| 58 |
+
save_at_phase_end: false
|
| 59 |
+
computed_plan: null
|
| 60 |
+
per_device_batch_size: 16
|
| 61 |
+
load_all_data_for_training: true
|
| 62 |
+
num_obs_frames: 4
|
| 63 |
+
image_mode: multiframe
|
| 64 |
+
prompt_mode: raw
|
| 65 |
+
stitch_grid:
|
| 66 |
+
- 2
|
| 67 |
+
- 2
|
| 68 |
+
obs_image_size: null
|
| 69 |
+
video_backend: torchvision_av
|
| 70 |
+
dataset:
|
| 71 |
+
source_hf: ''
|
| 72 |
+
config_name: null
|
| 73 |
+
source_subdir: null
|
| 74 |
+
converted_name: flappy_train
|
| 75 |
+
single_source_hf: ''
|
| 76 |
+
mixed_source_hf: ''
|
| 77 |
+
single_converted_name: flappy_train
|
| 78 |
+
mixed_converted_name: flappy_mixed_latency_train
|
| 79 |
+
single_latency_filter: null
|
| 80 |
+
mixed_latency_filter: null
|
| 81 |
+
force_download: false
|
| 82 |
+
setup_force: false
|
| 83 |
+
skip_verification: false
|
| 84 |
+
verify_rows: 200
|
| 85 |
+
max_episodes: null
|
| 86 |
+
episodes_per_latency: null
|
| 87 |
+
latency_filter: null
|
| 88 |
+
debug_subset:
|
| 89 |
+
enabled: false
|
| 90 |
+
max_episodes: 5
|
| 91 |
+
suffix: debug
|
| 92 |
+
base_model:
|
| 93 |
+
repo_id: Qwen/Qwen3-VL-4B-Instruct
|
| 94 |
+
initialization:
|
| 95 |
+
checkpoint_local_dir: playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
|
| 96 |
+
checkpoint_hf_repo_id: StarVLA/Qwen3VL-OFT-Bridge-RT-1
|
| 97 |
+
checkpoint_filename: checkpoints/steps_5000_pytorch_model.pt
|
| 98 |
+
trainer:
|
| 99 |
+
max_train_steps: 4000
|
| 100 |
+
num_warmup_steps: 100
|
| 101 |
+
save_interval: 500
|
| 102 |
+
eval_interval: 250
|
| 103 |
+
eval_num_batches: 50
|
| 104 |
+
per_latency_eval_num_batches: null
|
| 105 |
+
eval_action_classification: false
|
| 106 |
+
eval_action_classification_interval: null
|
| 107 |
+
cc_f1_tolerance: 1
|
| 108 |
+
learning_rate:
|
| 109 |
+
base: 2.0e-05
|
| 110 |
+
qwen_vl_interface: 1.0e-05
|
| 111 |
+
action_model: 0.0001
|
| 112 |
+
lr_scheduler_type: cosine_with_min_lr
|
| 113 |
+
scheduler_specific_kwargs:
|
| 114 |
+
min_lr: 1.0e-06
|
| 115 |
+
freeze_modules: ''
|
| 116 |
+
freeze_vit: false
|
| 117 |
+
freeze_tied_embedding: false
|
| 118 |
+
freeze_llm_layers: []
|
| 119 |
+
loss_scale:
|
| 120 |
+
vla: 1.0
|
| 121 |
+
vlm: 0.1
|
| 122 |
+
max_grad_norm: 1.0
|
| 123 |
+
weight_decay: 0.0
|
| 124 |
+
logging_frequency: 1
|
| 125 |
+
profile_timing:
|
| 126 |
+
enabled: false
|
| 127 |
+
log_interval: 10
|
| 128 |
+
gradient_clipping: 1.0
|
| 129 |
+
gradient_accumulation_steps: 4
|
| 130 |
+
distributed_backend: deepspeed
|
| 131 |
+
is_resume: false
|
| 132 |
+
pretrained_checkpoint: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
|
| 133 |
+
resume_step: 0
|
| 134 |
+
reload_modules: null
|
| 135 |
+
optimizer:
|
| 136 |
+
name: AdamW
|
| 137 |
+
betas:
|
| 138 |
+
- 0.9
|
| 139 |
+
- 0.95
|
| 140 |
+
eps: 1.0e-08
|
| 141 |
+
weight_decay: 1.0e-08
|
| 142 |
+
fused: true
|
| 143 |
+
save_format: pt
|
| 144 |
+
workspace_dir: WORKSPACE_DIR
|
| 145 |
+
run_root_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 146 |
+
seed: 42
|
| 147 |
+
wandb_entity: saberrr-zju
|
| 148 |
+
wandb_project: starVLA_rl_games
|
| 149 |
+
auth:
|
| 150 |
+
env_file: null
|
| 151 |
+
hf_token_env: HF_TOKEN
|
| 152 |
+
wandb_api_key_env: WANDB_API_KEY
|
| 153 |
+
paths:
|
| 154 |
+
run_root_dir: results/Checkpoints
|
| 155 |
+
dataset_local_dir: data/flappy_fix_latency_2_200ep_7k2steps
|
| 156 |
+
dataset_cache_dir: null
|
| 157 |
+
base_model_dir: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 158 |
+
accelerate_config: starVLA/config/deepseeds/deepspeed_zero2.yaml
|
| 159 |
+
launch:
|
| 160 |
+
use_accelerate: true
|
| 161 |
+
gpus: null
|
| 162 |
+
num_processes: 1
|
| 163 |
+
dry_run: false
|
| 164 |
+
conda:
|
| 165 |
+
enabled: true
|
| 166 |
+
env_name: null
|
| 167 |
+
rl_games:
|
| 168 |
+
model_alias: openvla
|
| 169 |
+
env_eval:
|
| 170 |
+
image_size: 224
|
| 171 |
+
frameskip: 1
|
| 172 |
+
image_transform: raw_rgb
|
| 173 |
+
prompt_mode: raw
|
| 174 |
+
ghost_trail:
|
| 175 |
+
history_frames: 5
|
| 176 |
+
gamma: 1.3
|
| 177 |
+
min_alpha: 35
|
| 178 |
+
scroll_px_per_step: 4.0
|
| 179 |
+
ground_fraction: 0.22
|
| 180 |
+
seed: 42
|
| 181 |
+
fixed_episode_seeds: true
|
| 182 |
+
latency_seed_stride: 0
|
| 183 |
+
task_seed_stride: 0
|
| 184 |
+
task_description: ''
|
| 185 |
+
eval_parallel_envs: 5
|
| 186 |
+
enabled: true
|
| 187 |
+
eval_backend: latency_bench
|
| 188 |
+
distributed_mode: rank_sharded
|
| 189 |
+
vectorized:
|
| 190 |
+
enabled: false
|
| 191 |
+
batch_size: 1
|
| 192 |
+
latency:
|
| 193 |
+
prompt_map_path: /workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
| 194 |
+
mode: single
|
| 195 |
+
values:
|
| 196 |
+
- 0
|
| 197 |
+
mid_train:
|
| 198 |
+
enabled: true
|
| 199 |
+
interval_steps: 250
|
| 200 |
+
latencies:
|
| 201 |
+
- 2
|
| 202 |
+
num_episodes: 20
|
| 203 |
+
max_steps_per_episode: 3600
|
| 204 |
+
post_train:
|
| 205 |
+
enabled: true
|
| 206 |
+
latencies:
|
| 207 |
+
- 2
|
| 208 |
+
num_episodes: 50
|
| 209 |
+
max_steps_per_episode: 3600
|
| 210 |
+
task: flappy
|
| 211 |
+
initialization_mode: bridge
|
| 212 |
+
action_carrier: bridge
|
| 213 |
+
model: openvla
|
| 214 |
+
env: flappy
|
| 215 |
+
init: bridge
|
| 216 |
+
bridge_base_model:
|
| 217 |
+
repo_id:
|
| 218 |
+
openvla: Qwen/Qwen3-VL-4B-Instruct
|
| 219 |
+
pi0: StarVLA/Qwen2.5-VL-3B-Instruct-Action
|
| 220 |
+
pi05: Qwen/Qwen3-VL-4B-Instruct
|
| 221 |
+
gr00t: Qwen/Qwen3-VL-4B-Instruct
|
| 222 |
+
local_dir:
|
| 223 |
+
openvla: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 224 |
+
pi0: playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
|
| 225 |
+
pi05: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 226 |
+
gr00t: playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 227 |
+
mode: single
|
| 228 |
+
checkpoint:
|
| 229 |
+
load: none
|
| 230 |
+
hf_repo_id: null
|
| 231 |
+
save_best_model: false
|
| 232 |
+
save_final_model: true
|
| 233 |
+
save_pt_file: false
|
| 234 |
+
save_safetensors_file: true
|
| 235 |
+
local:
|
| 236 |
+
keep_last_n: 1
|
| 237 |
+
sync:
|
| 238 |
+
enabled: false
|
| 239 |
+
repo_id: null
|
| 240 |
+
keep_last_n: 0
|
| 241 |
+
sync_every_n_checkpoints: 1
|
| 242 |
+
resume_policy: local_latest
|
| 243 |
+
run_id: flappy_fix_latency_2_200ep_7k2steps_plain_multi
|
| 244 |
+
output_dir: null
|
| 245 |
+
config_yaml: null
|
| 246 |
+
is_debug: false
|
| 247 |
+
version_id: 0.21
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/hydra.yaml
ADDED
|
@@ -0,0 +1,368 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
hydra:
|
| 2 |
+
run:
|
| 3 |
+
dir: ${run_root_dir}/${run_id}/hydra
|
| 4 |
+
sweep:
|
| 5 |
+
dir: multirun/${now:%Y-%m-%d}/${now:%H-%M-%S}
|
| 6 |
+
subdir: ${hydra.job.num}
|
| 7 |
+
launcher:
|
| 8 |
+
_target_: hydra._internal.core_plugins.basic_launcher.BasicLauncher
|
| 9 |
+
sweeper:
|
| 10 |
+
_target_: hydra._internal.core_plugins.basic_sweeper.BasicSweeper
|
| 11 |
+
max_batch_size: null
|
| 12 |
+
params: null
|
| 13 |
+
help:
|
| 14 |
+
app_name: ${hydra.job.name}
|
| 15 |
+
header: '${hydra.help.app_name} is powered by Hydra.
|
| 16 |
+
|
| 17 |
+
'
|
| 18 |
+
footer: 'Powered by Hydra (https://hydra.cc)
|
| 19 |
+
|
| 20 |
+
Use --hydra-help to view Hydra specific help
|
| 21 |
+
|
| 22 |
+
'
|
| 23 |
+
template: '${hydra.help.header}
|
| 24 |
+
|
| 25 |
+
== Configuration groups ==
|
| 26 |
+
|
| 27 |
+
Compose your configuration from those groups (group=option)
|
| 28 |
+
|
| 29 |
+
|
| 30 |
+
$APP_CONFIG_GROUPS
|
| 31 |
+
|
| 32 |
+
|
| 33 |
+
== Config ==
|
| 34 |
+
|
| 35 |
+
Override anything in the config (foo.bar=value)
|
| 36 |
+
|
| 37 |
+
|
| 38 |
+
$CONFIG
|
| 39 |
+
|
| 40 |
+
|
| 41 |
+
${hydra.help.footer}
|
| 42 |
+
|
| 43 |
+
'
|
| 44 |
+
hydra_help:
|
| 45 |
+
template: 'Hydra (${hydra.runtime.version})
|
| 46 |
+
|
| 47 |
+
See https://hydra.cc for more info.
|
| 48 |
+
|
| 49 |
+
|
| 50 |
+
== Flags ==
|
| 51 |
+
|
| 52 |
+
$FLAGS_HELP
|
| 53 |
+
|
| 54 |
+
|
| 55 |
+
== Configuration groups ==
|
| 56 |
+
|
| 57 |
+
Compose your configuration from those groups (For example, append hydra/job_logging=disabled
|
| 58 |
+
to command line)
|
| 59 |
+
|
| 60 |
+
|
| 61 |
+
$HYDRA_CONFIG_GROUPS
|
| 62 |
+
|
| 63 |
+
|
| 64 |
+
Use ''--cfg hydra'' to Show the Hydra config.
|
| 65 |
+
|
| 66 |
+
'
|
| 67 |
+
hydra_help: ???
|
| 68 |
+
hydra_logging:
|
| 69 |
+
version: 1
|
| 70 |
+
formatters:
|
| 71 |
+
simple:
|
| 72 |
+
format: '[%(asctime)s][HYDRA] %(message)s'
|
| 73 |
+
handlers:
|
| 74 |
+
console:
|
| 75 |
+
class: logging.StreamHandler
|
| 76 |
+
formatter: simple
|
| 77 |
+
stream: ext://sys.stdout
|
| 78 |
+
root:
|
| 79 |
+
level: INFO
|
| 80 |
+
handlers:
|
| 81 |
+
- console
|
| 82 |
+
loggers:
|
| 83 |
+
logging_example:
|
| 84 |
+
level: DEBUG
|
| 85 |
+
disable_existing_loggers: false
|
| 86 |
+
job_logging:
|
| 87 |
+
version: 1
|
| 88 |
+
formatters:
|
| 89 |
+
simple:
|
| 90 |
+
format: '[%(asctime)s][%(name)s][%(levelname)s] - %(message)s'
|
| 91 |
+
handlers:
|
| 92 |
+
console:
|
| 93 |
+
class: logging.StreamHandler
|
| 94 |
+
formatter: simple
|
| 95 |
+
stream: ext://sys.stdout
|
| 96 |
+
file:
|
| 97 |
+
class: logging.FileHandler
|
| 98 |
+
formatter: simple
|
| 99 |
+
filename: ${hydra.runtime.output_dir}/${hydra.job.name}.log
|
| 100 |
+
root:
|
| 101 |
+
level: INFO
|
| 102 |
+
handlers:
|
| 103 |
+
- console
|
| 104 |
+
- file
|
| 105 |
+
disable_existing_loggers: false
|
| 106 |
+
env: {}
|
| 107 |
+
mode: RUN
|
| 108 |
+
searchpath: []
|
| 109 |
+
callbacks: {}
|
| 110 |
+
output_subdir: .hydra
|
| 111 |
+
overrides:
|
| 112 |
+
hydra:
|
| 113 |
+
- hydra.mode=RUN
|
| 114 |
+
task:
|
| 115 |
+
- model=openvla
|
| 116 |
+
- env=flappy
|
| 117 |
+
- init=bridge
|
| 118 |
+
- mode=single
|
| 119 |
+
- ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 120 |
+
- ++framework.qwenvl.attn_implementation=flash_attention_2
|
| 121 |
+
- ++framework.qwenvl.flex_backend=triton
|
| 122 |
+
- ++framework.qwenvl.enable_gradient_checkpointing=true
|
| 123 |
+
- ++framework.action_model.state_dim=7
|
| 124 |
+
- ++framework.action_model.loss_type=discrete_ce
|
| 125 |
+
- ++framework.action_model.action_horizon=1
|
| 126 |
+
- ++framework.action_model.future_action_window_size=0
|
| 127 |
+
- ++framework.action_model.past_action_window_size=0
|
| 128 |
+
- ++framework.action_model.action_dim=7
|
| 129 |
+
- ++framework.action_model.action_env_dim=2
|
| 130 |
+
- ++framework.kv_memory.enabled=false
|
| 131 |
+
- ++framework.kv_memory.window=4
|
| 132 |
+
- ++framework.kv_memory.rollout_len=8
|
| 133 |
+
- ++framework.kv_memory.packed_train=false
|
| 134 |
+
- ++framework.kv_memory.rebased_sink=true
|
| 135 |
+
- ++framework.name=QwenOFT
|
| 136 |
+
- ++datasets.vla_data.dataset_py=lerobot_datasets
|
| 137 |
+
- ++datasets.vla_data.include_state=true
|
| 138 |
+
- ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
|
| 139 |
+
- ++datasets.vla_data.data_mix=flappy_train
|
| 140 |
+
- ++datasets.vla_data.eval_data_mix=null
|
| 141 |
+
- ++datasets.vla_data.custom_mixtures_path=null
|
| 142 |
+
- ++datasets.vla_data.action_type=discrete
|
| 143 |
+
- ++datasets.vla_data.sequential_step_sampling=false
|
| 144 |
+
- ++datasets.vla_data.eval_sequential_step_sampling=null
|
| 145 |
+
- ++datasets.vla_data.num_workers=8
|
| 146 |
+
- ++datasets.vla_data.eval_num_workers=8
|
| 147 |
+
- ++datasets.vla_data.prefetch_factor=4
|
| 148 |
+
- ++datasets.vla_data.persistent_workers=true
|
| 149 |
+
- ++datasets.vla_data.pin_memory=true
|
| 150 |
+
- ++datasets.vla_data.shuffle=true
|
| 151 |
+
- ++datasets.vla_data.action_balance.enabled=false
|
| 152 |
+
- ++datasets.vla_data.action_balance.strategy=balanced_epoch
|
| 153 |
+
- ++datasets.vla_data.action_balance.action_key=action_id
|
| 154 |
+
- ++datasets.vla_data.action_balance.target_flap_fraction=0.3
|
| 155 |
+
- ++datasets.vla_data.action_balance.noop_id=0
|
| 156 |
+
- ++datasets.vla_data.action_balance.flap_id=1
|
| 157 |
+
- ++datasets.vla_data.latency_curriculum.enabled=false
|
| 158 |
+
- ++datasets.vla_data.latency_curriculum.strategy=exclusive
|
| 159 |
+
- ++datasets.vla_data.latency_curriculum.latencies=null
|
| 160 |
+
- ++datasets.vla_data.latency_curriculum.phase_steps=null
|
| 161 |
+
- ++datasets.vla_data.latency_curriculum.phase_distributions=null
|
| 162 |
+
- ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
|
| 163 |
+
- ++datasets.vla_data.latency_curriculum.replay_passes=0.25
|
| 164 |
+
- ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
|
| 165 |
+
- ++datasets.vla_data.latency_curriculum.final_equalization=true
|
| 166 |
+
- ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
|
| 167 |
+
- ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
|
| 168 |
+
- ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
|
| 169 |
+
- ++datasets.vla_data.latency_curriculum.computed_plan=null
|
| 170 |
+
- ++datasets.vla_data.per_device_batch_size=16
|
| 171 |
+
- ++datasets.vla_data.load_all_data_for_training=true
|
| 172 |
+
- ++datasets.vla_data.num_obs_frames=4
|
| 173 |
+
- ++datasets.vla_data.image_mode=multiframe
|
| 174 |
+
- ++datasets.vla_data.prompt_mode=raw
|
| 175 |
+
- ++datasets.vla_data.stitch_grid=[2,2]
|
| 176 |
+
- ++datasets.vla_data.obs_image_size=null
|
| 177 |
+
- ++datasets.vla_data.video_backend=torchvision_av
|
| 178 |
+
- ++dataset.source_hf=
|
| 179 |
+
- ++dataset.config_name=null
|
| 180 |
+
- ++dataset.source_subdir=null
|
| 181 |
+
- ++dataset.converted_name=flappy_train
|
| 182 |
+
- ++dataset.single_source_hf=
|
| 183 |
+
- ++dataset.mixed_source_hf=
|
| 184 |
+
- ++dataset.single_converted_name=flappy_train
|
| 185 |
+
- ++dataset.mixed_converted_name=flappy_mixed_latency_train
|
| 186 |
+
- ++dataset.single_latency_filter=null
|
| 187 |
+
- ++dataset.mixed_latency_filter=null
|
| 188 |
+
- ++dataset.force_download=false
|
| 189 |
+
- ++dataset.setup_force=false
|
| 190 |
+
- ++dataset.skip_verification=false
|
| 191 |
+
- ++dataset.verify_rows=200
|
| 192 |
+
- ++dataset.max_episodes=null
|
| 193 |
+
- ++dataset.episodes_per_latency=null
|
| 194 |
+
- ++dataset.latency_filter=null
|
| 195 |
+
- ++dataset.debug_subset.enabled=false
|
| 196 |
+
- ++dataset.debug_subset.max_episodes=5
|
| 197 |
+
- ++dataset.debug_subset.suffix=debug
|
| 198 |
+
- ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
|
| 199 |
+
- ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
|
| 200 |
+
- ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
|
| 201 |
+
- ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
|
| 202 |
+
- trainer.max_train_steps=4000
|
| 203 |
+
- trainer.num_warmup_steps=100
|
| 204 |
+
- trainer.save_interval=500
|
| 205 |
+
- trainer.eval_interval=250
|
| 206 |
+
- trainer.eval_num_batches=50
|
| 207 |
+
- trainer.per_latency_eval_num_batches=null
|
| 208 |
+
- trainer.eval_action_classification=false
|
| 209 |
+
- trainer.eval_action_classification_interval=null
|
| 210 |
+
- trainer.cc_f1_tolerance=1
|
| 211 |
+
- trainer.learning_rate.base=2e-05
|
| 212 |
+
- trainer.learning_rate.qwen_vl_interface=1e-05
|
| 213 |
+
- trainer.learning_rate.action_model=0.0001
|
| 214 |
+
- trainer.lr_scheduler_type=cosine_with_min_lr
|
| 215 |
+
- trainer.scheduler_specific_kwargs.min_lr=1e-06
|
| 216 |
+
- trainer.freeze_modules=
|
| 217 |
+
- trainer.freeze_vit=false
|
| 218 |
+
- trainer.freeze_tied_embedding=false
|
| 219 |
+
- trainer.freeze_llm_layers=[]
|
| 220 |
+
- trainer.loss_scale.vla=1.0
|
| 221 |
+
- trainer.loss_scale.vlm=0.1
|
| 222 |
+
- trainer.max_grad_norm=1.0
|
| 223 |
+
- trainer.weight_decay=0.0
|
| 224 |
+
- trainer.logging_frequency=1
|
| 225 |
+
- trainer.profile_timing.enabled=false
|
| 226 |
+
- trainer.profile_timing.log_interval=10
|
| 227 |
+
- trainer.gradient_clipping=1.0
|
| 228 |
+
- trainer.gradient_accumulation_steps=4
|
| 229 |
+
- trainer.distributed_backend=deepspeed
|
| 230 |
+
- trainer.is_resume=false
|
| 231 |
+
- trainer.pretrained_checkpoint=null
|
| 232 |
+
- trainer.resume_step=0
|
| 233 |
+
- trainer.reload_modules=null
|
| 234 |
+
- trainer.optimizer.name=AdamW
|
| 235 |
+
- trainer.optimizer.betas=[0.9,0.95]
|
| 236 |
+
- trainer.optimizer.eps=1e-08
|
| 237 |
+
- trainer.optimizer.weight_decay=1e-08
|
| 238 |
+
- trainer.optimizer.fused=true
|
| 239 |
+
- trainer.save_format=pt
|
| 240 |
+
- ++workspace_dir=WORKSPACE_DIR
|
| 241 |
+
- ++run_root_dir=results/Checkpoints
|
| 242 |
+
- ++seed=42
|
| 243 |
+
- ++wandb_entity=saberrr-zju
|
| 244 |
+
- ++wandb_project=starVLA_rl_games
|
| 245 |
+
- ++auth.env_file=null
|
| 246 |
+
- ++auth.hf_token_env=HF_TOKEN
|
| 247 |
+
- ++auth.wandb_api_key_env=WANDB_API_KEY
|
| 248 |
+
- ++paths.run_root_dir=results/Checkpoints
|
| 249 |
+
- ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
|
| 250 |
+
- ++paths.dataset_cache_dir=null
|
| 251 |
+
- ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 252 |
+
- ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
|
| 253 |
+
- ++rl_games.model_alias=openvla
|
| 254 |
+
- ++rl_games.env_eval.image_size=224
|
| 255 |
+
- ++rl_games.env_eval.frameskip=1
|
| 256 |
+
- ++rl_games.env_eval.image_transform=raw_rgb
|
| 257 |
+
- ++rl_games.env_eval.prompt_mode=raw
|
| 258 |
+
- ++rl_games.env_eval.ghost_trail.history_frames=5
|
| 259 |
+
- ++rl_games.env_eval.ghost_trail.gamma=1.3
|
| 260 |
+
- ++rl_games.env_eval.ghost_trail.min_alpha=35
|
| 261 |
+
- ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
|
| 262 |
+
- ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
|
| 263 |
+
- ++rl_games.env_eval.seed=42
|
| 264 |
+
- ++rl_games.env_eval.fixed_episode_seeds=true
|
| 265 |
+
- ++rl_games.env_eval.latency_seed_stride=0
|
| 266 |
+
- ++rl_games.env_eval.task_seed_stride=0
|
| 267 |
+
- ++rl_games.env_eval.task_description=
|
| 268 |
+
- ++rl_games.env_eval.eval_parallel_envs=5
|
| 269 |
+
- ++rl_games.env_eval.enabled=true
|
| 270 |
+
- ++rl_games.env_eval.eval_backend=latency_bench
|
| 271 |
+
- ++rl_games.env_eval.distributed_mode=rank_sharded
|
| 272 |
+
- ++rl_games.env_eval.vectorized.enabled=false
|
| 273 |
+
- ++rl_games.env_eval.vectorized.batch_size=1
|
| 274 |
+
- ++rl_games.env_eval.latency.prompt_map_path=null
|
| 275 |
+
- ++rl_games.env_eval.latency.mode=single
|
| 276 |
+
- ++rl_games.env_eval.latency.values=[0]
|
| 277 |
+
- ++rl_games.env_eval.mid_train.enabled=true
|
| 278 |
+
- ++rl_games.env_eval.mid_train.interval_steps=250
|
| 279 |
+
- ++rl_games.env_eval.mid_train.latencies=[2]
|
| 280 |
+
- ++rl_games.env_eval.mid_train.num_episodes=20
|
| 281 |
+
- ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
|
| 282 |
+
- ++rl_games.env_eval.post_train.enabled=true
|
| 283 |
+
- ++rl_games.env_eval.post_train.latencies=[2]
|
| 284 |
+
- ++rl_games.env_eval.post_train.num_episodes=50
|
| 285 |
+
- ++rl_games.env_eval.post_train.max_steps_per_episode=3600
|
| 286 |
+
- ++rl_games.task=flappy
|
| 287 |
+
- ++rl_games.initialization_mode=bridge
|
| 288 |
+
- ++rl_games.action_carrier=bridge
|
| 289 |
+
- ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
|
| 290 |
+
- ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
|
| 291 |
+
- ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
|
| 292 |
+
- ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
|
| 293 |
+
- ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 294 |
+
- ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
|
| 295 |
+
- ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 296 |
+
- ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 297 |
+
- ++checkpoint.load=none
|
| 298 |
+
- ++checkpoint.hf_repo_id=null
|
| 299 |
+
- ++checkpoint.save_best_model=false
|
| 300 |
+
- ++checkpoint.save_final_model=true
|
| 301 |
+
- ++checkpoint.save_pt_file=false
|
| 302 |
+
- ++checkpoint.save_safetensors_file=true
|
| 303 |
+
- ++checkpoint.local.keep_last_n=1
|
| 304 |
+
- ++checkpoint.sync.enabled=false
|
| 305 |
+
- ++checkpoint.sync.repo_id=null
|
| 306 |
+
- ++checkpoint.sync.keep_last_n=0
|
| 307 |
+
- ++checkpoint.sync.sync_every_n_checkpoints=1
|
| 308 |
+
- ++checkpoint.sync.resume_policy=local_latest
|
| 309 |
+
- ++run_id=flappy_fix_latency_2_200ep_7k2steps_plain_multi
|
| 310 |
+
- ++output_dir=null
|
| 311 |
+
- ++config_yaml=null
|
| 312 |
+
- ++is_debug=false
|
| 313 |
+
- ++version_id=0.21
|
| 314 |
+
- ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 315 |
+
- trainer.is_resume=false
|
| 316 |
+
- trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
|
| 317 |
+
- trainer.resume_step=0
|
| 318 |
+
- ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
|
| 319 |
+
- ++datasets.vla_data.data_mix=flappy_train__bridge
|
| 320 |
+
- ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
|
| 321 |
+
- ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 322 |
+
- ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
| 323 |
+
job:
|
| 324 |
+
name: train_starvla_hydra
|
| 325 |
+
chdir: false
|
| 326 |
+
override_dirname: ++auth.env_file=null,++auth.hf_token_env=HF_TOKEN,++auth.wandb_api_key_env=WANDB_API_KEY,++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action,++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct,++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action,++checkpoint.hf_repo_id=null,++checkpoint.load=none,++checkpoint.local.keep_last_n=1,++checkpoint.save_best_model=false,++checkpoint.save_final_model=true,++checkpoint.save_pt_file=false,++checkpoint.save_safetensors_file=true,++checkpoint.sync.enabled=false,++checkpoint.sync.keep_last_n=0,++checkpoint.sync.repo_id=null,++checkpoint.sync.resume_policy=local_latest,++checkpoint.sync.sync_every_n_checkpoints=1,++config_yaml=null,++dataset.config_name=null,++dataset.converted_name=flappy_train,++dataset.debug_subset.enabled=false,++dataset.debug_subset.max_episodes=5,++dataset.debug_subset.suffix=debug,++dataset.episodes_per_latency=null,++dataset.force_download=false,++dataset.latency_filter=null,++dataset.max_episodes=null,++dataset.mixed_converted_name=flappy_mixed_latency_train,++dataset.mixed_latency_filter=null,++dataset.mixed_source_hf=,++dataset.setup_force=false,++dataset.single_converted_name=flappy_train,++dataset.single_latency_filter=null,++dataset.single_source_hf=,++dataset.skip_verification=false,++dataset.source_hf=,++dataset.source_subdir=null,++dataset.verify_rows=200,++datasets.vla_data.action_balance.action_key=action_id,++datasets.vla_data.action_balance.enabled=false,++datasets.vla_data.action_balance.flap_id=1,++datasets.vla_data.action_balance.noop_id=0,++datasets.vla_data.action_balance.strategy=balanced_epoch,++datasets.vla_data.action_balance.target_flap_fraction=0.3,++datasets.vla_data.action_type=discrete,++datasets.vla_data.custom_mixtures_path=null,++datasets.vla_data.data_mix=flappy_train,++datasets.vla_data.data_mix=flappy_train__bridge,++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps,++datasets.vla_data.data_root_dir=playground/Datasets/rl_games,++datasets.vla_data.dataset_py=lerobot_datasets,++datasets.vla_data.eval_data_mix=flappy_train__bridge__val,++datasets.vla_data.eval_data_mix=null,++datasets.vla_data.eval_num_workers=8,++datasets.vla_data.eval_sequential_step_sampling=null,++datasets.vla_data.image_mode=multiframe,++datasets.vla_data.include_state=true,++datasets.vla_data.latency_curriculum.computed_plan=null,++datasets.vla_data.latency_curriculum.enabled=false,++datasets.vla_data.latency_curriculum.eval_at_phase_end=false,++datasets.vla_data.latency_curriculum.final_equalization=true,++datasets.vla_data.latency_curriculum.latencies=null,++datasets.vla_data.latency_curriculum.new_latency_passes=1.0,++datasets.vla_data.latency_curriculum.phase_distributions=null,++datasets.vla_data.latency_curriculum.phase_steps=null,++datasets.vla_data.latency_curriculum.replay_passes=0.25,++datasets.vla_data.latency_curriculum.save_at_phase_end=false,++datasets.vla_data.latency_curriculum.step_budget_mode=auto,++datasets.vla_data.latency_curriculum.strategy=exclusive,++datasets.vla_data.latency_curriculum.target_total_passes=2.0,++datasets.vla_data.load_all_data_for_training=true,++datasets.vla_data.num_obs_frames=4,++datasets.vla_data.num_workers=8,++datasets.vla_data.obs_image_size=null,++datasets.vla_data.per_device_batch_size=16,++datasets.vla_data.persistent_workers=true,++datasets.vla_data.pin_memory=true,++datasets.vla_data.prefetch_factor=4,++datasets.vla_data.prompt_mode=raw,++datasets.vla_data.sequential_step_sampling=false,++datasets.vla_data.shuffle=true,++datasets.vla_data.stitch_grid=[2,2],++datasets.vla_data.video_backend=torchvision_av,++framework.action_model.action_dim=7,++framework.action_model.action_env_dim=2,++framework.action_model.action_horizon=1,++framework.action_model.future_action_window_size=0,++framework.action_model.loss_type=discrete_ce,++framework.action_model.past_action_window_size=0,++framework.action_model.state_dim=7,++framework.kv_memory.enabled=false,++framework.kv_memory.packed_train=false,++framework.kv_memory.rebased_sink=true,++framework.kv_memory.rollout_len=8,++framework.kv_memory.window=4,++framework.name=QwenOFT,++framework.qwenvl.attn_implementation=flash_attention_2,++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++framework.qwenvl.enable_gradient_checkpointing=true,++framework.qwenvl.flex_backend=triton,++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt,++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1,++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1,++is_debug=false,++output_dir=null,++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml,++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct,++paths.dataset_cache_dir=null,++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps,++paths.run_root_dir=results/Checkpoints,++rl_games.action_carrier=bridge,++rl_games.env_eval.distributed_mode=rank_sharded,++rl_games.env_eval.enabled=true,++rl_games.env_eval.eval_backend=latency_bench,++rl_games.env_eval.eval_parallel_envs=5,++rl_games.env_eval.fixed_episode_seeds=true,++rl_games.env_eval.frameskip=1,++rl_games.env_eval.ghost_trail.gamma=1.3,++rl_games.env_eval.ghost_trail.ground_fraction=0.22,++rl_games.env_eval.ghost_trail.history_frames=5,++rl_games.env_eval.ghost_trail.min_alpha=35,++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0,++rl_games.env_eval.image_size=224,++rl_games.env_eval.image_transform=raw_rgb,++rl_games.env_eval.latency.mode=single,++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json,++rl_games.env_eval.latency.prompt_map_path=null,++rl_games.env_eval.latency.values=[0],++rl_games.env_eval.latency_seed_stride=0,++rl_games.env_eval.mid_train.enabled=true,++rl_games.env_eval.mid_train.interval_steps=250,++rl_games.env_eval.mid_train.latencies=[2],++rl_games.env_eval.mid_train.max_steps_per_episode=3600,++rl_games.env_eval.mid_train.num_episodes=20,++rl_games.env_eval.post_train.enabled=true,++rl_games.env_eval.post_train.latencies=[2],++rl_games.env_eval.post_train.max_steps_per_episode=3600,++rl_games.env_eval.post_train.num_episodes=50,++rl_games.env_eval.prompt_mode=raw,++rl_games.env_eval.seed=42,++rl_games.env_eval.task_description=,++rl_games.env_eval.task_seed_stride=0,++rl_games.env_eval.vectorized.batch_size=1,++rl_games.env_eval.vectorized.enabled=false,++rl_games.initialization_mode=bridge,++rl_games.model_alias=openvla,++rl_games.task=flappy,++run_id=flappy_fix_latency_2_200ep_7k2steps_plain_multi,++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints,++run_root_dir=results/Checkpoints,++seed=42,++version_id=0.21,++wandb_entity=saberrr-zju,++wandb_project=starVLA_rl_games,++workspace_dir=WORKSPACE_DIR,env=flappy,init=bridge,mode=single,model=openvla,trainer.cc_f1_tolerance=1,trainer.distributed_backend=deepspeed,trainer.eval_action_classification=false,trainer.eval_action_classification_interval=null,trainer.eval_interval=250,trainer.eval_num_batches=50,trainer.freeze_llm_layers=[],trainer.freeze_modules=,trainer.freeze_tied_embedding=false,trainer.freeze_vit=false,trainer.gradient_accumulation_steps=4,trainer.gradient_clipping=1.0,trainer.is_resume=false,trainer.is_resume=false,trainer.learning_rate.action_model=0.0001,trainer.learning_rate.base=2e-05,trainer.learning_rate.qwen_vl_interface=1e-05,trainer.logging_frequency=1,trainer.loss_scale.vla=1.0,trainer.loss_scale.vlm=0.1,trainer.lr_scheduler_type=cosine_with_min_lr,trainer.max_grad_norm=1.0,trainer.max_train_steps=4000,trainer.num_warmup_steps=100,trainer.optimizer.betas=[0.9,0.95],trainer.optimizer.eps=1e-08,trainer.optimizer.fused=true,trainer.optimizer.name=AdamW,trainer.optimizer.weight_decay=1e-08,trainer.per_latency_eval_num_batches=null,trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt,trainer.pretrained_checkpoint=null,trainer.profile_timing.enabled=false,trainer.profile_timing.log_interval=10,trainer.reload_modules=null,trainer.resume_step=0,trainer.resume_step=0,trainer.save_format=pt,trainer.save_interval=500,trainer.scheduler_specific_kwargs.min_lr=1e-06,trainer.weight_decay=0.0
|
| 327 |
+
id: ???
|
| 328 |
+
num: ???
|
| 329 |
+
config_name: train
|
| 330 |
+
env_set: {}
|
| 331 |
+
env_copy: []
|
| 332 |
+
config:
|
| 333 |
+
override_dirname:
|
| 334 |
+
kv_sep: '='
|
| 335 |
+
item_sep: ','
|
| 336 |
+
exclude_keys: []
|
| 337 |
+
runtime:
|
| 338 |
+
version: 1.3.3
|
| 339 |
+
version_base: '1.1'
|
| 340 |
+
cwd: /workspace/latency-sensitive-bench/starVLA
|
| 341 |
+
config_sources:
|
| 342 |
+
- path: hydra.conf
|
| 343 |
+
schema: pkg
|
| 344 |
+
provider: hydra
|
| 345 |
+
- path: /workspace/latency-sensitive-bench/starVLA/examples/rl_games/config
|
| 346 |
+
schema: file
|
| 347 |
+
provider: main
|
| 348 |
+
- path: ''
|
| 349 |
+
schema: structured
|
| 350 |
+
provider: schema
|
| 351 |
+
output_dir: /workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra
|
| 352 |
+
choices:
|
| 353 |
+
cross_task_setup: null
|
| 354 |
+
checkpoint: default
|
| 355 |
+
mode: single
|
| 356 |
+
init: bridge
|
| 357 |
+
env: flappy
|
| 358 |
+
model: openvla
|
| 359 |
+
hydra/env: default
|
| 360 |
+
hydra/callbacks: null
|
| 361 |
+
hydra/job_logging: default
|
| 362 |
+
hydra/hydra_logging: default
|
| 363 |
+
hydra/hydra_help: default
|
| 364 |
+
hydra/help: default
|
| 365 |
+
hydra/sweeper: basic
|
| 366 |
+
hydra/launcher: basic
|
| 367 |
+
hydra/output: default
|
| 368 |
+
verbose: false
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/.hydra/overrides.yaml
ADDED
|
@@ -0,0 +1,208 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
- model=openvla
|
| 2 |
+
- env=flappy
|
| 3 |
+
- init=bridge
|
| 4 |
+
- mode=single
|
| 5 |
+
- ++framework.qwenvl.base_vlm=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 6 |
+
- ++framework.qwenvl.attn_implementation=flash_attention_2
|
| 7 |
+
- ++framework.qwenvl.flex_backend=triton
|
| 8 |
+
- ++framework.qwenvl.enable_gradient_checkpointing=true
|
| 9 |
+
- ++framework.action_model.state_dim=7
|
| 10 |
+
- ++framework.action_model.loss_type=discrete_ce
|
| 11 |
+
- ++framework.action_model.action_horizon=1
|
| 12 |
+
- ++framework.action_model.future_action_window_size=0
|
| 13 |
+
- ++framework.action_model.past_action_window_size=0
|
| 14 |
+
- ++framework.action_model.action_dim=7
|
| 15 |
+
- ++framework.action_model.action_env_dim=2
|
| 16 |
+
- ++framework.kv_memory.enabled=false
|
| 17 |
+
- ++framework.kv_memory.window=4
|
| 18 |
+
- ++framework.kv_memory.rollout_len=8
|
| 19 |
+
- ++framework.kv_memory.packed_train=false
|
| 20 |
+
- ++framework.kv_memory.rebased_sink=true
|
| 21 |
+
- ++framework.name=QwenOFT
|
| 22 |
+
- ++datasets.vla_data.dataset_py=lerobot_datasets
|
| 23 |
+
- ++datasets.vla_data.include_state=true
|
| 24 |
+
- ++datasets.vla_data.data_root_dir=playground/Datasets/rl_games
|
| 25 |
+
- ++datasets.vla_data.data_mix=flappy_train
|
| 26 |
+
- ++datasets.vla_data.eval_data_mix=null
|
| 27 |
+
- ++datasets.vla_data.custom_mixtures_path=null
|
| 28 |
+
- ++datasets.vla_data.action_type=discrete
|
| 29 |
+
- ++datasets.vla_data.sequential_step_sampling=false
|
| 30 |
+
- ++datasets.vla_data.eval_sequential_step_sampling=null
|
| 31 |
+
- ++datasets.vla_data.num_workers=8
|
| 32 |
+
- ++datasets.vla_data.eval_num_workers=8
|
| 33 |
+
- ++datasets.vla_data.prefetch_factor=4
|
| 34 |
+
- ++datasets.vla_data.persistent_workers=true
|
| 35 |
+
- ++datasets.vla_data.pin_memory=true
|
| 36 |
+
- ++datasets.vla_data.shuffle=true
|
| 37 |
+
- ++datasets.vla_data.action_balance.enabled=false
|
| 38 |
+
- ++datasets.vla_data.action_balance.strategy=balanced_epoch
|
| 39 |
+
- ++datasets.vla_data.action_balance.action_key=action_id
|
| 40 |
+
- ++datasets.vla_data.action_balance.target_flap_fraction=0.3
|
| 41 |
+
- ++datasets.vla_data.action_balance.noop_id=0
|
| 42 |
+
- ++datasets.vla_data.action_balance.flap_id=1
|
| 43 |
+
- ++datasets.vla_data.latency_curriculum.enabled=false
|
| 44 |
+
- ++datasets.vla_data.latency_curriculum.strategy=exclusive
|
| 45 |
+
- ++datasets.vla_data.latency_curriculum.latencies=null
|
| 46 |
+
- ++datasets.vla_data.latency_curriculum.phase_steps=null
|
| 47 |
+
- ++datasets.vla_data.latency_curriculum.phase_distributions=null
|
| 48 |
+
- ++datasets.vla_data.latency_curriculum.new_latency_passes=1.0
|
| 49 |
+
- ++datasets.vla_data.latency_curriculum.replay_passes=0.25
|
| 50 |
+
- ++datasets.vla_data.latency_curriculum.target_total_passes=2.0
|
| 51 |
+
- ++datasets.vla_data.latency_curriculum.final_equalization=true
|
| 52 |
+
- ++datasets.vla_data.latency_curriculum.step_budget_mode=auto
|
| 53 |
+
- ++datasets.vla_data.latency_curriculum.eval_at_phase_end=false
|
| 54 |
+
- ++datasets.vla_data.latency_curriculum.save_at_phase_end=false
|
| 55 |
+
- ++datasets.vla_data.latency_curriculum.computed_plan=null
|
| 56 |
+
- ++datasets.vla_data.per_device_batch_size=16
|
| 57 |
+
- ++datasets.vla_data.load_all_data_for_training=true
|
| 58 |
+
- ++datasets.vla_data.num_obs_frames=4
|
| 59 |
+
- ++datasets.vla_data.image_mode=multiframe
|
| 60 |
+
- ++datasets.vla_data.prompt_mode=raw
|
| 61 |
+
- ++datasets.vla_data.stitch_grid=[2,2]
|
| 62 |
+
- ++datasets.vla_data.obs_image_size=null
|
| 63 |
+
- ++datasets.vla_data.video_backend=torchvision_av
|
| 64 |
+
- ++dataset.source_hf=
|
| 65 |
+
- ++dataset.config_name=null
|
| 66 |
+
- ++dataset.source_subdir=null
|
| 67 |
+
- ++dataset.converted_name=flappy_train
|
| 68 |
+
- ++dataset.single_source_hf=
|
| 69 |
+
- ++dataset.mixed_source_hf=
|
| 70 |
+
- ++dataset.single_converted_name=flappy_train
|
| 71 |
+
- ++dataset.mixed_converted_name=flappy_mixed_latency_train
|
| 72 |
+
- ++dataset.single_latency_filter=null
|
| 73 |
+
- ++dataset.mixed_latency_filter=null
|
| 74 |
+
- ++dataset.force_download=false
|
| 75 |
+
- ++dataset.setup_force=false
|
| 76 |
+
- ++dataset.skip_verification=false
|
| 77 |
+
- ++dataset.verify_rows=200
|
| 78 |
+
- ++dataset.max_episodes=null
|
| 79 |
+
- ++dataset.episodes_per_latency=null
|
| 80 |
+
- ++dataset.latency_filter=null
|
| 81 |
+
- ++dataset.debug_subset.enabled=false
|
| 82 |
+
- ++dataset.debug_subset.max_episodes=5
|
| 83 |
+
- ++dataset.debug_subset.suffix=debug
|
| 84 |
+
- ++base_model.repo_id=Qwen/Qwen3-VL-4B-Instruct
|
| 85 |
+
- ++initialization.checkpoint_local_dir=playground/Pretrained_models/Qwen3VL-OFT-Bridge-RT-1
|
| 86 |
+
- ++initialization.checkpoint_hf_repo_id=StarVLA/Qwen3VL-OFT-Bridge-RT-1
|
| 87 |
+
- ++initialization.checkpoint_filename=checkpoints/steps_5000_pytorch_model.pt
|
| 88 |
+
- trainer.max_train_steps=4000
|
| 89 |
+
- trainer.num_warmup_steps=100
|
| 90 |
+
- trainer.save_interval=500
|
| 91 |
+
- trainer.eval_interval=250
|
| 92 |
+
- trainer.eval_num_batches=50
|
| 93 |
+
- trainer.per_latency_eval_num_batches=null
|
| 94 |
+
- trainer.eval_action_classification=false
|
| 95 |
+
- trainer.eval_action_classification_interval=null
|
| 96 |
+
- trainer.cc_f1_tolerance=1
|
| 97 |
+
- trainer.learning_rate.base=2e-05
|
| 98 |
+
- trainer.learning_rate.qwen_vl_interface=1e-05
|
| 99 |
+
- trainer.learning_rate.action_model=0.0001
|
| 100 |
+
- trainer.lr_scheduler_type=cosine_with_min_lr
|
| 101 |
+
- trainer.scheduler_specific_kwargs.min_lr=1e-06
|
| 102 |
+
- trainer.freeze_modules=
|
| 103 |
+
- trainer.freeze_vit=false
|
| 104 |
+
- trainer.freeze_tied_embedding=false
|
| 105 |
+
- trainer.freeze_llm_layers=[]
|
| 106 |
+
- trainer.loss_scale.vla=1.0
|
| 107 |
+
- trainer.loss_scale.vlm=0.1
|
| 108 |
+
- trainer.max_grad_norm=1.0
|
| 109 |
+
- trainer.weight_decay=0.0
|
| 110 |
+
- trainer.logging_frequency=1
|
| 111 |
+
- trainer.profile_timing.enabled=false
|
| 112 |
+
- trainer.profile_timing.log_interval=10
|
| 113 |
+
- trainer.gradient_clipping=1.0
|
| 114 |
+
- trainer.gradient_accumulation_steps=4
|
| 115 |
+
- trainer.distributed_backend=deepspeed
|
| 116 |
+
- trainer.is_resume=false
|
| 117 |
+
- trainer.pretrained_checkpoint=null
|
| 118 |
+
- trainer.resume_step=0
|
| 119 |
+
- trainer.reload_modules=null
|
| 120 |
+
- trainer.optimizer.name=AdamW
|
| 121 |
+
- trainer.optimizer.betas=[0.9,0.95]
|
| 122 |
+
- trainer.optimizer.eps=1e-08
|
| 123 |
+
- trainer.optimizer.weight_decay=1e-08
|
| 124 |
+
- trainer.optimizer.fused=true
|
| 125 |
+
- trainer.save_format=pt
|
| 126 |
+
- ++workspace_dir=WORKSPACE_DIR
|
| 127 |
+
- ++run_root_dir=results/Checkpoints
|
| 128 |
+
- ++seed=42
|
| 129 |
+
- ++wandb_entity=saberrr-zju
|
| 130 |
+
- ++wandb_project=starVLA_rl_games
|
| 131 |
+
- ++auth.env_file=null
|
| 132 |
+
- ++auth.hf_token_env=HF_TOKEN
|
| 133 |
+
- ++auth.wandb_api_key_env=WANDB_API_KEY
|
| 134 |
+
- ++paths.run_root_dir=results/Checkpoints
|
| 135 |
+
- ++paths.dataset_local_dir=data/flappy_fix_latency_2_200ep_7k2steps
|
| 136 |
+
- ++paths.dataset_cache_dir=null
|
| 137 |
+
- ++paths.base_model_dir=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 138 |
+
- ++paths.accelerate_config=starVLA/config/deepseeds/deepspeed_zero2.yaml
|
| 139 |
+
- ++rl_games.model_alias=openvla
|
| 140 |
+
- ++rl_games.env_eval.image_size=224
|
| 141 |
+
- ++rl_games.env_eval.frameskip=1
|
| 142 |
+
- ++rl_games.env_eval.image_transform=raw_rgb
|
| 143 |
+
- ++rl_games.env_eval.prompt_mode=raw
|
| 144 |
+
- ++rl_games.env_eval.ghost_trail.history_frames=5
|
| 145 |
+
- ++rl_games.env_eval.ghost_trail.gamma=1.3
|
| 146 |
+
- ++rl_games.env_eval.ghost_trail.min_alpha=35
|
| 147 |
+
- ++rl_games.env_eval.ghost_trail.scroll_px_per_step=4.0
|
| 148 |
+
- ++rl_games.env_eval.ghost_trail.ground_fraction=0.22
|
| 149 |
+
- ++rl_games.env_eval.seed=42
|
| 150 |
+
- ++rl_games.env_eval.fixed_episode_seeds=true
|
| 151 |
+
- ++rl_games.env_eval.latency_seed_stride=0
|
| 152 |
+
- ++rl_games.env_eval.task_seed_stride=0
|
| 153 |
+
- ++rl_games.env_eval.task_description=
|
| 154 |
+
- ++rl_games.env_eval.eval_parallel_envs=5
|
| 155 |
+
- ++rl_games.env_eval.enabled=true
|
| 156 |
+
- ++rl_games.env_eval.eval_backend=latency_bench
|
| 157 |
+
- ++rl_games.env_eval.distributed_mode=rank_sharded
|
| 158 |
+
- ++rl_games.env_eval.vectorized.enabled=false
|
| 159 |
+
- ++rl_games.env_eval.vectorized.batch_size=1
|
| 160 |
+
- ++rl_games.env_eval.latency.prompt_map_path=null
|
| 161 |
+
- ++rl_games.env_eval.latency.mode=single
|
| 162 |
+
- ++rl_games.env_eval.latency.values=[0]
|
| 163 |
+
- ++rl_games.env_eval.mid_train.enabled=true
|
| 164 |
+
- ++rl_games.env_eval.mid_train.interval_steps=250
|
| 165 |
+
- ++rl_games.env_eval.mid_train.latencies=[2]
|
| 166 |
+
- ++rl_games.env_eval.mid_train.num_episodes=20
|
| 167 |
+
- ++rl_games.env_eval.mid_train.max_steps_per_episode=3600
|
| 168 |
+
- ++rl_games.env_eval.post_train.enabled=true
|
| 169 |
+
- ++rl_games.env_eval.post_train.latencies=[2]
|
| 170 |
+
- ++rl_games.env_eval.post_train.num_episodes=50
|
| 171 |
+
- ++rl_games.env_eval.post_train.max_steps_per_episode=3600
|
| 172 |
+
- ++rl_games.task=flappy
|
| 173 |
+
- ++rl_games.initialization_mode=bridge
|
| 174 |
+
- ++rl_games.action_carrier=bridge
|
| 175 |
+
- ++bridge_base_model.repo_id.openvla=Qwen/Qwen3-VL-4B-Instruct
|
| 176 |
+
- ++bridge_base_model.repo_id.pi0=StarVLA/Qwen2.5-VL-3B-Instruct-Action
|
| 177 |
+
- ++bridge_base_model.repo_id.pi05=Qwen/Qwen3-VL-4B-Instruct
|
| 178 |
+
- ++bridge_base_model.repo_id.gr00t=Qwen/Qwen3-VL-4B-Instruct
|
| 179 |
+
- ++bridge_base_model.local_dir.openvla=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 180 |
+
- ++bridge_base_model.local_dir.pi0=playground/Pretrained_models/Qwen2.5-VL-3B-Instruct-Action
|
| 181 |
+
- ++bridge_base_model.local_dir.pi05=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 182 |
+
- ++bridge_base_model.local_dir.gr00t=playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 183 |
+
- ++checkpoint.load=none
|
| 184 |
+
- ++checkpoint.hf_repo_id=null
|
| 185 |
+
- ++checkpoint.save_best_model=false
|
| 186 |
+
- ++checkpoint.save_final_model=true
|
| 187 |
+
- ++checkpoint.save_pt_file=false
|
| 188 |
+
- ++checkpoint.save_safetensors_file=true
|
| 189 |
+
- ++checkpoint.local.keep_last_n=1
|
| 190 |
+
- ++checkpoint.sync.enabled=false
|
| 191 |
+
- ++checkpoint.sync.repo_id=null
|
| 192 |
+
- ++checkpoint.sync.keep_last_n=0
|
| 193 |
+
- ++checkpoint.sync.sync_every_n_checkpoints=1
|
| 194 |
+
- ++checkpoint.sync.resume_policy=local_latest
|
| 195 |
+
- ++run_id=flappy_fix_latency_2_200ep_7k2steps_plain_multi
|
| 196 |
+
- ++output_dir=null
|
| 197 |
+
- ++config_yaml=null
|
| 198 |
+
- ++is_debug=false
|
| 199 |
+
- ++version_id=0.21
|
| 200 |
+
- ++run_root_dir=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints
|
| 201 |
+
- trainer.is_resume=false
|
| 202 |
+
- trainer.pretrained_checkpoint=/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/checkpoints/_initialization/StarVLA_Qwen3VL-OFT-Bridge-RT-1/checkpoints/steps_5000_pytorch_model.pt
|
| 203 |
+
- trainer.resume_step=0
|
| 204 |
+
- ++datasets.vla_data.data_root_dir=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps
|
| 205 |
+
- ++datasets.vla_data.data_mix=flappy_train__bridge
|
| 206 |
+
- ++datasets.vla_data.eval_data_mix=flappy_train__bridge__val
|
| 207 |
+
- ++framework.qwenvl.base_vlm=/workspace/latency-sensitive-bench/starVLA/playground/Pretrained_models/Qwen3-VL-4B-Instruct
|
| 208 |
+
- ++rl_games.env_eval.latency.prompt_map_path=/workspace/latency-sensitive-bench/starVLA/data/flappy_fix_latency_2_200ep_7k2steps/flappy_train__bridge/latency_prompt_map.json
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/hydra/train_starvla_hydra.log
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 1, "episode_return": 6.200000092387199, "episode_return_env": 6.200000092387199, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 64, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 64}
|
| 2 |
+
{"episode_id": 3, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
|
| 3 |
+
{"episode_id": 5, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
|
| 4 |
+
{"episode_id": 7, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
|
| 5 |
+
{"episode_id": 9, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
|
| 6 |
+
{"episode_id": 11, "episode_return": 48.50000058859587, "episode_return_env": 48.50000058859587, "game_score": 10.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 406, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 406}
|
| 7 |
+
{"episode_id": 13, "episode_return": 3.90000007301569, "episode_return_env": 3.90000007301569, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 50, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 50}
|
| 8 |
+
{"episode_id": 15, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
|
| 9 |
+
{"episode_id": 17, "episode_return": 284.8000033646822, "episode_return_env": 284.8000033646822, "game_score": 60.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2319, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2319}
|
| 10 |
+
{"episode_id": 19, "episode_return": 5.000000089406967, "episode_return_env": 5.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 61, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 61}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 118.70000141113997, "episode_return_env": 118.70000141113997, "game_score": 25.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 973, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 973}
|
| 2 |
+
{"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 3 |
+
{"episode_id": 4, "episode_return": 102.90000123530626, "episode_return_env": 102.90000123530626, "game_score": 21.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 851, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 851}
|
| 4 |
+
{"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 5 |
+
{"episode_id": 8, "episode_return": 426.60000501573086, "episode_return_env": 426.60000501573086, "game_score": 91.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3458, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3458}
|
| 6 |
+
{"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 7 |
+
{"episode_id": 12, "episode_return": 218.40000258386135, "episode_return_env": 218.40000258386135, "game_score": 46.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1781, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1781}
|
| 8 |
+
{"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 16, "episode_return": 23.200000301003456, "episode_return_env": 23.200000301003456, "game_score": 4.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 207, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 207}
|
| 10 |
+
{"episode_id": 18, "episode_return": 384.5000045225024, "episode_return_env": 384.5000045225024, "game_score": 82.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3118, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3118}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 1, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 43, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 2 |
+
{"episode_id": 3, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 45, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 3 |
+
{"episode_id": 5, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 47, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 4 |
+
{"episode_id": 7, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 49, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 5 |
+
{"episode_id": 9, "episode_return": 13.000000178813934, "episode_return_env": 13.000000178813934, "game_score": 2.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 51, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 123, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 123}
|
| 6 |
+
{"episode_id": 11, "episode_return": 90.6000010818243, "episode_return_env": 90.6000010818243, "game_score": 19.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 53, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 746, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 746}
|
| 7 |
+
{"episode_id": 13, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 55, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 8 |
+
{"episode_id": 15, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 57, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 17, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 59, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 10 |
+
{"episode_id": 19, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 61, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1500/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 379.5000044628978, "episode_return_env": 379.5000044628978, "game_score": 81.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3077, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3077}
|
| 2 |
+
{"episode_id": 2, "episode_return": 132.60000157356262, "episode_return_env": 132.60000157356262, "game_score": 28.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1085, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1085}
|
| 3 |
+
{"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 4 |
+
{"episode_id": 6, "episode_return": 62.80000075697899, "episode_return_env": 62.80000075697899, "game_score": 13.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 522, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 522}
|
| 5 |
+
{"episode_id": 8, "episode_return": 151.00000178813934, "episode_return_env": 151.00000178813934, "game_score": 32.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 1233, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 1233}
|
| 6 |
+
{"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 7 |
+
{"episode_id": 12, "episode_return": 90.6000010818243, "episode_return_env": 90.6000010818243, "game_score": 19.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 746, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 746}
|
| 8 |
+
{"episode_id": 14, "episode_return": 361.00000424683094, "episode_return_env": 361.00000424683094, "game_score": 77.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 2928, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 2928}
|
| 9 |
+
{"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 10 |
+
{"episode_id": 18, "episode_return": 34.60000042617321, "episode_return_env": 34.60000042617321, "game_score": 7.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_1750/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 294, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 294}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 2 |
+
{"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 3 |
+
{"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 4 |
+
{"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 5 |
+
{"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 6 |
+
{"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 7 |
+
{"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 8 |
+
{"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 10 |
+
{"episode_id": 18, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2000/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 2 |
+
{"episode_id": 2, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 3 |
+
{"episode_id": 4, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 4 |
+
{"episode_id": 6, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 5 |
+
{"episode_id": 8, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 6 |
+
{"episode_id": 10, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 7 |
+
{"episode_id": 12, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 8 |
+
{"episode_id": 14, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 9 |
+
{"episode_id": 16, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
| 10 |
+
{"episode_id": 18, "episode_return": 444.6000052243471, "episode_return_env": 444.6000052243471, "game_score": 94.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 3600, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 3600}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/_progress/rank_1.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2/episode_metrics.jsonl
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{"episode_id": 0, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 42, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
|
| 2 |
+
{"episode_id": 2, "episode_return": 4.800000086426735, "episode_return_env": 4.800000086426735, "game_score": 0.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 44, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 59, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 59}
|
| 3 |
+
{"episode_id": 4, "episode_return": 6.000000089406967, "episode_return_env": 6.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 46, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 62, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 62}
|
| 4 |
+
{"episode_id": 6, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 48, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
|
| 5 |
+
{"episode_id": 8, "episode_return": 6.000000089406967, "episode_return_env": 6.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 50, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 62, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 62}
|
| 6 |
+
{"episode_id": 10, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 52, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
|
| 7 |
+
{"episode_id": 12, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 54, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
|
| 8 |
+
{"episode_id": 14, "episode_return": 6.100000090897083, "episode_return_env": 6.100000090897083, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 56, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 63, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 63}
|
| 9 |
+
{"episode_id": 16, "episode_return": 6.000000089406967, "episode_return_env": 6.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 58, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 62, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 62}
|
| 10 |
+
{"episode_id": 18, "episode_return": 6.000000089406967, "episode_return_env": 6.000000089406967, "game_score": 1.0, "mean_latency_ms": 66.66666666666667, "metadata": {"checkpoint_path": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "config_name": "starvla_flappy_train_eval", "env_fps": 30.0, "env_id": "flappy", "episode_seed": 60, "frame_ms": 33.333333333333336, "instance_id": null, "instance_origin": null, "latency_type": "fixed", "mode": "simulated", "obs_fps": 30.0, "output_dir": "/workspace/latency-sensitive-bench/starVLA/results/Checkpoints/flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_250/flappy/latency_2", "policy_id": "starvla", "profile_id": null, "profile_path": null, "replay_host": null, "run_name": "starvla_flappy_train_eval", "sample_index": null, "target_device": null, "trace_index": null}, "num_actions": 62, "num_dropped_actions": 0, "num_invalid_actions": 0, "p90_latency_ms": 66.66666666666667, "p99_latency_ms": 66.66666666666667, "return_raw": null, "survival_steps": 62}
|
flappy_fix_latency_2_200ep_7k2steps_plain_multi/latency_bench_eval/mid_train/step_2500/_progress/rank_0.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"completed": 10}
|