Jonna Marie Matthiesen commited on
Commit
9560ed1
·
1 Parent(s): 1550e5f

Add FlashHead version to measurement setup

Browse files
Files changed (1) hide show
  1. config.json +13 -13
config.json CHANGED
@@ -221,9 +221,9 @@
221
  "fps"
222
  ],
223
  "experiment_setup": {
224
- "agx_thor": "Measurement setup: NVIDIA AI IoT vLLM 0.16.0 arm64, 256 tokens generated, 10 warm-up runs, averaged over 25 runs.",
225
- "agx_orin": "Measurement setup: NVIDIA AI IoT vLLM 0.16.0 tegra, 256 tokens generated, 10 warm-up runs, averaged over 25 runs.",
226
- "orin_nano": "Measurement setup: NVIDIA AI IoT vLLM 0.16.0 tegra, 256 tokens generated, 10 warm-up runs, averaged over 25 runs."
227
  },
228
  "default_device": "agx_orin"
229
  },
@@ -231,10 +231,10 @@
231
  "data_file": "data/Llama-3.2.csv",
232
  "accuracy_file": "data/acc-Llama-3.2.csv",
233
  "experiment_setup": {
234
- "agx_thor": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 arm64, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
235
- "agx_orin": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
236
- "orin_nano_super": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
237
- "rtx_3500_ada": "Measurement setup: vLLM 0.10.2, batch_size=1, 32 input tokens, 128 output tokens generated, 10 warm-up runs, averaged over 100 runs."
238
  },
239
  "default_device": "agx_orin"
240
  },
@@ -242,10 +242,10 @@
242
  "data_file": "data/Gemma-3.csv",
243
  "accuracy_file": "data/acc-Gemma-3.csv",
244
  "experiment_setup": {
245
- "agx_thor": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 arm64, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
246
  "agx_orin": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
247
  "orin_nano_super": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
248
- "rtx_3500_ada": "Measurement setup: vLLM 0.10.2, batch_size=1, 32 input tokens, 128 output tokens generated, 10 warm-up runs, averaged over 100 runs."
249
  },
250
  "default_device": "agx_orin"
251
  },
@@ -253,13 +253,13 @@
253
  "data_file": "data/Qwen3.csv",
254
  "accuracy_file": "data/acc-Qwen3.csv",
255
  "experiment_setup": {
256
- "agx_thor": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 arm64, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
257
- "agx_orin": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
258
  "orin_nano_super": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
259
- "rtx_3500_ada": "Measurement setup: vLLM 0.10.2, batch_size=1, 32 input tokens, 128 output tokens generated, 10 warm-up runs, averaged over 100 runs."
260
  },
261
  "default_device": "agx_orin"
262
  }
263
  },
264
  "accuracy_title": "Accuracy"
265
- }
 
221
  "fps"
222
  ],
223
  "experiment_setup": {
224
+ "agx_thor": "Measurement setup: NVIDIA AI IoT vLLM 0.16.0 arm64, FlashHead 0.1.9, 256 tokens generated, 10 warm-up runs, averaged over 25 runs.",
225
+ "agx_orin": "Measurement setup: NVIDIA AI IoT vLLM 0.16.0 tegra, FlashHead 0.1.9, 256 tokens generated, 10 warm-up runs, averaged over 25 runs.",
226
+ "orin_nano": "Measurement setup: NVIDIA AI IoT vLLM 0.16.0 tegra, FlashHead 0.1.9, 256 tokens generated, 10 warm-up runs, averaged over 25 runs."
227
  },
228
  "default_device": "agx_orin"
229
  },
 
231
  "data_file": "data/Llama-3.2.csv",
232
  "accuracy_file": "data/acc-Llama-3.2.csv",
233
  "experiment_setup": {
234
+ "agx_thor": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 arm64, FlashHead 0.1.7, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
235
+ "agx_orin": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, FlashHead 0.1.7, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
236
+ "orin_nano_super": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, FlashHead 0.1.7, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
237
+ "rtx_3500_ada": "Measurement setup: vLLM 0.10.2, FlashHead 0.1.7, batch_size=1, 32 input tokens, 128 output tokens generated, 10 warm-up runs, averaged over 100 runs."
238
  },
239
  "default_device": "agx_orin"
240
  },
 
242
  "data_file": "data/Gemma-3.csv",
243
  "accuracy_file": "data/acc-Gemma-3.csv",
244
  "experiment_setup": {
245
+ "agx_thor": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 arm64, FlashHead 0.1.7, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
246
  "agx_orin": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
247
  "orin_nano_super": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
248
+ "rtx_3500_ada": "Measurement setup: vLLM 0.10.2, FlashHead 0.1.7, batch_size=1, 32 input tokens, 128 output tokens generated, 10 warm-up runs, averaged over 100 runs."
249
  },
250
  "default_device": "agx_orin"
251
  },
 
253
  "data_file": "data/Qwen3.csv",
254
  "accuracy_file": "data/acc-Qwen3.csv",
255
  "experiment_setup": {
256
+ "agx_thor": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 arm64, FlashHead 0.1.7, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
257
+ "agx_orin": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, FlashHead 0.1.7, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
258
  "orin_nano_super": "Measurement setup: NVIDIA AI IoT vLLM 0.19.0 tegra, 32 input tokens, 256 output tokens generated, 10 warm-up runs, averaged over 25 runs.",
259
+ "rtx_3500_ada": "Measurement setup: vLLM 0.10.2, FlashHead 0.1.7, batch_size=1, 32 input tokens, 128 output tokens generated, 10 warm-up runs, averaged over 100 runs."
260
  },
261
  "default_device": "agx_orin"
262
  }
263
  },
264
  "accuracy_title": "Accuracy"
265
+ }