clef-flash-FP8 / generation_config.json
prithivMLmods's picture
Upload FP8 compressed quants — clef-flash(9b) via llm-compressor
332ab8a verified
Raw History Blame Contribute Delete
116 Bytes
{
"_from_model_config": true,
"eos_token_id": 248044,
"transformers_version": "5.17.0",
"use_cache": true
}