clef-flash-FP8 / recipe.yaml
prithivMLmods's picture
Upload FP8 compressed quants — clef-flash(9b) via llm-compressor
332ab8a verified
Raw History Blame Contribute Delete
314 Bytes
default_stage:
default_modifiers:
QuantizationModifier:
targets: [Linear]
ignore: ['re:.*lm_head', 're:.*embed_tokens$', 're:.*visual.*', 're:.*model.visual.*',
're:.*linear_attn.*']
scheme: FP8_DYNAMIC
bypass_divisibility_checks: false
requires_calibration_data: false