Update modelopt quantization config parsing (#13919)

Signed-off-by: Zhiyu Cheng <zhiyuc@nvidia.com>
This commit is contained in:
Zhiyu
2026-02-11 19:08:29 -08:00
committed by GitHub
parent b2d7fd5c87
commit 7e262b6496
2 changed files with 19 additions and 0 deletions

View File

@@ -197,6 +197,8 @@ def get_quant_config(
# compressed-tensors uses a compressions_config
hf_quant_config = getattr(model_config.hf_config, "compression_config", None)
if hf_quant_config is not None:
if not isinstance(hf_quant_config, dict):
hf_quant_config = hf_quant_config.to_dict()
hf_quant_config["packed_modules_mapping"] = packed_modules_mapping
return quant_cls.from_config(hf_quant_config)