Enable native ModelOpt quantization support (1/3) (#7149)
Signed-off-by: Zhiyu Cheng <zhiyuc@nvidia.com>
This commit is contained in:
@@ -226,6 +226,9 @@ def get_quant_config(
|
||||
return ModelOptFp4Config.from_config(config)
|
||||
else:
|
||||
return quant_cls.from_config(config)
|
||||
elif model_config.quantization == "modelopt_fp8":
|
||||
if config["producer"]["name"] == "modelopt_fp8":
|
||||
return quant_cls.from_config(config)
|
||||
else:
|
||||
raise ValueError(
|
||||
f"Unsupported quantization config"
|
||||
|
||||
Reference in New Issue
Block a user