diff --git a/python/sglang/srt/models/deepseek_v2.py b/python/sglang/srt/models/deepseek_v2.py index d10ff54c0..13f0498ac 100644 --- a/python/sglang/srt/models/deepseek_v2.py +++ b/python/sglang/srt/models/deepseek_v2.py @@ -281,6 +281,7 @@ class MoEGate(nn.Module): elif _use_aiter and quant_config.get_name() in ( "fp8", "compressed_tensors", + "quark", ): correction_bias_dtype = torch.bfloat16 self.e_score_correction_bias = nn.Parameter(