diff --git a/python/sglang/srt/models/deepseek_v2.py b/python/sglang/srt/models/deepseek_v2.py index f2dd98c6e..a63efb0fd 100644 --- a/python/sglang/srt/models/deepseek_v2.py +++ b/python/sglang/srt/models/deepseek_v2.py @@ -1195,8 +1195,6 @@ class DeepseekV2AttentionMLA( scaling_factor = rope_scaling["factor"] mscale = yarn_get_mscale(scaling_factor, float(mscale_all_dim)) self.scaling = self.scaling * mscale * mscale - else: - self.rotary_emb.forward = self.rotary_emb.forward_native else: self.rotary_emb = None self.use_deepseek_yarn_rope = rope_scaling is not None