From 9fe56cd0fb77293331b3260af78597b5619ec9f9 Mon Sep 17 00:00:00 2001 From: yudian0504 <138860534+yudian0504@users.noreply.github.com> Date: Mon, 19 Jan 2026 14:06:11 +0800 Subject: [PATCH] Fix kernel selection in biased_grouped_topk_gpu (#17325) --- python/sglang/srt/layers/moe/topk.py | 1 - 1 file changed, 1 deletion(-) diff --git a/python/sglang/srt/layers/moe/topk.py b/python/sglang/srt/layers/moe/topk.py index c88f631ef..419786c2f 100644 --- a/python/sglang/srt/layers/moe/topk.py +++ b/python/sglang/srt/layers/moe/topk.py @@ -795,7 +795,6 @@ def biased_grouped_topk_gpu( elif ( _is_cuda - and num_fused_shared_experts == 0 # moe_fused_gate kernel ensures that num_experts/num_expert_group does not exceed MAX_VPT=32 now. And when kernel can handle MAX_VPT > 32, we can remove this assertion. and experts_per_group <= 32 and is_power_of_two(num_experts)