From f6e37d3edb945ae35eb3659982c487a7d3edb7b6 Mon Sep 17 00:00:00 2001 From: Lzhang-hub <57925599+Lzhang-hub@users.noreply.github.com> Date: Fri, 28 Nov 2025 17:26:32 +0800 Subject: [PATCH] [Bugfix] qwen2.5-vl spec decode accept_len low (#13904) Co-authored-by: Yuan Luo --- python/sglang/srt/models/qwen2_5_vl.py | 1 + 1 file changed, 1 insertion(+) diff --git a/python/sglang/srt/models/qwen2_5_vl.py b/python/sglang/srt/models/qwen2_5_vl.py index 6b39825cb..86df6e69f 100644 --- a/python/sglang/srt/models/qwen2_5_vl.py +++ b/python/sglang/srt/models/qwen2_5_vl.py @@ -654,6 +654,7 @@ class Qwen2_5_VLForConditionalGeneration(nn.Module): hidden_states, self.lm_head, forward_batch, + aux_hidden_states, ) else: return self.pooler(hidden_states, forward_batch)