[DLLM] Fix dLLM regression (#15371)
This commit is contained in:
@@ -1834,13 +1834,11 @@ class Scheduler(
|
||||
|
||||
# Determine chunked_prefill_size for this batch
|
||||
chunked_prefill_size = self.chunked_prefill_size
|
||||
if self.chunked_req is not None:
|
||||
self.chunked_req.init_next_round_input()
|
||||
if self.enable_dynamic_chunking:
|
||||
history_len = len(self.chunked_req.prefix_indices)
|
||||
dynamic_size = self.predict_next_chunk_size(history_len)
|
||||
if dynamic_size is not None:
|
||||
chunked_prefill_size = dynamic_size
|
||||
if self.chunked_req is not None and self.enable_dynamic_chunking:
|
||||
history_len = len(self.chunked_req.prefix_indices)
|
||||
dynamic_size = self.predict_next_chunk_size(history_len)
|
||||
if dynamic_size is not None:
|
||||
chunked_prefill_size = dynamic_size
|
||||
|
||||
# Prefill policy
|
||||
adder = PrefillAdder(
|
||||
|
||||
Reference in New Issue
Block a user