refine stdout logging codes (#13015)

This commit is contained in:
yinghui
2025-11-12 00:16:14 +08:00
committed by GitHub
parent a06c44f905
commit 38a704bccb
7 changed files with 227 additions and 341 deletions
@@ -724,8 +724,8 @@ class SchedulerOutputProcessorMixin:
queue_times = []
forward_entry_times = []
prefill_delays = []
prefill_latencies = []
prefill_launch_delays = []
prefill_launch_latencies = []
if return_logprob:
input_token_logprobs_val = []
@@ -830,24 +830,10 @@ class SchedulerOutputProcessorMixin:
queue_times.append(req.time_stats.get_queueing_time())
forward_entry_times.append(req.time_stats.forward_entry_time)
if req.time_stats.prefill_start_time > 0.0:
prefill_delays.append(
req.time_stats.prefill_start_time
- req.time_stats.forward_entry_time
)
else:
prefill_delays.append(None)
if (
req.time_stats.prefill_start_time > 0.0
and req.time_stats.prefill_end_time > 0.0
):
prefill_latencies.append(
req.time_stats.prefill_end_time
- req.time_stats.prefill_start_time
)
else:
prefill_latencies.append(None)
prefill_launch_delays.append(req.time_stats.get_prefill_launch_delay())
prefill_launch_latencies.append(
req.time_stats.get_prefill_launch_latency()
)
if not self.spec_algorithm.is_none():
spec_verify_ct.append(req.spec_verify_ct)
@@ -946,8 +932,8 @@ class SchedulerOutputProcessorMixin:
spec_accepted_tokens=spec_accepted_tokens,
queue_time=queue_times,
forward_entry_time=forward_entry_times,
prefill_delay=prefill_delays,
prefill_latency=prefill_latencies,
prefill_launch_delay=prefill_launch_delays,
prefill_launch_latency=prefill_launch_latencies,
finished_reasons=finished_reasons,
decoded_texts=decoded_texts,
decode_ids=decode_ids_list,
@@ -989,8 +975,8 @@ class SchedulerOutputProcessorMixin:
cached_tokens = []
queue_times = []
forward_entry_times = []
prefill_delays = []
prefill_latencies = []
prefill_launch_delays = []
prefill_launch_latencies = []
retraction_counts = []
for req in reqs:
if req.finished():
@@ -1004,24 +990,10 @@ class SchedulerOutputProcessorMixin:
queue_times.append(req.time_stats.get_queueing_time())
forward_entry_times.append(req.time_stats.forward_entry_time)
if req.time_stats.prefill_start_time > 0.0:
prefill_delays.append(
req.time_stats.prefill_start_time
- req.time_stats.forward_entry_time
)
else:
prefill_delays.append(None)
if (
req.time_stats.prefill_start_time > 0.0
and req.time_stats.prefill_end_time > 0.0
):
prefill_latencies.append(
req.time_stats.prefill_end_time
- req.time_stats.prefill_start_time
)
else:
prefill_latencies.append(None)
prefill_launch_delays.append(req.time_stats.get_prefill_launch_delay())
prefill_launch_latencies.append(
req.time_stats.get_prefill_launch_latency()
)
retraction_counts.append(req.retraction_count)
self.send_to_detokenizer.send_output(
BatchEmbeddingOutput(
@@ -1029,8 +1001,8 @@ class SchedulerOutputProcessorMixin:
http_worker_ipcs=http_worker_ipcs,
queue_time=queue_times,
forward_entry_time=forward_entry_times,
prefill_delay=prefill_delays,
prefill_latency=prefill_latencies,
prefill_launch_delay=prefill_launch_delays,
prefill_launch_latency=prefill_launch_latencies,
finished_reasons=finished_reasons,
embeddings=embeddings,
prompt_tokens=prompt_tokens,