refine stdout logging codes (#13015)
This commit is contained in:
@@ -724,8 +724,8 @@ class SchedulerOutputProcessorMixin:
|
||||
|
||||
queue_times = []
|
||||
forward_entry_times = []
|
||||
prefill_delays = []
|
||||
prefill_latencies = []
|
||||
prefill_launch_delays = []
|
||||
prefill_launch_latencies = []
|
||||
|
||||
if return_logprob:
|
||||
input_token_logprobs_val = []
|
||||
@@ -830,24 +830,10 @@ class SchedulerOutputProcessorMixin:
|
||||
queue_times.append(req.time_stats.get_queueing_time())
|
||||
forward_entry_times.append(req.time_stats.forward_entry_time)
|
||||
|
||||
if req.time_stats.prefill_start_time > 0.0:
|
||||
prefill_delays.append(
|
||||
req.time_stats.prefill_start_time
|
||||
- req.time_stats.forward_entry_time
|
||||
)
|
||||
else:
|
||||
prefill_delays.append(None)
|
||||
|
||||
if (
|
||||
req.time_stats.prefill_start_time > 0.0
|
||||
and req.time_stats.prefill_end_time > 0.0
|
||||
):
|
||||
prefill_latencies.append(
|
||||
req.time_stats.prefill_end_time
|
||||
- req.time_stats.prefill_start_time
|
||||
)
|
||||
else:
|
||||
prefill_latencies.append(None)
|
||||
prefill_launch_delays.append(req.time_stats.get_prefill_launch_delay())
|
||||
prefill_launch_latencies.append(
|
||||
req.time_stats.get_prefill_launch_latency()
|
||||
)
|
||||
|
||||
if not self.spec_algorithm.is_none():
|
||||
spec_verify_ct.append(req.spec_verify_ct)
|
||||
@@ -946,8 +932,8 @@ class SchedulerOutputProcessorMixin:
|
||||
spec_accepted_tokens=spec_accepted_tokens,
|
||||
queue_time=queue_times,
|
||||
forward_entry_time=forward_entry_times,
|
||||
prefill_delay=prefill_delays,
|
||||
prefill_latency=prefill_latencies,
|
||||
prefill_launch_delay=prefill_launch_delays,
|
||||
prefill_launch_latency=prefill_launch_latencies,
|
||||
finished_reasons=finished_reasons,
|
||||
decoded_texts=decoded_texts,
|
||||
decode_ids=decode_ids_list,
|
||||
@@ -989,8 +975,8 @@ class SchedulerOutputProcessorMixin:
|
||||
cached_tokens = []
|
||||
queue_times = []
|
||||
forward_entry_times = []
|
||||
prefill_delays = []
|
||||
prefill_latencies = []
|
||||
prefill_launch_delays = []
|
||||
prefill_launch_latencies = []
|
||||
retraction_counts = []
|
||||
for req in reqs:
|
||||
if req.finished():
|
||||
@@ -1004,24 +990,10 @@ class SchedulerOutputProcessorMixin:
|
||||
queue_times.append(req.time_stats.get_queueing_time())
|
||||
forward_entry_times.append(req.time_stats.forward_entry_time)
|
||||
|
||||
if req.time_stats.prefill_start_time > 0.0:
|
||||
prefill_delays.append(
|
||||
req.time_stats.prefill_start_time
|
||||
- req.time_stats.forward_entry_time
|
||||
)
|
||||
else:
|
||||
prefill_delays.append(None)
|
||||
|
||||
if (
|
||||
req.time_stats.prefill_start_time > 0.0
|
||||
and req.time_stats.prefill_end_time > 0.0
|
||||
):
|
||||
prefill_latencies.append(
|
||||
req.time_stats.prefill_end_time
|
||||
- req.time_stats.prefill_start_time
|
||||
)
|
||||
else:
|
||||
prefill_latencies.append(None)
|
||||
prefill_launch_delays.append(req.time_stats.get_prefill_launch_delay())
|
||||
prefill_launch_latencies.append(
|
||||
req.time_stats.get_prefill_launch_latency()
|
||||
)
|
||||
retraction_counts.append(req.retraction_count)
|
||||
self.send_to_detokenizer.send_output(
|
||||
BatchEmbeddingOutput(
|
||||
@@ -1029,8 +1001,8 @@ class SchedulerOutputProcessorMixin:
|
||||
http_worker_ipcs=http_worker_ipcs,
|
||||
queue_time=queue_times,
|
||||
forward_entry_time=forward_entry_times,
|
||||
prefill_delay=prefill_delays,
|
||||
prefill_latency=prefill_latencies,
|
||||
prefill_launch_delay=prefill_launch_delays,
|
||||
prefill_launch_latency=prefill_launch_latencies,
|
||||
finished_reasons=finished_reasons,
|
||||
embeddings=embeddings,
|
||||
prompt_tokens=prompt_tokens,
|
||||
|
||||
Reference in New Issue
Block a user