This website requires JavaScript.
Explore
Help
Sign In
chenchenghao
/
sglang
Watch
1
Star
0
Fork
0
You've already forked sglang
Code
Issues
Pull Requests
Actions
12
Packages
Projects
Releases
Wiki
Activity
Files
0f9318f7d07ce00f2e70eee7d3e3e8d6f7b35d88
sglang
/
sgl-kernel
/
benchmark
History
fzyzcjy
e85cb1ce9d
Fix quant kernel test errors and benchmark wrong output speeds (
#7604
)
2025-08-21 03:48:41 -07:00
..
bench_activation.py
…
bench_awq_dequant.py
…
bench_cutlass_mla.py
…
bench_dsv3_fused_a_gemm.py
…
bench_dsv3_router_gemm.py
[Kimi K2] dsv3_router_gemm supports NUM_EXPERTS == 384 (
#8013
)
2025-08-01 22:01:24 +08:00
bench_fp4_gemm.py
…
bench_fp8_blockwise_gemm.py
…
bench_fp8_blockwise_group_gemm.py
fix benchmark fp8 blockwise group gemm (
#8815
)
2025-08-06 21:02:21 +08:00
bench_fp8_gemm.py
[Perf] Tunings for SM100 FP8 CUTLASS kernel (
#8818
)
2025-08-13 21:59:22 -07:00
bench_int8_gemm.py
…
bench_lightning_attention_decode.py
…
bench_moe_align_block_size.py
…
bench_moe_ep_post_reorder.py
…
bench_moe_ep_pre_reorder.py
…
bench_moe_fused_gate.py
…
bench_moe_silu_and_mul.py
…
bench_moe_topk_softmax.py
…
bench_nvfp4_scaled_gemm.py
…
bench_per_tensor_quant_fp8.py
…
bench_per_token_group_quant_8bit.py
Fix quant kernel test errors and benchmark wrong output speeds (
#7604
)
2025-08-21 03:48:41 -07:00
bench_per_token_quant_fp8.py
fix per token cuda kernel hidden dim cannot divide by 16 (
#8543
)
2025-08-01 09:27:18 -07:00
bench_qserve_w4a8_gemm.py
…
bench_rotary_embedding.py
Fuse writing KV buffer into rope kernel (part 1: sgl-kernel) (
#9077
)
2025-08-12 01:46:40 -07:00
bench_top_k_top_p_sampling.py
[sgl-kernel] Support FlashInfer top_k_top_p_sampling_from_logits (
#9060
)
2025-08-14 10:56:36 -07:00