This website requires JavaScript.
Explore
Help
Sign In
chenchenghao
/
sglang
Watch
1
Star
0
Fork
0
Code
Issues
Pull Requests
Actions
12
Packages
Projects
Releases
Wiki
Activity
Files
a3398d8478e981659c4d045635e62c8066ca6bae
sglang
/
sgl-kernel
/
benchmark
T
History
Yi Zhang
and
ispobock
2998c4bdf4
[optimize] fuse renormalize into moe_topk_softmax (
#7744
)
...
Co-authored-by: ispobock <
ispobaoke@gmail.com
>
2025-07-03 12:42:44 -07:00
..
bench_awq_dequant.py
…
bench_cutlass_mla.py
…
bench_dsv3_fused_a_gemm.py
Add dsv3 fused a gemm to sgl-kernel (
#7630
)
2025-06-29 02:52:24 -07:00
bench_dsv3_router_gemm.py
Add dsv3 router gemm kernel (
#7627
)
2025-06-29 23:31:55 -07:00
bench_fp8_blockwise_gemm.py
…
bench_fp8_blockwise_group_gemm.py
Add CUTLASS FP8 Blockscale MoE kernel for Hopper architecture (
#7278
)
2025-07-02 23:27:03 -07:00
bench_fp8_gemm.py
…
bench_int8_gemm.py
Add shapes for int8 gemm benchmark (
#3093
)
2025-01-24 12:27:30 +08:00
bench_lightning_attention_decode.py
[Fix] use
torch.cat
instead of
torch.concat
to prevent entering the
Autograd
backends. (
#4466
)
2025-03-16 00:02:47 -07:00
bench_moe_align_block_size.py
Fuse sorted_token_ids padding to moe_align_block_size kernel (
#7437
)
2025-06-24 17:44:27 -07:00
bench_moe_ep_post_reorder.py
…
bench_moe_ep_pre_reorder.py
…
bench_moe_fused_gate.py
…
bench_moe_silu_and_mul.py
…
bench_moe_topk_softmax.py
[optimize] fuse renormalize into moe_topk_softmax (
#7744
)
2025-07-03 12:42:44 -07:00
bench_per_tensor_quant_fp8.py
…
bench_per_token_group_quant_8bit.py
…
bench_per_token_quant_fp8.py
…
bench_qserve_w4a8_gemm.py
…