Logo
Explore Help
Sign In
chenchenghao/sglang
1
0
Fork 0
You've already forked sglang
Code Issues Pull Requests Actions 12 Packages Projects Releases Wiki Activity
Files
d5e0346847a3a36ab7b4492f0d55f4f80189fe97
sglang/benchmark/kernels
History
roikoren755 1b48e1b974 Feat/nemotron nano v3 support (#12690)
2025-11-21 13:53:05 -08:00
..
all_reduce
[AMD] Add AITER Custom All-Reduce (#13102)
2025-11-12 21:53:44 -08:00
decoding_attention_triton
…
deepep
fix(deepep): resolve benchmark failure on 4×IB-card setup by aligning tuning config with DeepEP commit bdd119f8 (#11965)
2025-10-22 21:20:54 -07:00
deepseek
[NVIDIA] Add fp8 gemm benchmark on blackwell (#13528)
2025-11-19 19:35:00 -08:00
elementwise
[sgl-kernel] Optimize concat_mla_k kernel (#10543)
2025-09-28 23:04:22 +08:00
flashinfer_allreduce_fusion
[benchmark] add flashinfer_allreduce_fusion benchmark (#9937)
2025-09-03 16:31:01 +08:00
fused_moe_triton
Feat/nemotron nano v3 support (#12690)
2025-11-21 13:53:05 -08:00
minmax-text-01-lightning_attention
[lint] improve ruff check (#11922)
2025-10-22 11:32:50 +08:00
quantization
Replace [silu_and_mul_]scaled_fp4_group_quant by Flashinfer equivalent (#12376)
2025-11-13 00:26:00 -08:00
scheduler_batch
[test] add ut and bm for get_last_loc (#6746)
2025-05-29 11:47:21 -07:00
sliding_window_attention_triton
Optimize triton swa kernel by skipping computation (#8860)
2025-08-06 21:37:50 +08:00
Powered by Gitea Version: 1.25.5 Page: 1816ms Template: 211ms
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API