This website requires JavaScript.
Explore
Help
Sign In
chenchenghao
/
sglang
Watch
1
Star
0
Fork
0
Code
Issues
Pull Requests
Actions
11
Packages
Projects
Releases
Wiki
Activity
Files
2bc61dd19460908dcf0d94b44deed9f2b07e2460
sglang
/
sgl-kernel
/
csrc
/
gemm
T
History
Qi Yuhang
0f04a5f428
Optimize cutlass int8 gemm kernel for large M on SM89 Ada GPU (
#10714
)
2025-09-21 17:04:27 -07:00
..
gptq
…
marlin
…
awq_kernel.cu
…
bmm_fp8.cu
…
dsv3_fused_a_gemm.cu
Remove annoying warnings in sgl kernel build (
#9905
)
2025-09-02 20:18:25 -07:00
dsv3_router_gemm_bf16_out.cu
…
dsv3_router_gemm_entry.cu
…
dsv3_router_gemm_float_out.cu
…
fp8_blockwise_gemm_kernel.cu
CUTLASS fp8 blockwise gemm support of sm120 (
#9969
)
2025-09-06 22:28:54 -07:00
fp8_gemm_kernel.cu
…
int8_gemm_kernel.cu
Optimize cutlass int8 gemm kernel for large M on SM89 Ada GPU (
#10714
)
2025-09-21 17:04:27 -07:00
math.hpp
…
nvfp4_expert_quant.cu
Remove annoying warnings in sgl kernel build (
#9905
)
2025-09-02 20:18:25 -07:00
nvfp4_quant_entry.cu
…
nvfp4_quant_kernels.cu
…
nvfp4_quant.cuh
…
nvfp4_scaled_mm_entry.cu
…
nvfp4_scaled_mm_kernels.cu
Optimize nvfp4 block scaled gemm kernel when M is small. (
#10101
)
2025-09-06 22:31:00 -07:00
per_tensor_quant_fp8.cu
…
per_token_group_quant_8bit.cu
Revert "[1/2] Optimizations and refactors about quant kernel (
#9534
)" (
#10292
)
2025-09-10 18:24:23 -07:00
per_token_quant_fp8.cu
…
qserve_w4a8_per_chn_gemm.cu
…
qserve_w4a8_per_group_gemm.cu
…