This website requires JavaScript.
Explore
Help
Sign In
chenchenghao
/
sglang
Watch
1
Star
0
Fork
0
Code
Issues
Pull Requests
Actions
12
Packages
Projects
Releases
Wiki
Activity
Files
79e6a8a6acd81325630125c663868335f47cc07f
sglang
/
sgl-kernel
/
csrc
/
gemm
T
History
Kaixi Hou
e5638573c1
[NVIDA] [1/N] Nvfp4 Masked Gemm: Add quant op for the flashinfer grouped gemm (
#9200
)
2025-08-22 12:19:45 -07:00
..
gptq
[2/n]decouple quantization implementation from vLLM dependency (
#8112
)
2025-08-14 03:19:03 -07:00
marlin
[2/n]decouple quantization implementation from vLLM dependency (
#8112
)
2025-08-14 03:19:03 -07:00
awq_kernel.cu
…
bmm_fp8.cu
…
dsv3_fused_a_gemm.cu
…
dsv3_router_gemm_bf16_out.cu
…
dsv3_router_gemm_entry.cu
…
dsv3_router_gemm_float_out.cu
…
fp8_blockwise_gemm_kernel.cu
[sgl-kernel] 1/N Refactor sglang cutlass 3x - gemm fp8 blockwise sm90 (
#8913
)
2025-08-14 10:55:54 -07:00
fp8_gemm_kernel.cu
…
int8_gemm_kernel.cu
…
math.hpp
…
nvfp4_expert_quant.cu
[NVIDA] [1/N] Nvfp4 Masked Gemm: Add quant op for the flashinfer grouped gemm (
#9200
)
2025-08-22 12:19:45 -07:00
nvfp4_quant_entry.cu
[NVIDA] [1/N] Nvfp4 Masked Gemm: Add quant op for the flashinfer grouped gemm (
#9200
)
2025-08-22 12:19:45 -07:00
nvfp4_quant_kernels.cu
…
nvfp4_scaled_mm_entry.cu
…
nvfp4_scaled_mm_kernels.cu
…
per_tensor_quant_fp8.cu
[AMD] Reorganize hip-related header files in sgl-kernel (
#9320
)
2025-08-18 16:53:44 -07:00
per_token_group_quant_8bit.cu
…
per_token_quant_fp8.cu
[AMD] Reorganize hip-related header files in sgl-kernel (
#9320
)
2025-08-18 16:53:44 -07:00
qserve_w4a8_per_chn_gemm.cu
…
qserve_w4a8_per_group_gemm.cu
…