This website requires JavaScript.
Explore
Help
Sign In
chenchenghao
/
sglang
Watch
1
Star
0
Fork
0
Code
Issues
Pull Requests
Actions
13
Packages
Projects
Releases
Wiki
Activity
Files
e86476acfc525d7c378efbeab2321d5bc65b7899
sglang
/
sgl-kernel
/
csrc
/
gemm
T
History
…
..
gptq
…
marlin
…
awq_kernel.cu
Fix AWQ Dequant and Weight Loading of deepseek v2 (
#6842
)
2025-06-17 13:45:10 -07:00
bmm_fp8.cu
…
dsv3_fused_a_gemm.cu
…
dsv3_router_gemm_bf16_out.cu
…
dsv3_router_gemm_entry.cu
…
dsv3_router_gemm_float_out.cu
…
fp8_blockwise_gemm_kernel.cu
…
fp8_gemm_kernel.cu
…
int8_gemm_kernel.cu
…
math.hpp
…
nvfp4_expert_quant.cu
…
nvfp4_quant_entry.cu
…
nvfp4_quant_kernels.cu
…
nvfp4_quant.cuh
[NVIDIA] Fix CUDA arch requirement in nvfp4 cast (
#12581
)
2026-01-21 20:21:11 -08:00
nvfp4_scaled_mm_entry.cu
…
nvfp4_scaled_mm_kernels.cu
…
per_tensor_quant_fp8.cu
…
per_token_group_quant_8bit_v2.cu
…
per_token_group_quant_8bit.cu
…
per_token_quant_fp8.cu
…
qserve_w4a8_per_chn_gemm.cu
…
qserve_w4a8_per_group_gemm.cu
…