This website requires JavaScript.
Explore
Help
Sign In
chenchenghao
/
sglang
Watch
1
Star
0
Fork
0
You've already forked sglang
Code
Issues
Pull Requests
Actions
12
Packages
Projects
Releases
Wiki
Activity
Files
d6898dd2534a3faa801a7166062722288cc5c92a
sglang
/
python
/
sglang
/
srt
/
model_loader
History
Zhiyu
c66b2c9cf1
Add support for nvidia modelopt fp8 kv cache (
#3223
)
2025-02-22 07:04:58 +08:00
..
__init__.py
Update model_loader deps and qqq quantization deps (
#2220
) (
#2318
)
2024-12-02 23:22:13 +08:00
loader.py
Support loading of larger models with on-the-fly quantization (
#3061
)
2025-01-22 21:33:17 -08:00
utils.py
Update model_loader deps and qqq quantization deps (
#2220
) (
#2318
)
2024-12-02 23:22:13 +08:00
weight_utils.py
Add support for nvidia modelopt fp8 kv cache (
#3223
)
2025-02-22 07:04:58 +08:00