Enable memory saver for hybrid model (#11974)

This commit is contained in:
Junrong Lin
2025-11-04 14:55:26 +08:00
committed by GitHub
parent f600866a44
commit 173e0f704f
3 changed files with 15 additions and 8 deletions

View File

@@ -1798,6 +1798,7 @@ class ModelRunner:
),
enable_kvcache_transpose=False,
device=self.device,
enable_memory_saver=self.server_args.enable_memory_saver,
mamba_pool=self.req_to_token_pool.mamba_pool,
use_mla=self.use_mla_backend,
**extra_args,