[9/n] decouple quantization impl from vllm dependency - adjust ci (#12753)

This commit is contained in:
Peng Zhang
2025-11-10 14:55:19 -08:00
committed by GitHub
parent 0493775b06
commit 012bfc4fdc
4 changed files with 13 additions and 13 deletions
+2 -2
View File
@@ -199,11 +199,11 @@ suites = {
TestFile("test_deepseek_v32_mtp.py", 275),
TestFile("test_deepseek_v32_nsabackend.py", 600),
],
"vllm_dependency_test": [
"quantization_test": [
TestFile("quant/test_awq.py", 163),
TestFile("test_bnb.py", 5),
TestFile("test_gptqmodel_dynamic.py", 102),
TestFile("test_vllm_dependency.py", 185),
TestFile("test_quantization.py", 185),
TestFile("test_gguf.py", 96),
],
# If the test cases take too long, considering adding them to nightly tests instead of per-commit tests
@@ -77,7 +77,7 @@ def check_model_scores(results):
if is_in_ci():
write_github_step_summary(
f"### TestNightlyGsm8KEval for vLLM awq, gptq, gguf\n{summary}"
f"### TestNightlyGsm8KEval for awq, gptq, gguf\n{summary}"
)
if failed_models: