[9/n] decouple quantization impl from vllm dependency - adjust ci (#12753)
This commit is contained in:
@@ -199,11 +199,11 @@ suites = {
|
||||
TestFile("test_deepseek_v32_mtp.py", 275),
|
||||
TestFile("test_deepseek_v32_nsabackend.py", 600),
|
||||
],
|
||||
"vllm_dependency_test": [
|
||||
"quantization_test": [
|
||||
TestFile("quant/test_awq.py", 163),
|
||||
TestFile("test_bnb.py", 5),
|
||||
TestFile("test_gptqmodel_dynamic.py", 102),
|
||||
TestFile("test_vllm_dependency.py", 185),
|
||||
TestFile("test_quantization.py", 185),
|
||||
TestFile("test_gguf.py", 96),
|
||||
],
|
||||
# If the test cases take too long, considering adding them to nightly tests instead of per-commit tests
|
||||
|
||||
@@ -77,7 +77,7 @@ def check_model_scores(results):
|
||||
|
||||
if is_in_ci():
|
||||
write_github_step_summary(
|
||||
f"### TestNightlyGsm8KEval for vLLM awq, gptq, gguf\n{summary}"
|
||||
f"### TestNightlyGsm8KEval for awq, gptq, gguf\n{summary}"
|
||||
)
|
||||
|
||||
if failed_models:
|
||||
Reference in New Issue
Block a user