ci: unify PR test suite naming (#21187)

This commit is contained in:
Lianmin Zheng
2026-03-23 00:18:45 -07:00
committed by GitHub
parent 3d312643b9
commit 814202704b
283 changed files with 554 additions and 554 deletions
@@ -13,8 +13,8 @@ from sglang.test.test_utils import (
popen_launch_server,
)
register_cuda_ci(est_time=42, suite="stage-b-test-large-1-gpu")
register_amd_ci(est_time=42, suite="stage-b-test-small-1-gpu-amd")
register_cuda_ci(est_time=42, suite="stage-b-test-1-gpu-large")
register_amd_ci(est_time=42, suite="stage-b-test-1-gpu-small-amd")
class TestCompressedTensorsLlama3FP8(CustomTestCase):
@@ -11,8 +11,8 @@ from sglang.test.test_utils import CustomTestCase, is_in_ci
# Cross encoder model tests
register_cuda_ci(est_time=100, suite="stage-b-test-small-1-gpu")
register_amd_ci(est_time=150, suite="stage-b-test-small-1-gpu-amd")
register_cuda_ci(est_time=100, suite="stage-b-test-1-gpu-small")
register_amd_ci(est_time=150, suite="stage-b-test-1-gpu-small-amd")
MODELS = [
("cross-encoder/ms-marco-MiniLM-L6-v2", 1, 1e-2),
@@ -5,7 +5,7 @@ from sglang.test.test_utils import CustomTestCase, is_in_ci, run_bench_one_batch
register_cuda_ci(
est_time=120,
suite="stage-b-test-large-2-gpu",
suite="stage-b-test-2-gpu-large",
disabled="Temporarily disabled",
)
@@ -1,8 +1,8 @@
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
# Generation model tests (CUDA only)
register_cuda_ci(est_time=103, suite="stage-b-test-large-1-gpu")
register_amd_ci(est_time=106, suite="stage-b-test-small-1-gpu-amd")
register_cuda_ci(est_time=103, suite="stage-b-test-1-gpu-large")
register_amd_ci(est_time=106, suite="stage-b-test-1-gpu-small-amd")
# Copyright 2023-2024 SGLang Team
# Licensed under the Apache License, Version 2.0 (the "License");
@@ -17,7 +17,7 @@ from sglang.test.test_utils import (
register_cuda_ci(
est_time=400,
suite="stage-b-test-large-2-gpu",
suite="stage-b-test-2-gpu-large",
)
GPT_OSS_MODEL = "openai/gpt-oss-120b"
@@ -11,7 +11,7 @@ from sglang.test.test_utils import (
popen_launch_server,
)
register_cuda_ci(est_time=90, suite="stage-b-test-large-2-gpu")
register_cuda_ci(est_time=90, suite="stage-b-test-2-gpu-large")
class TestKimiLinear(CustomTestCase):
@@ -17,7 +17,7 @@ from sglang.test.test_utils import (
register_cuda_ci(
est_time=100,
suite="stage-b-test-large-2-gpu",
suite="stage-b-test-2-gpu-large",
)
KIMI_LINEAR_MODEL = "moonshotai/Kimi-Linear-48B-A3B-Instruct"
@@ -8,7 +8,7 @@ from sglang.test.server_fixtures.mmmu_fixture import MMMUServerBase
register_cuda_ci(
est_time=200,
suite="stage-b-test-small-1-gpu",
suite="stage-b-test-1-gpu-small",
disabled="Temporarily disabled",
)
@@ -4,7 +4,7 @@ from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.kits.lm_eval_kit import LMEvalMixin
from sglang.test.server_fixtures.default_fixture import DefaultServerBase
register_cuda_ci(est_time=180, suite="stage-b-test-large-2-gpu")
register_cuda_ci(est_time=180, suite="stage-b-test-2-gpu-large")
NEMOTRON_3_NANO_THINKING_ARGS = [
"--trust-remote-code",
@@ -5,7 +5,7 @@ from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.kits.gsm8k_accuracy_kit import GSM8KMixin
from sglang.test.server_fixtures.default_fixture import DefaultServerBase
register_cuda_ci(est_time=132, suite="stage-b-test-large-2-gpu")
register_cuda_ci(est_time=132, suite="stage-b-test-2-gpu-large")
class TestNvidiaNemotronNanoV2BF16(GSM8KMixin, DefaultServerBase):
@@ -10,7 +10,7 @@ from sglang.test.server_fixtures.mmmu_fixture import MMMUServerBase
# GSM8k + MMMU evaluation
register_cuda_ci(est_time=214, suite="stage-b-test-large-1-gpu")
register_cuda_ci(est_time=214, suite="stage-b-test-1-gpu-large")
MODEL = "nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-BF16"
+2 -2
View File
@@ -13,8 +13,8 @@ from sglang.test.test_utils import (
popen_launch_server,
)
register_cuda_ci(est_time=90, suite="stage-b-test-small-1-gpu")
register_amd_ci(est_time=130, suite="stage-b-test-small-1-gpu-amd")
register_cuda_ci(est_time=90, suite="stage-b-test-1-gpu-small")
register_amd_ci(est_time=130, suite="stage-b-test-1-gpu-small-amd")
class TestQwen2(CustomTestCase):
+2 -2
View File
@@ -24,8 +24,8 @@ from sglang.test.test_utils import CustomTestCase
# ==============================================================================
register_cuda_ci(est_time=103, suite="stage-b-test-small-1-gpu")
register_amd_ci(est_time=132, suite="stage-b-test-small-1-gpu-amd-nondeterministic")
register_cuda_ci(est_time=103, suite="stage-b-test-1-gpu-small")
register_amd_ci(est_time=132, suite="stage-b-test-1-gpu-small-amd-nondeterministic")
MODELS = [
("LxzGordon/URM-LLaMa-3.1-8B", 1, 4e-2),
@@ -20,8 +20,8 @@ from sglang.test.test_utils import (
popen_launch_server,
)
register_cuda_ci(est_time=245, suite="stage-b-test-small-1-gpu")
register_amd_ci(est_time=320, suite="stage-b-test-small-1-gpu-amd")
register_cuda_ci(est_time=245, suite="stage-b-test-1-gpu-small")
register_amd_ci(est_time=320, suite="stage-b-test-1-gpu-small-amd")
class TestTransformersFallbackEndpoint(CustomTestCase):
+2 -2
View File
@@ -16,8 +16,8 @@ from sglang.test.test_utils import is_in_ci
# VLM (Vision Language Model) tests
register_cuda_ci(est_time=228, suite="stage-b-test-large-1-gpu")
register_amd_ci(est_time=850, suite="stage-b-test-small-1-gpu-amd-nondeterministic")
register_cuda_ci(est_time=228, suite="stage-b-test-1-gpu-large")
register_amd_ci(est_time=850, suite="stage-b-test-1-gpu-small-amd-nondeterministic")
_is_hip = is_hip()
# VLM models for testing