Revert "[CI] Update nightly test models for H200/B200 (#22288)" (#22297)

This commit is contained in:
Kangyan-Zhou
2026-04-07 17:04:06 -07:00
committed by GitHub
parent f6fc39569a
commit dd73e9a62e
5 changed files with 67 additions and 13 deletions
@@ -1,11 +1,14 @@
import unittest
from sglang.test.accuracy_test_runner import AccuracyTestParams
from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.performance_test_runner import PerformanceTestParams
from sglang.test.run_combined_tests import run_combined_tests
from sglang.test.test_utils import ModelLaunchSettings
# Manual-only: not registered in any CI suite
# Runs on both H200 and B200 via nightly-8-gpu-common suite
register_cuda_ci(est_time=5400, suite="nightly-8-gpu-common", nightly=True)
DEEPSEEK_V31_MODEL_PATH = "deepseek-ai/DeepSeek-V3.1"
@@ -0,0 +1,52 @@
import unittest
from sglang.test.accuracy_test_runner import AccuracyTestParams
from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.performance_test_runner import PerformanceTestParams
from sglang.test.run_combined_tests import run_combined_tests
from sglang.test.test_utils import ModelLaunchSettings
# Runs on both H200 and B200 via nightly-8-gpu-common suite
register_cuda_ci(est_time=1800, suite="nightly-8-gpu-common", nightly=True)
GLM_4_6_MODEL_PATH = "zai-org/GLM-4.6"
class TestGLM46(unittest.TestCase):
"""Unified test class for GLM-4.6 performance and accuracy.
Single variant with simple TP=8 configuration.
GLM-4.6 is a 357B MoE model.
Runs BOTH:
- Performance test (using NightlyBenchmarkRunner)
- Accuracy test (using run_eval with mgsm_en)
"""
def test_glm_46(self):
"""Run performance and accuracy for GLM-4.6."""
base_args = [
"--tp=8",
"--trust-remote-code",
]
variants = [
ModelLaunchSettings(
GLM_4_6_MODEL_PATH,
tp_size=8,
extra_args=base_args,
variant="TP8",
),
]
run_combined_tests(
models=variants,
test_name="GLM-4.6",
accuracy_params=AccuracyTestParams(dataset="gsm8k", baseline_accuracy=0.80),
performance_params=PerformanceTestParams(
profile_dir="performance_profiles_glm_4_6",
),
)
if __name__ == "__main__":
unittest.main()
@@ -1,11 +1,14 @@
import unittest
from sglang.test.accuracy_test_runner import AccuracyTestParams
from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.performance_test_runner import PerformanceTestParams
from sglang.test.run_combined_tests import run_combined_tests
from sglang.test.test_utils import ModelLaunchSettings
# Manual-only: not registered in any CI suite
# Runs on both H200 and B200 via nightly-8-gpu-common suite
register_cuda_ci(est_time=1800, suite="nightly-8-gpu-common", nightly=True)
GLM_4_6_FP8_MODEL_PATH = "zai-org/GLM-4.6-FP8"
+3 -10
View File
@@ -9,7 +9,7 @@ from sglang.test.test_utils import ModelLaunchSettings
# Runs on both H200 and B200 via nightly-8-gpu-common suite
register_cuda_ci(est_time=1800, suite="nightly-8-gpu-common", nightly=True)
QWEN35_MODEL_PATH = "Qwen/Qwen3.5-397B-A17B-FP8"
QWEN35_MODEL_PATH = "Qwen/Qwen3.5-397B-A17B"
class TestQwen35(unittest.TestCase):
@@ -30,7 +30,6 @@ class TestQwen35(unittest.TestCase):
"--tool-call-parser=qwen3_coder",
"--mem-fraction-static=0.8",
]
dp_args = ["--dp=8", "--enable-dp-attention"]
mtp_args = [
"--speculative-algorithm=EAGLE",
"--speculative-num-steps=3",
@@ -49,14 +48,8 @@ class TestQwen35(unittest.TestCase):
ModelLaunchSettings(
QWEN35_MODEL_PATH,
tp_size=8,
extra_args=base_args + dp_args,
variant="TP8+DP8",
),
ModelLaunchSettings(
QWEN35_MODEL_PATH,
tp_size=8,
extra_args=base_args + dp_args + mtp_args,
variant="TP8+DP8+MTP",
extra_args=base_args + mtp_args,
variant="TP8+MTP",
env={"SGLANG_ENABLE_SPEC_V2": "1"},
),
]
@@ -1,11 +1,14 @@
import unittest
from sglang.test.accuracy_test_runner import AccuracyTestParams
from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.performance_test_runner import PerformanceTestParams
from sglang.test.run_combined_tests import run_combined_tests
from sglang.test.test_utils import ModelLaunchSettings, is_blackwell_system
# Manual-only: not registered in any CI suite
# Runs on both H200 and B200 via nightly-8-gpu-common suite
register_cuda_ci(est_time=1800, suite="nightly-8-gpu-common", nightly=True)
QWEN3_235B_FP8_MODEL_PATH = "Qwen/Qwen3-235B-A22B-Instruct-2507-FP8"
QWEN3_235B_EAGLE3_MODEL_PATH = (
"lmsys/SGLang-EAGLE3-Qwen3-235B-A22B-Instruct-2507-SpecForge-Meituan"