Add 5090 dry run stage to PR test workflow (#17022)

This commit is contained in:
Alison Shao
2026-01-13 14:12:33 -08:00
committed by GitHub
parent 339915ce2b
commit b880607108
71 changed files with 158 additions and 3 deletions
@@ -9,6 +9,7 @@ from sglang.test.test_utils import CustomTestCase
# Triton kernel unit test for KV indices creation
register_cuda_ci(est_time=10, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=10, suite="stage-b-test-small-1-gpu-amd")
@@ -15,6 +15,7 @@ from sglang.srt.server_args import ServerArgs, set_global_server_args_for_schedu
from sglang.test.ci.ci_register import register_cuda_ci
register_cuda_ci(est_time=9, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu-5090")
class TestMamba(unittest.TestCase):
@@ -15,6 +15,7 @@ from sglang.test.test_utils import (
# RadixAttention server integration tests
register_cuda_ci(est_time=100, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=79, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=100, suite="stage-b-test-small-1-gpu-amd")
@@ -21,6 +21,7 @@ from sglang.test.ci.ci_register import register_cuda_ci
# CPU-based unit test, runs quickly on any GPU runner
register_cuda_ci(est_time=5, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu-5090")
import time
import unittest
@@ -19,6 +19,7 @@ from sglang.test.test_utils import (
# Torch native attention backend integration test with MMLU eval
register_cuda_ci(est_time=169, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=120, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=150, suite="stage-b-test-small-1-gpu-amd")
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=111, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=76, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=179, suite="stage-b-test-small-1-gpu-amd")
import unittest
@@ -8,6 +8,7 @@ from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.test_utils import DEFAULT_SMALL_MODEL_NAME_FOR_TEST, CustomTestCase
register_cuda_ci(est_time=55, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=31, suite="stage-b-test-small-1-gpu-5090")
class TestHiddenState(CustomTestCase):
@@ -17,6 +17,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=38, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=40, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=38, suite="stage-b-test-small-1-gpu-amd")
+1
View File
@@ -10,6 +10,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
from sglang.test.test_utils import CustomTestCase
register_cuda_ci(est_time=6, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=5, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=10, suite="stage-b-test-small-1-gpu-amd")
HOOK_CALLS = []
+1
View File
@@ -14,6 +14,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=60, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=62, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=60, suite="stage-b-test-small-1-gpu-amd")
@@ -18,6 +18,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=47, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=49, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=70, suite="stage-b-test-small-1-gpu-amd")
+1
View File
@@ -7,6 +7,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
from sglang.test.test_utils import CustomTestCase
register_cuda_ci(est_time=9, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=1, suite="stage-b-test-small-1-gpu-amd")
@@ -28,6 +28,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=127, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=122, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=130, suite="stage-b-test-small-1-gpu-amd")
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=9, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=15, suite="stage-b-test-small-1-gpu-amd")
import unittest
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_cuda_ci
register_cuda_ci(est_time=96, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=96, suite="stage-b-test-small-1-gpu-5090")
import time
import unittest
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_cuda_ci
register_cuda_ci(est_time=25, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=3, suite="stage-b-test-small-1-gpu-5090")
# Adapted from https://github.com/vllm-project/vllm/blob/main/tests/kernels/mamba/test_causal_conv1d.py
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_cuda_ci
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=5, suite="stage-b-test-small-1-gpu-5090")
# Adapted from https://github.com/vllm-project/vllm/blob/633f943e30a4444d890d26b81850f7217736f840/tests/kernels/mamba/test_mamba_ssm_ssd.py
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_cuda_ci
register_cuda_ci(est_time=13, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu-5090")
# Adapted from https://github.com/vllm-project/vllm/blob/633f943e30a4444d890d26b81850f7217736f840/tests/kernels/mamba/test_mamba_ssm_ssd.py
@@ -30,6 +30,7 @@ from sglang.test.lora_utils import (
from sglang.test.test_utils import CustomTestCase, is_in_ci
register_cuda_ci(est_time=200, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=137, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(
est_time=200,
suite="stage-b-test-small-1-gpu-amd",
@@ -24,6 +24,7 @@ from sglang.test.runners import SRTRunner
from sglang.test.test_utils import CustomTestCase
register_cuda_ci(est_time=224, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=215, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=224, suite="stage-b-test-small-1-gpu-amd")
PROMPTS = [
@@ -41,6 +41,10 @@ register_cuda_ci(
est_time=150,
suite="stage-b-test-small-1-gpu",
)
register_cuda_ci(
est_time=76,
suite="stage-b-test-small-1-gpu-5090",
)
from sglang.test.test_utils import DEFAULT_PORT_FOR_SRT_TEST_RUNNER, CustomTestCase
+1
View File
@@ -6,6 +6,7 @@ import requests
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=32, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=29, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=32, suite="stage-b-test-small-1-gpu-amd")
from prometheus_client.parser import text_string_to_metric_families
from prometheus_client.samples import Sample
@@ -6,6 +6,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
from sglang.test.test_utils import CustomTestCase
register_cuda_ci(est_time=30, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=26, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=45, suite="stage-b-test-small-1-gpu")
@@ -26,6 +26,7 @@ CALIBRATION_NUM_SAMPLES = 512
DEFAULT_DEVICE = "cuda:0"
register_cuda_ci(est_time=11, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu-5090")
class TestModelOptModelLoader(CustomTestCase):
@@ -2,6 +2,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
# Cross encoder model tests
register_cuda_ci(est_time=100, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=105, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=150, suite="stage-b-test-small-1-gpu-amd")
import multiprocessing as mp
@@ -2,6 +2,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
# Embedding model tests
register_cuda_ci(est_time=73, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=58, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(
est_time=73,
suite="stage-b-test-small-1-gpu-amd",
@@ -2,6 +2,7 @@ from sglang.test.ci.ci_register import register_cuda_ci
# Encoder embedding model tests (CUDA only)
register_cuda_ci(est_time=270, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=144, suite="stage-b-test-small-1-gpu-5090")
# Copyright 2023-2024 SGLang Team
# Licensed under the Apache License, Version 2.0 (the "License");
@@ -2,6 +2,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
# Qwen model tests
register_cuda_ci(est_time=90, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=84, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=130, suite="stage-b-test-small-1-gpu-amd")
import unittest
@@ -2,6 +2,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
# Reward model tests
register_cuda_ci(est_time=103, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=69, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=132, suite="stage-b-test-small-1-gpu-amd")
# Copyright 2023-2024 SGLang Team
@@ -2,6 +2,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
# Transformers fallback model tests
register_cuda_ci(est_time=245, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=210, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=320, suite="stage-b-test-small-1-gpu-amd")
import dataclasses
@@ -14,6 +14,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=70, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=48, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=141, suite="stage-b-test-small-1-gpu-amd")
@@ -29,6 +29,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=184, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=130, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=149, suite="stage-b-test-small-1-gpu-amd")
@@ -31,6 +31,7 @@ from sglang.srt.entrypoints.openai.protocol import (
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=3, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=2, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=10, suite="stage-b-test-small-1-gpu-amd")
@@ -24,6 +24,7 @@ from sglang.srt.utils import get_or_create_event_loop
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=10, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=10, suite="stage-b-test-small-1-gpu-amd")
@@ -14,6 +14,7 @@ from sglang.srt.managers.tokenizer_manager import TokenizerManager
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=10, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=10, suite="stage-b-test-small-1-gpu-amd")
@@ -14,6 +14,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=109, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=84, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=180, suite="stage-b-test-small-1-gpu-amd")
@@ -14,6 +14,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=27, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=20, suite="stage-b-test-small-1-gpu-amd")
@@ -17,6 +17,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=186, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=134, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(
est_time=186,
suite="stage-b-test-small-1-gpu-amd",
@@ -24,6 +24,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=89, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=77, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=89, suite="stage-b-test-small-1-gpu-amd")
@@ -23,6 +23,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=120, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=109, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=258, suite="stage-b-test-small-1-gpu-amd")
@@ -12,6 +12,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=40, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=39, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=60, suite="stage-b-test-small-1-gpu-amd")
@@ -12,6 +12,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=6, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=37, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=47, suite="stage-b-test-small-1-gpu-amd")
@@ -2,6 +2,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
# Ops - Repeat Interleave tests (1-GPU)
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=75, suite="stage-b-test-small-1-gpu-amd")
import time
@@ -18,6 +18,7 @@ from sglang.srt.utils.profile_merger import ProfileMerger
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=8, suite="stage-b-test-small-1-gpu-amd")
@@ -5,6 +5,7 @@ from sglang.srt.managers.io_struct import ProfileReqInput
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=9, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=6, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=9, suite="stage-b-test-small-1-gpu-amd")
@@ -30,6 +30,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=41, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=39, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=60, suite="stage-b-test-small-1-gpu-amd")
OUTPUT_DIR = "./profiler_dir"
+1
View File
@@ -18,6 +18,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=77, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=76, suite="stage-b-test-small-1-gpu-5090")
class TestAutoRound(CustomTestCase):
+1
View File
@@ -11,6 +11,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
from sglang.test.test_utils import CustomTestCase
register_cuda_ci(est_time=44, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=25, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=22, suite="stage-b-test-small-1-gpu-amd")
@@ -12,6 +12,7 @@ from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.test_utils import CustomTestCase
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=10, suite="stage-b-test-small-1-gpu-5090")
def native_w8a8_per_token_matmul(A, B, As, Bs, output_dtype=torch.float16):
+1
View File
@@ -7,6 +7,7 @@ from sglang import Engine
from sglang.test.ci.ci_register import register_cuda_ci
register_cuda_ci(est_time=103, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=88, suite="stage-b-test-small-1-gpu-5090")
from sglang.lang.chat_template import get_chat_template_by_model_path
from sglang.srt.utils import kill_process_tree
from sglang.test.run_eval import run_eval
@@ -9,6 +9,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
from sglang.test.test_utils import CustomTestCase
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=9, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=12, suite="stage-b-test-small-1-gpu-amd")
+1
View File
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=9, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=8, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=15, suite="stage-b-test-small-1-gpu-amd")
import unittest
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=90, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=54, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=90, suite="stage-b-test-small-1-gpu")
import json
@@ -1,6 +1,7 @@
from sglang.test.ci.ci_register import register_cuda_ci
register_cuda_ci(est_time=195, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=164, suite="stage-b-test-small-1-gpu-5090")
import gc
import json
@@ -18,6 +18,7 @@ import os
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=41, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=43, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=60, suite="stage-b-test-small-1-gpu-amd")
import random
import unittest
+1
View File
@@ -10,6 +10,7 @@ from sglang.srt.utils import kill_process_tree
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=82, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=44, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=82, suite="stage-b-test-small-1-gpu-amd")
from sglang.test.test_utils import (
DEFAULT_SMALL_MODEL_NAME_FOR_TEST,
@@ -7,6 +7,7 @@ from sglang.srt.utils import kill_process_tree
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
register_cuda_ci(est_time=66, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=64, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=66, suite="stage-b-test-small-1-gpu-amd")
from sglang.test.run_eval import run_eval
from sglang.test.test_utils import (
+1
View File
@@ -18,6 +18,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=131, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=119, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=51, suite="stage-b-test-small-1-gpu-amd")
@@ -8,6 +8,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
from sglang.test.test_utils import CustomTestCase, run_mmlu_test, run_mulit_request_test
register_cuda_ci(est_time=312, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=323, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=312, suite="stage-b-test-small-1-gpu-amd")
@@ -8,6 +8,7 @@ from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
from sglang.test.test_utils import CustomTestCase
register_cuda_ci(est_time=1, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=6, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=2, suite="stage-b-test-small-1-gpu-amd")
@@ -18,6 +18,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=130, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=146, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=195, suite="stage-b-test-small-1-gpu-amd")
@@ -18,6 +18,7 @@ from sglang.test.test_utils import (
from sglang.utils import is_in_ci
register_cuda_ci(est_time=311, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=400, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=450, suite="stage-b-test-small-1-gpu-amd")
@@ -12,6 +12,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=50, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=87, suite="stage-b-test-small-1-gpu-5090")
class TestEagle3Basic(EagleServerBase):
@@ -17,6 +17,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=283, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=404, suite="stage-b-test-small-1-gpu-5090")
class TestEagleServerBase(CustomTestCase, MatchedStopMixin):
@@ -9,6 +9,7 @@ from sglang.srt.speculative.eagle_utils import (
from sglang.test.ci.ci_register import register_cuda_ci
register_cuda_ci(est_time=3, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=2, suite="stage-b-test-small-1-gpu-5090")
class TestBuildEagleTree(unittest.TestCase):
@@ -24,6 +24,7 @@ from sglang.test.test_utils import (
)
register_cuda_ci(est_time=77, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=52, suite="stage-b-test-small-1-gpu-5090")
register_amd_ci(est_time=117, suite="stage-b-test-small-1-gpu-amd")
+1
View File
@@ -7,6 +7,7 @@ from sglang.test.ci.ci_register import register_cuda_ci
from sglang.test.test_utils import run_doctests
register_cuda_ci(est_time=20, suite="stage-b-test-small-1-gpu")
register_cuda_ci(est_time=7, suite="stage-b-test-small-1-gpu-5090")
def test_resolve_evs_config():
+1
View File
@@ -27,6 +27,7 @@ PER_COMMIT_SUITES = {
HWBackend.CUDA: [
"stage-a-test-1",
"stage-b-test-small-1-gpu",
"stage-b-test-small-1-gpu-5090",
"stage-b-test-large-1-gpu",
"stage-b-test-large-2-gpu",
"stage-c-test-large-4-gpu",