diff --git a/.github/workflows/pr-test-extra.yml b/.github/workflows/pr-test-extra.yml index 37476365d..c004b923c 100644 --- a/.github/workflows/pr-test-extra.yml +++ b/.github/workflows/pr-test-extra.yml @@ -213,6 +213,19 @@ jobs: run_timeout_minutes: '60' secrets: inherit + extra-b-test-deepep-4-gpu-h100: + needs: [check-changes, call-gate, sgl-kernel-build-wheels] + if: ${{ !failure() && !cancelled() && needs.check-changes.result == 'success' && (needs.call-gate.result == 'success' || needs.call-gate.result == 'skipped') }} + uses: ./.github/workflows/_pr-test-stage.yml + with: + self_name: extra-b-test-deepep-4-gpu-h100 + runner_config: deepep-4-gpu-h100 + check_changes: ${{ toJson(needs.check-changes.outputs) }} + caller_inputs: ${{ toJson(inputs) }} + partitions: ${{ needs.check-changes.outputs.partitions }} + run_timeout_minutes: '60' + secrets: inherit + extra-b-test-deepep-4-gpu-b200: needs: [check-changes, call-gate, sgl-kernel-build-wheels] if: ${{ !failure() && !cancelled() && needs.check-changes.result == 'success' && (needs.call-gate.result == 'success' || needs.call-gate.result == 'skipped') }} @@ -256,6 +269,7 @@ jobs: extra-b-test-4-gpu-h100, extra-b-test-4-gpu-b200, extra-b-test-8-gpu-h200, + extra-b-test-deepep-4-gpu-h100, extra-b-test-deepep-4-gpu-b200, extra-b-test-deepep-8-gpu-h200, ] diff --git a/test/registered/cp/test_gqa_preill_cp.py b/test/registered/cp/test_gqa_prefill_cp.py similarity index 98% rename from test/registered/cp/test_gqa_preill_cp.py rename to test/registered/cp/test_gqa_prefill_cp.py index f4a939d85..4f49c143d 100644 --- a/test/registered/cp/test_gqa_preill_cp.py +++ b/test/registered/cp/test_gqa_prefill_cp.py @@ -11,7 +11,7 @@ from sglang.test.test_utils import ( popen_launch_server, ) -register_cuda_ci(est_time=500, stage="extra-b", runner_config="4-gpu-h100") +register_cuda_ci(est_time=500, stage="extra-b", runner_config="deepep-4-gpu-h100") GQA_MODEL_PATH = "Qwen/Qwen3-30B-A3B-FP8" diff --git a/test/registered/rl/test_return_routed_experts.py b/test/registered/rl/test_return_routed_experts.py index d8ae2be83..723679ad6 100644 --- a/test/registered/rl/test_return_routed_experts.py +++ b/test/registered/rl/test_return_routed_experts.py @@ -24,7 +24,7 @@ from sglang.test.test_utils import ( popen_launch_server, ) -register_cuda_ci(est_time=400, stage="extra-b", runner_config="4-gpu-h100") +register_cuda_ci(est_time=400, stage="extra-b", runner_config="deepep-4-gpu-h100") # FP8 variant of Qwen3-30B-A3B: required because DeepEP normal/LL fast paths in # ep_moe/layer.py only run for {Fp8Config (via deep_gemm), W4AFp8Config, aiter, diff --git a/test/run_suite.py b/test/run_suite.py index 5c7f42cff..a6907ac1f 100644 --- a/test/run_suite.py +++ b/test/run_suite.py @@ -93,6 +93,7 @@ PER_COMMIT_SUITES = { "extra-b-test-4-gpu-h100", "extra-b-test-4-gpu-b200", "extra-b-test-8-gpu-h200", + "extra-b-test-deepep-4-gpu-h100", "extra-b-test-deepep-4-gpu-b200", "extra-b-test-deepep-8-gpu-h200", ],