From edfddda1920d3583a5e84c4f0eea2a650d7f384e Mon Sep 17 00:00:00 2001 From: Liangsheng Yin Date: Wed, 8 Apr 2026 21:39:32 -0700 Subject: [PATCH] Move runai model loader test to nightly suite (#22418) --- .github/workflows/nightly-test-nvidia.yml | 2 ++ .github/workflows/pr-test.yml | 1 - test/registered/model_loading/test_runai_model_loader.py | 2 +- 3 files changed, 3 insertions(+), 2 deletions(-) diff --git a/.github/workflows/nightly-test-nvidia.yml b/.github/workflows/nightly-test-nvidia.yml index f523f4c8d..d5ce7930b 100644 --- a/.github/workflows/nightly-test-nvidia.yml +++ b/.github/workflows/nightly-test-nvidia.yml @@ -71,6 +71,8 @@ jobs: - name: Run test timeout-minutes: 60 + env: + RUNAI_STREAMER_MEMORY_LIMIT: 0 run: | cd test python3 run_suite.py --hw cuda --suite nightly-1-gpu --nightly --continue-on-error diff --git a/.github/workflows/pr-test.yml b/.github/workflows/pr-test.yml index b5325c527..b4cc681a3 100644 --- a/.github/workflows/pr-test.yml +++ b/.github/workflows/pr-test.yml @@ -706,7 +706,6 @@ jobs: timeout-minutes: 30 env: CONTINUE_ON_ERROR_FLAG: ${{ needs.check-changes.outputs.continue_on_error == 'true' && '--continue-on-error' || '' }} - RUNAI_STREAMER_MEMORY_LIMIT: 0 run: | source /etc/profile.d/sglang-ci.sh cd test/ diff --git a/test/registered/model_loading/test_runai_model_loader.py b/test/registered/model_loading/test_runai_model_loader.py index 8db3a8bba..cc1a65658 100644 --- a/test/registered/model_loading/test_runai_model_loader.py +++ b/test/registered/model_loading/test_runai_model_loader.py @@ -5,7 +5,7 @@ from sglang.srt.environ import temp_set_env from sglang.test.ci.ci_register import register_cuda_ci from sglang.test.test_utils import CustomTestCase -register_cuda_ci(est_time=120, suite="stage-b-test-1-gpu-small") +register_cuda_ci(est_time=380, suite="nightly-1-gpu", nightly=True) TEST_GCS_MODEL = "gs://vertex-model-garden-public-us/codegemma/codegemma-2b/"