diff --git a/test/registered/attention/test_normal_decode_set_metadata.py b/test/registered/attention/test_normal_decode_set_metadata.py index edf5f90fd..99d5eeef6 100644 --- a/test/registered/attention/test_normal_decode_set_metadata.py +++ b/test/registered/attention/test_normal_decode_set_metadata.py @@ -17,11 +17,12 @@ from sglang.srt.layers.attention.flashattention_backend import ( normal_decode_set_metadata, ) from sglang.srt.mem_cache.swa_memory_pool import SWAKVPool -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci from sglang.test.test_utils import CustomTestCase # Register this test for CUDA CI in base-b (fast attention/kernel tests) register_cuda_ci(est_time=11, stage="base-b", runner_config="1-gpu-large") +register_amd_ci(est_time=17, suite="stage-b-test-1-gpu-large-amd") def reference_normal_decode_set_metadata( diff --git a/test/registered/lora/test_lora_update.py b/test/registered/lora/test_lora_update.py index 835039978..ff6047823 100644 --- a/test/registered/lora/test_lora_update.py +++ b/test/registered/lora/test_lora_update.py @@ -23,7 +23,7 @@ import requests import torch from sglang.srt.utils import kill_process_tree -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci from sglang.test.runners import SRTRunner from sglang.test.test_utils import ( DEFAULT_TIMEOUT_FOR_SERVER_LAUNCH, @@ -39,6 +39,10 @@ register_cuda_ci( stage="base-b", runner_config="1-gpu-large", ) +register_amd_ci( + est_time=730, + suite="stage-b-test-1-gpu-large-amd", +) PROMPTS = [ "SGL is a", diff --git a/test/registered/unit/spec/test_resolve_swa_kv_pool.py b/test/registered/unit/spec/test_resolve_swa_kv_pool.py index a488e381b..c8147be3c 100644 --- a/test/registered/unit/spec/test_resolve_swa_kv_pool.py +++ b/test/registered/unit/spec/test_resolve_swa_kv_pool.py @@ -8,10 +8,11 @@ from sglang.srt.layers.attention.trtllm_mha_backend import TRTLLMHAAttnBackend from sglang.srt.mem_cache.base_swa_memory_pool import BaseSWAKVPool from sglang.srt.mem_cache.swa_memory_pool import SWAKVPool from sglang.srt.speculative.spec_info import SpeculativeAlgorithm -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci from sglang.test.test_utils import CustomTestCase register_cuda_ci(est_time=5, stage="base-b", runner_config="1-gpu-large") +register_amd_ci(est_time=8, suite="stage-b-test-1-gpu-large-amd") _RESOLVERS = ( ("trtllm_mha", TRTLLMHAAttnBackend._resolve_swa_kv_pool, SWAKVPool),