diff --git a/test/registered/jit/minimax/test_minimax_decode_topk.py b/test/registered/jit/minimax/test_minimax_decode_topk.py index 21e8ed3fa..c4860b7bf 100644 --- a/test/registered/jit/minimax/test_minimax_decode_topk.py +++ b/test/registered/jit/minimax/test_minimax_decode_topk.py @@ -10,10 +10,11 @@ import pytest import torch from sglang.jit_kernel.minimax_decode_topk import minimax_decode_topk -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci register_cuda_ci(est_time=40, suite="base-b-kernel-unit-1-gpu-large") register_cuda_ci(est_time=40, suite="base-b-kernel-unit-1-gpu-b200") +register_amd_ci(est_time=15, suite="nightly-amd-kernel-1-gpu", nightly=True) def _ref(score, seq_lens, block_size, topk): diff --git a/test/registered/jit/minimax/test_minimax_store_kv_index.py b/test/registered/jit/minimax/test_minimax_store_kv_index.py index 8f74cbeac..d23880bcf 100644 --- a/test/registered/jit/minimax/test_minimax_store_kv_index.py +++ b/test/registered/jit/minimax/test_minimax_store_kv_index.py @@ -9,10 +9,11 @@ import pytest import torch from sglang.jit_kernel.minimax_store_kv_index import store_kv_index -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci register_cuda_ci(est_time=30, suite="base-b-kernel-unit-1-gpu-large") register_cuda_ci(est_time=30, suite="base-b-kernel-unit-1-gpu-b200") +register_amd_ci(est_time=10, suite="nightly-amd-kernel-1-gpu", nightly=True) dev = "cuda" HEAD_DIM = 128 diff --git a/test/registered/jit/test_deepseek_v4_compress_state_runtime_shapes.py b/test/registered/jit/test_deepseek_v4_compress_state_runtime_shapes.py index 568238671..58489668d 100644 --- a/test/registered/jit/test_deepseek_v4_compress_state_runtime_shapes.py +++ b/test/registered/jit/test_deepseek_v4_compress_state_runtime_shapes.py @@ -98,10 +98,11 @@ from sglang.jit_kernel.tests.deepseek_v4.common import ( make_legacy_context, to_seq_extend, ) -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci from sglang.utils import is_in_ci register_cuda_ci(est_time=30, suite="base-b-kernel-unit-1-gpu-large") +register_amd_ci(est_time=25, suite="nightly-amd-kernel-1-gpu", nightly=True) Mode = Literal["decode", "prefill"] ShapeTier = Literal["ci", "smoke", "full"] diff --git a/test/registered/jit/test_fused_store_index_cache.py b/test/registered/jit/test_fused_store_index_cache.py index 1766e8d0c..30494852f 100644 --- a/test/registered/jit/test_fused_store_index_cache.py +++ b/test/registered/jit/test_fused_store_index_cache.py @@ -22,7 +22,7 @@ from typing import Optional, Tuple import pytest import torch -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci try: from sglang.jit_kernel.fused_store_index_cache import ( @@ -50,6 +50,7 @@ except ImportError: register_cuda_ci(est_time=24, suite="base-b-kernel-unit-1-gpu-large") register_cuda_ci(est_time=120, suite="nightly-kernel-1-gpu", nightly=True) +register_amd_ci(est_time=24, suite="nightly-amd-kernel-1-gpu", nightly=True) PAGE_SIZE = 64 HEAD_DIM = 128 diff --git a/test/registered/jit/test_fused_verify_triton_gdn.py b/test/registered/jit/test_fused_verify_triton_gdn.py index ec9ba72dc..c6af34475 100644 --- a/test/registered/jit/test_fused_verify_triton_gdn.py +++ b/test/registered/jit/test_fused_verify_triton_gdn.py @@ -11,7 +11,7 @@ import sys import pytest import torch -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci try: from sglang.srt.layers.attention.fla.fused_gdn_gating import fused_gdn_gating @@ -28,6 +28,7 @@ except ImportError: register_cuda_ci(est_time=6, suite="base-b-kernel-unit-1-gpu-large") register_cuda_ci(est_time=120, suite="nightly-kernel-1-gpu", nightly=True) +register_amd_ci(est_time=10, suite="nightly-amd-kernel-1-gpu", nightly=True) def _make_tensors(N, T, H, HV, K, V, device="cuda", seed=2025): diff --git a/test/registered/jit/test_kvcacheio_asymmetric.py b/test/registered/jit/test_kvcacheio_asymmetric.py index 3fa8f9c33..5667e1b43 100644 --- a/test/registered/jit/test_kvcacheio_asymmetric.py +++ b/test/registered/jit/test_kvcacheio_asymmetric.py @@ -5,9 +5,10 @@ import pytest import torch from sglang.srt.mem_cache.memory_pool_host import AsymmetricMHATokenToKVPoolHost -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci register_cuda_ci(est_time=10, suite="base-b-kernel-unit-1-gpu-large") +register_amd_ci(est_time=10, suite="nightly-amd-kernel-1-gpu", nightly=True) # These tests use AsymmetricMHATokenToKVPoolHost methods and let that class call # the real sgl-kernel transfer ops. diff --git a/test/registered/jit/test_mla_kv_pack_quantize_fp8.py b/test/registered/jit/test_mla_kv_pack_quantize_fp8.py index b78c42fd2..b4775d3b2 100644 --- a/test/registered/jit/test_mla_kv_pack_quantize_fp8.py +++ b/test/registered/jit/test_mla_kv_pack_quantize_fp8.py @@ -5,9 +5,10 @@ import torch from sglang.jit_kernel.mla_kv_pack_quantize_fp8 import mla_kv_pack_quantize_fp8 from sglang.jit_kernel.utils import get_ci_test_range -from sglang.test.ci.ci_register import register_cuda_ci +from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci register_cuda_ci(est_time=60, suite="base-b-kernel-unit-1-gpu-large") +register_amd_ci(est_time=60, suite="nightly-amd-kernel-1-gpu", nightly=True) DEVICE = "cuda"