[AMD] Register 5 JIT kernel unit tests for AMD nightly CI (#29197)
This commit is contained in:
@@ -16,10 +16,11 @@ from sglang.jit_kernel.tests.deepseek_v4.common import (
|
|||||||
make_state_pool,
|
make_state_pool,
|
||||||
to_seq_extend,
|
to_seq_extend,
|
||||||
)
|
)
|
||||||
from sglang.test.ci.ci_register import register_cuda_ci
|
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
|
||||||
|
|
||||||
register_cuda_ci(est_time=30, suite="base-b-kernel-unit-1-gpu-large")
|
register_cuda_ci(est_time=30, suite="base-b-kernel-unit-1-gpu-large")
|
||||||
register_cuda_ci(est_time=30, suite="nightly-kernel-1-gpu", nightly=True)
|
register_cuda_ci(est_time=30, suite="nightly-kernel-1-gpu", nightly=True)
|
||||||
|
register_amd_ci(est_time=30, suite="nightly-amd-kernel-1-gpu", nightly=True)
|
||||||
|
|
||||||
Context = Union[LegacyContext, PagedContext]
|
Context = Union[LegacyContext, PagedContext]
|
||||||
|
|
||||||
|
|||||||
@@ -16,10 +16,11 @@ from sglang.jit_kernel.tests.deepseek_v4.common import (
|
|||||||
make_state_pool,
|
make_state_pool,
|
||||||
to_seq_extend,
|
to_seq_extend,
|
||||||
)
|
)
|
||||||
from sglang.test.ci.ci_register import register_cuda_ci
|
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
|
||||||
|
|
||||||
register_cuda_ci(est_time=30, suite="base-b-kernel-unit-1-gpu-large")
|
register_cuda_ci(est_time=30, suite="base-b-kernel-unit-1-gpu-large")
|
||||||
register_cuda_ci(est_time=30, suite="nightly-kernel-1-gpu", nightly=True)
|
register_cuda_ci(est_time=30, suite="nightly-kernel-1-gpu", nightly=True)
|
||||||
|
register_amd_ci(est_time=30, suite="nightly-amd-kernel-1-gpu", nightly=True)
|
||||||
|
|
||||||
Context = Union[LegacyContext, PagedContext]
|
Context = Union[LegacyContext, PagedContext]
|
||||||
|
|
||||||
|
|||||||
@@ -7,10 +7,11 @@ import torch.nn.functional as F
|
|||||||
|
|
||||||
from sglang.jit_kernel.diffusion.group_norm_silu import apply_group_norm_silu
|
from sglang.jit_kernel.diffusion.group_norm_silu import apply_group_norm_silu
|
||||||
from sglang.jit_kernel.diffusion.triton.group_norm_silu import triton_group_norm_silu
|
from sglang.jit_kernel.diffusion.triton.group_norm_silu import triton_group_norm_silu
|
||||||
from sglang.test.ci.ci_register import register_cuda_ci
|
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
|
||||||
|
|
||||||
register_cuda_ci(est_time=8, suite="base-b-kernel-unit-1-gpu-large")
|
register_cuda_ci(est_time=8, suite="base-b-kernel-unit-1-gpu-large")
|
||||||
register_cuda_ci(est_time=120, suite="nightly-kernel-1-gpu", nightly=True)
|
register_cuda_ci(est_time=120, suite="nightly-kernel-1-gpu", nightly=True)
|
||||||
|
register_amd_ci(est_time=15, suite="nightly-amd-kernel-1-gpu", nightly=True)
|
||||||
|
|
||||||
DEVICE = "cuda"
|
DEVICE = "cuda"
|
||||||
DTYPES = [torch.float16, torch.bfloat16, torch.float32]
|
DTYPES = [torch.float16, torch.bfloat16, torch.float32]
|
||||||
|
|||||||
@@ -10,10 +10,11 @@ from sglang.jit_kernel.diffusion.triton.scale_shift import (
|
|||||||
fuse_residual_layernorm_scale_shift_gate_select01_kernel,
|
fuse_residual_layernorm_scale_shift_gate_select01_kernel,
|
||||||
)
|
)
|
||||||
from sglang.jit_kernel.utils import get_ci_test_range
|
from sglang.jit_kernel.utils import get_ci_test_range
|
||||||
from sglang.test.ci.ci_register import register_cuda_ci
|
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
|
||||||
|
|
||||||
register_cuda_ci(est_time=15, suite="base-b-kernel-unit-1-gpu-large")
|
register_cuda_ci(est_time=15, suite="base-b-kernel-unit-1-gpu-large")
|
||||||
register_cuda_ci(est_time=120, suite="nightly-kernel-1-gpu", nightly=True)
|
register_cuda_ci(est_time=120, suite="nightly-kernel-1-gpu", nightly=True)
|
||||||
|
register_amd_ci(est_time=30, suite="nightly-amd-kernel-1-gpu", nightly=True)
|
||||||
|
|
||||||
DEVICE = "cuda"
|
DEVICE = "cuda"
|
||||||
DTYPES = get_ci_test_range(
|
DTYPES = get_ci_test_range(
|
||||||
|
|||||||
@@ -13,10 +13,11 @@ from sglang.jit_kernel.diffusion.triton.varlen_pack_pad import (
|
|||||||
fused_scatter_to_padded,
|
fused_scatter_to_padded,
|
||||||
)
|
)
|
||||||
from sglang.jit_kernel.utils import get_ci_test_range
|
from sglang.jit_kernel.utils import get_ci_test_range
|
||||||
from sglang.test.ci.ci_register import register_cuda_ci
|
from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci
|
||||||
|
|
||||||
register_cuda_ci(est_time=10, suite="base-b-kernel-unit-1-gpu-large")
|
register_cuda_ci(est_time=10, suite="base-b-kernel-unit-1-gpu-large")
|
||||||
register_cuda_ci(est_time=60, suite="nightly-kernel-1-gpu", nightly=True)
|
register_cuda_ci(est_time=60, suite="nightly-kernel-1-gpu", nightly=True)
|
||||||
|
register_amd_ci(est_time=15, suite="nightly-amd-kernel-1-gpu", nightly=True)
|
||||||
|
|
||||||
DEVICE = "cuda"
|
DEVICE = "cuda"
|
||||||
DTYPES = get_ci_test_range([torch.bfloat16, torch.float16], [torch.bfloat16])
|
DTYPES = get_ci_test_range([torch.bfloat16, torch.float16], [torch.bfloat16])
|
||||||
|
|||||||
Reference in New Issue
Block a user