diff --git a/python/sglang/srt/arg_groups/deepseek_v4_hook.py b/python/sglang/srt/arg_groups/deepseek_v4_hook.py index b3af8e95f..235b3415a 100644 --- a/python/sglang/srt/arg_groups/deepseek_v4_hook.py +++ b/python/sglang/srt/arg_groups/deepseek_v4_hook.py @@ -51,13 +51,6 @@ def apply_deepseek_v4_defaults(server_args: "ServerArgs", model_arch: str) -> No f"Setting swa_full_tokens_ratio to {server_args.swa_full_tokens_ratio} for {model_arch}." ) - if server_args.disaggregation_mode != "null" and server_args.pp_size > 1: - # get_mla_kv_ptrs_with_pp cannot slice V4's buffer-type-organized - # flat KV ptrs by PP layer range. - raise ValueError( - f"V4 PD disaggregation requires pp_size=1, got pp_size={server_args.pp_size}." - ) - def validate_deepseek_v4_cp(server_args: "ServerArgs") -> None: """Validate DeepSeek V4 context-parallel configuration."""