From ca29c2b0e79e4ea1f8257c08927a7b7549ee2480 Mon Sep 17 00:00:00 2001 From: ybyang <10629930+whybeyoung@users.noreply.github.com> Date: Wed, 20 May 2026 10:57:23 +0800 Subject: [PATCH] fix(dsv4): drop stale pp_size=1 guard for V4 PD disaggregation (#25771) --- python/sglang/srt/arg_groups/deepseek_v4_hook.py | 7 ------- 1 file changed, 7 deletions(-) diff --git a/python/sglang/srt/arg_groups/deepseek_v4_hook.py b/python/sglang/srt/arg_groups/deepseek_v4_hook.py index b3af8e95f..235b3415a 100644 --- a/python/sglang/srt/arg_groups/deepseek_v4_hook.py +++ b/python/sglang/srt/arg_groups/deepseek_v4_hook.py @@ -51,13 +51,6 @@ def apply_deepseek_v4_defaults(server_args: "ServerArgs", model_arch: str) -> No f"Setting swa_full_tokens_ratio to {server_args.swa_full_tokens_ratio} for {model_arch}." ) - if server_args.disaggregation_mode != "null" and server_args.pp_size > 1: - # get_mla_kv_ptrs_with_pp cannot slice V4's buffer-type-organized - # flat KV ptrs by PP layer range. - raise ValueError( - f"V4 PD disaggregation requires pp_size=1, got pp_size={server_args.pp_size}." - ) - def validate_deepseek_v4_cp(server_args: "ServerArgs") -> None: """Validate DeepSeek V4 context-parallel configuration."""