From 08ceb96ea5350fd18095d7f5a2b5a987c6d0c9ca Mon Sep 17 00:00:00 2001 From: Aleksi Vesanto Date: Wed, 10 Jun 2026 08:55:47 +0300 Subject: [PATCH] [diffusion] fix: remove boolean arithmetic guard to fix compiling (#27065) --- .../multimodal_gen/runtime/layers/attention/layer.py | 12 +++--------- 1 file changed, 3 insertions(+), 9 deletions(-) diff --git a/python/sglang/multimodal_gen/runtime/layers/attention/layer.py b/python/sglang/multimodal_gen/runtime/layers/attention/layer.py index 9d202e362..d3b827c81 100644 --- a/python/sglang/multimodal_gen/runtime/layers/attention/layer.py +++ b/python/sglang/multimodal_gen/runtime/layers/attention/layer.py @@ -648,15 +648,9 @@ class USPAttention(nn.Module): sp_size = get_ulysses_parallel_world_size() if ( - sum( - bool(n) - for n in ( - num_replicated_prefix, - num_replicated_suffix, - num_replicated_kv_prefix, - ) - ) - > 1 + (num_replicated_prefix > 0 and num_replicated_suffix > 0) + or (num_replicated_prefix > 0 and num_replicated_kv_prefix > 0) + or (num_replicated_suffix > 0 and num_replicated_kv_prefix > 0) ): raise ValueError( "USPAttention supports at most one replicated-token mode per call."