diff --git a/python/sglang/srt/models/qwen3_moe.py b/python/sglang/srt/models/qwen3_moe.py index a29df9f46..6b749191e 100644 --- a/python/sglang/srt/models/qwen3_moe.py +++ b/python/sglang/srt/models/qwen3_moe.py @@ -661,10 +661,7 @@ class Qwen3MoeAttention(nn.Module): ): if hidden_states.shape[0] == 0: return hidden_states, forward_batch, None - if ( - not _is_npu - or forward_batch.forward_mode.is_extend_or_draft_extend_or_mixed() - ): + if not _is_npu: return self.forward_prepare_native( positions=positions, hidden_states=hidden_states,