diff --git a/python/sglang/srt/models/qwen3.py b/python/sglang/srt/models/qwen3.py index ba6652915..dfa440621 100644 --- a/python/sglang/srt/models/qwen3.py +++ b/python/sglang/srt/models/qwen3.py @@ -287,10 +287,7 @@ class Qwen3Attention(nn.Module): positions, hidden_states, forward_batch ) save_kv_cache = False - elif ( - not _is_npu - or forward_batch.forward_mode.is_extend_or_draft_extend_or_mixed() - ): + elif not _is_npu: q, k, v = self.forward_prepare_native( positions=positions, hidden_states=hidden_states,