From e4f7f7b3807b9e8bfb188954b9301fc46bdfc6a1 Mon Sep 17 00:00:00 2001 From: ICENacl <40969745+ICENacl@users.noreply.github.com> Date: Thu, 30 Jul 2026 03:01:09 +0800 Subject: [PATCH] fix(qwen3.5): restrict MoE weights to local PP layers (#32022) Co-authored-by: chunjiang.hc Co-authored-by: Yihao Wang <42559837+AgainstEntropy@users.noreply.github.com> --- python/sglang/srt/models/qwen3_5.py | 6 +++--- 1 file changed, 3 insertions(+), 3 deletions(-) diff --git a/python/sglang/srt/models/qwen3_5.py b/python/sglang/srt/models/qwen3_5.py index fcdcb92e0..d869d61bc 100644 --- a/python/sglang/srt/models/qwen3_5.py +++ b/python/sglang/srt/models/qwen3_5.py @@ -2288,9 +2288,9 @@ class Qwen3_5MoeForConditionalGeneration(Qwen3VLForConditionalGeneration): self._routed_experts_weights_of_layer = LazyValue( lambda: { - layer_id: layer.mlp.get_moe_weights() - for layer_id, layer in enumerate(self.model.layers) - if isinstance(layer.mlp, Qwen2MoeSparseMoeBlock) + layer_id: self.model.layers[layer_id].mlp.get_moe_weights() + for layer_id in range(self.model.start_layer, self.model.end_layer) + if isinstance(self.model.layers[layer_id].mlp, Qwen2MoeSparseMoeBlock) } )