diff --git a/python/sglang/srt/models/bailing_moe_v3.py b/python/sglang/srt/models/bailing_moe_v3.py index 14317b338..bf660d593 100644 --- a/python/sglang/srt/models/bailing_moe_v3.py +++ b/python/sglang/srt/models/bailing_moe_v3.py @@ -1333,7 +1333,7 @@ class BailingMoeV3ForCausalLM(nn.Module): # in the logits processor. Accuracy-neutral on ling-v3. params_dtype=torch.bfloat16, quant_config=quant_config, - use_attn_tp_group=get_parallel().enable_dp_lm_head, + use_attn_tp_group=get_parallel().config.enable_dp_lm_head, ) ) self.logits_processor = LogitsProcessor(config) diff --git a/test/registered/unit/models/test_shared_experts_fusion_gates.py b/test/registered/unit/models/test_shared_experts_fusion_gates.py index d53b365e9..f698e2421 100644 --- a/test/registered/unit/models/test_shared_experts_fusion_gates.py +++ b/test/registered/unit/models/test_shared_experts_fusion_gates.py @@ -335,7 +335,7 @@ class TestBailingMoeV3Gate(_FusionGateCase): parallel = SimpleNamespace( tp_size=1, moe_ep_size=1, - enable_dp_lm_head=False, + config=SimpleNamespace(enable_dp_lm_head=False), ) with ( unittest.mock.patch.object(