diff --git a/python/sglang/srt/layers/quantization/unquant.py b/python/sglang/srt/layers/quantization/unquant.py index 7339640c4..3cc28e2ae 100644 --- a/python/sglang/srt/layers/quantization/unquant.py +++ b/python/sglang/srt/layers/quantization/unquant.py @@ -593,6 +593,8 @@ class UnquantizedFusedMoEMethod(FusedMoEMethodBase, MultiPlatformOp): b1=getattr(layer, "w13_weight_bias", None), b2=getattr(layer, "w2_weight_bias", None), activation=moe_runner_config.activation, + gemm1_alpha=moe_runner_config.gemm1_alpha, + gemm1_limit=moe_runner_config.gemm1_clamp_limit, ) return StandardCombineInput(hidden_states=output) else: