[Intel GPU] Enable sgl-kernel-xpu fused_experts MoE kernel path for GPT-OSS bf16 models. (#22417)
This commit is contained in:
@@ -593,6 +593,8 @@ class UnquantizedFusedMoEMethod(FusedMoEMethodBase, MultiPlatformOp):
|
|||||||
b1=getattr(layer, "w13_weight_bias", None),
|
b1=getattr(layer, "w13_weight_bias", None),
|
||||||
b2=getattr(layer, "w2_weight_bias", None),
|
b2=getattr(layer, "w2_weight_bias", None),
|
||||||
activation=moe_runner_config.activation,
|
activation=moe_runner_config.activation,
|
||||||
|
gemm1_alpha=moe_runner_config.gemm1_alpha,
|
||||||
|
gemm1_limit=moe_runner_config.gemm1_clamp_limit,
|
||||||
)
|
)
|
||||||
return StandardCombineInput(hidden_states=output)
|
return StandardCombineInput(hidden_states=output)
|
||||||
else:
|
else:
|
||||||
|
|||||||
Reference in New Issue
Block a user