[Kernel] Add fused MoE Triton configs for Qwen3.8-Flash-Next FP8 on NVIDIA H200 NVL (TP2+EP2) (#38116)

This commit is contained in:
Chan ahn
2026-09-07 10:17:55 -07:00
committed by GitHub
parent c99d906eff
commit dcebe8c473
2 changed files with 147 additions and 0 deletions
@@ -84,6 +84,7 @@ def get_model_config(
"Qwen3VLMoeForConditionalGeneration",
"Qwen3_5MoeForCausalLM",
"Qwen3_5MoeForConditionalGeneration",
"Qwen4ExpForConditionalGeneration",
"InternS2PreviewForConditionalGeneration",
"MellumForCausalLM",
]: