[fix] qwen3.5 fuse_moe_triton_tune bug (#20232)

This commit is contained in:
zhangxiaolei
2026-03-27 19:23:24 -04:00
committed by GitHub
parent 6d48719e31
commit e2b8463c80
@@ -37,11 +37,7 @@ def get_model_config(
topk_ids_dir: str = None,
) -> Dict:
config = get_config(model_name, trust_remote_code=True)
# Replace config with text_config for encoder-decoder models after getting block_shape and architecture
if hasattr(config, "text_config"):
config = config.get_text_config()
architecture = config.architectures[0]
block_shape = None
if (
hasattr(config, "quantization_config")
@@ -61,8 +57,9 @@ def get_model_config(
group_size = weights_config.get("group_size")
block_shape = [0, group_size]
assert len(block_shape) == 2
architecture = config.architectures[0]
# Replace config with text_config for encoder-decoder models after getting block_shape and architecture
if hasattr(config, "text_config"):
config = config.get_text_config()
hidden_size = config.hidden_size
if architecture == "DbrxForCausalLM":