Fix GLM NextN draft value head dim (#26049)

This commit is contained in:
Yueming Yuan
2026-06-09 16:13:37 -07:00
committed by GitHub
parent 4455abd164
commit 53a4b51f8c
+11
View File
@@ -674,6 +674,17 @@ class ModelConfig:
self.scaling = compute_mla_mscale_scaling(
self.hf_config.rope_scaling, self.scaling
)
elif "Glm4MoeForCausalLMNextN" in self.hf_config.architectures:
if self.head_dim is None:
self.head_dim = (
self.hf_text_config.hidden_size
// self.hf_text_config.num_attention_heads
)
if self.swa_head_dim is None:
self.swa_head_dim = self.head_dim
self.v_head_dim = self.head_dim
self.swa_v_head_dim = self.swa_head_dim
self.attention_arch = AttentionArch.MHA
elif "MiniCPM3ForCausalLM" in self.hf_config.architectures:
self.head_dim = 128
self.attention_arch = AttentionArch.MLA