fix: Qwen3.5-35B-A3B-AWQ w2_weight KeyError and related params for CPU (#31174)
Co-authored-by: Niu Ziru <niuziru@a4bf018d3341.jf.intel.com>
This commit is contained in:
@@ -194,6 +194,8 @@ class AWQCPUConfig(AWQConfig):
|
|||||||
layer.scheme = self.get_linear_scheme(layer)
|
layer.scheme = self.get_linear_scheme(layer)
|
||||||
return AWQLinearMethod(self)
|
return AWQLinearMethod(self)
|
||||||
elif isinstance(layer, FusedMoE):
|
elif isinstance(layer, FusedMoE):
|
||||||
|
if is_layer_skipped_awq(prefix, self.modules_to_not_convert):
|
||||||
|
return None
|
||||||
layer.scheme = self.get_moe_scheme(layer)
|
layer.scheme = self.get_moe_scheme(layer)
|
||||||
return AWQMoEMethod(self)
|
return AWQMoEMethod(self)
|
||||||
return None
|
return None
|
||||||
|
|||||||
@@ -301,7 +301,7 @@ class Qwen3_5GatedDeltaNet(nn.Module):
|
|||||||
group_size=None,
|
group_size=None,
|
||||||
norm_before_gate=True,
|
norm_before_gate=True,
|
||||||
device=torch.get_device_module().current_device(),
|
device=torch.get_device_module().current_device(),
|
||||||
dtype=config.torch_dtype,
|
dtype=torch.get_default_dtype(),
|
||||||
**(
|
**(
|
||||||
{"activation": self.output_gate_type}
|
{"activation": self.output_gate_type}
|
||||||
if self.output_gate_type is not None
|
if self.output_gate_type is not None
|
||||||
|
|||||||
Reference in New Issue
Block a user