fix: Qwen3.5-35B-A3B-AWQ w2_weight KeyError and related params for CPU (#31174)
Co-authored-by: Niu Ziru <niuziru@a4bf018d3341.jf.intel.com>
This commit is contained in:
@@ -194,6 +194,8 @@ class AWQCPUConfig(AWQConfig):
|
||||
layer.scheme = self.get_linear_scheme(layer)
|
||||
return AWQLinearMethod(self)
|
||||
elif isinstance(layer, FusedMoE):
|
||||
if is_layer_skipped_awq(prefix, self.modules_to_not_convert):
|
||||
return None
|
||||
layer.scheme = self.get_moe_scheme(layer)
|
||||
return AWQMoEMethod(self)
|
||||
return None
|
||||
|
||||
@@ -301,7 +301,7 @@ class Qwen3_5GatedDeltaNet(nn.Module):
|
||||
group_size=None,
|
||||
norm_before_gate=True,
|
||||
device=torch.get_device_module().current_device(),
|
||||
dtype=config.torch_dtype,
|
||||
dtype=torch.get_default_dtype(),
|
||||
**(
|
||||
{"activation": self.output_gate_type}
|
||||
if self.output_gate_type is not None
|
||||
|
||||
Reference in New Issue
Block a user