fix(gemma4): quantize MTP bridge projections (#32440)
This commit is contained in:
@@ -91,7 +91,7 @@ class Gemma4AssistantForCausalLM(Gemma4ForCausalLM):
|
|||||||
2 * self.backbone_hidden_size,
|
2 * self.backbone_hidden_size,
|
||||||
self.hidden_size,
|
self.hidden_size,
|
||||||
bias=False,
|
bias=False,
|
||||||
quant_config=None,
|
quant_config=quant_config,
|
||||||
prefix=add_prefix("pre_projection", prefix),
|
prefix=add_prefix("pre_projection", prefix),
|
||||||
)
|
)
|
||||||
self.model = Gemma4TextModel(
|
self.model = Gemma4TextModel(
|
||||||
@@ -103,7 +103,7 @@ class Gemma4AssistantForCausalLM(Gemma4ForCausalLM):
|
|||||||
self.hidden_size,
|
self.hidden_size,
|
||||||
self.backbone_hidden_size,
|
self.backbone_hidden_size,
|
||||||
bias=False,
|
bias=False,
|
||||||
quant_config=None,
|
quant_config=quant_config,
|
||||||
prefix=add_prefix("post_projection", prefix),
|
prefix=add_prefix("post_projection", prefix),
|
||||||
)
|
)
|
||||||
|
|
||||||
|
|||||||
Reference in New Issue
Block a user