fix(gemma4): quantize MTP bridge projections (#32440)
This commit is contained in:
@@ -91,7 +91,7 @@ class Gemma4AssistantForCausalLM(Gemma4ForCausalLM):
|
||||
2 * self.backbone_hidden_size,
|
||||
self.hidden_size,
|
||||
bias=False,
|
||||
quant_config=None,
|
||||
quant_config=quant_config,
|
||||
prefix=add_prefix("pre_projection", prefix),
|
||||
)
|
||||
self.model = Gemma4TextModel(
|
||||
@@ -103,7 +103,7 @@ class Gemma4AssistantForCausalLM(Gemma4ForCausalLM):
|
||||
self.hidden_size,
|
||||
self.backbone_hidden_size,
|
||||
bias=False,
|
||||
quant_config=None,
|
||||
quant_config=quant_config,
|
||||
prefix=add_prefix("post_projection", prefix),
|
||||
)
|
||||
|
||||
|
||||
Reference in New Issue
Block a user