Pass quant_config to attention gate projection (#28649)
This commit is contained in:
@@ -304,7 +304,7 @@ class LagunaAttention(nn.Module):
|
||||
g_proj_dim,
|
||||
bias=False,
|
||||
gather_output=False,
|
||||
quant_config=None,
|
||||
quant_config=quant_config,
|
||||
tp_rank=attn_tp_rank,
|
||||
tp_size=attn_tp_size,
|
||||
prefix=add_prefix("g_proj", prefix),
|
||||
|
||||
Reference in New Issue
Block a user