[CPU] Fix truncated KV prefix in intel_amx spec verify (#36430)
This commit is contained in:
@@ -215,7 +215,6 @@ class IntelAMXAttnBackend(AttentionBackend):
|
|||||||
seq_lens, extend_seq_lens, extend_start_loc, tree_mask = self.extend_metadata
|
seq_lens, extend_seq_lens, extend_start_loc, tree_mask = self.extend_metadata
|
||||||
|
|
||||||
_, max_extend_len = self.forward_metadata
|
_, max_extend_len = self.forward_metadata
|
||||||
seq_lens = forward_batch.seq_lens
|
|
||||||
if seq_lens.dtype != torch.int64:
|
if seq_lens.dtype != torch.int64:
|
||||||
seq_lens = seq_lens.to(torch.int64)
|
seq_lens = seq_lens.to(torch.int64)
|
||||||
|
|
||||||
@@ -262,7 +261,6 @@ class IntelAMXAttnBackend(AttentionBackend):
|
|||||||
seq_lens = forward_batch.seq_lens
|
seq_lens = forward_batch.seq_lens
|
||||||
|
|
||||||
q = q.reshape(-1, layer.tp_q_head_num * layer.qk_head_dim)
|
q = q.reshape(-1, layer.tp_q_head_num * layer.qk_head_dim)
|
||||||
seq_lens = forward_batch.seq_lens
|
|
||||||
if seq_lens.dtype != torch.int64:
|
if seq_lens.dtype != torch.int64:
|
||||||
seq_lens = seq_lens.to(torch.int64)
|
seq_lens = seq_lens.to(torch.int64)
|
||||||
|
|
||||||
|
|||||||
Reference in New Issue
Block a user