feat(sgl-kernel): add InfLLM v2 attention kernels (#29383)
Co-authored-by: Size Wang <paulgeorge13hhhhh@gmail.com> Co-authored-by: lijiayi <lijiayi@modelbest.cn> Co-authored-by: suhmily10 <suhmily@gmail.com> Co-authored-by: Xiaoyue Xu <xiaoyue.xu.me@gmail.com> Co-authored-by: hansjohn <74091612+hansjohn@users.noreply.github.com> Co-authored-by: zhangyan <1762895426@qq.com>
This commit is contained in:
co-authored by
Size Wang
lijiayi
suhmily10
Xiaoyue Xu
hansjohn
zhangyan
parent
be70bfbdbb
commit
9bd02dc5b9
@@ -0,0 +1,7 @@
|
||||
from sgl_kernel.infllm_v2.attention import infllmv2_attn_stage1
|
||||
from sgl_kernel.infllm_v2.max_pooling import max_pooling_1d_varlen
|
||||
|
||||
__all__ = [
|
||||
"infllmv2_attn_stage1",
|
||||
"max_pooling_1d_varlen",
|
||||
]
|
||||
Reference in New Issue
Block a user