Logo
Explore Help
Register Sign In
minke.yu/sglang
Watch 1
Star 0
Fork 0
Code Issues Pull Requests Actions 15 Packages Projects Releases Wiki Activity
Files
9bd02dc5b90eea9f484190094df93337830bc3ab
sglang/sgl-kernel/include
T
History
caupheSize Wanglijiayisuhmily10Xiaoyue Xuhansjohnzhangyan
9bd02dc5b9 feat(sgl-kernel): add InfLLM v2 attention kernels (#29383)
Co-authored-by: Size Wang <paulgeorge13hhhhh@gmail.com>
Co-authored-by: lijiayi <lijiayi@modelbest.cn>
Co-authored-by: suhmily10 <suhmily@gmail.com>
Co-authored-by: Xiaoyue Xu <xiaoyue.xu.me@gmail.com>
Co-authored-by: hansjohn <74091612+hansjohn@users.noreply.github.com>
Co-authored-by: zhangyan <1762895426@qq.com>
2026-07-06 22:46:54 -07:00
..
hip
[AMD][Diffusion] support timestep embedding kernel for AMD GPUs (#16766)
2026-01-12 22:17:07 -08:00
musa
[MUSA][18/N] Add MUSA-optimized kernel implementations for hot ops (#23255)
2026-05-07 20:38:33 -07:00
pytorch_extension_utils_rocm.h
[AMD] Support Hierarchical Caching on AMD GPUs (#8236)
2025-08-28 15:27:07 -07:00
scalar_type.hpp
Add new moe wna16 marlin gemm (#14122)
2025-12-01 23:07:53 +08:00
sgl_flash_kernel_ops.h
Upgrade fa3 hash (#28394)
2026-06-17 13:32:11 -07:00
sgl_kernel_musa_ops.h
[MUSA]: Add flashinfer sampling backend (#24978)
2026-05-14 20:23:15 -07:00
sgl_kernel_ops.h
feat(sgl-kernel): add InfLLM v2 attention kernels (#29383)
2026-07-06 22:46:54 -07:00
sgl_kernel_torch_shim.h
Add typo checker in pre-commit (#6179)
2025-05-11 12:55:00 +08:00
utils.h
[7/n] decouple quantization impl from vllm dependency - gguf kernel (#11019)
2025-10-11 14:04:57 -07:00
Powered by Gitea Version: 1.27.3 Page: 488ms Template: 3ms
GitHub Default Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API