Logo
Explore Help
Register Sign In
minke.yu/sglang
Watch 1
Star 0
Fork 0
Code Issues Pull Requests Actions 12 Packages Projects Releases Wiki Activity
Files
d021990bf5aff7f0cbcc7a024aa17dbfaee824d0
sglang/sgl-kernel/csrc/gemm
T
History
Brayden ZhongBrayden Zhongroot
03342e7732 Delete sgl-kernel AOT router GEMM and fused A GEMM (#30280)
Co-authored-by: Brayden Zhong <brayden@radixark.ai>
Co-authored-by: root <root@sgl-b300-inference.datacrunch.io>
2026-07-22 08:44:59 +08:00
..
gptq
[2/n]decouple quantization implementation from vLLM dependency (#8112)
2025-08-14 03:19:03 -07:00
marlin
Revert "[Feature] NVFP4 Marlin fallback for non-Blackwell GPUs (SM75+… (#22047)
2026-04-03 13:12:30 -07:00
awq_kernel.cu
Fix AWQ Dequant and Weight Loading of deepseek v2 (#6842)
2025-06-17 13:45:10 -07:00
fp8_gemm_kernel.cu
[fp8] SM90 swap-AB scaled_mm dispatch (~1.16x kernel geomean, +5.8-18.5% end-to-end) (#25532)
2026-05-20 13:20:37 +08:00
int8_gemm_kernel.cu
Optimize cutlass int8 gemm kernel for large M on SM89 Ada GPU (#10714)
2025-09-21 17:04:27 -07:00
math.hpp
[Perf] Tunings for SM100 FP8 CUTLASS kernel (#8818)
2025-08-13 21:59:22 -07:00
per_token_group_quant_8bit_v2.cu
Enable PDL for various kernels in DSV32/GLM5 (#23965)
2026-05-09 03:42:56 -07:00
per_token_group_quant_8bit.cu
Reland [1/2] Optimizations and refactors about quant kernel (#10312)
2025-10-11 15:59:03 +08:00
per_token_quant_fp8.cu
support smem in per_token_quant_fp8 kernel (#16725)
2026-02-02 17:18:50 +08:00
Powered by Gitea Version: 1.27.3 Page: 507ms Template: 4ms
GitHub Default Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API