Logo
Explore Help
Register Sign In
minke.yu/sglang
Watch 1
Star 0
Fork 0
Code Issues Pull Requests Actions 12 Packages Projects Releases Wiki Activity
16,804 Commits 3 Branches 0 Tags
aa8222917343b0a2bb702b23cb2651057b0a4191
Commit Graph
4 Commits
This Branch
This Branch
All Branches
Author SHA1 Message Date
amd-danli103andThomas Wang d01812d89e [AMD] Optimize KIMI-K3 with Triton MLA decode kernel by tuning the stage-1 geometry for gfx950 (#34580)
Co-authored-by: Thomas Wang <thomawan@amd.com>
2026-08-17 21:16:14 -07:00
amd-danli103andamd-danli103 462b6171bd [AMD] Fix stale SWA ring buffer on radix prefix reuse for DeepSeek-V4 with unified_kv backend (#30339)
Co-authored-by: amd-danli103 <dan2.li@amd.com>
2026-07-09 11:28:22 -07:00
amd-danli103amd-danli103Thomas Wang
54e71506b3 [AMD][DSV4] Remove per-batch D2H syncs in MTP to avoid bubbles between 2 batches (#29420)
Co-authored-by: amd-danli103 <amd-danli103@users.noreply.github.com>
Co-authored-by: Thomas Wang <thomawan@amd.com>
2026-06-29 22:39:59 -07:00
amd-danli103Raiden-Makotoyichiche@amd.com
c4ec39a785 [AMD] refactor sparse MLA decode kernel for Deepseek V4 triton backend (#28265)
Co-authored-by: Raiden-Makoto <Raiden-Makoto@users.noreply.github.com>
Co-authored-by: yichiche@amd.com <jacky.cheng>
2026-06-15 03:26:59 -07:00
Powered by Gitea Version: 1.27.3 Page: 401ms Template: 3ms
GitHub Default Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API