Logo
Explore Help
Register Sign In
minke.yu/sglang
Watch 1
Star 0
Fork 0
Code Issues Pull Requests Actions 12 Packages Projects Releases Wiki Activity
Files
efebcab43ed851405bd41cfdf206245945dbb8ee
sglang/benchmark/kernels
T
History
zhangxiaolei e2b8463c80 [fix] qwen3.5 fuse_moe_triton_tune bug (#20232)
2026-03-27 19:23:24 -04:00
..
all_reduce
refactor: consolidate is_in_ci (jit_kernel, sgl-kernel benchmarks, tests) (#21009)
2026-03-20 05:55:36 -07:00
decoding_attention_triton
Fix benchmark import for should_use_tensor_core (#17232)
2026-01-16 17:48:36 -05:00
deepep
Add CLI args to conveniently support tuning more models (#12922)
2026-03-12 23:10:55 -07:00
deepseek
[Benchmark] use flashinfer bench_gpu_time instead of triton do_bench (#20305)
2026-03-12 04:04:30 +00:00
elementwise
[Benchmark] use flashinfer bench_gpu_time instead of triton do_bench (#20305)
2026-03-12 04:04:30 +00:00
flashinfer_allreduce_fusion
[kernel slimming] Clean many useless sgl-kernel deprecated kernels (#20277)
2026-03-14 16:45:54 +08:00
fused_moe_triton
[fix] qwen3.5 fuse_moe_triton_tune bug (#20232)
2026-03-27 19:23:24 -04:00
quantization
Fix result writer in tuning_block_wise_kernel.py, and add FP8 kernel config for L40 (#20368)
2026-03-20 09:28:54 +08:00
scheduler_batch
[Benchmark] use flashinfer bench_gpu_time instead of triton do_bench (#20305)
2026-03-12 04:04:30 +00:00
sliding_window_attention_triton
[Benchmark] use flashinfer bench_gpu_time instead of triton do_bench (#20305)
2026-03-12 04:04:30 +00:00
Powered by Gitea Version: 1.27.3 Page: 249ms Template: 5ms
GitHub Default Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API