Logo
Explore Help
Register Sign In
minke.yu/sglang
Watch 1
Star 0
Fork 0
Code Issues Pull Requests Actions 14 Packages Projects Releases Wiki Activity
Files
09fa012ba79e7e36112e44b1f2de2bc215c38f1f
sglang/python/sglang/srt/model_executor
T
History
Yuhao Yang ca44aa25af Fix dp_attention crash when dp_size < tp_size in warmup dummy run (#19760)
2026-03-03 19:43:13 -08:00
..
cpu_graph_runner.py
Add torch.compile support for qwen3-next on CPU (#12444)
2026-02-26 23:28:03 -08:00
cuda_graph_runner.py
Refactor CUDA graph input buffers with shared buffer pool (#19180)
2026-02-24 02:24:40 -08:00
forward_batch_deepseek_mha_mixin.py
[2/n] deepseek_v2.py Refactor: Migrate MHA forward method in deepseek_v2.py (#16817)
2026-01-17 09:36:25 +08:00
forward_batch_info.py
Remove sync points in mamba cache + prefill cudagraph plumbing for DP (#19639)
2026-03-02 15:03:42 +08:00
hook_manager.py
Rename: --hooks to --forward-hooks (#13994)
2025-11-26 22:26:28 +08:00
input_buffers.py
Refactor CUDA graph input buffers with shared buffer pool (#19180)
2026-02-24 02:24:40 -08:00
mindspore_runner.py
[NPU]mindspore model support moe (#15363)
2026-02-02 17:52:49 +08:00
model_runner_kv_cache_mixin.py
[Spec V2] Support specV2 for mamba hybrid attention (#18808)
2026-02-27 00:36:01 +08:00
model_runner.py
Fix dp_attention crash when dp_size < tp_size in warmup dummy run (#19760)
2026-03-03 19:43:13 -08:00
piecewise_cuda_graph_runner.py
Piecewise Cuda Graph set default (#16331)
2026-03-02 23:18:07 +08:00
Powered by Gitea Version: 1.27.3 Page: 383ms Template: 3ms
GitHub Default Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API