---
title: Welcome to SGLang
description: High-performance serving framework for large language and multimodal models.
keywords:
- sglang
- llm serving
- multimodal
- inference runtime
mode: wide
---
import { popularModels } from "/src/snippets/configs/popular-models.jsx";
import { PopularModels } from "/src/snippets/_popular_models.jsx";
{/* One hero per model, rotating. The Cookbook landing page renders the same
list as a compact strip. Edit the list, not this page. */}
{"SGLang and Miles Add Day-0 Support for Qwen3.8"}
{"Aug 12, 2026"}
{"Unified Radix Cache: One Tree for Hybrid Model Prefix Caching"}
{"August 11, 2026"}
{"SGLang Adds Day-0 Support for NVIDIA Nemotron 3.5 Lightning"}
{"August 11, 2026"}
{"SGLang Adds Day-0 Support for Muse Glimmer, a Multimodal Model Built for Local Agentic Workflows"}
{"August 10, 2026"}
{"HPC-Ops \u00d7 SGLang: High-Performance Attention, Router GEMM, and MoE Kernels from Tencent Hunyuan"}
{"August 7, 2026"}
{"Full-Stack Performance Optimization of AR+DiT in SGL-Diffusion"}
{"August 05, 2026"}
Stay connected