From 2a89c6823a5bad38f2ff00fd4ab96c0810ffa6a7 Mon Sep 17 00:00:00 2001 From: raghotham <853234+raghotham@users.noreply.github.com> Date: Fri, 14 Aug 2026 23:00:41 -0700 Subject: [PATCH] fix: honor explicit model loader classes (#34880) Co-authored-by: ehhuang --- python/sglang/srt/model_loader/loader.py | 6 +++--- 1 file changed, 3 insertions(+), 3 deletions(-) diff --git a/python/sglang/srt/model_loader/loader.py b/python/sglang/srt/model_loader/loader.py index 645dfdf12..123e5a03f 100644 --- a/python/sglang/srt/model_loader/loader.py +++ b/python/sglang/srt/model_loader/loader.py @@ -4278,6 +4278,9 @@ def get_model_loader( if load_config.load_format == LoadFormat.DUMMY: return DummyModelLoader(load_config) + if isinstance(load_config.load_format, type): + return load_config.load_format(load_config) + if model_config and model_config.quantization in ["auto-round-int8"]: logger.info("Using IncModelLoader due to AutoRound quantization config.") return IncModelLoader(load_config) @@ -4332,9 +4335,6 @@ def get_model_loader( ) return ModelOptModelLoader(load_config) - if isinstance(load_config.load_format, type): - return load_config.load_format(load_config) - if load_config.load_format == LoadFormat.SHARDED_STATE: return ShardedStateLoader(load_config)