diff --git a/python/sglang/srt/model_loader/loader.py b/python/sglang/srt/model_loader/loader.py index 645dfdf12..123e5a03f 100644 --- a/python/sglang/srt/model_loader/loader.py +++ b/python/sglang/srt/model_loader/loader.py @@ -4278,6 +4278,9 @@ def get_model_loader( if load_config.load_format == LoadFormat.DUMMY: return DummyModelLoader(load_config) + if isinstance(load_config.load_format, type): + return load_config.load_format(load_config) + if model_config and model_config.quantization in ["auto-round-int8"]: logger.info("Using IncModelLoader due to AutoRound quantization config.") return IncModelLoader(load_config) @@ -4332,9 +4335,6 @@ def get_model_loader( ) return ModelOptModelLoader(load_config) - if isinstance(load_config.load_format, type): - return load_config.load_format(load_config) - if load_config.load_format == LoadFormat.SHARDED_STATE: return ShardedStateLoader(load_config)