diff --git a/python/sglang/srt/layers/quantization/compressed_tensors/utils.py b/python/sglang/srt/layers/quantization/compressed_tensors/utils.py index 435d6ebb2..e7d6db63d 100644 --- a/python/sglang/srt/layers/quantization/compressed_tensors/utils.py +++ b/python/sglang/srt/layers/quantization/compressed_tensors/utils.py @@ -59,8 +59,8 @@ def should_ignore_layer( # If shard_idx=1+ confirm scheme matches prior shards. elif should_ignore_shard != should_ignore_layer: raise ValueError( - f"Found a different quantization schemes for " - f"{shard_proj_names} in {layer_name}. vLLM " + f"Found different quantization schemes for " + f"{shard_proj_names} in {layer_name}. SGLang " "requires all to use the same scheme." ) diff --git a/python/sglang/srt/layers/quantization/quark/quark.py b/python/sglang/srt/layers/quantization/quark/quark.py index 3afb26000..57dc7f162 100644 --- a/python/sglang/srt/layers/quantization/quark/quark.py +++ b/python/sglang/srt/layers/quantization/quark/quark.py @@ -430,7 +430,7 @@ class QuarkConfig(QuantizationConfig): ): raise ValueError( f"Found a different quantization configuration for " - f"{shard_proj_names} in {layer_name}. vLLM " + f"{shard_proj_names} in {layer_name}. SGLang " "requires all to use the same scheme." ) return shard_configs[0] diff --git a/python/sglang/srt/layers/quantization/quark/utils.py b/python/sglang/srt/layers/quantization/quark/utils.py index 930dab855..7fd865233 100644 --- a/python/sglang/srt/layers/quantization/quark/utils.py +++ b/python/sglang/srt/layers/quantization/quark/utils.py @@ -72,8 +72,8 @@ def should_ignore_layer( # If shard_idx=1+ confirm scheme matches prior shards. elif should_ignore_shard != should_ignore_layer: raise ValueError( - f"Found a different quantization schemes for " - f"{shard_proj_names} in {layer_name}. vLLM " + f"Found different quantization schemes for " + f"{shard_proj_names} in {layer_name}. SGLang " "requires all to use the same scheme." )