[chore] harden checkpoint quantization metadata parsing (#36922)

This commit is contained in:
Mick
2026-09-03 09:27:22 +08:00
committed by GitHub
parent fbf909b460
commit 0dd66def7c
4 changed files with 45 additions and 68 deletions
@@ -14,6 +14,7 @@ from unittest.mock import MagicMock, patch
import torch
import torch.nn as nn
from transformers import PretrainedConfig
from sglang.srt.configs.device_config import DeviceConfig
from sglang.srt.configs.load_config import LoadConfig
@@ -657,7 +658,7 @@ class TestModelOptFp4LoaderSelection(CustomTestCase):
quantization="modelopt_fp4",
is_draft_model=True,
is_draft_quantization_explicit=is_explicit,
hf_config=SimpleNamespace(
hf_config=PretrainedConfig(
quantization_config={
"quant_algo": "NVFP4",
"group_size": 16,
@@ -757,7 +758,7 @@ class TestModelOptMixedPrecisionConfig(CustomTestCase):
with self.subTest(inline_config=inline_config):
model_config = SimpleNamespace(
quantization="modelopt_mixed",
hf_config=SimpleNamespace(
hf_config=PretrainedConfig(
quantization_config=inline_config,
),
model_path=model_path,
@@ -787,7 +788,7 @@ class TestModelOptMixedPrecisionConfig(CustomTestCase):
}
model_config = SimpleNamespace(
quantization="modelopt_mixed",
hf_config=SimpleNamespace(
hf_config=PretrainedConfig(
quantization_config={
"quant_method": "modelopt_mixed",
"quant_algo": "MIXED_PRECISION",