[CI] Fix qwen3-vl lora nightly ci (#12708)
This commit is contained in:
@@ -96,19 +96,20 @@ LORA_MODEL_VARIANTS = [
|
|||||||
max_loras_per_batch=1,
|
max_loras_per_batch=1,
|
||||||
),
|
),
|
||||||
),
|
),
|
||||||
(
|
# TODO: Move 30B MoE to 2 GPU runner
|
||||||
"Qwen3-VL-MoE",
|
# (
|
||||||
LoRAModelCase(
|
# "Qwen3-VL-MoE",
|
||||||
base="Qwen/Qwen3-VL-30B-A3B-Instruct",
|
# LoRAModelCase(
|
||||||
adaptors=[
|
# base="Qwen/Qwen3-VL-30B-A3B-Instruct",
|
||||||
LoRAAdaptor(
|
# adaptors=[
|
||||||
name="sosoai/qwen3_vl_30b_lora",
|
# LoRAAdaptor(
|
||||||
prefill_tolerance=3e-1,
|
# name="sosoai/qwen3_vl_30b_lora",
|
||||||
),
|
# prefill_tolerance=3e-1,
|
||||||
],
|
# ),
|
||||||
max_loras_per_batch=1,
|
# ],
|
||||||
),
|
# max_loras_per_batch=1,
|
||||||
),
|
# ),
|
||||||
|
# ),
|
||||||
]
|
]
|
||||||
|
|
||||||
LORA_MAX_NEW_TOKENS = 32
|
LORA_MAX_NEW_TOKENS = 32
|
||||||
|
|||||||
Reference in New Issue
Block a user