[Tiny fix] Fix bench_speculative.py run bug (#13416)
This commit is contained in:
@@ -106,6 +106,8 @@ def send_one_batch(base_url, num_prompts, batch_size, tokenizer, is_multimodal):
|
|||||||
max_concurrency=batch_size,
|
max_concurrency=batch_size,
|
||||||
disable_tqdm=False,
|
disable_tqdm=False,
|
||||||
lora_names=None,
|
lora_names=None,
|
||||||
|
lora_request_distribution=None,
|
||||||
|
lora_zipf_alpha=None,
|
||||||
extra_request_body={},
|
extra_request_body={},
|
||||||
profile=None,
|
profile=None,
|
||||||
)
|
)
|
||||||
|
|||||||
Reference in New Issue
Block a user