Fix lora test (#13479)
This commit is contained in:
@@ -24,16 +24,15 @@ from argparse import ArgumentParser
|
|||||||
from datetime import datetime
|
from datetime import datetime
|
||||||
from typing import Any, Dict, List, Optional, Tuple
|
from typing import Any, Dict, List, Optional, Tuple
|
||||||
|
|
||||||
import aiohttp
|
|
||||||
import numpy as np
|
import numpy as np
|
||||||
from launch_server import LORA_PATH, NUM_LORAS
|
from launch_server import LORA_PATH, NUM_LORAS
|
||||||
from tqdm.asyncio import tqdm
|
from tqdm.asyncio import tqdm
|
||||||
from transformers import PreTrainedTokenizerBase
|
from transformers import PreTrainedTokenizerBase
|
||||||
|
|
||||||
from sglang.bench_serving import (
|
from sglang.bench_serving import (
|
||||||
AIOHTTP_TIMEOUT,
|
|
||||||
RequestFuncInput,
|
RequestFuncInput,
|
||||||
RequestFuncOutput,
|
RequestFuncOutput,
|
||||||
|
_create_bench_client_session,
|
||||||
calculate_metrics,
|
calculate_metrics,
|
||||||
get_request,
|
get_request,
|
||||||
get_tokenizer,
|
get_tokenizer,
|
||||||
@@ -56,7 +55,7 @@ async def async_request_openai_completions(
|
|||||||
|
|
||||||
prompt = request_func_input.prompt
|
prompt = request_func_input.prompt
|
||||||
|
|
||||||
async with aiohttp.ClientSession(timeout=AIOHTTP_TIMEOUT) as session:
|
async with _create_bench_client_session() as session:
|
||||||
# payload = {
|
# payload = {
|
||||||
# "model": request_func_input.model,
|
# "model": request_func_input.model,
|
||||||
# "prompt": prompt,
|
# "prompt": prompt,
|
||||||
|
|||||||
Reference in New Issue
Block a user