[model-gateway][e2e_test]: Create directory structure and backends config (#16469)
This commit is contained in:
@@ -11,7 +11,21 @@ from .gpu_allocator import (
|
||||
wait_for_gpu_memory_to_clear,
|
||||
)
|
||||
from .model_pool import ModelInstance, ModelPool
|
||||
from .model_specs import MODEL_SPECS
|
||||
from .model_specs import ( # Default model paths; Model groups
|
||||
CHAT_MODELS,
|
||||
DEFAULT_EMBEDDING_MODEL_PATH,
|
||||
DEFAULT_ENABLE_THINKING_MODEL_PATH,
|
||||
DEFAULT_GPT_OSS_MODEL_PATH,
|
||||
DEFAULT_MISTRAL_FUNCTION_CALLING_MODEL_PATH,
|
||||
DEFAULT_MODEL_PATH,
|
||||
DEFAULT_QWEN_FUNCTION_CALLING_MODEL_PATH,
|
||||
DEFAULT_REASONING_MODEL_PATH,
|
||||
DEFAULT_SMALL_MODEL_PATH,
|
||||
EMBEDDING_MODELS,
|
||||
FUNCTION_CALLING_MODELS,
|
||||
MODEL_SPECS,
|
||||
REASONING_MODELS,
|
||||
)
|
||||
|
||||
__all__ = [
|
||||
# GPU allocation
|
||||
@@ -28,4 +42,18 @@ __all__ = [
|
||||
"ModelInstance",
|
||||
"ModelPool",
|
||||
"MODEL_SPECS",
|
||||
# Default model paths
|
||||
"DEFAULT_MODEL_PATH",
|
||||
"DEFAULT_SMALL_MODEL_PATH",
|
||||
"DEFAULT_REASONING_MODEL_PATH",
|
||||
"DEFAULT_ENABLE_THINKING_MODEL_PATH",
|
||||
"DEFAULT_QWEN_FUNCTION_CALLING_MODEL_PATH",
|
||||
"DEFAULT_MISTRAL_FUNCTION_CALLING_MODEL_PATH",
|
||||
"DEFAULT_GPT_OSS_MODEL_PATH",
|
||||
"DEFAULT_EMBEDDING_MODEL_PATH",
|
||||
# Model groups
|
||||
"CHAT_MODELS",
|
||||
"EMBEDDING_MODELS",
|
||||
"REASONING_MODELS",
|
||||
"FUNCTION_CALLING_MODELS",
|
||||
]
|
||||
|
||||
@@ -107,3 +107,17 @@ CHAT_MODELS = get_models_with_feature("chat")
|
||||
EMBEDDING_MODELS = get_models_with_feature("embedding")
|
||||
REASONING_MODELS = get_models_with_feature("reasoning")
|
||||
FUNCTION_CALLING_MODELS = get_models_with_feature("function_calling")
|
||||
|
||||
|
||||
# =============================================================================
|
||||
# Default model path constants (for backward compatibility with existing tests)
|
||||
# =============================================================================
|
||||
|
||||
DEFAULT_MODEL_PATH = MODEL_SPECS["llama-8b"]["model"]
|
||||
DEFAULT_SMALL_MODEL_PATH = MODEL_SPECS["llama-1b"]["model"]
|
||||
DEFAULT_REASONING_MODEL_PATH = MODEL_SPECS["deepseek-7b"]["model"]
|
||||
DEFAULT_ENABLE_THINKING_MODEL_PATH = MODEL_SPECS["qwen-30b"]["model"]
|
||||
DEFAULT_QWEN_FUNCTION_CALLING_MODEL_PATH = MODEL_SPECS["qwen-7b"]["model"]
|
||||
DEFAULT_MISTRAL_FUNCTION_CALLING_MODEL_PATH = MODEL_SPECS["mistral-7b"]["model"]
|
||||
DEFAULT_GPT_OSS_MODEL_PATH = MODEL_SPECS["gpt-oss"]["model"]
|
||||
DEFAULT_EMBEDDING_MODEL_PATH = MODEL_SPECS["embedding"]["model"]
|
||||
|
||||
Reference in New Issue
Block a user