[model-gateway][e2e_test]: Create directory structure and backends config (#16469)

This commit is contained in:
Simo Lin
2026-01-05 08:01:53 -08:00
committed by GitHub
parent a3914e3b3f
commit 2b4d6d813b
9 changed files with 909 additions and 1 deletions
+29 -1
View File
@@ -11,7 +11,21 @@ from .gpu_allocator import (
wait_for_gpu_memory_to_clear,
)
from .model_pool import ModelInstance, ModelPool
from .model_specs import MODEL_SPECS
from .model_specs import ( # Default model paths; Model groups
CHAT_MODELS,
DEFAULT_EMBEDDING_MODEL_PATH,
DEFAULT_ENABLE_THINKING_MODEL_PATH,
DEFAULT_GPT_OSS_MODEL_PATH,
DEFAULT_MISTRAL_FUNCTION_CALLING_MODEL_PATH,
DEFAULT_MODEL_PATH,
DEFAULT_QWEN_FUNCTION_CALLING_MODEL_PATH,
DEFAULT_REASONING_MODEL_PATH,
DEFAULT_SMALL_MODEL_PATH,
EMBEDDING_MODELS,
FUNCTION_CALLING_MODELS,
MODEL_SPECS,
REASONING_MODELS,
)
__all__ = [
# GPU allocation
@@ -28,4 +42,18 @@ __all__ = [
"ModelInstance",
"ModelPool",
"MODEL_SPECS",
# Default model paths
"DEFAULT_MODEL_PATH",
"DEFAULT_SMALL_MODEL_PATH",
"DEFAULT_REASONING_MODEL_PATH",
"DEFAULT_ENABLE_THINKING_MODEL_PATH",
"DEFAULT_QWEN_FUNCTION_CALLING_MODEL_PATH",
"DEFAULT_MISTRAL_FUNCTION_CALLING_MODEL_PATH",
"DEFAULT_GPT_OSS_MODEL_PATH",
"DEFAULT_EMBEDDING_MODEL_PATH",
# Model groups
"CHAT_MODELS",
"EMBEDDING_MODELS",
"REASONING_MODELS",
"FUNCTION_CALLING_MODELS",
]
@@ -107,3 +107,17 @@ CHAT_MODELS = get_models_with_feature("chat")
EMBEDDING_MODELS = get_models_with_feature("embedding")
REASONING_MODELS = get_models_with_feature("reasoning")
FUNCTION_CALLING_MODELS = get_models_with_feature("function_calling")
# =============================================================================
# Default model path constants (for backward compatibility with existing tests)
# =============================================================================
DEFAULT_MODEL_PATH = MODEL_SPECS["llama-8b"]["model"]
DEFAULT_SMALL_MODEL_PATH = MODEL_SPECS["llama-1b"]["model"]
DEFAULT_REASONING_MODEL_PATH = MODEL_SPECS["deepseek-7b"]["model"]
DEFAULT_ENABLE_THINKING_MODEL_PATH = MODEL_SPECS["qwen-30b"]["model"]
DEFAULT_QWEN_FUNCTION_CALLING_MODEL_PATH = MODEL_SPECS["qwen-7b"]["model"]
DEFAULT_MISTRAL_FUNCTION_CALLING_MODEL_PATH = MODEL_SPECS["mistral-7b"]["model"]
DEFAULT_GPT_OSS_MODEL_PATH = MODEL_SPECS["gpt-oss"]["model"]
DEFAULT_EMBEDDING_MODEL_PATH = MODEL_SPECS["embedding"]["model"]