[model-gateway] bug fix on module name (#16332)
This commit is contained in:
@@ -8,11 +8,11 @@ use tokio::runtime::Runtime;
|
||||
use once_cell::sync::Lazy;
|
||||
use uuid::Uuid;
|
||||
|
||||
use sgl_model_gateway::tokenizer::create_tokenizer_from_file;
|
||||
use sgl_model_gateway::tokenizer::traits::Tokenizer;
|
||||
use sgl_model_gateway::grpc_client::sglang_scheduler::SglangSchedulerClient;
|
||||
use sgl_model_gateway::protocols::chat::ChatCompletionRequest;
|
||||
use sgl_model_gateway::routers::grpc::utils::{process_chat_messages, generate_tool_constraints};
|
||||
use smg::tokenizer::create_tokenizer_from_file;
|
||||
use smg::tokenizer::traits::Tokenizer;
|
||||
use smg::grpc_client::sglang_scheduler::SglangSchedulerClient;
|
||||
use smg::protocols::chat::ChatCompletionRequest;
|
||||
use smg::routers::grpc::utils::{process_chat_messages, generate_tool_constraints};
|
||||
|
||||
use super::error::{SglErrorCode, set_error_message};
|
||||
use super::grpc_converter::sgl_grpc_response_converter_create;
|
||||
|
||||
@@ -9,12 +9,12 @@ use serde_json::Value;
|
||||
use tokio::runtime::Runtime;
|
||||
use once_cell::sync::Lazy;
|
||||
|
||||
use sgl_model_gateway::tokenizer::traits::Tokenizer;
|
||||
use sgl_model_gateway::tokenizer::stream::DecodeStream;
|
||||
use sgl_model_gateway::tool_parser::ToolParser;
|
||||
use sgl_model_gateway::protocols::common::{Tool, ToolChoice, ToolChoiceValue, ToolCallDelta, FunctionCallDelta, Usage, StringOrArray};
|
||||
use sgl_model_gateway::tokenizer::stop::StopSequenceDecoder;
|
||||
use sgl_model_gateway::grpc_client::sglang_proto as proto;
|
||||
use smg::tokenizer::traits::Tokenizer;
|
||||
use smg::tokenizer::stream::DecodeStream;
|
||||
use smg::tool_parser::ToolParser;
|
||||
use smg::protocols::common::{Tool, ToolChoice, ToolChoiceValue, ToolCallDelta, FunctionCallDelta, Usage, StringOrArray};
|
||||
use smg::tokenizer::stop::StopSequenceDecoder;
|
||||
use smg::grpc_client::sglang_proto as proto;
|
||||
|
||||
use super::error::{SglErrorCode, set_error_message, clear_error_message};
|
||||
use super::tokenizer::TokenizerHandle;
|
||||
@@ -22,9 +22,9 @@ use super::utils::generate_tool_call_id;
|
||||
|
||||
/// Global parser factory (initialized once)
|
||||
// Use the re-exported ParserFactory from tool_parser module
|
||||
static PARSER_FACTORY: Lazy<sgl_model_gateway::tool_parser::ParserFactory> = Lazy::new(|| {
|
||||
static PARSER_FACTORY: Lazy<smg::tool_parser::ParserFactory> = Lazy::new(|| {
|
||||
// ParserFactory is re-exported from tool_parser::factory, so we can use it directly
|
||||
sgl_model_gateway::tool_parser::ParserFactory::default()
|
||||
smg::tool_parser::ParserFactory::default()
|
||||
});
|
||||
|
||||
/// Global tokio runtime for async operations
|
||||
@@ -151,7 +151,7 @@ pub unsafe extern "C" fn sgl_grpc_response_converter_create(
|
||||
// Create stop decoder if needed
|
||||
let stop_decoder = if stop.is_some() || stop_token_ids.is_some() {
|
||||
Some(Arc::new(tokio::sync::Mutex::new(
|
||||
sgl_model_gateway::routers::grpc::utils::create_stop_decoder(
|
||||
smg::routers::grpc::utils::create_stop_decoder(
|
||||
&tokenizer,
|
||||
stop.as_ref(),
|
||||
stop_token_ids.as_ref(),
|
||||
@@ -389,9 +389,9 @@ pub(crate) async fn convert_proto_chunk_to_openai(
|
||||
request_id: &str,
|
||||
created: u64,
|
||||
system_fingerprint: Option<&str>,
|
||||
) -> Result<Option<sgl_model_gateway::protocols::chat::ChatCompletionStreamResponse>, String> {
|
||||
use sgl_model_gateway::grpc_client::sglang_proto::generate_response::Response::*;
|
||||
use sgl_model_gateway::protocols::chat::{ChatCompletionStreamResponse, ChatMessageDelta, ChatStreamChoice};
|
||||
) -> Result<Option<smg::protocols::chat::ChatCompletionStreamResponse>, String> {
|
||||
use smg::grpc_client::sglang_proto::generate_response::Response::*;
|
||||
use smg::protocols::chat::{ChatCompletionStreamResponse, ChatMessageDelta, ChatStreamChoice};
|
||||
|
||||
match proto_response.response {
|
||||
Some(Chunk(chunk)) => {
|
||||
@@ -427,19 +427,19 @@ pub(crate) async fn convert_proto_chunk_to_openai(
|
||||
let mut text = String::new();
|
||||
for &token_id in &chunk.token_ids {
|
||||
match decoder_guard.process_token(token_id).unwrap_or_else(|_| {
|
||||
sgl_model_gateway::tokenizer::stop::SequenceDecoderOutput::Held
|
||||
smg::tokenizer::stop::SequenceDecoderOutput::Held
|
||||
}) {
|
||||
sgl_model_gateway::tokenizer::stop::SequenceDecoderOutput::Text(t) => {
|
||||
smg::tokenizer::stop::SequenceDecoderOutput::Text(t) => {
|
||||
text.push_str(&t);
|
||||
}
|
||||
sgl_model_gateway::tokenizer::stop::SequenceDecoderOutput::StoppedWithText(t) => {
|
||||
smg::tokenizer::stop::SequenceDecoderOutput::StoppedWithText(t) => {
|
||||
text.push_str(&t);
|
||||
break;
|
||||
}
|
||||
sgl_model_gateway::tokenizer::stop::SequenceDecoderOutput::Stopped => {
|
||||
smg::tokenizer::stop::SequenceDecoderOutput::Stopped => {
|
||||
break;
|
||||
}
|
||||
sgl_model_gateway::tokenizer::stop::SequenceDecoderOutput::Held => {}
|
||||
smg::tokenizer::stop::SequenceDecoderOutput::Held => {}
|
||||
}
|
||||
}
|
||||
text
|
||||
|
||||
@@ -14,7 +14,7 @@ use std::ptr;
|
||||
use std::sync::Arc;
|
||||
use serde_json::Value;
|
||||
|
||||
use sgl_model_gateway::grpc_client::sglang_proto as proto;
|
||||
use smg::grpc_client::sglang_proto as proto;
|
||||
|
||||
use super::error::{SglErrorCode, set_error_message};
|
||||
use super::grpc_converter::GrpcResponseConverterHandle;
|
||||
|
||||
@@ -12,9 +12,9 @@ use std::os::raw::{c_char, c_int};
|
||||
use std::ptr;
|
||||
use std::os::raw::c_uint;
|
||||
|
||||
use sgl_model_gateway::tokenizer::create_tokenizer_from_file;
|
||||
use sgl_model_gateway::protocols::chat::ChatCompletionRequest;
|
||||
use sgl_model_gateway::routers::grpc::utils::{process_chat_messages, generate_tool_constraints};
|
||||
use smg::tokenizer::create_tokenizer_from_file;
|
||||
use smg::protocols::chat::ChatCompletionRequest;
|
||||
use smg::routers::grpc::utils::{process_chat_messages, generate_tool_constraints};
|
||||
|
||||
use super::error::{SglErrorCode, set_error_message};
|
||||
use super::memory::{sgl_free_string, sgl_free_token_ids};
|
||||
|
||||
@@ -23,7 +23,7 @@ use tokio::runtime::Runtime;
|
||||
use once_cell::sync::Lazy;
|
||||
use futures_util::StreamExt;
|
||||
|
||||
use sgl_model_gateway::grpc_client::{sglang_proto as proto, sglang_scheduler::{SglangSchedulerClient, AbortOnDropStream}};
|
||||
use smg::grpc_client::{sglang_proto as proto, sglang_scheduler::{SglangSchedulerClient, AbortOnDropStream}};
|
||||
|
||||
use super::error::{SglErrorCode, set_error_message};
|
||||
use super::grpc_converter::{GrpcResponseConverterHandle, convert_proto_chunk_to_openai};
|
||||
|
||||
@@ -6,7 +6,7 @@ use std::ptr;
|
||||
use std::sync::Arc;
|
||||
use serde_json::Value;
|
||||
|
||||
use sgl_model_gateway::tokenizer::{
|
||||
use smg::tokenizer::{
|
||||
create_tokenizer_from_file,
|
||||
traits::Tokenizer as TokenizerTrait,
|
||||
chat_template::ChatTemplateParams,
|
||||
|
||||
@@ -9,8 +9,8 @@ use serde_json::{json, Value};
|
||||
use tokio::runtime::Runtime;
|
||||
use once_cell::sync::Lazy;
|
||||
|
||||
use sgl_model_gateway::tool_parser::{ParserFactory, ToolParser};
|
||||
use sgl_model_gateway::protocols::common::Tool;
|
||||
use smg::tool_parser::{ParserFactory, ToolParser};
|
||||
use smg::protocols::common::Tool;
|
||||
|
||||
use super::error::{SglErrorCode, set_error_message, clear_error_message};
|
||||
use super::utils::generate_tool_call_id;
|
||||
|
||||
@@ -1,5 +1,5 @@
|
||||
use pyo3::prelude::*;
|
||||
use sgl_model_gateway::*;
|
||||
use smg::*;
|
||||
use once_cell::sync::OnceCell;
|
||||
use std::collections::HashMap;
|
||||
|
||||
|
||||
Reference in New Issue
Block a user