From 229cadec0409478977859abace5abb53264624b3 Mon Sep 17 00:00:00 2001 From: Cheng Wan <54331508+ch-wan@users.noreply.github.com> Date: Sat, 16 May 2026 17:12:11 -0700 Subject: [PATCH] Update logging for inplace setting in MoE layer (#25499) --- python/sglang/srt/layers/moe/fused_moe_triton/layer.py | 7 ++++--- 1 file changed, 4 insertions(+), 3 deletions(-) diff --git a/python/sglang/srt/layers/moe/fused_moe_triton/layer.py b/python/sglang/srt/layers/moe/fused_moe_triton/layer.py index 943ac4f17..9b8431950 100644 --- a/python/sglang/srt/layers/moe/fused_moe_triton/layer.py +++ b/python/sglang/srt/layers/moe/fused_moe_triton/layer.py @@ -312,9 +312,10 @@ class FusedMoE(torch.nn.Module): get_moe_runner_backend().is_flashinfer_trtllm_routed() or get_moe_runner_backend().is_flashinfer_trtllm() ): - logging.warning( - "Setting inplace to False for FlashInfer TRTLLM MoE backend." - ) + if self.moe_runner_config.inplace: + logging.info( + "Setting inplace to False for FlashInfer TRTLLM MoE backend." + ) self.moe_runner_config.inplace = False self.should_fuse_routed_scaling_factor_in_topk = (