diff --git a/python/sglang/srt/model_executor/model_runner_kv_cache_mixin.py b/python/sglang/srt/model_executor/model_runner_kv_cache_mixin.py index 74ce00c19..58658b12c 100644 --- a/python/sglang/srt/model_executor/model_runner_kv_cache_mixin.py +++ b/python/sglang/srt/model_executor/model_runner_kv_cache_mixin.py @@ -536,6 +536,7 @@ class ModelRunnerKVCacheMixin: get_attention_tp_size() ), head_dim=self.model_config.head_dim, + v_head_dim=self.model_config.v_head_dim, layer_num=self.num_effective_layers, device=self.device, enable_memory_saver=self.server_args.enable_memory_saver, @@ -555,6 +556,7 @@ class ModelRunnerKVCacheMixin: get_attention_tp_size() ), head_dim=self.model_config.head_dim, + v_head_dim=self.model_config.v_head_dim, layer_num=self.num_effective_layers, device=self.device, enable_memory_saver=self.server_args.enable_memory_saver,