diff --git a/python/sglang/srt/mem_cache/storage/flexkv/flexkv_radix_cache.py b/python/sglang/srt/mem_cache/storage/flexkv/flexkv_radix_cache.py index df41c4c82..6d9f2f618 100644 --- a/python/sglang/srt/mem_cache/storage/flexkv/flexkv_radix_cache.py +++ b/python/sglang/srt/mem_cache/storage/flexkv/flexkv_radix_cache.py @@ -388,9 +388,9 @@ class FlexKVRadixCache(RadixCache): return # Compute the committed prefix mirroring LMCRadixCache's logic. - from sglang.srt.server_args import get_global_server_args + from sglang.srt.runtime_context import get_server_args - global_server_args = get_global_server_args() + global_server_args = get_server_args() topk = global_server_args.speculative_eagle_topk enable_kv_committed_len = topk is None or topk == 1 if enable_kv_committed_len: diff --git a/test/registered/unit/mem_cache/test_registry.py b/test/registered/unit/mem_cache/test_registry.py index 84b37820f..6947b851f 100644 --- a/test/registered/unit/mem_cache/test_registry.py +++ b/test/registered/unit/mem_cache/test_registry.py @@ -35,6 +35,7 @@ def _make_ctx( server_args.radix_cache_backend = backend server_args.enable_streaming_session = enable_streaming server_args.enable_lmcache = enable_lmcache + server_args.enable_flexkv = False return TreeCacheBuildContext( server_args=server_args, params=MagicMock(),