[diffusion] UX: reduce hot-path server log noise (#37804)
This commit is contained in:
@@ -650,7 +650,7 @@ class DiffusionServer:
|
|||||||
)
|
)
|
||||||
except ValueError:
|
except ValueError:
|
||||||
pass
|
pass
|
||||||
logger.info(
|
logger.debug(
|
||||||
"GLM distributed mode dispatched request with %d output(s) "
|
"GLM distributed mode dispatched request with %d output(s) "
|
||||||
"to denoiser[%d]",
|
"to denoiser[%d]",
|
||||||
request.req.num_outputs_per_prompt,
|
request.req.num_outputs_per_prompt,
|
||||||
|
|||||||
@@ -706,7 +706,7 @@ class DenoisingStage(PipelineStage, RolloutDenoisingMixin):
|
|||||||
|
|
||||||
self._quality_fusions_mounted = want
|
self._quality_fusions_mounted = want
|
||||||
for description in sorted(mounted_fusions):
|
for description in sorted(mounted_fusions):
|
||||||
logger.info("Mounted %s for quality=%s", description, quality)
|
logger.debug("Mounted %s for quality=%s", description, quality)
|
||||||
|
|
||||||
def _cache_dit_dual_model_name(self) -> str:
|
def _cache_dit_dual_model_name(self) -> str:
|
||||||
return "wan2.2"
|
return "wan2.2"
|
||||||
|
|||||||
+1
-1
@@ -371,7 +371,7 @@ def _build_cube_attn_metadata(
|
|||||||
num_steps=num_steps,
|
num_steps=num_steps,
|
||||||
device=device,
|
device=device,
|
||||||
)
|
)
|
||||||
logger.info(
|
logger.debug(
|
||||||
"cube sparse attention enabled: local_cube_size=%s "
|
"cube sparse attention enabled: local_cube_size=%s "
|
||||||
"topk_ratio_list(len=%d, min=%.4f, max=%.4f)",
|
"topk_ratio_list(len=%d, min=%.4f, max=%.4f)",
|
||||||
list(local_cube_size),
|
list(local_cube_size),
|
||||||
|
|||||||
@@ -109,6 +109,18 @@ class _BoundedCaptureCache:
|
|||||||
or self.evict_on_miss
|
or self.evict_on_miss
|
||||||
)
|
)
|
||||||
|
|
||||||
|
def _evict_lru(self) -> None:
|
||||||
|
evicted_signature, evicted = self.entries.popitem(last=False)
|
||||||
|
self._release(evicted)
|
||||||
|
self.evictions += 1
|
||||||
|
logger.debug(
|
||||||
|
"Evicted VLA %s CUDA graph for signature %s (entries=%d/%d)",
|
||||||
|
self.name,
|
||||||
|
evicted_signature,
|
||||||
|
len(self.entries),
|
||||||
|
self.max_entries,
|
||||||
|
)
|
||||||
|
|
||||||
def prepare_admission(self, signature: Any) -> None:
|
def prepare_admission(self, signature: Any) -> None:
|
||||||
if (
|
if (
|
||||||
signature in self.entries
|
signature in self.entries
|
||||||
@@ -116,16 +128,7 @@ class _BoundedCaptureCache:
|
|||||||
or not self.evict_on_miss
|
or not self.evict_on_miss
|
||||||
):
|
):
|
||||||
return
|
return
|
||||||
evicted_signature, evicted = self.entries.popitem(last=False)
|
self._evict_lru()
|
||||||
self._release(evicted)
|
|
||||||
self.evictions += 1
|
|
||||||
logger.info(
|
|
||||||
"Evicted VLA %s CUDA graph for signature %s (entries=%d/%d)",
|
|
||||||
self.name,
|
|
||||||
evicted_signature,
|
|
||||||
len(self.entries),
|
|
||||||
self.max_entries,
|
|
||||||
)
|
|
||||||
|
|
||||||
def put(self, signature: Any, entry: Any) -> bool:
|
def put(self, signature: Any, entry: Any) -> bool:
|
||||||
if self.max_entries == 0 or not self.can_admit(signature):
|
if self.max_entries == 0 or not self.can_admit(signature):
|
||||||
@@ -138,16 +141,7 @@ class _BoundedCaptureCache:
|
|||||||
self.captures += 1
|
self.captures += 1
|
||||||
|
|
||||||
if len(self.entries) > self.max_entries:
|
if len(self.entries) > self.max_entries:
|
||||||
evicted_signature, evicted = self.entries.popitem(last=False)
|
self._evict_lru()
|
||||||
self._release(evicted)
|
|
||||||
self.evictions += 1
|
|
||||||
logger.info(
|
|
||||||
"Evicted VLA %s CUDA graph for signature %s (entries=%d/%d)",
|
|
||||||
self.name,
|
|
||||||
evicted_signature,
|
|
||||||
len(self.entries),
|
|
||||||
self.max_entries,
|
|
||||||
)
|
|
||||||
return True
|
return True
|
||||||
|
|
||||||
def discard(self, signature: Any) -> None:
|
def discard(self, signature: Any) -> None:
|
||||||
|
|||||||
Reference in New Issue
Block a user