Convert local-only self.X attributes to locals (#25430)
This commit is contained in:
@@ -445,7 +445,7 @@ class TokenizerManager(TokenizerControlMixin, TokenizerManagerScoreMixin):
|
||||
self.disaggregation_mode = DisaggregationMode(
|
||||
self.server_args.disaggregation_mode
|
||||
)
|
||||
self.bootstrap_server = start_disagg_service(self.server_args)
|
||||
start_disagg_service(self.server_args)
|
||||
# Single-source counter for auto-assigning fake bootstrap_room.
|
||||
self.fake_bootstrap_room_counter = 0
|
||||
|
||||
|
||||
@@ -1500,8 +1500,8 @@ class ModelRunner(ModelRunnerKVCacheMixin):
|
||||
|
||||
# Register model for layerwise NVTX profiling if enabled
|
||||
if self.server_args.enable_layerwise_nvtx_marker:
|
||||
self.pyt_hooks = PytHooks()
|
||||
self.pyt_hooks.register_hooks(self.model, module_prefix="model")
|
||||
pyt_hooks = PytHooks()
|
||||
pyt_hooks.register_hooks(self.model, module_prefix="model")
|
||||
|
||||
if self.server_args.kv_cache_dtype == "fp8_e4m3":
|
||||
if self.server_args.quantization_param_path is not None:
|
||||
@@ -2080,8 +2080,8 @@ class ModelRunner(ModelRunnerKVCacheMixin):
|
||||
)
|
||||
|
||||
# We need to get device after patch otherwise the device would be wrong
|
||||
self.device_module = torch.get_device_module(self.device)
|
||||
infered_device = self.device_module.current_device()
|
||||
device_module = torch.get_device_module(self.device)
|
||||
infered_device = device_module.current_device()
|
||||
|
||||
named_tensors = [
|
||||
(name, _unwrap_tensor(tensor, tp_rank=self.tp_rank, device=infered_device))
|
||||
|
||||
Reference in New Issue
Block a user