LPLB: linear-programming load balancer for MoE expert parallelism (#24515)
Co-authored-by: xutizhou <xutingz@nvidia.com>
This commit is contained in:
@@ -40,6 +40,7 @@ dependencies = [
|
||||
"numpy",
|
||||
"nvidia-cutlass-dsl[cu13]==4.5.2",
|
||||
"nvidia-ml-py",
|
||||
"nvidia-mathdx==25.6.0",
|
||||
"openai-harmony==0.0.4",
|
||||
"openai==2.6.1",
|
||||
"orjson",
|
||||
|
||||
Reference in New Issue
Block a user