Fix lora doc (#15282)
This commit is contained in:
@@ -90,11 +90,12 @@
|
|||||||
"outputs": [],
|
"outputs": [],
|
||||||
"source": [
|
"source": [
|
||||||
"server_process, port = launch_server_cmd(\n",
|
"server_process, port = launch_server_cmd(\n",
|
||||||
|
" # Here we set max-loras-per-batch to 2: one slot for adaptor and another one for base model\n",
|
||||||
" \"\"\"\n",
|
" \"\"\"\n",
|
||||||
"python3 -m sglang.launch_server --model-path meta-llama/Meta-Llama-3.1-8B-Instruct \\\n",
|
"python3 -m sglang.launch_server --model-path meta-llama/Meta-Llama-3.1-8B-Instruct \\\n",
|
||||||
" --enable-lora \\\n",
|
" --enable-lora \\\n",
|
||||||
" --lora-paths lora0=algoprog/fact-generation-llama-3.1-8b-instruct-lora \\\n",
|
" --lora-paths lora0=algoprog/fact-generation-llama-3.1-8b-instruct-lora \\\n",
|
||||||
" --max-loras-per-batch 1 \\\n",
|
" --max-loras-per-batch 2 \\\n",
|
||||||
" --log-level warning \\\n",
|
" --log-level warning \\\n",
|
||||||
"\"\"\"\n",
|
"\"\"\"\n",
|
||||||
")\n",
|
")\n",
|
||||||
|
|||||||
Reference in New Issue
Block a user