diff --git a/docs/advanced_features/lora.ipynb b/docs/advanced_features/lora.ipynb index da25e9882..67bfdac32 100644 --- a/docs/advanced_features/lora.ipynb +++ b/docs/advanced_features/lora.ipynb @@ -90,11 +90,12 @@ "outputs": [], "source": [ "server_process, port = launch_server_cmd(\n", + " # Here we set max-loras-per-batch to 2: one slot for adaptor and another one for base model\n", " \"\"\"\n", "python3 -m sglang.launch_server --model-path meta-llama/Meta-Llama-3.1-8B-Instruct \\\n", " --enable-lora \\\n", " --lora-paths lora0=algoprog/fact-generation-llama-3.1-8b-instruct-lora \\\n", - " --max-loras-per-batch 1 \\\n", + " --max-loras-per-batch 2 \\\n", " --log-level warning \\\n", "\"\"\"\n", ")\n",