Skip to content

Commit 2e0aca6

Browse files
authored
Merge pull request #48 from GoGoJoestar/main
fix bug in gradio_demo.py when launch vLLM server
2 parents cce5350 + 4e733da commit 2e0aca6

1 file changed

Lines changed: 10 additions & 10 deletions

File tree

scripts/inference/gradio_demo.py

Lines changed: 10 additions & 10 deletions
Original file line numberDiff line numberDiff line change
@@ -80,7 +80,7 @@
8080
parser.add_argument(
8181
"--post_host",
8282
type=str,
83-
default="localhost",
83+
default="0.0.0.0",
8484
help="Host of vLLM service.")
8585
parser.add_argument(
8686
"--post_port",
@@ -128,15 +128,15 @@ def setup():
128128
tokenizer = LlamaTokenizer.from_pretrained(args.tokenizer_path, legacy=True)
129129

130130
print("Start launch vllm server.")
131-
cmd = [
132-
"python -m vllm.entrypoints.api_server",
133-
f"--model={args.base_model}",
134-
f"--tokenizer={args.tokenizer_path}",
135-
"--tokenizer-mode=slow",
136-
f"--tensor-parallel-size={len(args.gpus.split(','))}",
137-
"&",
138-
]
139-
subprocess.check_call(cmd)
131+
cmd = f"python -m vllm.entrypoints.api_server \
132+
--model={args.base_model} \
133+
--tokenizer={args.tokenizer_path} \
134+
--tokenizer-mode=slow \
135+
--tensor-parallel-size={len(args.gpus.split(','))} \
136+
--host {args.post_host} \
137+
--port {args.post_port} \
138+
&"
139+
subprocess.check_call(cmd, shell=True)
140140
else:
141141
max_memory = args.max_memory
142142
port = args.port

0 commit comments

Comments
 (0)