update
This commit is contained in:
@@ -0,0 +1,26 @@
|
||||
name: gpu-lab-sglang
|
||||
services:
|
||||
sglang:
|
||||
image: gpu-lab-sglang:v100-cu121
|
||||
container_name: gpu-lab-sglang
|
||||
network_mode: host
|
||||
ipc: host
|
||||
shm_size: "32gb"
|
||||
env_file:
|
||||
- active/current.env
|
||||
environment:
|
||||
- PYTHONPATH=/opt/v100-bootstrap
|
||||
volumes:
|
||||
- /root/models:/models:ro
|
||||
- /root/model-cache:/model-cache:ro
|
||||
- /root/gpu-lab/start-sglang-qwen.sh:/start-sglang-qwen.sh:ro
|
||||
- /root/gpu-lab/v100-bootstrap:/opt/v100-bootstrap:ro
|
||||
deploy:
|
||||
resources:
|
||||
reservations:
|
||||
devices:
|
||||
- driver: nvidia
|
||||
count: all
|
||||
capabilities: [gpu]
|
||||
entrypoint: ["/bin/bash", "/start-sglang-qwen.sh"]
|
||||
restart: "no"
|
||||
Reference in New Issue
Block a user