Files
vllm-legacy/park/compose.sglang.yml
T
2026-07-08 20:22:40 +02:00

27 lines
714 B
YAML

name: gpu-lab-sglang
services:
sglang:
image: gpu-lab-sglang:v100-cu121
container_name: gpu-lab-sglang
network_mode: host
ipc: host
shm_size: "32gb"
env_file:
- active/current.env
environment:
- PYTHONPATH=/opt/v100-bootstrap
volumes:
- /root/models:/models:ro
- /root/model-cache:/model-cache:ro
- /root/gpu-lab/start-sglang-qwen.sh:/start-sglang-qwen.sh:ro
- /root/gpu-lab/v100-bootstrap:/opt/v100-bootstrap:ro
deploy:
resources:
reservations:
devices:
- driver: nvidia
count: all
capabilities: [gpu]
entrypoint: ["/bin/bash", "/start-sglang-qwen.sh"]
restart: "no"