27 lines
714 B
YAML
27 lines
714 B
YAML
name: gpu-lab-sglang
|
|
services:
|
|
sglang:
|
|
image: gpu-lab-sglang:v100-cu121
|
|
container_name: gpu-lab-sglang
|
|
network_mode: host
|
|
ipc: host
|
|
shm_size: "32gb"
|
|
env_file:
|
|
- active/current.env
|
|
environment:
|
|
- PYTHONPATH=/opt/v100-bootstrap
|
|
volumes:
|
|
- /root/models:/models:ro
|
|
- /root/model-cache:/model-cache:ro
|
|
- /root/gpu-lab/start-sglang-qwen.sh:/start-sglang-qwen.sh:ro
|
|
- /root/gpu-lab/v100-bootstrap:/opt/v100-bootstrap:ro
|
|
deploy:
|
|
resources:
|
|
reservations:
|
|
devices:
|
|
- driver: nvidia
|
|
count: all
|
|
capabilities: [gpu]
|
|
entrypoint: ["/bin/bash", "/start-sglang-qwen.sh"]
|
|
restart: "no"
|