Files
light-heart-labs--ods/ods/docker-compose.multigpu-nvidia.yml
2026-07-13 12:34:03 +08:00

13 lines
359 B
YAML

services:
llama-server:
environment:
NVIDIA_VISIBLE_DEVICES: "${LLAMA_SERVER_GPU_UUIDS:-all}"
LLAMA_ARG_SPLIT_MODE: "${LLAMA_ARG_SPLIT_MODE:-none}"
LLAMA_ARG_TENSOR_SPLIT: "${LLAMA_ARG_TENSOR_SPLIT:-}"
deploy:
resources:
reservations:
devices:
- driver: nvidia
capabilities: [gpu]