vllm/.helm/values.yaml

67 lines
1.3 KiB
YAML
Raw Permalink Normal View History

global:
cluster: ""
env: dev
imagePullSecrets:
- name: registrysecret
image:
vllm: 192.168.10.68:5000/vllm/vllm-openai:v0.14.0
2026-09-09 14:12:08 +00:00
port: 8004
envVars:
2026-09-09 14:12:08 +00:00
VLLM_MODEL: kristaller486/dots.ocr-1.5
VLLM_MAX_TOKENS: 24000
VLLM_TEMPERATURE: 0.2
VLLM_TOP_P: 0.9
VLLM_REQUEST_TIMEOUT: 3000.0
VLLM_MAX_MODEL_LEN: 32768
VLLM_WORKER_MULTIPROC_METHOD: spawn
VLLM_LOGGING_LEVEL: INFO
HF_HUB_ENABLE_HF_TRANSFER: 1
HF_HOME: /root/.cache/huggingface
VLLM_DOWNLOAD_DIR: /root/.cache/huggingface
CUDA_LAUNCH_BLOCKING: 0
LOG_LEVEL: INFO
VLLM_PORT: 8005
TRANSFORMERS_OFFLINE: 1
gpu:
enabled: true
nodeSelector:
node-role.deckhouse.io/cuda-worker: ""
tolerations:
- key: dedicated.deckhouse.io
operator: Equal
value: cuda-worker
effect: NoExecute
2026-09-09 14:12:08 +00:00
resources:
_default:
requests:
cpu: "1"
memory: "10Gi"
limits:
memory: "10Gi"
nvidia.com/gpu: 1
storage:
size:
_default: 10Gi
class:
_default: localpath
2026-09-09 14:12:08 +00:00
ingress:
tls:
enabled: false
2026-09-09 14:12:08 +00:00
className:
_default: nginx
host:
_default: vllm.valdemorte.online
preprod: vllm.preprod.valdemorte.online
prod: vllm.prod.valdemorte.online
2026-09-09 14:12:08 +00:00
secretName:
_default: vllm-tls