From 760e6f6475a0d26b7c89790f6292fe86cafec977 Mon Sep 17 00:00:00 2001 From: =?UTF-8?q?=EC=9A=B0=EC=B0=BD=ED=98=B8?= Date: Mon, 17 Mar 2025 13:22:33 +0900 Subject: [PATCH] Update CUSTOM-README.md --- charts/vllm/CUSTOM-README.md | 17 ++++++++++++++++- 1 file changed, 16 insertions(+), 1 deletion(-) diff --git a/charts/vllm/CUSTOM-README.md b/charts/vllm/CUSTOM-README.md index f132d14..2721cb1 100644 --- a/charts/vllm/CUSTOM-README.md +++ b/charts/vllm/CUSTOM-README.md @@ -23,7 +23,22 @@ helm upgrade vllm ./ -f custom-values.yaml --install -n vllm --create-namespace - custom-values.yaml에 정의된 값에 대한 설명이다. ### 1) 모델 배포 설정 (Optional) - +| Name | 설명 | 기본값 | +| ------------------------ | ------------------------------------------------------ | ------------------------- | +| `modelSpec.name` | 배포할 모델의 이름 | "" | +| `modelSpec.repository` | Image의 경로 | "" | +| `modelSpec.tag` | Image의 tag | "latest" | +| `modelSpec.modelURL` | 배포할 모델의 URL(HuggingSpace 기준) | "" | +| `modelSpec.replicaCount` | replicaCount 정의 | "1" | +| `modelSpec.requestCPU` | POD의 CPU Request 값 | "10" | +| `modelSpec.requestMemory` | POD의 Moemory Request 값 | "64Gi" | +| `modelSpec.requestGPU` | POD의 GPU Request 값 | "1" | +| `modelSpec.pvcStorage` | PVC의 용량 설정 | "50Gi" | +| `modelSpec.pvcAccessMode` | pvcAccessMode 정의 | "[]" | +| `modelSpec.storageClass` | 사용할 Storage Class 값 | "" | +| `modelSpec.vllmConfig.maxModelLen` | 모델이 한 번에 처리할 수 있는 최대 시퀀스 길이(토큰 수)를 설정 | "16384" | +| `modelSpec.vllmConfig.dtype` | 모델 계산에 사용될 데이터 타입을 설정 | "bfloat16" | +| `modelSpec.vllmConfig.extraArgs` | 모델 실행 시 추가적인 커맨드 라인 인자를 설정 | "custom-values.yaml 참고" ### 2) VLLM Router 배포 설정 - VLLM 실행 시에 필요한 설정을 작성한다.