@@ -24,7 +24,15 @@ Apart from above mentioned services, there are following conditional dependencie
2424
2525## Installing the Chart
2626
27- To install the chart, run the following:
27+ Please follow the following steps to install the ChatQnA Chart:
28+
29+ 1 . Clone the GenAIInfra repository:
30+
31+ ``` bash
32+ git clone https://github.com/opea-project/GenAIInfra.git
33+ ```
34+
35+ 2 . Setup the dependencies and required environment variables:
2836
2937``` bash
3038cd GenAIInfra/helm-charts/
@@ -33,20 +41,41 @@ helm dependency update chatqna
3341export HFTOKEN=" insert-your-huggingface-token-here"
3442export MODELDIR=" /mnt/opea-models"
3543export MODELNAME=" Intel/neural-chat-7b-v3-3"
44+ ```
45+
46+ 3 . Depending on the device which we are targeting for running ChatQnA, please use one the following installation commands:
47+
48+ ``` bash
49+ # Install the chart on a Xeon machine
3650helm install chatqna chatqna --set global.HUGGINGFACEHUB_API_TOKEN=${HFTOKEN} --set global.modelUseHostPath=${MODELDIR} --set tgi.LLM_MODEL_ID=${MODELNAME}
51+ ```
3752
53+ ``` bash
3854# To use Gaudi device
3955helm install chatqna chatqna --set global.HUGGINGFACEHUB_API_TOKEN=${HFTOKEN} --set global.modelUseHostPath=${MODELDIR} --set tgi.LLM_MODEL_ID=${MODELNAME} -f chatqna/gaudi-values.yaml
56+ ```
4057
58+ ``` bash
4159# To use Nvidia GPU
4260helm install chatqna chatqna --set global.HUGGINGFACEHUB_API_TOKEN=${HFTOKEN} --set global.modelUseHostPath=${MODELDIR} --set tgi.LLM_MODEL_ID=${MODELNAME} -f chatqna/nv-values.yaml
61+ ```
4362
63+ ``` bash
64+ # To include guardrail component in chatqna on Xeon
65+ helm install chatqna chatqna --set global.HUGGINGFACEHUB_API_TOKEN=${HFTOKEN} --set global.modelUseHostPath=${MODELDIR} -f chatqna/guardrails-values.yaml
66+ ```
4467
45- # To use OpenVINO vLLM inference engine on Xeon device
46-
47- helm install chatqna chatqna --set global.HUGGINGFACEHUB_API_TOKEN=${HFTOKEN} --set global.modelUseHostPath=${MODELDIR} --set global.LLM_MODEL_ID= ${MODELNAME} --set tags.tgi=false --set vllm-openvino.enabled=true
68+ ``` bash
69+ # To include guardrail component in chatqna on Gaudi
70+ helm install chatqna chatqna --set global.HUGGINGFACEHUB_API_TOKEN=${HFTOKEN} --set global.modelUseHostPath=${MODELDIR} -f chatqna/guardrails-gaudi-values.yaml
4871```
4972
73+ > ** _ NOTE:_ ** Default installation will use [ TGI (Text Generation Inference)] ( https://github.com/huggingface/text-generation-inference ) as inference engine. To use vLLM as inference engine, please see below.
74+
75+ ``` bash
76+ # To use OpenVINO vLLM inference engine on Xeon device
77+ helm install chatqna chatqna --set global.HUGGINGFACEHUB_API_TOKEN=${HFTOKEN} --set global.modelUseHostPath=${MODELDIR} --set llm-vllm-uservice.LLM_MODEL_ID=${MODELNAME} --set vllm-openvino.LLM_MODEL_ID=${MODELNAME} --set tags.tgi=false --set vllm-openvino.enabled=true
78+ ```
5079
5180### IMPORTANT NOTE
5281
0 commit comments