diff --git a/cluster/applications/open-webui/deployment.yaml b/cluster/applications/open-webui/deployment.yaml index d0f1087..241a59c 100644 --- a/cluster/applications/open-webui/deployment.yaml +++ b/cluster/applications/open-webui/deployment.yaml @@ -39,9 +39,8 @@ spec: name: body-wars-secret key: vllm-api-key optional: false - # Backend configuration for vLLM - - name: OLLAMA_BASE_URLS - value: "http://astro-orbiter:8000" + # Backend configuration for vLLM (OpenAI-compatible, NOT Ollama) + # OLLAMA_BASE_URLS removed: astro-orbiter runs vLLM, not Ollama - name: OPENAI_BASE_URL value: "http://astro-orbiter:8000/v1" - name: OPENAI_API_KEY diff --git a/cluster/platform/astro-orbiter-gateway/externalname-service.yaml b/cluster/platform/astro-orbiter-gateway/externalname-service.yaml new file mode 100644 index 0000000..e4d44b1 --- /dev/null +++ b/cluster/platform/astro-orbiter-gateway/externalname-service.yaml @@ -0,0 +1,37 @@ +apiVersion: v1 +kind: Service +metadata: + name: astro-orbiter + namespace: default + labels: + app.kubernetes.io/name: astro-orbiter-gateway + app.kubernetes.io/component: llm-inference +spec: + type: ExternalName + externalName: 10.1.71.130 + ports: + - name: vllm-8000 + port: 8000 + protocol: TCP + - name: llama-cpp-8001 + port: 8001 + protocol: TCP + - name: router-8002 + port: 8002 + protocol: TCP +--- +apiVersion: v1 +kind: Service +metadata: + name: astro-orbiter-vllm + namespace: default + labels: + app.kubernetes.io/name: astro-orbiter-gateway + app.kubernetes.io/component: llm-inference +spec: + type: ExternalName + externalName: 10.1.71.130 + ports: + - name: vllm + port: 8000 + protocol: TCP