Step 1: Download a quantized model

# 1. Home Llama 3.2 3B (Latest Stable - Best Quality & Multilingual)
wget -O Home-Llama-3.2-3B-Q4_K_M.gguf \
  "https://huggingface.co/acon96/Home-Llama-3.2-3B/resolve/main/Home-Llama-3.2-3B.q4_k_m.gguf"

# 2. Home FunctionGemma 270M (Ultra-fast / Low RAM - ideal for sub-second responses)
wget -O Home-FunctionGemma-270m-Q4_0.gguf \
  "https://huggingface.co/acon96/Home-FunctionGemma-270m/resolve/main/Home-FunctionGemma-270m.q4_0.gguf"

# 3. Home 3B v3 (StableLM-Zephyr base)
wget -O Home-3B-v3-Q4_K_M.gguf \
  "https://huggingface.co/acon96/Home-3B-v3-GGUF/resolve/main/Home-3B-v3.q4_k_m.gguf"

 

Step 2: Setup with llama.cpp

docker run -it --rm \
  --name homellm \
  -v /datadocker/home-llm/models:/models \
  -p 8092:8080 \
  ghcr.io/ggml-org/llama.cpp:server-b10499  \
  -m /models/Home-3B-v3-Q4_K_M.gguf \
  --host 0.0.0.0 \
  --port 8080 \
  --threads 4 \
  --jinja

vist test:

http://192.168.2.125:8092/

 

Step 3: Connect  Llama.cpp server to Home Assistant

Connect Home Assistant to llama.cpp server  using a llama.cpp integration.

add llama.cpp integration

URL:http://192.168.2.125:8092/v1

 

 

 

Comments

Be the first to post a comment

Post a comment