Salta ai contenuti

Modelfile

Il Modelfile è l’equivalente di un Dockerfile per i modelli: parte da un modello base e fissa system prompt, parametri e template.

Istruzione Uso
FROM modello base o file GGUF
PARAMETER num_ctx, temperature, top_p, num_predict, stop
SYSTEM system prompt
TEMPLATE chat template (Go template)
MESSAGE esempi few-shot
ADAPTER adapter LoRA
Finestra del terminale
mkdir -p ~/ollama-models && cd ~/ollama-models
Finestra del terminale
cat > Modelfile.k8s-sre <<'MF'
FROM qwen2.5:7b-instruct
PARAMETER num_ctx 16384
PARAMETER temperature 0.1
PARAMETER top_p 0.9
SYSTEM """
You are a senior Kubernetes and OpenShift SRE.
Answer in English, concise and technical.
For every problem: state the root cause, the evidence from the input, and the exact kubectl/oc command to fix or verify it.
Never invent resource names that are not in the input.
If data is missing, list the command needed to collect it.
"""
MF
Finestra del terminale
ollama create k8s-sre -f Modelfile.k8s-sre
Finestra del terminale
ollama show k8s-sre --modelfile | head -20
Finestra del terminale
kubectl -n shop-demo describe pod -l app=worker | ollama run k8s-sre

k8s-sre si usa poi come nome modello in k8sgpt e negli altri tool.

Utile per recuperare il TEMPLATE corretto quando importi un GGUF offline:

Finestra del terminale
ollama show qwen2.5:7b-instruct --modelfile > Modelfile.qwen2.5-7b-original
Parametro Default tipico Per il debug
num_ctx 2048–4096 8192–16384 (log ed eventi sono lunghi)
temperature 0.7–0.8 0–0.2 (risposte deterministiche)
num_predict illimitato 1024 per limitare risposte prolisse