Modelfile
Il Modelfile è l’equivalente di un Dockerfile per i modelli: parte da un modello base e fissa system prompt, parametri e template.
| Istruzione | Uso |
|---|---|
FROM |
modello base o file GGUF |
PARAMETER |
num_ctx, temperature, top_p, num_predict, stop |
SYSTEM |
system prompt |
TEMPLATE |
chat template (Go template) |
MESSAGE |
esempi few-shot |
ADAPTER |
adapter LoRA |
Esempio: modello k8s-sre
Sezione intitolata “Esempio: modello k8s-sre”mkdir -p ~/ollama-models && cd ~/ollama-modelscat > Modelfile.k8s-sre <<'MF'FROM qwen2.5:7b-instructPARAMETER num_ctx 16384PARAMETER temperature 0.1PARAMETER top_p 0.9SYSTEM """You are a senior Kubernetes and OpenShift SRE.Answer in English, concise and technical.For every problem: state the root cause, the evidence from the input, and the exact kubectl/oc command to fix or verify it.Never invent resource names that are not in the input.If data is missing, list the command needed to collect it."""MFollama create k8s-sre -f Modelfile.k8s-sreollama show k8s-sre --modelfile | head -20kubectl -n shop-demo describe pod -l app=worker | ollama run k8s-srek8s-sre si usa poi come nome modello in k8sgpt e negli altri tool.
Vedere il Modelfile di un modello esistente
Sezione intitolata “Vedere il Modelfile di un modello esistente”Utile per recuperare il TEMPLATE corretto quando importi un GGUF offline:
ollama show qwen2.5:7b-instruct --modelfile > Modelfile.qwen2.5-7b-originalParametri utili
Sezione intitolata “Parametri utili”| Parametro | Default tipico | Per il debug |
|---|---|---|
num_ctx |
2048–4096 | 8192–16384 (log ed eventi sono lunghi) |
temperature |
0.7–0.8 | 0–0.2 (risposte deterministiche) |
num_predict |
illimitato | 1024 per limitare risposte prolisse |