Modelli offline
Offline non si fa ollama pull: i modelli sono file. Si scaricano su una macchina connessa e si trasferiscono.
Metodo 1 — copia dello store
Sezione intitolata “Metodo 1 — copia dello store”Lato connesso:
ollama pull qwen2.5:14b-instructtar -C ~/.ollama -czf ollama-qwen2.5-14b.tgz models/manifests/registry.ollama.ai/library/qwen2.5/14b-instruct $(cd ~/.ollama && jq -r '.layers[].digest, .config.digest' models/manifests/registry.ollama.ai/library/qwen2.5/14b-instruct | sed 's/sha256:/models\/blobs\/sha256-/')shasum -a 256 ollama-qwen2.5-14b.tgz > ollama-qwen2.5-14b.tgz.sha256Così archivi solo manifest e blob di quel modello. Per copiare tutto lo store:
tar -C ~/.ollama -czf ollama-models-all.tgz modelsLato offline:
sha256sum -c ollama-qwen2.5-14b.tgz.sha256mkdir -p ~/.ollama && tar -C ~/.ollama -xzf ollama-qwen2.5-14b.tgzollama listMetodo 2 — import da GGUF
Sezione intitolata “Metodo 2 — import da GGUF”Controllo totale su origine e versione (repo Hugging Face + commit).
Lato connesso:
pip install -U "huggingface_hub[cli]"huggingface-cli download Qwen/Qwen2.5-7B-Instruct-GGUF qwen2.5-7b-instruct-q4_k_m.gguf --local-dir ./ggufollama show qwen2.5:7b-instruct --modelfile | sed -n '/^TEMPLATE/,/^"""$/p' > template.txtLato offline:
printf 'FROM ./gguf/qwen2.5-7b-instruct-q4_k_m.gguf\nPARAMETER num_ctx 16384\n' > Modelfile && cat template.txt >> Modelfileollama create qwen2.5-7b-local -f ModelfileSenza il TEMPLATE corretto il modello risponde, ma il tool calling non funziona.
Metodo 3 — registry OCI con oras
Sezione intitolata “Metodo 3 — registry OCI con oras”Il registry interno (Harbor, Quay, MSR, Nexus) diventa la fonte unica, come per le immagini.
brew install orasoras login registry.internaloras push registry.internal/ai-models/qwen2.5-14b-instruct:q4_k_m ollama-qwen2.5-14b.tgz:application/gzip ollama-qwen2.5-14b.tgz.sha256:text/plainoras manifest fetch registry.internal/ai-models/qwen2.5-14b-instruct:q4_k_m | jqoras pull registry.internal/ai-models/qwen2.5-14b-instruct:q4_k_m -o ./modelIl deploy in-cluster che scarica da qui è in Ollama in-cluster.
Provenienza
Sezione intitolata “Provenienza”Registra per ogni modello: repo e commit HF (o tag Ollama), quantizzazione, sha256 dei blob, data di import. Pinna per digest:
oras resolve registry.internal/ai-models/qwen2.5-14b-instruct:q4_k_m