Salta ai contenuti

Modelli offline

Offline non si fa ollama pull: i modelli sono file. Si scaricano su una macchina connessa e si trasferiscono.

Lato connesso:

Finestra del terminale
ollama pull qwen2.5:14b-instruct
Finestra del terminale
tar -C ~/.ollama -czf ollama-qwen2.5-14b.tgz models/manifests/registry.ollama.ai/library/qwen2.5/14b-instruct $(cd ~/.ollama && jq -r '.layers[].digest, .config.digest' models/manifests/registry.ollama.ai/library/qwen2.5/14b-instruct | sed 's/sha256:/models\/blobs\/sha256-/')
Finestra del terminale
shasum -a 256 ollama-qwen2.5-14b.tgz > ollama-qwen2.5-14b.tgz.sha256

Così archivi solo manifest e blob di quel modello. Per copiare tutto lo store:

Finestra del terminale
tar -C ~/.ollama -czf ollama-models-all.tgz models

Lato offline:

Finestra del terminale
sha256sum -c ollama-qwen2.5-14b.tgz.sha256
Finestra del terminale
mkdir -p ~/.ollama && tar -C ~/.ollama -xzf ollama-qwen2.5-14b.tgz
Finestra del terminale
ollama list

Controllo totale su origine e versione (repo Hugging Face + commit).

Lato connesso:

Finestra del terminale
pip install -U "huggingface_hub[cli]"
Finestra del terminale
huggingface-cli download Qwen/Qwen2.5-7B-Instruct-GGUF qwen2.5-7b-instruct-q4_k_m.gguf --local-dir ./gguf
Finestra del terminale
ollama show qwen2.5:7b-instruct --modelfile | sed -n '/^TEMPLATE/,/^"""$/p' > template.txt

Lato offline:

Finestra del terminale
printf 'FROM ./gguf/qwen2.5-7b-instruct-q4_k_m.gguf\nPARAMETER num_ctx 16384\n' > Modelfile && cat template.txt >> Modelfile
Finestra del terminale
ollama create qwen2.5-7b-local -f Modelfile

Senza il TEMPLATE corretto il modello risponde, ma il tool calling non funziona.

Il registry interno (Harbor, Quay, MSR, Nexus) diventa la fonte unica, come per le immagini.

Finestra del terminale
brew install oras
Finestra del terminale
oras login registry.internal
Finestra del terminale
oras push registry.internal/ai-models/qwen2.5-14b-instruct:q4_k_m ollama-qwen2.5-14b.tgz:application/gzip ollama-qwen2.5-14b.tgz.sha256:text/plain
Finestra del terminale
oras manifest fetch registry.internal/ai-models/qwen2.5-14b-instruct:q4_k_m | jq
Finestra del terminale
oras pull registry.internal/ai-models/qwen2.5-14b-instruct:q4_k_m -o ./model

Il deploy in-cluster che scarica da qui è in Ollama in-cluster.

Registra per ogni modello: repo e commit HF (o tag Ollama), quantizzazione, sha256 dei blob, data di import. Pinna per digest:

Finestra del terminale
oras resolve registry.internal/ai-models/qwen2.5-14b-instruct:q4_k_m