Installazione su Mac
Due opzioni: la formula Homebrew (solo CLI + daemon, controllabile da terminale) o l’app Ollama (icona nella menu bar, avvio al login). Per il lab è consigliata la formula: start/stop espliciti e nessun processo residente.
Formula Homebrew (consigliata)
Sezione intitolata “Formula Homebrew (consigliata)”brew install ollamaollama --versionAvvio in foreground (si ferma con Ctrl+C, niente resta attivo):
ollama serveOppure come servizio launchd in background:
brew services start ollamabrew services info ollamaApp Ollama (alternativa)
Sezione intitolata “App Ollama (alternativa)”brew install --cask ollamaopen -a OllamaL’app si registra come login item. Per evitarlo: System Settings → General → Login Items, rimuovi Ollama. Non installare app e formula insieme: competono per la porta 11434.
Verifica
Sezione intitolata “Verifica”curl -s http://localhost:11434/api/versionlsof -nP -iTCP:11434 -sTCP:LISTENollama pull qwen2.5:7b-instructollama run qwen2.5:7b-instruct "explain CrashLoopBackOff in one sentence"Velocità reale
Sezione intitolata “Velocità reale”--verbose stampa i token/s di prompt e generazione: è il numero da confrontare tra modelli.
ollama run qwen2.5:7b-instruct --verbose "list 5 causes of ImagePullBackOff"Riferimento indicativo su Apple Silicon: 7B Q4 20–50 token/s, 14B Q4 10–25 token/s, a seconda del chip.
Esporre Ollama ai pod di kind
Sezione intitolata “Esporre Ollama ai pod di kind”Di default il daemon ascolta su 127.0.0.1. Docker Desktop di solito inoltra host.docker.internal anche verso servizi su loopback; se i pod non lo raggiungono, avvialo su tutte le interfacce:
OLLAMA_HOST=0.0.0.0:11434 ollama serveCon 0.0.0.0 Ollama è raggiungibile da tutta la rete locale: fallo solo su reti fidate, o usa il firewall di macOS.