Installare Ollama su macOS (Apple Silicon): guida 2026
I Mac Apple Silicon (M1, M2, M3, M4) sono tra i migliori computer destinati al grande pubblico per l'IA locale. La memoria unificata permette a un MacBook Pro da 64 GB di eseguire modelli da 70B che un PC gaming da 2.000 € non può nemmeno pensare di eseguire. Ecco come iniziare in 3 minuti.
#Perché un Mac per l'IA locale?
Su un PC classico, la VRAM della GPU è fisicamente separata dalla RAM della CPU. Hai una RTX 4070 da 12 GB? Sei limitato a 12 GB per i tuoi modelli, indipendentemente dai tuoi 64 GB di RAM di sistema.
Su un Mac Apple Silicon, la memoria è unificata: GPU, CPU e Neural Engine condividono la stessa RAM. Un MacBook Pro M3 Max da 64 GB può allocare 48 GB a un modello: abbastanza per caricare un grande MoE come Qwen 3.6 35B-A3B a piena precisione o eseguire più modelli contemporaneamente, senza difficoltà.
#Prerequisiti
Ollama funziona sul tuo Mac. Il kit Mac lo rende un servizio affidabile — avvio automatico, rete, log (cap. 7) —, vi collega Open WebUI (cap. 8) e ti spiega in che modo la memoria unificata influisce sulla scelta del modello (cap. 2).
- Spazio online a vita
- PDF + file
- Aggiornamenti a vita
- macOS 12 Monterey o successivo
- Sonoma (14) o Sequoia (15) raccomandati per le ultime ottimizzazioni Metal.
- Mac Apple Silicon
- M1, M2, M3 o M4 — pro, max, ultra, non importa. I Mac Intel non sono supportati ufficialmente (lenti).
- Almeno 16 GB di RAM
- 8 GB bastano per un 3B, ma il margine è ridotto. 16 GB permettono di usare modelli da 8–9B, 32 GB i MoE da 30B (come Qwen 3.6 35B-A3B), 64 GB i modelli più grandi a piena precisione.
- ~20 GB di spazio disco
- Per 3-4 modelli. I download vanno in ~/.ollama/models.
#1. Installazione
Due metodi, entrambi puliti: il .dmg ufficiale o Homebrew. Gli sviluppatori preferiranno Homebrew, gli altri sceglieranno la soluzione più semplice.
#Opzione A — Applicazione .dmg
- 01Apri il .dmg scaricatoTrascina Ollama.app nella tua cartella Applicazioni, come qualsiasi app Mac.
- 02Avvia Ollama.app una voltaAl primo avvio, macOS richiede conferma ("applicazione scaricata da internet"). Clicca Apri.
- 03Autorizza l'utility da linea di comandoOllama propone di installare il comando ollama. Accetta — ti verrà richiesta una password di amministratore.
- 04L'icona del lama appare nella barra dei menuÈ il daemon. Puoi chiudere la finestra di benvenuto: continua a funzionare.
#Opzione B — Homebrew
Più veloce da aggiornare. Vantaggio: esegui brew upgrade ollama quando esce una nuova versione.
#Verifica
#2. Il tuo primo modello
Su un Mac con 16 GB, inizia con Qwen 3.5 9B o Granite 4.2 8B. Su 32 GB o più, puoi puntare direttamente a Qwen 3.8 27B o a un modello MoE veloce come Qwen 3.6 35B-A3B.
#3. Capire la memoria unificata
macOS assegna dinamicamente la RAM tra le app. Quando Ollama carica un modello, il sistema sposta automaticamente altre cose nello swap se necessario. Puoi quindi caricare modelli più grandi del solito, al prezzo di un rallentamento generale.
Per monitorare tutto questo in tempo reale mentre un modello è in esecuzione:
#4. Verificare l'accelerazione Metal
Metal è l'equivalente Apple di CUDA: l'API che permette a Ollama di eseguire i calcoli sulla GPU integrata del Mac. È attivato per impostazione predefinita, ma vale la pena verificarlo.
Nella colonna PROCESSOR devi vedere 100% GPU. Se vedi CPU, qualcosa non va: si tratta di un modello non supportato oppure di un driver Metal troppo vecchio.
#5. Un'interfaccia simile a ChatGPT
Per l'uso quotidiano, usare il terminale diventa presto stancante. Tre valide opzioni su Mac:
- Enchanted (gratuito, App Store)
- Il più curato dal punto di vista del design. Nativo in SwiftUI, si connette a Ollama senza configurazione.
- Msty (gratuito, .dmg)
- Più completo: supporto per più modelli, schede, prompt salvati, RAG integrato.
- Open WebUI tramite Docker
- Se hai già Docker, questa è la versione più ricca di funzionalità (cronologia, markdown, estensioni).
#6. Ollama all'avvio
Per impostazione predefinita, Ollama si avvia all'inizio della tua sessione se l'hai installato tramite il .dmg. Con Homebrew, l'avvio è manuale:
Per disattivare: brew services stop ollama. Per vedere lo stato: brew services list.
#Risoluzione dei problemi
- "ollama : command not found" dopo l'installazione
- Il link simbolico non è stato creato. Avvia Ollama.app una volta e accetta l'offerta di installare la CLI.
- Il modello si blocca a metà percorso
- Memoria insufficiente. Chiudi Chrome/Electron e riavvia. Altrimenti, scegli una quantizzazione più piccola.
- Ventole al massimo sul MacBook
- È normale durante l'inferenza intensiva. Per limitare il fenomeno: usa un modello più piccolo oppure collega il MacBook alla rete elettrica (i MacBook riducono le prestazioni quando funzionano a batteria).
- Impossibile eliminare Ollama
- Ferma il daemon: ollama stop. Poi elimina Ollama.app e la cartella ~/.ollama (contiene tutti i modelli scaricati).
Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.