Principiante 3 minOllama

Installare Ollama su macOS (Apple Silicon): guida 2026

I Mac Apple Silicon (M1, M2, M3, M4) sono tra i migliori computer destinati al grande pubblico per l'IA locale. La memoria unificata permette a un MacBook Pro da 64 GB di eseguire modelli da 70B che un PC gaming da 2.000 € non può nemmeno pensare di eseguire. Ecco come iniziare in 3 minuti.

Di Mohamed Meguedmi·Agg. 2026-08-27·Testato su macOS 14+

#Perché un Mac per l'IA locale?

Su un PC classico, la VRAM della GPU è fisicamente separata dalla RAM della CPU. Hai una RTX 4070 da 12 GB? Sei limitato a 12 GB per i tuoi modelli, indipendentemente dai tuoi 64 GB di RAM di sistema.

Su un Mac Apple Silicon, la memoria è unificata: GPU, CPU e Neural Engine condividono la stessa RAM. Un MacBook Pro M3 Max da 64 GB può allocare 48 GB a un modello: abbastanza per caricare un grande MoE come Qwen 3.6 35B-A3B a piena precisione o eseguire più modelli contemporaneamente, senza difficoltà.

→
Regola pratica
macOS riserva circa il 25% della RAM per il sistema. Su un Mac da 16 GB, conta circa 12 GB disponibili. Su 32 GB: circa 24 GB. Su 64 GB: circa 48 GB.

#Prerequisiti

Il kit Mac

Ollama funziona sul tuo Mac. Il kit Mac lo rende un servizio affidabile — avvio automatico, rete, log (cap. 7) —, vi collega Open WebUI (cap. 8) e ti spiega in che modo la memoria unificata influisce sulla scelta del modello (cap. 2).

  • Spazio online a vita
  • PDF + file
  • Aggiornamenti a vita
macOS 12 Monterey o successivo
Sonoma (14) o Sequoia (15) raccomandati per le ultime ottimizzazioni Metal.
Mac Apple Silicon
M1, M2, M3 o M4 — pro, max, ultra, non importa. I Mac Intel non sono supportati ufficialmente (lenti).
Almeno 16 GB di RAM
8 GB bastano per un 3B, ma il margine è ridotto. 16 GB permettono di usare modelli da 8–9B, 32 GB i MoE da 30B (come Qwen 3.6 35B-A3B), 64 GB i modelli più grandi a piena precisione.
~20 GB di spazio disco
Per 3-4 modelli. I download vanno in ~/.ollama/models.

#1. Installazione

Due metodi, entrambi puliti: il .dmg ufficiale o Homebrew. Gli sviluppatori preferiranno Homebrew, gli altri sceglieranno la soluzione più semplice.

#Opzione A — Applicazione .dmg

Download ufficiale
https://ollama.com/download/mac
  1. 01
    Apri il .dmg scaricato
    Trascina Ollama.app nella tua cartella Applicazioni, come qualsiasi app Mac.
  2. 02
    Avvia Ollama.app una volta
    Al primo avvio, macOS richiede conferma ("applicazione scaricata da internet"). Clicca Apri.
  3. 03
    Autorizza l'utility da linea di comando
    Ollama propone di installare il comando ollama. Accetta — ti verrà richiesta una password di amministratore.
  4. 04
    L'icona del lama appare nella barra dei menu
    È il daemon. Puoi chiudere la finestra di benvenuto: continua a funzionare.

#Opzione B — Homebrew

Terminale
brew install --cask ollama

Più veloce da aggiornare. Vantaggio: esegui brew upgrade ollama quando esce una nuova versione.

#Verifica

Terminale
ollama --version

#2. Il tuo primo modello

Su un Mac con 16 GB, inizia con Qwen 3.5 9B o Granite 4.2 8B. Su 32 GB o più, puoi puntare direttamente a Qwen 3.8 27B o a un modello MoE veloce come Qwen 3.6 35B-A3B.

Qwen 3.5 9B (tutte le configurazioni ≥16 GB)
ollama run qwen3.5:9b
Granite 4.2 8B (≥16 GB per un uso agevole)
ollama run granite4.2:8b
Qwen 3.8 27B (≥32 GB consigliati)
ollama run qwen3.8:27b
Qwen 3.6 35B-A3B MoE (≥32 GB, utilizzo agevole con 64 GB)
ollama run qwen3.6:35b
i
Primo download
Il modello arriva tramite il CDN di Ollama (diversi GB). Prevedi da 2 a 10 minuti a seconda della tua connessione. Gli avvii successivi sono istantanei.

#3. Capire la memoria unificata

macOS assegna dinamicamente la RAM tra le app. Quando Ollama carica un modello, il sistema sposta automaticamente altre cose nello swap se necessario. Puoi quindi caricare modelli più grandi del solito, al prezzo di un rallentamento generale.

Per monitorare tutto questo in tempo reale mentre un modello è in esecuzione:

Monitoraggio memoria
top -o mem
!
Swap eccessivo = lentezza
Se vedi più di 10 GB di swap attivo mentre Ollama è in esecuzione, il tuo modello è troppo grande per il tuo Mac. Passa a un modello di taglia inferiore o scegli una quantizzazione più aggressiva (Q3 invece di Q4).

#4. Verificare l'accelerazione Metal

Metal è l'equivalente Apple di CUDA: l'API che permette a Ollama di eseguire i calcoli sulla GPU integrata del Mac. È attivato per impostazione predefinita, ma vale la pena verificarlo.

Stato del modello caricato
ollama ps

Nella colonna PROCESSOR devi vedere 100% GPU. Se vedi CPU, qualcosa non va: si tratta di un modello non supportato oppure di un driver Metal troppo vecchio.

Consumo GPU in tempo reale
sudo powermetrics --samplers gpu_power -i 500

#5. Un'interfaccia simile a ChatGPT

Per l'uso quotidiano, usare il terminale diventa presto stancante. Tre valide opzioni su Mac:

Enchanted (gratuito, App Store)
Il più curato dal punto di vista del design. Nativo in SwiftUI, si connette a Ollama senza configurazione.
Msty (gratuito, .dmg)
Più completo: supporto per più modelli, schede, prompt salvati, RAG integrato.
Open WebUI tramite Docker
Se hai già Docker, questa è la versione più ricca di funzionalità (cronologia, markdown, estensioni).
Enchanted in 1 riga
open 'macappstore://apps.apple.com/app/enchanted-llm/id6474268307'

#6. Ollama all'avvio

Per impostazione predefinita, Ollama si avvia all'inizio della tua sessione se l'hai installato tramite il .dmg. Con Homebrew, l'avvio è manuale:

Avvio automatico tramite brew services
brew services start ollama

Per disattivare: brew services stop ollama. Per vedere lo stato: brew services list.

#Risoluzione dei problemi

"ollama : command not found" dopo l'installazione
Il link simbolico non è stato creato. Avvia Ollama.app una volta e accetta l'offerta di installare la CLI.
Il modello si blocca a metà percorso
Memoria insufficiente. Chiudi Chrome/Electron e riavvia. Altrimenti, scegli una quantizzazione più piccola.
Ventole al massimo sul MacBook
È normale durante l'inferenza intensiva. Per limitare il fenomeno: usa un modello più piccolo oppure collega il MacBook alla rete elettrica (i MacBook riducono le prestazioni quando funzionano a batteria).
Impossibile eliminare Ollama
Ferma il daemon: ollama stop. Poi elimina Ollama.app e la cartella ~/.ollama (contiene tutti i modelli scaricati).
Questa guida ti è stata utile?

Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.