Installare Ollama in 5 minuti (Windows, macOS, Linux)
Per installare Ollama, scarica l'installatore da ollama.com (Windows, macOS 14 o successivo) oppure esegui il comando curl ufficiale su Linux, poi digita ollama run seguito dal nome di un modello. Prevedi 5 minuti per queste operazioni, escluso il download del modello. Non è richiesta alcuna GPU: è la memoria disponibile a determinare le dimensioni del modello che puoi eseguire.
Questa pagina spiega l'installazione di Ollama sui tre sistemi, cosa verificare prima di iniziare, il primo modello da avviare e le poche impostazioni che evitano brutte sorprese: dove vengono memorizzati i modelli, come liberare la memoria, cosa rimane locale. I dettagli specifici di ciascun sistema si trovano in una guida dedicata.
#Installare Ollama: la versione breve per ogni sistema
Ollama è un motore che scarica modelli di linguaggio open-weight e li esegue sul tuo dispositivo, con un'interfaccia in linea di comando e una API locale. La sua installazione avviene in una sola operazione su ogni sistema. Su Windows e macOS, scarichi un'applicazione da ollama.com/download; su Linux, uno script ufficiale installa il programma e il servizio. Poi, il comando ollama run suivie con il nome di un modello lo scarica per la prima volta all'invocazione e apre una conversazione.
| Sistema | Metodo | Prerequisiti annunciati da Ollama |
|---|---|---|
| Windows | Programma di installazione OllamaSetup.exe, oppure comando PowerShell irm https://ollama.com/install.ps1 | iex | Windows 10 22H2 o successivo; driver NVIDIA 551.61 o successivo se usi una scheda NVIDIA |
| macOS | File ollama.dmg trascinato in Applicazioni, o brew install ollama | macOS 14 Sonoma o versione successiva; chip Apple M (CPU e GPU) o x86 (solo CPU) |
| Linux | curl -fsSL https://ollama.com/install.sh | sh | Driver NVIDIA 550 o più recente (o ROCm v7 per AMD) se si desidera l'accelerazione GPU |
In tutti e tre i casi, il server è in ascolto su http://localhost:11434 e il comando ollama è disponibile nel terminale. Le sezioni successive descrivono in dettaglio ciascun sistema senza ripetere le guide dedicate passo dopo passo, poi passano al primo modello.
#Prerequisiti: quale macchina, quali dimensioni del modello
Il tuo ChatGPT privato e gratuito sulla tua macchina in 1 ora — LM Studio, Ollama, Open WebUI, i tuoi documenti, senza cloud.
- Spazio online a vita
- PDF + file
- Aggiornamenti a vita
Ollama si avvia su quasi ogni macchina recente; ciò che varia è la dimensione accettabile del modello. Il fattore limitante è la memoria disponibile per i pesi: la VRAM di una scheda grafica dedicata, la memoria unificata di un Mac Apple Silicon o, in mancanza di queste, la RAM del sistema, usando in tal caso solo il processore e ottenendo risposte più lente.
| Dimensione del modello | Memoria per i pesi | Macchina di partenza ragionevole |
|---|---|---|
| 3B | circa 2 GB | PC 8 GB di RAM, senza GPU |
| 7-8B | circa 5 GB | 16 GB di RAM, oppure una GPU con 8 GB |
| 14B | circa 9 GB | GPU da 12 GB, oppure Mac da 16 GB |
| 32B | circa 19-20 GB | GPU 24 GB, o Mac 32 GB |
| 70B | circa 40 GB | Mac con 64 GB o più, o più GPU |
Questi numeri riguardano solo i pesi. Bisogna aggiungere il contesto (cache KV), che cresce con la lunghezza della conversazione, e lasciare spazio al sistema: un modello da 5 GB su una macchina con 8 GB di RAM funziona, ma senza margine per tenere aperto anche un browser. Per scegliere la quantizzazione, vedere la guida su Q4, Q5 e Q8.
Per lo spazio su disco, la documentazione di Ollama indica almeno 4 GB per il programma su Windows, ai quali si aggiungono i modelli, che possono raggiungere decine o persino centinaia di GB a seconda di ciò che scarichi. È preferibile un SSD interno: la lentezza nel caricamento di un modello da un disco esterno si fa sentire a ogni avvio.
#Installare Ollama su Windows
Ollama funziona come un'applicazione nativa di Windows, con supporto per le schede NVIDIA e AMD Radeon. Dopo l'installazione, funziona in background e il comando ollama diventa disponibile in cmd, PowerShell o qualsiasi altro terminale. L'installazione non richiede diritti di amministratore e si effettua per impostazione predefinita nella cartella personale.
- 01ScaricareSu ollama.com/download, scegli Windows e scarica OllamaSetup.exe. La pagina offre anche il comando PowerShell irm https://ollama.com/install.ps1 | iex, che ha lo stesso effetto.
- 02Avviare il programma di installazioneFai doppio clic sul file. Per installare in una posizione diversa dalla cartella personale, avvialo con il parametro /DIR seguito dal percorso, ad esempio OllamaSetup.exe /DIR="d:\dossier".
- 03VerificareApri PowerShell e digita ollama --version. Apparirà anche un'icona Ollama nella zona di notifica, vicino all'orologio.
- 04Verificare il driver GPUCon una scheda NVIDIA, la documentazione richiede il driver 551.61 o successivo. Per una scheda AMD, serve lo stack ROCm v7 oppure un driver Radeon compatibile con Vulkan.
Per la procedura completa passo passo e la risoluzione dei problemi specifici di Windows, consulta la guida dedicata a Windows 11.
#Installare Ollama su macOS
Ollama richiede macOS 14 Sonoma o una versione successiva. I chip Apple M sfruttano il calcolo sulla GPU; i Mac con processore Intel (x86) funzionano solo sulla CPU, il che ne limita l'uso ai modelli molto piccoli. Il metodo consigliato dalla documentazione consiste nel montare il file ollama.dmg e trascinare l'applicazione nella cartella Applications del sistema.
- Applicazione ufficiale
- Al primo avvio, l'applicazione verifica che il comando ollama sia presente nel tuo PATH e, in caso contrario, richiede l'autorizzazione a creare un collegamento in /usr/local/bin.
- Homebrew
- In Homebrew esiste una formula ollama (brew install ollama): è l'alternativa da terminale per chi ha già Homebrew, senza passare dal file .dmg.
- Memoria unificata
- Su Apple Silicon, CPU e GPU condividono la stessa memoria: un Mac da 16 GB può quindi caricare un modello da 14B in Q4, mentre un PC dotato di una scheda da 8 GB di VRAM non lo potrebbe fare.
La guida dedicata a macOS spiega in dettaglio come scegliere il modello in base alla memoria del Mac e quali impostazioni sono utili su Apple Silicon.
#Installare Ollama su Linux
Su Linux basta un comando. Lo script ufficiale scarica il programma e lo configura come servizio.
La documentazione propone anche un'installazione manuale: estrazione dell'archivio ollama-linux-amd64.tar.zst in /usr (o dell'archivio arm64 per le macchine ARM), archivio ROCm aggiuntivo per le schede AMD, poi creazione di un utente e di un servizio systemd se vuoi l'avvio automatico. Per aggiornare, esegui nuovamente lo script di installazione; la variabile OLLAMA_VERSION permette di installare una versione precisa.
Per una scheda NVIDIA, installa il driver e verifica con nvidia-smi, che deve mostrare la tua scheda. Per una scheda AMD, la documentazione richiede il driver ROCm v7. La guida dedicata a Linux spiega in dettaglio systemd, i permessi e le variabili d'ambiente.
#Avviare il primo modello
Appena installato Ollama, ollama run t scarica il modello richiesto se non è già presente, poi apre una conversazione nel terminale. Il primo invio dipende dalla tua connessione: un modello da 3 a 5 GB richiede alcuni minuti, e i file rimangono successivamente sul disco. Gli invii successivi partono senza nuovo download, rimane solo il caricamento in memoria.
La famiglia Qwen 3.5 è pubblicata su ollama.com in dimensioni da 0.8b a 122b, con visione, strumenti e ragionamento a seconda delle versioni. Il tag 4b occupa pochi GB in Q4, quindi gira su quasi ogni macchina. Se disponi di 16 GB di memoria, prova un modello da 8-9B; la tabella sopra fornisce il riferimento. Le pagine di scelta per VRAM del sito ti aiutano a rifinire la scelta.
#I comandi da conoscere dopo l'installazione
- ollama list
- Mostra i modelli scaricati e le loro dimensioni su disco.
- ollama pull nom
- Scarica un modello senza eseguirlo, utile per preparare diversi modelli prima di un viaggio.
- ollama ps
- Mostra i modelli caricati in memoria e se ciascuno gira su GPU o su CPU
- ollama stop nom
- Rimuove un modello dalla memoria senza attendere i 5 minuti predefiniti.
- ollama rm nom
- Elimina un modello per liberare spazio su disco.
- ollama serve
- Avvia il server a mano, utile sotto Linux se il servizio non è attivo.
Per il resto (aggiornamento, eliminazione completa di Ollama e dei suoi modelli), consulta la guida sulla manutenzione di Ollama.
#Dove sono salvati i modelli e come spostarli
I modelli possono facilmente occupare diverse decine di GB e il disco di sistema è raramente il posto migliore. La FAQ ufficiale indica il loro percorso predefinito: ~/.ollama/models su macOS, /usr/share/ollama/.ollama/models su Linux, C:\Users\%username%\.ollama\models su Windows.
Per spostarli, imposta la variabile d'ambiente OLLAMA_MODELS sul percorso della cartella desiderata. Su Windows, chiudi Ollama dall'area di notifica, apri le variabili d'ambiente del tuo account, crea la variabile e poi riavvia l'applicazione. Su Linux, con l'installazione standard, l'utente ollama deve avere i permessi di lettura e scrittura su questa cartella: la documentazione propone sudo chown -R ollama:ollama seguito dal percorso della cartella.
#Confidenzialità: ciò che rimane locale
In modalità locale, i prompt e le risposte rimangono sulla tua macchina: la FAQ di Ollama indica che l'azienda non vede i tuoi prompt né i tuoi dati quando esegui un modello localmente. I modelli detti cloud sono diversi: passano attraverso i server di Ollama. Se vuoi un utilizzo esclusivamente locale, la documentazione descrive una modalità solo locale: la variabile OLLAMA_NO_CLOUD=1, oppure l'impostazione disable_ollama_cloud in ~/.ollama/server.json. Riavvia poi Ollama.
Per impostazione predefinita, il server ascolta solo su 127.0.0.1, porta 11434: nessun altro sulla tua rete può interrogarlo. Impostare OLLAMA_HOST su 0.0.0.0 lo espone a tutta la rete locale, senza autenticazione. Farlo solo dietro un firewall o un proxy.
#Risoluzione dei problemi: i cinque problemi frequenti
- Comando non trovato
- Chiudi e riapri il terminale: l'installatore ha appena modificato il PATH. Su macOS, riavvia l'applicazione affinché proponga il collegamento /usr/local/bin.
- GPU non utilizzato
- Avvia un modello poi ollama ps: la colonna del processore indica GPU o CPU. Aggiorna il driver (NVIDIA 551.61 minimo sotto Windows, 550 sotto Linux) poi riavvia Ollama.
- Scheda AMD non riconosciuta su Windows
- La documentazione specifica che alcuni sistemi RDNA2 (RX 6000) non espongono ROCm v7 su Windows. Vulkan, attivato per impostazione predefinita, è allora il fallback consigliato.
- Porta 11434 occupata
- Un'altra istanza di Ollama è già in esecuzione, oppure un altro programma sta utilizzando la porta. Chiudi l'applicazione, poi riavviala.
- Download bloccato dietro un proxy
- Usa HTTPS_PROXY ed evita HTTP_PROXY, che secondo la FAQ può interferire con le connessioni del client; il certificato del proxy deve essere installato come certificato di sistema.
Come installare Ollama su Windows 10?+
Ollama è gratuito?+
Serve una GPU per usare Ollama?+
Dove Ollama salva i modelli?+
Ollama invia le mie conversazioni su Internet?+
Come capire se Ollama utilizza la mia GPU?+
- Installare Ollama su Windows 11: guida completa
- Installare Ollama su macOS (Apple Silicon)
- Installare Ollama su Linux
- Ollama con Docker
- Scegliere la quantizzazione
- Ollama : aggiornare, eliminare, disinstallare
- Fonte: documentazione Ollama per Windows
- Fonte: documentazione Ollama per macOS
- Fonte: documentazione Ollama per Linux
- Fonte: FAQ Ollama
Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.