Principiante 11 minOllama

Installare Ollama in 5 minuti (Windows, macOS, Linux)

Risposta diretta

Per installare Ollama, scarica l'installatore da ollama.com (Windows, macOS 14 o successivo) oppure esegui il comando curl ufficiale su Linux, poi digita ollama run seguito dal nome di un modello. Prevedi 5 minuti per queste operazioni, escluso il download del modello. Non è richiesta alcuna GPU: è la memoria disponibile a determinare le dimensioni del modello che puoi eseguire.

Questa pagina spiega l'installazione di Ollama sui tre sistemi, cosa verificare prima di iniziare, il primo modello da avviare e le poche impostazioni che evitano brutte sorprese: dove vengono memorizzati i modelli, come liberare la memoria, cosa rimane locale. I dettagli specifici di ciascun sistema si trovano in una guida dedicata.

Di Mohamed Meguedmi·Agg. 2026-09-29·Testato su Windows 11

#Installare Ollama: la versione breve per ogni sistema

Ollama è un motore che scarica modelli di linguaggio open-weight e li esegue sul tuo dispositivo, con un'interfaccia in linea di comando e una API locale. La sua installazione avviene in una sola operazione su ogni sistema. Su Windows e macOS, scarichi un'applicazione da ollama.com/download; su Linux, uno script ufficiale installa il programma e il servizio. Poi, il comando ollama run suivie con il nome di un modello lo scarica per la prima volta all'invocazione e apre una conversazione.

Installazione di Ollama per sistema operativo (documentazione ufficiale, settembre 2026)
SistemaMetodoPrerequisiti annunciati da Ollama
WindowsProgramma di installazione OllamaSetup.exe, oppure comando PowerShell irm https://ollama.com/install.ps1 | iexWindows 10 22H2 o successivo; driver NVIDIA 551.61 o successivo se usi una scheda NVIDIA
macOSFile ollama.dmg trascinato in Applicazioni, o brew install ollamamacOS 14 Sonoma o versione successiva; chip Apple M (CPU e GPU) o x86 (solo CPU)
Linuxcurl -fsSL https://ollama.com/install.sh | shDriver NVIDIA 550 o più recente (o ROCm v7 per AMD) se si desidera l'accelerazione GPU

In tutti e tre i casi, il server è in ascolto su http://localhost:11434 e il comando ollama è disponibile nel terminale. Le sezioni successive descrivono in dettaglio ciascun sistema senza ripetere le guide dedicate passo dopo passo, poi passano al primo modello.

#Prerequisiti: quale macchina, quali dimensioni del modello

Il kit IA Locale

Il tuo ChatGPT privato e gratuito sulla tua macchina in 1 ora — LM Studio, Ollama, Open WebUI, i tuoi documenti, senza cloud.

  • Spazio online a vita
  • PDF + file
  • Aggiornamenti a vita

Ollama si avvia su quasi ogni macchina recente; ciò che varia è la dimensione accettabile del modello. Il fattore limitante è la memoria disponibile per i pesi: la VRAM di una scheda grafica dedicata, la memoria unificata di un Mac Apple Silicon o, in mancanza di queste, la RAM del sistema, usando in tal caso solo il processore e ottenendo risposte più lente.

Indicazione di memoria in base alla dimensione del modello, in quantizzazione Q4 (solo pesi)
Dimensione del modelloMemoria per i pesiMacchina di partenza ragionevole
3Bcirca 2 GBPC 8 GB di RAM, senza GPU
7-8Bcirca 5 GB16 GB di RAM, oppure una GPU con 8 GB
14Bcirca 9 GBGPU da 12 GB, oppure Mac da 16 GB
32Bcirca 19-20 GBGPU 24 GB, o Mac 32 GB
70Bcirca 40 GBMac con 64 GB o più, o più GPU

Questi numeri riguardano solo i pesi. Bisogna aggiungere il contesto (cache KV), che cresce con la lunghezza della conversazione, e lasciare spazio al sistema: un modello da 5 GB su una macchina con 8 GB di RAM funziona, ma senza margine per tenere aperto anche un browser. Per scegliere la quantizzazione, vedere la guida su Q4, Q5 e Q8.

Per lo spazio su disco, la documentazione di Ollama indica almeno 4 GB per il programma su Windows, ai quali si aggiungono i modelli, che possono raggiungere decine o persino centinaia di GB a seconda di ciò che scarichi. È preferibile un SSD interno: la lentezza nel caricamento di un modello da un disco esterno si fa sentire a ogni avvio.

→
Nessuna GPU: è possibile, ma scegli un modello piccolo
Usando soltanto la CPU, un modello da 3 a 4 miliardi di parametri resta utilizzabile per riassumere o scrivere un breve testo. Oltre i 7-8B senza acceleratore, l'attesa diventa pesante. La guida sui LLM senza GPU presenta in dettaglio i modelli in base alla quantità di RAM.

#Installare Ollama su Windows

Ollama funziona come un'applicazione nativa di Windows, con supporto per le schede NVIDIA e AMD Radeon. Dopo l'installazione, funziona in background e il comando ollama diventa disponibile in cmd, PowerShell o qualsiasi altro terminale. L'installazione non richiede diritti di amministratore e si effettua per impostazione predefinita nella cartella personale.

  1. 01
    Scaricare
    Su ollama.com/download, scegli Windows e scarica OllamaSetup.exe. La pagina offre anche il comando PowerShell irm https://ollama.com/install.ps1 | iex, che ha lo stesso effetto.
  2. 02
    Avviare il programma di installazione
    Fai doppio clic sul file. Per installare in una posizione diversa dalla cartella personale, avvialo con il parametro /DIR seguito dal percorso, ad esempio OllamaSetup.exe /DIR="d:\dossier".
  3. 03
    Verificare
    Apri PowerShell e digita ollama --version. Apparirà anche un'icona Ollama nella zona di notifica, vicino all'orologio.
  4. 04
    Verificare il driver GPU
    Con una scheda NVIDIA, la documentazione richiede il driver 551.61 o successivo. Per una scheda AMD, serve lo stack ROCm v7 oppure un driver Radeon compatibile con Vulkan.
i
Windows 10: terminale e caratteri
La documentazione segnala che i caratteri Unicode della barra di avanzamento possono apparire come quadrati in alcuni terminali di Windows 10. Cambiare il font del terminale risolve il problema; è solo un aspetto estetico e non influisce sul download.

Per la procedura completa passo passo e la risoluzione dei problemi specifici di Windows, consulta la guida dedicata a Windows 11.

#Installare Ollama su macOS

Ollama richiede macOS 14 Sonoma o una versione successiva. I chip Apple M sfruttano il calcolo sulla GPU; i Mac con processore Intel (x86) funzionano solo sulla CPU, il che ne limita l'uso ai modelli molto piccoli. Il metodo consigliato dalla documentazione consiste nel montare il file ollama.dmg e trascinare l'applicazione nella cartella Applications del sistema.

Applicazione ufficiale
Al primo avvio, l'applicazione verifica che il comando ollama sia presente nel tuo PATH e, in caso contrario, richiede l'autorizzazione a creare un collegamento in /usr/local/bin.
Homebrew
In Homebrew esiste una formula ollama (brew install ollama): è l'alternativa da terminale per chi ha già Homebrew, senza passare dal file .dmg.
Memoria unificata
Su Apple Silicon, CPU e GPU condividono la stessa memoria: un Mac da 16 GB può quindi caricare un modello da 14B in Q4, mentre un PC dotato di una scheda da 8 GB di VRAM non lo potrebbe fare.

La guida dedicata a macOS spiega in dettaglio come scegliere il modello in base alla memoria del Mac e quali impostazioni sono utili su Apple Silicon.

#Installare Ollama su Linux

Su Linux basta un comando. Lo script ufficiale scarica il programma e lo configura come servizio.

Installazione ufficiale
curl -fsSL https://ollama.com/install.sh | sh

La documentazione propone anche un'installazione manuale: estrazione dell'archivio ollama-linux-amd64.tar.zst in /usr (o dell'archivio arm64 per le macchine ARM), archivio ROCm aggiuntivo per le schede AMD, poi creazione di un utente e di un servizio systemd se vuoi l'avvio automatico. Per aggiornare, esegui nuovamente lo script di installazione; la variabile OLLAMA_VERSION permette di installare una versione precisa.

Per una scheda NVIDIA, installa il driver e verifica con nvidia-smi, che deve mostrare la tua scheda. Per una scheda AMD, la documentazione richiede il driver ROCm v7. La guida dedicata a Linux spiega in dettaglio systemd, i permessi e le variabili d'ambiente.

#Avviare il primo modello

Appena installato Ollama, ollama run t scarica il modello richiesto se non è già presente, poi apre una conversazione nel terminale. Il primo invio dipende dalla tua connessione: un modello da 3 a 5 GB richiede alcuni minuti, e i file rimangono successivamente sul disco. Gli invii successivi partono senza nuovo download, rimane solo il caricamento in memoria.

Primo avvio
ollama run qwen3.5:4b

La famiglia Qwen 3.5 è pubblicata su ollama.com in dimensioni da 0.8b a 122b, con visione, strumenti e ragionamento a seconda delle versioni. Il tag 4b occupa pochi GB in Q4, quindi gira su quasi ogni macchina. Se disponi di 16 GB di memoria, prova un modello da 8-9B; la tabella sopra fornisce il riferimento. Le pagine di scelta per VRAM del sito ti aiutano a rifinire la scelta.

→
Uscire dalla conversazione
Digita /bye per uscire. Per impostazione predefinita, Ollama mantiene il modello in memoria per 5 minuti dopo l'ultima richiesta, accelerando così gli avvii successivi; ollama stop seguito dal nome del modello lo rimuove immediatamente dalla memoria.

#I comandi da conoscere dopo l'installazione

ollama list
Mostra i modelli scaricati e le loro dimensioni su disco.
ollama pull nom
Scarica un modello senza eseguirlo, utile per preparare diversi modelli prima di un viaggio.
ollama ps
Mostra i modelli caricati in memoria e se ciascuno gira su GPU o su CPU
ollama stop nom
Rimuove un modello dalla memoria senza attendere i 5 minuti predefiniti.
ollama rm nom
Elimina un modello per liberare spazio su disco.
ollama serve
Avvia il server a mano, utile sotto Linux se il servizio non è attivo.

Per il resto (aggiornamento, eliminazione completa di Ollama e dei suoi modelli), consulta la guida sulla manutenzione di Ollama.

#Dove sono salvati i modelli e come spostarli

I modelli possono facilmente occupare diverse decine di GB e il disco di sistema è raramente il posto migliore. La FAQ ufficiale indica il loro percorso predefinito: ~/.ollama/models su macOS, /usr/share/ollama/.ollama/models su Linux, C:\Users\%username%\.ollama\models su Windows.

Per spostarli, imposta la variabile d'ambiente OLLAMA_MODELS sul percorso della cartella desiderata. Su Windows, chiudi Ollama dall'area di notifica, apri le variabili d'ambiente del tuo account, crea la variabile e poi riavvia l'applicazione. Su Linux, con l'installazione standard, l'utente ollama deve avere i permessi di lettura e scrittura su questa cartella: la documentazione propone sudo chown -R ollama:ollama seguito dal percorso della cartella.

#Confidenzialità: ciò che rimane locale

In modalità locale, i prompt e le risposte rimangono sulla tua macchina: la FAQ di Ollama indica che l'azienda non vede i tuoi prompt né i tuoi dati quando esegui un modello localmente. I modelli detti cloud sono diversi: passano attraverso i server di Ollama. Se vuoi un utilizzo esclusivamente locale, la documentazione descrive una modalità solo locale: la variabile OLLAMA_NO_CLOUD=1, oppure l'impostazione disable_ollama_cloud in ~/.ollama/server.json. Riavvia poi Ollama.

Per impostazione predefinita, il server ascolta solo su 127.0.0.1, porta 11434: nessun altro sulla tua rete può interrogarlo. Impostare OLLAMA_HOST su 0.0.0.0 lo espone a tutta la rete locale, senza autenticazione. Farlo solo dietro un firewall o un proxy.

#Risoluzione dei problemi: i cinque problemi frequenti

Comando non trovato
Chiudi e riapri il terminale: l'installatore ha appena modificato il PATH. Su macOS, riavvia l'applicazione affinché proponga il collegamento /usr/local/bin.
GPU non utilizzato
Avvia un modello poi ollama ps: la colonna del processore indica GPU o CPU. Aggiorna il driver (NVIDIA 551.61 minimo sotto Windows, 550 sotto Linux) poi riavvia Ollama.
Scheda AMD non riconosciuta su Windows
La documentazione specifica che alcuni sistemi RDNA2 (RX 6000) non espongono ROCm v7 su Windows. Vulkan, attivato per impostazione predefinita, è allora il fallback consigliato.
Porta 11434 occupata
Un'altra istanza di Ollama è già in esecuzione, oppure un altro programma sta utilizzando la porta. Chiudi l'applicazione, poi riavviala.
Download bloccato dietro un proxy
Usa HTTPS_PROXY ed evita HTTP_PROXY, che secondo la FAQ può interferire con le connessioni del client; il certificato del proxy deve essere installato come certificato di sistema.
Domande frequenti sull'installazione di Ollama
Come installare Ollama su Windows 10?+
Ollama richiede Windows 10 22H2 o successivo, in edizione Home o Pro. Scarica OllamaSetup.exe da ollama.com/download e avvialo: non sono richiesti privilegi di amministratore. Apri poi PowerShell e digita ollama --version. Con una scheda NVIDIA, installa prima il driver 551.61 o successivo, altrimenti Ollama passa al processore e le risposte rallentano notevolmente.
Ollama è gratuito?+
Sì, per l'uso locale: il programma e i modelli aperti che esegue sono gratuiti; l'unico costo è l'elettricità consumata dal tuo hardware. Ollama offre inoltre modelli cloud accessibili con un account, distinti dall'esecuzione sulla tua macchina; fanno parte di un'offerta separata, che non è necessaria per questa guida.
Serve una GPU per usare Ollama?+
No. Ollama funziona anche con il solo processore, ma le risposte sono più lente, il che limita un uso confortevole ai piccoli modelli da 3 a 4 miliardi di parametri. Una scheda NVIDIA o AMD compatibile, o un Mac Apple Silicon, accelera notevolmente la generazione. Verifica poi con ollama ps dove il modello è effettivamente caricato.
Dove Ollama salva i modelli?+
Su macOS in ~/.ollama/models, su Linux in /usr/share/ollama/.ollama/models, su Windows in C:\Users\nom\.ollama\models. Per cambiare la posizione, imposta la variabile OLLAMA_MODELS, poi riavvia Ollama affinché la modifica abbia effetto. Copia quindi i modelli esistenti in questa cartella, oppure scaricali di nuovo se preferisci ripartire da zero, poi verifica con ollama list.
Ollama invia le mie conversazioni su Internet?+
Non in modalità locale: Ollama dichiara di non vedere i tuoi prompt né i tuoi dati quando il modello gira sulla tua macchina. I modelli cloud, invece, passano attraverso i suoi server. OLLAMA_NO_CLOUD=1 disattiva queste funzioni per mantenere il funzionamento rigorosamente locale; poi riavvia Ollama per applicare l'impostazione.
Come capire se Ollama utilizza la mia GPU?+
Avvia un modello, poi digita ollama ps in un secondo terminale. La colonna del processore indica la parte del modello caricata sulla GPU o sulla CPU. Se indica CPU anche se hai una scheda compatibile, aggiorna il driver e riavvia Ollama.
Questa guida ti è stata utile?

Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.