Avanzato 11 minNAS

Ollama su NAS Synology: un LLM sul server familial

Risposta diretta

Sì, in pratica sui NAS x86 (Intel Celeron o AMD Ryzen) la cui RAM può essere ampliata: i modelli ARM di fascia bassa hanno solo da 1 a 2 GB di memoria. Prevedi da 6 a 8 GB di RAM libera per un modello 7B in Q4, oltre a quella necessaria per DSM. Non esiste un pacchetto Ollama ufficiale: usa Container Manager (DSM 7.2+) e l'immagine ollama/ollama.

Un NAS Synology può ospitare un vero LLM locale, accessibile da tutta la rete domestica o aziendale, senza dipendere da un cloud. Ma non tutte le configurazioni si prestano a questo uso: il processore, la RAM disponibile e il modo in cui il servizio viene esposto sulla rete fanno la differenza tra uno strumento utilizzabile e una delusione. Ecco cosa verificare prima dell'installazione e cosa aspettarti usando soltanto la CPU.

Di Mohamed Meguedmi·Agg. 2026-09-28·Testato su Windows, macOS e Linux

#Quali NAS Synology sono compatibili con Ollama

La memoria è la prima cosa da verificare prima di ogni acquisto o ogni tentativo di installazione. Ollama pubblica versioni Linux per x86-64 come per ARM64: il processore ARM non è quindi il vero limite. Tuttavia, i NAS Synology di base costruiti attorno a un processore ARM Realtek dispongono soltanto di 1 GB (DS124, DS223j) o 2 GB (DS223) di memoria secondo le specifiche tecniche di Synology, mentre un modello 7B quantizzato in Q4 pesa da solo circa 5 GB. I modelli x86 (Intel Celeron o AMD Ryzen, in genere le serie « Plus ») sono la scelta realistica, perché la loro memoria può essere estesa.

In pratica, sono adatte le serie «Plus» e di fascia superiore, dotate di un Intel Celeron o di un AMD Ryzen. Prima di installare qualsiasi cosa, verifica la scheda tecnica esatta del tuo modello: il nome della gamma (Plus) è un indizio, non una garanzia di per sé.

!
Da verificare prima di acquistare un NAS per Ollama
Con 1 o 2 GB di memoria, un NAS ARM di base non può caricare un modello utile, anche se piccolo. Controlla nella scheda tecnica di Synology la memoria installata e la memoria massima prima di qualsiasi acquisto dedicato a questo progetto.

#Quanta RAM prevedere per un uso realistico

Il kit IA Locale

Il tuo ChatGPT privato e gratuito sulla tua macchina in 1 ora — LM Studio, Ollama, Open WebUI, i tuoi documenti, senza cloud.

  • Spazio online a vita
  • PDF + file
  • Aggiornamenti a vita

La quantità di RAM necessaria varia in base al modello caricato, alla quantizzazione, alla lunghezza del contesto e al numero di utenti simultanei; bisogna anche lasciare un margine per DSM e gli altri pacchetti in esecuzione in parallelo. Un modello 7B in Q4 occupa circa 5 GB per i pesi, ai quali si aggiungono il contesto e i processi: considera da 6 a 8 GB di RAM libera. Su un NAS con 8 GB totali, il margine diventa molto ridotto una volta considerati DSM e Container Manager; 16 GB consentono un funzionamento agevole.

RAM di serie su alcuni modelli Synology x86 compatibili
ModelloCPURAM di serieRAM massima
DS225+ / DS425+Intel Celeron J41252 GB DDR46 GB
DS725+AMD Ryzen R1600 (2 core)4 GB DDR4 ECC32 GB
DS925+AMD Ryzen V1500B (4 core)4 GB DDR4 ECC32 GB
DS1525+ / DS1825+AMD Ryzen V1500B (4 core)8 GB DDR4 ECC32 GB

I DS225+ e DS425+ vengono forniti con soli 2 GB di RAM di serie: sono decisamente insufficienti per un LLM utilizzabile, anche piccolo. Un potenziamento della memoria è indispensabile su questi modelli prima di qualsiasi installazione di Ollama.

#Quali modelli Synology considerare per primi?

I modelli dotati di Ryzen (DS725+, DS925+, DS1525+, DS1825+) offrono una RAM estendibile fino a 32 GB e un processore più adatto ai calcoli rispetto ai Celeron delle serie DS225+/DS425+. Per un utilizzo serio di LLM, bisogna puntare su queste serie, aggiornando la memoria fino al massimo supportato piuttosto che mantenere la configurazione di partenza.

#Installare Ollama tramite Container Manager

Synology non offre Ollama come pacchetto ufficiale nel Centro pacchetti: bisogna passare attraverso Container Manager, che sostituisce il vecchio pacchetto Docker dal DSM 7.2 (su DSM 7.0 e 7.1, il vecchio pacchetto Docker è ancora disponibile).

  1. 01
    Verificare la versione di DSM
    Container Manager richiede DSM 7.2 o successivo. Su versioni precedenti, bisogna usare il vecchio pacchetto Docker, con un'interfaccia diversa.
  2. 02
    Aprire Container Manager e cercare l'immagine ufficiale
    Dal menu principale di DSM, aprire Container Manager, andare in Registro, cercare ollama/ollama, selezionare l'immagine ufficiale e fare clic su Download.
  3. 03
    Configurare la porta e avviare il container
    Mappare la porta del container (11434 per impostazione predefinita per Ollama) su una porta con numero elevato sul lato host, seguendo il criterio dell'intervallo 8000-9000 raccomandato per questo tipo di servizio, anziché modificare le porte predefinite di DSM.
  4. 04
    Scaricare un primo modello adatto alla RAM disponibile
    Una volta avviato il container, connettersi tramite riga di comando o interfaccia e scaricare un modello dimensionato in base alla RAM libera realmente disponibile sul NAS, non alla RAM totale installata.

#Aggiungere un'interfaccia: Open WebUI in Docker Compose

Da solo, Ollama offre soltanto un'API e un'interfaccia a riga di comando, senza un'interfaccia di chat: per ottenere un'esperienza simile a ChatGPT, serve un secondo software collegato a Ollama. Il metodo consigliato consiste nel distribuire Ollama e Open WebUI come due container Docker distinti sullo stesso NAS, per poi scaricare un modello dimensionato in base alla RAM realmente disponibile, anziché scegliere il modello più capace trovato online — la scelta del modello resta soggetta agli stessi vincoli di memoria descritti sopra per Ollama da solo. A partire da DSM 7.2, Container Manager offre una scheda «Progetto» che esegue direttamente un file docker-compose.yml, senza ricorrere a SSH né scrivere comandi in un terminale: questo avvicina l'esperienza Synology a quella di un server Linux classico, mantenendo il controllo dall'interfaccia grafica DSM.

  1. 01
    Creare la cartella del progetto
    In File Station, creare una cartella dedicata, ad esempio /volume1/docker/openwebui, che ospiterà il file docker-compose.yml del progetto; mantenere questa cartella separata da quella utilizzata per l'installazione del solo Ollama evita di mescolare le configurazioni dei due container.
  2. 02
    Scrivere il file docker-compose.yml
    Dichiarare due servizi: ollama (l'API già installata nel passaggio precedente, o reintegrata qui) e open-webui, collegato a Ollama tramite il suo URL interno, con la porta 3000 esposta sul lato host per l'interfaccia web.
  3. 03
    Avviare il progetto dal Container Manager
    Creare un nuovo Progetto in Container Manager, indicare questa cartella, quindi eseguire il deployment: il comando sottostante equivale a docker compose up -d e avvia insieme i due container, rispettando il corretto ordine delle dipendenze tra loro.
  4. 04
    Aprire l'interfaccia e creare l'account amministratore
    Una volta avviati i container, aprire l'indirizzo IP del NAS seguito dalla porta 3000 da un browser sulla rete locale, creare l'account amministratore al primo accesso, quindi scaricare un modello da Ollama direttamente nell'interfaccia.
→
Fissare le aspettative corrette all'inizio, prima di installare qualsiasi cosa
Per un uso non in tempo reale — porre una domanda e attendere da 30 a 60 secondi per la risposta completa — l'inferenza con la sola CPU su un NAS basato su Celeron resta funzionale. Per un uso interattivo, con risposte che si visualizzano progressivamente senza attese percepibili, serve una GPU o hardware dedicato all'inferenza, cosa che un NAS Synology non offre.

#Aspettative realistiche con la sola CPU

Un NAS Synology esegue Ollama esclusivamente sulla CPU: su queste macchine non c'è una GPU dedicata da sfruttare. Il throughput reale va misurato con il modello e il carico previsti, perché varia in base alla lunghezza del contesto, alla versione di Ollama e alle attività concorrenti del NAS (backup, indicizzazione, altri pacchetti). Un ordine di grandezza qualitativo osservato per la generazione di testi lunghi si aggira intorno a 5 token al secondo: ampiamente sufficiente per un uso asincrono (riassunti, elaborazione in background), ma più al limite per una conversazione impegnativa in tempo reale.

i
Cosa fa bene un NAS Synology
Un utilizzo asincrono — riassunto di documenti, estrazione di informazioni, automazioni attivate da uno script — tollera bene una velocità di elaborazione modesta. Una conversazione interattiva rapida, molto meno.

#Sicurezza di rete: non esporre Ollama su Internet

Un NAS contiene generalmente tutti i file personali o professionali di una famiglia o di una piccola struttura: è un dispositivo da proteggere in via prioritaria, non da esporre per comodità. Inoltrare direttamente verso Internet una porta DSM o una porta di un container espone un dispositivo che contiene tutti i tuoi file alle scansioni automatizzate, e alcuni NAS Synology sono già stati presi di mira da campagne di ransomware proprio per questo motivo.

!
Regola semplice
Mantieni Ollama accessibile soltanto sulla rete locale (LAN) o tramite una VPN verso la tua rete. Non inoltrare mai la porta del container verso Internet nella configurazione del router o di DSM.

#A confronto con un deployment Docker di produzione

Questa guida punta a un'installazione semplice, con un solo container, su un NAS domestico o di una piccola organizzazione. Per uno stack di produzione con reverse proxy HTTPS, interfaccia web dedicata, RAG vettoriale e monitoraggio, la procedura è diversa e più impegnativa da gestire: è trattata nella guida di questo sito a Docker Compose in produzione, pensata per un server Linux dedicato anziché per un NAS.

#Per chi questo setup ha senso

Ollama su un NAS Synology è adatto a chi ha già un NAS x86 in servizio per l'archiviazione e vuole aggiungervi un uso dell'IA leggero, asincrono e accessibile da tutta la rete locale: riassumere documenti depositati in una cartella condivisa, estrarre informazioni da e-mail archiviate o fungere da componente di un'automazione domestica. Non è la scelta giusta se l'obiettivo è una conversazione fluida e rapida nell'uso quotidiano, oppure se il NAS funge già da sistema di backup principale e non ha un margine di memoria da dedicare a un LLM senza rischiare di rallentare le sue attività abituali.

Hai già un NAS x86 Plus con RAM libera
È lo scenario più conveniente: non serve acquistare hardware aggiuntivo, basta un eventuale potenziamento della memoria e un container da configurare.
Cerchi una conversazione immediata tipo ChatGPT
La sola CPU di un NAS resta lenta rispetto a una GPU dedicata o a un chip recente con memoria unificata; per questo uso, preferisci un mini-PC o una macchina con GPU.
Il NAS ospita già backup critici
Verifica la RAM disponibile e il carico della CPU prima di aggiungere Ollama: un servizio mal dimensionato può rallentare le operazioni di backup esistenti.
Domande frequenti
Tutti i NAS Synology possono eseguire Ollama?+
No, in pratica. Ollama esiste sia per x86-64 che per ARM64, ma i NAS di fascia bassa con processore ARM Realtek hanno solo 1 GB (DS124, DS223j) o 2 GB (DS223) di memoria, troppo poco per caricare un modello. I modelli realisticamente utilizzabili sono quelli x86-64 (Intel Celeron o AMD Ryzen, generalmente le serie «Plus» e superiori), la cui memoria può essere espansa.
Quanta RAM serve su un NAS Synology per Ollama?+
Prevedi da 6 a 8 GB di RAM libera per un modello 7B in Q4 (circa 5 GB di pesi più il contesto), oltre a quella consumata da DSM e dagli altri pacchetti attivi — il fabbisogno esatto varia in base alla quantizzazione, alla lunghezza del contesto e al numero di utenti simultanei. I modelli forniti con soli 2 GB di serie (DS225+, DS425+) richiedono tassativamente un potenziamento della memoria prima di qualsiasi installazione.
Esiste un pacchetto Ollama ufficiale nel Centro dei pacchetti Synology?+
No, e probabilmente non cambierà: Ollama rimane un software di terze parti dal punto di vista di Synology. È necessario usare Container Manager (DSM 7.2 o successivo), che ha sostituito il vecchio pacchetto Docker e offre anche una scheda Progetto per eseguire un file docker-compose.yml direttamente dall'interfaccia, senza SSH, per poi recuperare l'immagine ufficiale ollama/ollama dal Registro del gestore dei contenitori.
Quale velocità aspettarsi da Ollama su un NAS Synology?+
Il NAS funziona con la sola CPU, senza GPU dedicata. La velocità dipende fortemente dal modello, dal contesto e dal carico del NAS; un ordine di grandezza osservato per la generazione di testi lunghi è di circa 5 token al secondo. È adeguato per un uso asincrono (riassunto, attività in background), ma l'inferenza con la sola CPU su un NAS basato su Celeron è più adatta ad attendere da 30 a 60 secondi per una risposta completa che a una conversazione visualizzata man mano che viene generata.
È prudente rendere Ollama accessibile da Internet?+
No. Un NAS contiene spesso tutti i tuoi file personali o professionali; reindirizzare una porta DSM o una porta di un container verso Internet lo espone direttamente a scansioni automatizzate, e alcuni NAS Synology sono già stati presi di mira da campagne di ransomware proprio per questo motivo. Limitati all'accesso tramite la rete locale o una VPN verso la tua rete.
Come aggiungere un'interfaccia di chat tipo ChatGPT a Ollama su Synology?+
Distribuendo Open WebUI come secondo container collegato a Ollama, tramite un file docker-compose.yml collocato ad esempio in /volume1/docker/openwebui e avviato dalla scheda « Projet » di Container Manager (DSM 7.2+), senza dover aprire una sessione SSH. L'interfaccia è poi accessibile sulla porta 3000 da qualsiasi dispositivo della rete locale, con un account amministratore creato al primissimo accesso.
Questa guida ti è stata utile?

Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.