Ollama su NAS Synology: un LLM sul server familial
Sì, in pratica sui NAS x86 (Intel Celeron o AMD Ryzen) la cui RAM può essere ampliata: i modelli ARM di fascia bassa hanno solo da 1 a 2 GB di memoria. Prevedi da 6 a 8 GB di RAM libera per un modello 7B in Q4, oltre a quella necessaria per DSM. Non esiste un pacchetto Ollama ufficiale: usa Container Manager (DSM 7.2+) e l'immagine ollama/ollama.
Un NAS Synology può ospitare un vero LLM locale, accessibile da tutta la rete domestica o aziendale, senza dipendere da un cloud. Ma non tutte le configurazioni si prestano a questo uso: il processore, la RAM disponibile e il modo in cui il servizio viene esposto sulla rete fanno la differenza tra uno strumento utilizzabile e una delusione. Ecco cosa verificare prima dell'installazione e cosa aspettarti usando soltanto la CPU.
#Quali NAS Synology sono compatibili con Ollama
La memoria è la prima cosa da verificare prima di ogni acquisto o ogni tentativo di installazione. Ollama pubblica versioni Linux per x86-64 come per ARM64: il processore ARM non è quindi il vero limite. Tuttavia, i NAS Synology di base costruiti attorno a un processore ARM Realtek dispongono soltanto di 1 GB (DS124, DS223j) o 2 GB (DS223) di memoria secondo le specifiche tecniche di Synology, mentre un modello 7B quantizzato in Q4 pesa da solo circa 5 GB. I modelli x86 (Intel Celeron o AMD Ryzen, in genere le serie « Plus ») sono la scelta realistica, perché la loro memoria può essere estesa.
In pratica, sono adatte le serie «Plus» e di fascia superiore, dotate di un Intel Celeron o di un AMD Ryzen. Prima di installare qualsiasi cosa, verifica la scheda tecnica esatta del tuo modello: il nome della gamma (Plus) è un indizio, non una garanzia di per sé.
#Quanta RAM prevedere per un uso realistico
Il tuo ChatGPT privato e gratuito sulla tua macchina in 1 ora — LM Studio, Ollama, Open WebUI, i tuoi documenti, senza cloud.
- Spazio online a vita
- PDF + file
- Aggiornamenti a vita
La quantità di RAM necessaria varia in base al modello caricato, alla quantizzazione, alla lunghezza del contesto e al numero di utenti simultanei; bisogna anche lasciare un margine per DSM e gli altri pacchetti in esecuzione in parallelo. Un modello 7B in Q4 occupa circa 5 GB per i pesi, ai quali si aggiungono il contesto e i processi: considera da 6 a 8 GB di RAM libera. Su un NAS con 8 GB totali, il margine diventa molto ridotto una volta considerati DSM e Container Manager; 16 GB consentono un funzionamento agevole.
| Modello | CPU | RAM di serie | RAM massima |
|---|---|---|---|
| DS225+ / DS425+ | Intel Celeron J4125 | 2 GB DDR4 | 6 GB |
| DS725+ | AMD Ryzen R1600 (2 core) | 4 GB DDR4 ECC | 32 GB |
| DS925+ | AMD Ryzen V1500B (4 core) | 4 GB DDR4 ECC | 32 GB |
| DS1525+ / DS1825+ | AMD Ryzen V1500B (4 core) | 8 GB DDR4 ECC | 32 GB |
I DS225+ e DS425+ vengono forniti con soli 2 GB di RAM di serie: sono decisamente insufficienti per un LLM utilizzabile, anche piccolo. Un potenziamento della memoria è indispensabile su questi modelli prima di qualsiasi installazione di Ollama.
#Quali modelli Synology considerare per primi?
I modelli dotati di Ryzen (DS725+, DS925+, DS1525+, DS1825+) offrono una RAM estendibile fino a 32 GB e un processore più adatto ai calcoli rispetto ai Celeron delle serie DS225+/DS425+. Per un utilizzo serio di LLM, bisogna puntare su queste serie, aggiornando la memoria fino al massimo supportato piuttosto che mantenere la configurazione di partenza.
#Installare Ollama tramite Container Manager
Synology non offre Ollama come pacchetto ufficiale nel Centro pacchetti: bisogna passare attraverso Container Manager, che sostituisce il vecchio pacchetto Docker dal DSM 7.2 (su DSM 7.0 e 7.1, il vecchio pacchetto Docker è ancora disponibile).
- 01Verificare la versione di DSMContainer Manager richiede DSM 7.2 o successivo. Su versioni precedenti, bisogna usare il vecchio pacchetto Docker, con un'interfaccia diversa.
- 02Aprire Container Manager e cercare l'immagine ufficialeDal menu principale di DSM, aprire Container Manager, andare in Registro, cercare ollama/ollama, selezionare l'immagine ufficiale e fare clic su Download.
- 03Configurare la porta e avviare il containerMappare la porta del container (11434 per impostazione predefinita per Ollama) su una porta con numero elevato sul lato host, seguendo il criterio dell'intervallo 8000-9000 raccomandato per questo tipo di servizio, anziché modificare le porte predefinite di DSM.
- 04Scaricare un primo modello adatto alla RAM disponibileUna volta avviato il container, connettersi tramite riga di comando o interfaccia e scaricare un modello dimensionato in base alla RAM libera realmente disponibile sul NAS, non alla RAM totale installata.
#Aggiungere un'interfaccia: Open WebUI in Docker Compose
Da solo, Ollama offre soltanto un'API e un'interfaccia a riga di comando, senza un'interfaccia di chat: per ottenere un'esperienza simile a ChatGPT, serve un secondo software collegato a Ollama. Il metodo consigliato consiste nel distribuire Ollama e Open WebUI come due container Docker distinti sullo stesso NAS, per poi scaricare un modello dimensionato in base alla RAM realmente disponibile, anziché scegliere il modello più capace trovato online — la scelta del modello resta soggetta agli stessi vincoli di memoria descritti sopra per Ollama da solo. A partire da DSM 7.2, Container Manager offre una scheda «Progetto» che esegue direttamente un file docker-compose.yml, senza ricorrere a SSH né scrivere comandi in un terminale: questo avvicina l'esperienza Synology a quella di un server Linux classico, mantenendo il controllo dall'interfaccia grafica DSM.
- 01Creare la cartella del progettoIn File Station, creare una cartella dedicata, ad esempio /volume1/docker/openwebui, che ospiterà il file docker-compose.yml del progetto; mantenere questa cartella separata da quella utilizzata per l'installazione del solo Ollama evita di mescolare le configurazioni dei due container.
- 02Scrivere il file docker-compose.ymlDichiarare due servizi: ollama (l'API già installata nel passaggio precedente, o reintegrata qui) e open-webui, collegato a Ollama tramite il suo URL interno, con la porta 3000 esposta sul lato host per l'interfaccia web.
- 03Avviare il progetto dal Container ManagerCreare un nuovo Progetto in Container Manager, indicare questa cartella, quindi eseguire il deployment: il comando sottostante equivale a docker compose up -d e avvia insieme i due container, rispettando il corretto ordine delle dipendenze tra loro.
- 04Aprire l'interfaccia e creare l'account amministratoreUna volta avviati i container, aprire l'indirizzo IP del NAS seguito dalla porta 3000 da un browser sulla rete locale, creare l'account amministratore al primo accesso, quindi scaricare un modello da Ollama direttamente nell'interfaccia.
#Aspettative realistiche con la sola CPU
Un NAS Synology esegue Ollama esclusivamente sulla CPU: su queste macchine non c'è una GPU dedicata da sfruttare. Il throughput reale va misurato con il modello e il carico previsti, perché varia in base alla lunghezza del contesto, alla versione di Ollama e alle attività concorrenti del NAS (backup, indicizzazione, altri pacchetti). Un ordine di grandezza qualitativo osservato per la generazione di testi lunghi si aggira intorno a 5 token al secondo: ampiamente sufficiente per un uso asincrono (riassunti, elaborazione in background), ma più al limite per una conversazione impegnativa in tempo reale.
#Sicurezza di rete: non esporre Ollama su Internet
Un NAS contiene generalmente tutti i file personali o professionali di una famiglia o di una piccola struttura: è un dispositivo da proteggere in via prioritaria, non da esporre per comodità. Inoltrare direttamente verso Internet una porta DSM o una porta di un container espone un dispositivo che contiene tutti i tuoi file alle scansioni automatizzate, e alcuni NAS Synology sono già stati presi di mira da campagne di ransomware proprio per questo motivo.
#A confronto con un deployment Docker di produzione
Questa guida punta a un'installazione semplice, con un solo container, su un NAS domestico o di una piccola organizzazione. Per uno stack di produzione con reverse proxy HTTPS, interfaccia web dedicata, RAG vettoriale e monitoraggio, la procedura è diversa e più impegnativa da gestire: è trattata nella guida di questo sito a Docker Compose in produzione, pensata per un server Linux dedicato anziché per un NAS.
- Distribuzione di LLM con Docker Compose in produzione
- Alternativa: Ollama su Proxmox (LXC/VM)
- Fonte: compatibilità CPU e RAM per modello
- Fonte: Container Manager e sicurezza di rete
#Per chi questo setup ha senso
Ollama su un NAS Synology è adatto a chi ha già un NAS x86 in servizio per l'archiviazione e vuole aggiungervi un uso dell'IA leggero, asincrono e accessibile da tutta la rete locale: riassumere documenti depositati in una cartella condivisa, estrarre informazioni da e-mail archiviate o fungere da componente di un'automazione domestica. Non è la scelta giusta se l'obiettivo è una conversazione fluida e rapida nell'uso quotidiano, oppure se il NAS funge già da sistema di backup principale e non ha un margine di memoria da dedicare a un LLM senza rischiare di rallentare le sue attività abituali.
- Hai già un NAS x86 Plus con RAM libera
- È lo scenario più conveniente: non serve acquistare hardware aggiuntivo, basta un eventuale potenziamento della memoria e un container da configurare.
- Cerchi una conversazione immediata tipo ChatGPT
- La sola CPU di un NAS resta lenta rispetto a una GPU dedicata o a un chip recente con memoria unificata; per questo uso, preferisci un mini-PC o una macchina con GPU.
- Il NAS ospita già backup critici
- Verifica la RAM disponibile e il carico della CPU prima di aggiungere Ollama: un servizio mal dimensionato può rallentare le operazioni di backup esistenti.
Tutti i NAS Synology possono eseguire Ollama?+
Quanta RAM serve su un NAS Synology per Ollama?+
Esiste un pacchetto Ollama ufficiale nel Centro dei pacchetti Synology?+
Quale velocità aspettarsi da Ollama su un NAS Synology?+
È prudente rendere Ollama accessibile da Internet?+
Come aggiungere un'interfaccia di chat tipo ChatGPT a Ollama su Synology?+
Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.