Quale PC per l'IA locale? I nostri suggerimenti per budget
Per far funzionare un modello di IA in locale (Llama, Qwen, Mistral, gpt-oss…), una macchina si sceglie innanzitutto in base alla memoria, che fissa la dimensione dei modelli, poi in base alla sua banda passante, che ne determina la velocità. Ecco le nostre scelte per ogni budget, con i modelli che funzionano davvero su quelle macchine.
Aggiornato il 05/10/2026 · prezzi indicativi rilevati presso i nostri rivenditori a settembre 2026, soggetti a rapidi cambiamenti
- Meno di 1.000 €
- 1 200 – 1 500 €
- 2 000 – 2 500 €
- 3 000 – 3 500 €
- PC tower assemblato
- Portatile
- Oltre
- Domande
Le nostre scelte a colpo d'occhio
| Budget | La nostra scelta | Memoria per i modelli | Fino a (Q4) | Dove acquistare |
|---|---|---|---|---|
| Meno di 1.000 € | RTX 5060 Ti 16 GB GPU · ≈ 820 € | 16 GB | 14B senza difficoltà | |
| 1 200 – 1 500 € | RTX 5070 Ti 16 GB Scheda grafica · ≈ 1 300 – 1 400 € | 16 GB, 2 volte più banda passante | 14B, più veloce | |
| 2 000 – 2 500 € | Mac mini M5 Pro 24 GB / 512 GB Macchina completa · ≈ 2 000 € | ≈ 16 GB (su 24) | 14B | |
| 2 000 – 2 500 € | Mini-PC GMKtec EVO-X2 64 GB (Ryzen AI Max+ 395) Macchina completa | 64 GB | 30B senza difficoltà | GMKtec: negozio ufficiale europeo (sito in francese), consegna in Francia in media in 5–8 giorni. |
| 3 000 – 3 500 € | Mac Studio M5 Max 96 GB (GPU a 32 core) Workstation · ≈ 3.000 € | ≈ 72 GB (su 96) | 70B | |
| 3 300 – 4 000 € | Mini-PC Minisforum MS-S1 Max 128 GB / 2 TB (Ryzen AI Max+ 395) Macchina completa | 128 GB | gpt-oss 120B | |
| 3 600 – 4 600 € | PC assemblato Comete IA (RTX 5070 Ti 16 GB) PC tower assemblato · ≈ 3 650 € | 16 GB (+ 32 GB di RAM) | 14B senza difficoltà | |
| 3 600 – 4 600 € | PC assemblato Meteora IA (RTX 5080, 64 GB di RAM) PC tower assemblato | 16 GB (+ 64 GB di RAM) | 14B; MoE 30B in parte in RAM | |
| Portatile | Portatile RTX 5080 16 GB Portatile · a partire da ≈ 2.500 € | 16 GB | 14B senza difficoltà | |
| Portatile | MacBook Pro M5 Max 36 GB Portatile · a partire da 4.199 € (prezzo Apple) | ≈ 27 GB (su 36) | classe 30B |
Link affiliati — QuelLLM può percepire una commissione sugli acquisti, senza costi aggiuntivi per te, il che non influenza queste raccomandazioni (stabilite in modo indipendente). In qualità di Partner Amazon, QuelLLM realizza un guadagno sugli acquisti che soddisfano i requisiti.
Prima di tutto: di quali dimensioni vuoi che sia il modello da eseguire?
| Dimensione | Esempi | Memoria in Q4 | Configurazione hardware minima |
|---|---|---|---|
| 7-8B | Llama 3.1 8B | ≈ 6 GB | Scheda da 8 GB o processore (lento) |
| 12-14B | Gemma 3 12B, Qwen 3 14B | 7-9 GB | Scheda da 12-16 GB, Mac da 24 GB |
| 20-24B | gpt-oss 20B, Mistral Small 3.2 24B | 13-14 GB | Scheda da 16 GB (al limite) |
| 27-32B | Gemma 3 27B, Qwen 3 32B, Qwen 3 30B-A3B | 16-19 GB | Scheda da 24 a 32 GB, memoria unificata da 36 GB in su |
| 70-72B | Llama 3.3 70B Instruct, Qwen 2.5 72B Instruct | 40-42 GB | Memoria unificata da 64 a 128 GB |
| 120B (MoE) | gpt-oss 120B | ≈ 70 GB | Memoria unificata 96-128 GB |
Un modello MoE (Mixture of Experts) attiva solo una parte dei suoi parametri per ogni parola: è molto più veloce di un modello denso delle stesse dimensioni, ma richiede la stessa quantità di memoria per essere caricato. Sai già quale modello vuoi? Il configuratore verifica se il modello rientra nella memoria disponibile su una macchina.
L'insidia: più memoria non significa più velocità
| Macchina | Larghezza di banda |
|---|---|
| RTX 5080 (16 GB) | 960 GB/s |
| RTX 5070 Ti (16 GB) | 896 GB/s |
| Radeon RX 9070 XT (16 GB) | 644 GB/s |
| Apple M5 Max (36-128 GB) | Da 460 a 614 GB/s |
| RTX 5060 Ti (16 GB) | 448 GB/s |
| Mac mini M5 Pro (24-64 GB) | 307 GB/s |
| NVIDIA DGX Spark (128 GB) | 273 GB/s |
| Ryzen AI Max+ 395 (64-128 GB) | ≈ 212 GB/s |
Misura reale: su un MacBook Pro M5 Max 128 GB, gpt-oss 120B (MoE) produce 79,1 token/s, più velocemente di un modello denso da 27B (36,6 token/s in GGUF), perché attiva solo una piccola parte dei suoi parametri. Vedi il test completo.
Meno di 1.000 €: una scheda da 16 GB per il tuo PC
RTX 5060 Ti 16 GB
Scheda grafica da aggiungere a un PC esistente
- Memoria16 GB di GDDR7 dedicati
- Larghezza di banda448 GB/s
- Prezzo indicativo≈ 820 €
- Fino aModelli da 14B senza difficoltà, da 24B con quantizzazione spinta
Cosa ci gira (memoria necessaria in Q4)
RiferimentoUna scheda dedicata resta la soluzione più veloce per euro a parità di dimensione del modello. Non ci sono ancora misure QuelLLM pubblicate per questa scheda.
✓ Il più economico per superare gli 8 GB di VRAM · CUDA: compatibile con Ollama, LM Studio, llama.cpp e vLLM
✗ Limite di 16 GB: non permette di usare comodamente modelli da 32B · Presuppone un PC recente con alimentatore e case compatibili
Guida: quali LLM su una RTX 5060 Ti →Quale LLM con 16 GB di VRAM →
AlternativaRadeon RX 9070 XT 16 GB (≈ 960 – 1 070 €) — Gli stessi 16 GB, ma una banda passante superiore (644 GB/s); sul fronte software, ROCm resta meno maturo di CUDA: verifica i tuoi strumenti. La nostra scheda →
Nessuna scheda grafica? Un modello piccolo da 3 a 8B funziona anche sul processore, lentamente: vedere la nostra guida agli LLM senza GPU.
Da 1 200 a 1 500 €: la scheda da 16 GB più veloce
RTX 5070 Ti 16 GB
Scheda grafica da aggiungere a un PC esistente
- Memoria16 GB di GDDR7 dedicati
- Larghezza di banda896 GB/s (il doppio della 5060 Ti)
- Prezzo indicativo≈ 1 300 – 1 400 €
- Fino aStessi modelli della 5060 Ti (16 GB), con una generazione nettamente più veloce
Cosa ci gira (memoria necessaria in Q4)
RiferimentoLa velocità di generazione di un modello denso dipende dalla banda passante: con 896 GB/s, la 5070 Ti raggiunge il doppio della 5060 Ti (448 GB/s) con la stessa memoria.
✓ Migliore rapporto velocità/prezzo con 16 GB · CUDA: tutti gli strumenti e il fine-tuning LoRA funzionano
✗ Sempre 16 GB: stesso limite di dimensione della 5060 Ti · Prezzo della scheda sola, escluso il resto del PC
Guida: quali LLM su una RTX 5070 Ti →Scegli la tua GPU per l’IA locale →
AlternativaRTX 5080 16 GB (≈ 1 700 – 1 850 €) — 960 GB/s, cioè appena il 7 % in più di banda rispetto alla 5070 Ti, a un prezzo nettamente superiore: la memoria rimane di 16 GB.
Da 2.000 a 2.500 €: una macchina completa e silenziosa
Mac mini M5 Pro 24 GB / 512 GB
Macchina completa, macOS
- Memoria24 GB unificati, di cui ≈ 16 GB utilizzabili dalla GPU
- Larghezza di banda307 GB/s
- Prezzo indicativo≈ 2 000 €
- Fino aModelli da 14B eseguiti senza difficoltà
Cosa ci gira (memoria necessaria in Q4)
RiferimentoSu Mac, MLX accelera spesso la generazione: +86 % misurati su un modello 27B (M5 Max, test di un lettore con il nostro protocollo).
✓ Compatto, silenzioso, basso consumo · MLX, Ollama e LM Studio ottimizzati per Apple Silicon
✗ 24 GB diventano presto un limite oltre i 14B · Niente CUDA; memoria non espandibile dopo l'acquisto
Mini-PC GMKtec EVO-X2 64 GB (Ryzen AI Max+ 395)
Macchina completa, Windows o Linux
- Memoria64 GB di memoria unificata condivisa tra CPU e GPU
- Larghezza di banda≈ 212 GB/s
- Fino aModelli della classe 30B senza difficoltà; un 70B in Q4 entra in memoria ma resta lento
Cosa ci gira (memoria necessaria in Q4)
StimaMolto veloce sui modelli MoE (Qwen 3 30B-A3B: da 50 a 100 token/s stimati); un modello denso da 70B scende a 3-5 token/s (stime della nostra scheda, non una misurazione).
✓ 2,7 volte la memoria del Mac mini a un prezzo simile · Ideale per i modelli MoE da 30B
✗ Nessun CUDA né macOS: verificare gli strumenti AMD · Banda passante modesta per i grandi modelli densi
GMKtec: negozio ufficiale europeo (sito in francese), consegna in Francia in media in 5–8 giorni.
Da 3.000 a 3.500 €: da 96 a 128 GB per i modelli 70B
Mac Studio M5 Max 96 GB (GPU a 32 core)
Workstation compatta, macOS · configurazione venduta su Materiel.net (rif. MHL64ZD/A)
- Memoria96 GB di memoria unificata, di cui circa 72 GB utilizzabili dalla GPU
- Larghezza di banda460 GB/s
- Prezzo indicativo≈ 3 000 €
- Fino aModelli 70B in Q4; margine insufficiente per gpt-oss 120B (70 GB)
Cosa ci gira (memoria necessaria in Q4)
Misurazione comparabileSu un MacBook Pro M5 Max con 128 GB (40 core, 614 GB/s): Qwen 3.8 27B a 36,6 token/s in GGUF e 68 in MLX. Aspettati prestazioni leggermente inferiori con 32 core (460 GB/s).
✓ La più veloce tra le macchine da 96-128 GB in questo budget · Silenziosa, ecosistema MLX
✗ Senza CUDA · Memoria non espandibile: scegli la configurazione giusta già al momento dell'acquisto
Mini-PC Minisforum MS-S1 Max 128 GB / 2 TB (Ryzen AI Max+ 395)
Macchina completa, Windows o Linux · due porte 10 GbE, slot PCIe x16
- Memoria128 GB di memoria unificata condivisa tra CPU e GPU
- Larghezza di banda≈ 212 GB/s
- Fino afino a gpt-oss 120B (MoE); 70B caricabile in Q4
Cosa ci gira (memoria necessaria in Q4)
StimaUn modello denso da 70B gira a 3-5 token/s; i modelli MoE sono molto più veloci (stime della nostra scheda Ryzen AI Max, non una misurazione).
✓ Un terzo di memoria in più rispetto al Mac Studio da 96 GB · Carica i modelli più grandi destinati al grande pubblico (gpt-oss 120B)
✗ Metà della larghezza di banda del Mac Studio · Né CUDA né macOS
Da 3 600 a 4 600 €: un PC tower completo, assemblato e testato
PC assemblato Comete IA (RTX 5070 Ti 16 GB)
PC tower assemblato e testato da Materiel.net · Ryzen 7 9800X3D, SSD da 2 TB, Windows 11
- Memoria16 GB di VRAM + 32 GB di RAM DDR5
- Larghezza di banda896 GB/s (scheda grafica)
- Prezzo indicativo≈ 3 650 €
- Fino aModelli da 14B senza problemi, come con la sola scheda
Cosa ci gira (memoria necessaria in Q4)
RiferimentoStessa scheda del livello 1 200-1 500 €: paghi soprattutto un'intera macchina, montata e testata.
✓ Pronto all'uso, senza assemblaggio · Processore e SSD di fascia alta per tutti gli altri tuoi utilizzi
✗ Sempre 16 GB di VRAM · Costo molto superiore a quello di una sola scheda se hai già un PC
PC assemblato Meteora IA (RTX 5080, 64 GB di RAM)
PC tower assemblato e testato da Materiel.net · Ryzen 7 9800X3D, SSD da 2 TB, Windows 11
- Memoria16 GB di VRAM + 64 GB di RAM DDR5
- Larghezza di banda960 GB/s (scheda grafica)
- Fino a14B funziona bene sulla scheda; oltre, parte del modello passa in RAM, molto più lentamente
Cosa ci gira (memoria necessaria in Q4)
RiferimentoI 64 GB di RAM permettono di caricare un MoE come Qwen 3 30B-A3B in parte nella RAM anziché sulla scheda, con una velocità notevolmente ridotta.
✓ Scheda più veloce da 16 GB + 64 GB di RAM · Pronta all'uso, senza assemblaggio
✗ 16 GB di VRAM: nessun modello 32B veloce · Allo stesso prezzo, un mini-PC o un Mac con memoria unificata carica modelli più grandi
In mobilità: PC portatile RTX 5080 o MacBook Pro M5 Max?
Portatile RTX 5080 16 GB
Portatile Windows
- Memoria16 GB di GDDR7 dedicati
- Larghezza di banda≈ da 700 a 900 GB/s a seconda dello chassis
- Prezzo indicativoa partire da ≈ 2 500 €
- Fino aModelli da 14B senza difficoltà, da 24B con poco margine
Cosa ci gira (memoria necessaria in Q4)
RiferimentoStessa logica di una scheda desktop da 16 GB, un po' limitata dai limiti termici del portatile.
✓ CUDA in mobilità · Il portatile IA meno costoso con 16 GB di VRAM
✗ Rumore e riscaldamento durante le generazioni prolungate · Limite di 16 GB
MacBook Pro M5 Max 36 GB
Portatile macOS
- Memoria36 GB unificati, di cui circa 27 GB utilizzabili dalla GPU
- Larghezza di banda460 GB/s
- Prezzo indicativoa partire da 4 199 € (prezzo Apple)
- Fino aClasse 30B in Q4
Cosa ci gira (memoria necessaria in Q4)
MisurazioneNella versione da 128 GB (40 core, alimentazione da rete elettrica): gpt-oss 120B a 79,1 token/s e Qwen 3.8 27B a 68 token/s con MLX (test di un lettore con il nostro protocollo, 16/09/2026).
✓ L'unico portatile che ospita il chip M5 Max · Silenzioso, autonomia
✗ Costoso per 36 GB: per avere 64-128 GB serve una configurazione personalizzata Apple · Niente CUDA
DGX Spark, RTX 5090, Mac Studio M5 Ultra: serve puntare più in alto?
| Macchina | Memoria · banda passante | Prezzo indicativo | Il nostro parere |
|---|---|---|---|
| NVIDIA DGX Spark | 128 GB · 273 GB/s | ≈ 6 100 – 6 600 € | Per l'ecosistema NVIDIA e l'addestramento. In generazione, la sua larghezza di banda (273 GB/s) resta inferiore a quella di un Mac Studio M5 Max e appena superiore a quella di un mini-PC da 128 GB che costa la metà. Stesso chip GB10, con tempi di consegna più brevi: MSI EdgeXpert (128 GB). |
| RTX 5090 | 32 GB GDDR7 | alto | La scheda consumer più veloce: 32 GB per caricare interamente un modello da 30B. Riservata a chi ha un budget elevato, in un PC in grado di alimentarla. |
| Mac Studio M5 Ultra | Da 96 a 512 GB · fino a 1,2 TB/s | a partire da 6.599 € | Per eseguire a buona velocità modelli molto grandi (120B e oltre, MoE giganteschi). |
Dove trovarliMSI EdgeXpert (chip GB10 del DGX Spark, 128 GB)
RTX 5090 32 GB (solo la scheda)
Mac, PC NVIDIA o mini-PC AMD: cosa cambia dal punto di vista software
| Piattaforma | Strumenti | Da sapere |
|---|---|---|
| PC con scheda NVIDIA (CUDA) | Ollama, LM Studio, llama.cpp, vLLM | Tutto funziona, anche l'addestramento (LoRA). La scelta più semplice. |
| Mac Apple Silicon | Ollama, LM Studio, llama.cpp, MLX | MLX accelera spesso la generazione (+86% misurato su un 27B). Niente CUDA. |
| Mini-PC Ryzen AI Max, scheda Radeon | Ollama, LM Studio, llama.cpp (Vulkan o ROCm) | Compatibilità da verificare in base allo strumento; ROCm rimane meno maturo di CUDA. |
Domande frequenti
Qual è il miglior PC per l'IA locale nel 2026?
Dipende dalle dimensioni dei modelli che vuoi utilizzare. Fino a 14B, basta una scheda grafica da 16 GB (RTX 5060 Ti, oppure RTX 5070 Ti per la velocità) in un PC esistente. Per una macchina completa, un Mac mini M5 Pro (14B) o un mini-PC Ryzen AI Max+ 395 da 64 GB (30B). Per i modelli da 70B, servono da 64 a 128 GB di memoria unificata: Mac Studio M5 Max o mini-PC da 128 GB.
Quale scheda grafica scegliere per l'IA locale?
Punta ad almeno 16 GB di VRAM: la RTX 5060 Ti 16 GB per contenere la spesa, la RTX 5070 Ti per la velocità (896 GB/s), la Radeon RX 9070 XT se gli strumenti AMD fanno al caso tuo. Evita le versioni da 8 GB. Dettagli in la nostra guida per scegliere la propria GPU.
Quale mini PC scegliere per l'IA?
Un mini-PC con memoria unificata: Ryzen AI Max+ 395 da 64 GB (GMKtec EVO-X2) o 128 GB (GMKtec EVO-X2 128 GB, Minisforum MS-S1 Max), oppure un Mac mini M5 Pro se vuoi macOS. Un mini-PC classico senza una grande quantità di memoria condivisa può eseguire solo modelli piccoli.
Serve una scheda grafica o un mini-PC con memoria unificata?
La scheda grafica è più veloce (da 448 a 960 GB/s) ma limitata a 16 GB nei prodotti consumer. La memoria unificata (da 64 a 128 GB) permette di caricare modelli molto più grandi, ma la generazione con questi modelli è più lenta (da 212 a 614 GB/s a seconda della macchina). Scegli in base alla dimensione del modello che vuoi usare.
Quanto costa un PC per eseguire un LLM localmente?
Circa 750–850 € per una scheda da 16 GB da aggiungere a un PC esistente, 2.000 € per una macchina completa che fa girare modelli da 14 a 30B e 3.000–3.500 € per modelli da 70B e oltre.
È possibile eseguire un LLM senza scheda grafica?
Sì, i piccoli modelli da 3 a 8B funzionano sul processore con 16 GB di RAM, ma lentamente. Vedi la nostra guida agli LLM senza GPU.
Mac o PC per l'IA locale?
Il Mac offre molta memoria unificata, silenziosità e MLX (+86 % di velocità misurato su un 27B), ma non dispone di CUDA. Un PC NVIDIA offre più velocità per euro speso ed è compatibile con tutto, incluso l'addestramento. Un mini-PC AMD offre la maggiore quantità di memoria a parità di prezzo, con strumenti da verificare.
Quali sono gli svantaggi di un mini-PC per l'IA?
Una larghezza di banda modesta (circa 212 GB/s su Ryzen AI Max+ 395): un modello denso da 70B gira a 3-5 token/s secondo le nostre stime. Nessun supporto CUDA e memoria non espandibile dopo l'acquisto.