Home›Hardware IA›Quale PC per l'IA locale

Quale PC per l'IA locale? I nostri suggerimenti per budget

Per far funzionare un modello di IA in locale (Llama, Qwen, Mistral, gpt-oss…), una macchina si sceglie innanzitutto in base alla memoria, che fissa la dimensione dei modelli, poi in base alla sua banda passante, che ne determina la velocità. Ecco le nostre scelte per ogni budget, con i modelli che funzionano davvero su quelle macchine.

Aggiornato il 05/10/2026 · prezzi indicativi rilevati presso i nostri rivenditori a settembre 2026, soggetti a rapidi cambiamenti

Di Mohamed Meguedmi · dimensioni dei modelli derivanti da il nostro catalogo · la nostra metodologia

In sintesi: meno di 1.000 €, aggiungi una scheda da 16 GB (RTX 5060 Ti) al tuo PC; intorno ai 1.300 €, la RTX 5070 Ti è due volte più veloce a parità di memoria; intorno ai 2.000 €, una macchina completa: Mac mini M5 Pro o mini-PC Ryzen AI Max+ 395 64 GB ; intorno a 3.000-3.500 €, Da 96 a 128 GB di memoria unificata per i modelli da 70B. Oltre questa fascia, una workstation come il DGX Spark (273 GB/s, ≈ da 6.100 a 6.600 €) genera più lentamente di un Mac Studio M5 Max molto meno costoso.

Le nostre scelte a colpo d'occhio

BudgetLa nostra sceltaMemoria per i modelliFino a (Q4)Dove acquistare
Meno di 1.000 €RTX 5060 Ti 16 GB
GPU · ≈ 820 €
16 GB14B senza difficoltà
1 200 – 1 500 €RTX 5070 Ti 16 GB
Scheda grafica · ≈ 1 300 – 1 400 €
16 GB, 2 volte più banda passante14B, più veloce
2 000 – 2 500 €Mac mini M5 Pro 24 GB / 512 GB
Macchina completa · ≈ 2 000 €
≈ 16 GB (su 24)14B
2 000 – 2 500 €Mini-PC GMKtec EVO-X2 64 GB (Ryzen AI Max+ 395)
Macchina completa
64 GB30B senza difficoltà

GMKtec: negozio ufficiale europeo (sito in francese), consegna in Francia in media in 5–8 giorni.

3 000 – 3 500 €Mac Studio M5 Max 96 GB (GPU a 32 core)
Workstation · ≈ 3.000 €
≈ 72 GB (su 96)70B
3 300 – 4 000 €Mini-PC Minisforum MS-S1 Max 128 GB / 2 TB (Ryzen AI Max+ 395)
Macchina completa
128 GBgpt-oss 120B
3 600 – 4 600 €PC assemblato Comete IA (RTX 5070 Ti 16 GB)
PC tower assemblato · ≈ 3 650 €
16 GB (+ 32 GB di RAM)14B senza difficoltà
3 600 – 4 600 €PC assemblato Meteora IA (RTX 5080, 64 GB di RAM)
PC tower assemblato
16 GB (+ 64 GB di RAM)14B; MoE 30B in parte in RAM
PortatilePortatile RTX 5080 16 GB
Portatile · a partire da ≈ 2.500 €
16 GB14B senza difficoltà
PortatileMacBook Pro M5 Max 36 GB
Portatile · a partire da 4.199 € (prezzo Apple)
≈ 27 GB (su 36)classe 30B

Link affiliati — QuelLLM può percepire una commissione sugli acquisti, senza costi aggiuntivi per te, il che non influenza queste raccomandazioni (stabilite in modo indipendente). In qualità di Partner Amazon, QuelLLM realizza un guadagno sugli acquisti che soddisfano i requisiti.

Prima di tutto: di quali dimensioni vuoi che sia il modello da eseguire?

La memoria della macchina deve contenere l'intero modello, più da 1 a 2 GB per il contesto. La tabella indica la memoria necessaria in Q4, la quantizzazione più utilizzata. Su Mac, considera che circa 75 % della memoria unificata è utilizzabile dalla GPU, un po' meno nelle configurazioni di base (≈ 16 GB su 24).
DimensioneEsempiMemoria in Q4Configurazione hardware minima
7-8BLlama 3.1 8B≈ 6 GBScheda da 8 GB o processore (lento)
12-14BGemma 3 12B, Qwen 3 14B7-9 GBScheda da 12-16 GB, Mac da 24 GB
20-24Bgpt-oss 20B, Mistral Small 3.2 24B13-14 GBScheda da 16 GB (al limite)
27-32BGemma 3 27B, Qwen 3 32B, Qwen 3 30B-A3B16-19 GBScheda da 24 a 32 GB, memoria unificata da 36 GB in su
70-72BLlama 3.3 70B Instruct, Qwen 2.5 72B Instruct40-42 GBMemoria unificata da 64 a 128 GB
120B (MoE)gpt-oss 120B≈ 70 GBMemoria unificata 96-128 GB

Un modello MoE (Mixture of Experts) attiva solo una parte dei suoi parametri per ogni parola: è molto più veloce di un modello denso delle stesse dimensioni, ma richiede la stessa quantità di memoria per essere caricato. Sai già quale modello vuoi? Il configuratore verifica se il modello rientra nella memoria disponibile su una macchina.

L'insidia: più memoria non significa più velocità

Per un modello denso, la velocità di generazione dipende soprattutto dalla larghezza di banda della memoria : a ogni parola, il sistema rilegge tutto il modello. Una scheda grafica da 16 GB va quindi più veloce di una workstation da 128 GB… sui modelli che rientrano nei suoi 16 GB.
MacchinaLarghezza di banda
RTX 5080 (16 GB)960 GB/s
RTX 5070 Ti (16 GB)896 GB/s
Radeon RX 9070 XT (16 GB)644 GB/s
Apple M5 Max (36-128 GB)Da 460 a 614 GB/s
RTX 5060 Ti (16 GB)448 GB/s
Mac mini M5 Pro (24-64 GB)307 GB/s
NVIDIA DGX Spark (128 GB)273 GB/s
Ryzen AI Max+ 395 (64-128 GB)≈ 212 GB/s

Misura reale: su un MacBook Pro M5 Max 128 GB, gpt-oss 120B (MoE) produce 79,1 token/s, più velocemente di un modello denso da 27B (36,6 token/s in GGUF), perché attiva solo una piccola parte dei suoi parametri. Vedi il test completo.

Meno di 1.000 €: una scheda da 16 GB per il tuo PC

Hai già un PC desktop? Aggiungere una RTX 5060 Ti 16 GB è il modo più economico per far girare modelli fino a 14 miliardi di parametri senza difficoltà, e un 24B con una quantizzazione spinta. Evita la versione da 8 GB: i modelli 14B non ci stanno più.

RTX 5060 Ti 16 GB

Scheda grafica da aggiungere a un PC esistente

  • Memoria16 GB di GDDR7 dedicati
  • Larghezza di banda448 GB/s
  • Prezzo indicativo≈ 820 €
  • Fino aModelli da 14B senza difficoltà, da 24B con quantizzazione spinta

Cosa ci gira (memoria necessaria in Q4)

RiferimentoUna scheda dedicata resta la soluzione più veloce per euro a parità di dimensione del modello. Non ci sono ancora misure QuelLLM pubblicate per questa scheda.

✓ Il più economico per superare gli 8 GB di VRAM · CUDA: compatibile con Ollama, LM Studio, llama.cpp e vLLM

✗ Limite di 16 GB: non permette di usare comodamente modelli da 32B · Presuppone un PC recente con alimentatore e case compatibili

AlternativaRadeon RX 9070 XT 16 GB (≈ 960 – 1 070 €) — Gli stessi 16 GB, ma una banda passante superiore (644 GB/s); sul fronte software, ROCm resta meno maturo di CUDA: verifica i tuoi strumenti. La nostra scheda →

Nessuna scheda grafica? Un modello piccolo da 3 a 8B funziona anche sul processore, lentamente: vedere la nostra guida agli LLM senza GPU.

Da 1 200 a 1 500 €: la scheda da 16 GB più veloce

La RTX 5070 Ti mantiene 16 GB di memoria ma raddoppia la banda passante (896 GB/s contro 448 GB/s): gli stessi modelli, con una generazione nettamente più veloce. È la scelta giusta per programmare o usare il RAG ogni giorno.

RTX 5070 Ti 16 GB

Scheda grafica da aggiungere a un PC esistente

  • Memoria16 GB di GDDR7 dedicati
  • Larghezza di banda896 GB/s (il doppio della 5060 Ti)
  • Prezzo indicativo≈ 1 300 – 1 400 €
  • Fino aStessi modelli della 5060 Ti (16 GB), con una generazione nettamente più veloce

Cosa ci gira (memoria necessaria in Q4)

RiferimentoLa velocità di generazione di un modello denso dipende dalla banda passante: con 896 GB/s, la 5070 Ti raggiunge il doppio della 5060 Ti (448 GB/s) con la stessa memoria.

✓ Migliore rapporto velocità/prezzo con 16 GB · CUDA: tutti gli strumenti e il fine-tuning LoRA funzionano

✗ Sempre 16 GB: stesso limite di dimensione della 5060 Ti · Prezzo della scheda sola, escluso il resto del PC

AlternativaRTX 5080 16 GB (≈ 1 700 – 1 850 €) — 960 GB/s, cioè appena il 7 % in più di banda rispetto alla 5070 Ti, a un prezzo nettamente superiore: la memoria rimane di 16 GB.

Da 2.000 a 2.500 €: una macchina completa e silenziosa

Non hai un PC da aggiornare? Due macchine complete si contendono questa fascia di budget: il Mac mini M5 Pro 24 GB per macOS e il silenzio, o un mini-PC Ryzen AI Max+ 395 con 64 GB per avere 2,7 volte la memoria e utilizzare i modelli da 30B.

Mac mini M5 Pro 24 GB / 512 GB

Macchina completa, macOS

  • Memoria24 GB unificati, di cui ≈ 16 GB utilizzabili dalla GPU
  • Larghezza di banda307 GB/s
  • Prezzo indicativo≈ 2 000 €
  • Fino aModelli da 14B eseguiti senza difficoltà

Cosa ci gira (memoria necessaria in Q4)

RiferimentoSu Mac, MLX accelera spesso la generazione: +86 % misurati su un modello 27B (M5 Max, test di un lettore con il nostro protocollo).

✓ Compatto, silenzioso, basso consumo · MLX, Ollama e LM Studio ottimizzati per Apple Silicon

✗ 24 GB diventano presto un limite oltre i 14B · Niente CUDA; memoria non espandibile dopo l'acquisto

Mini-PC GMKtec EVO-X2 64 GB (Ryzen AI Max+ 395)

Macchina completa, Windows o Linux

  • Memoria64 GB di memoria unificata condivisa tra CPU e GPU
  • Larghezza di banda≈ 212 GB/s
  • Fino aModelli della classe 30B senza difficoltà; un 70B in Q4 entra in memoria ma resta lento

Cosa ci gira (memoria necessaria in Q4)

StimaMolto veloce sui modelli MoE (Qwen 3 30B-A3B: da 50 a 100 token/s stimati); un modello denso da 70B scende a 3-5 token/s (stime della nostra scheda, non una misurazione).

✓ 2,7 volte la memoria del Mac mini a un prezzo simile · Ideale per i modelli MoE da 30B

✗ Nessun CUDA né macOS: verificare gli strumenti AMD · Banda passante modesta per i grandi modelli densi

GMKtec: negozio ufficiale europeo (sito in francese), consegna in Francia in media in 5–8 giorni.

Da 3.000 a 3.500 €: da 96 a 128 GB per i modelli 70B

Per un modello da 70B (Llama 3.3, Qwen 2.5 72B) o un grande MoE come gpt-oss 120B, servono Da 64 a 128 GB di memoria unificata. Il Mac Studio M5 Max 96 GB genera più velocemente; un mini-PC Ryzen AI Max+ 395 con 128 GB carica modelli più grandi: il Minisforum MS-S1 Max su Amazon, o il GMKtec EVO-X2 128 GB sul negozio ufficiale GMKtec.

Mac Studio M5 Max 96 GB (GPU a 32 core)

Workstation compatta, macOS · configurazione venduta su Materiel.net (rif. MHL64ZD/A)

  • Memoria96 GB di memoria unificata, di cui circa 72 GB utilizzabili dalla GPU
  • Larghezza di banda460 GB/s
  • Prezzo indicativo≈ 3 000 €
  • Fino aModelli 70B in Q4; margine insufficiente per gpt-oss 120B (70 GB)

Cosa ci gira (memoria necessaria in Q4)

Misurazione comparabileSu un MacBook Pro M5 Max con 128 GB (40 core, 614 GB/s): Qwen 3.8 27B a 36,6 token/s in GGUF e 68 in MLX. Aspettati prestazioni leggermente inferiori con 32 core (460 GB/s).

✓ La più veloce tra le macchine da 96-128 GB in questo budget · Silenziosa, ecosistema MLX

✗ Senza CUDA · Memoria non espandibile: scegli la configurazione giusta già al momento dell'acquisto

Mini-PC Minisforum MS-S1 Max 128 GB / 2 TB (Ryzen AI Max+ 395)

Macchina completa, Windows o Linux · due porte 10 GbE, slot PCIe x16

  • Memoria128 GB di memoria unificata condivisa tra CPU e GPU
  • Larghezza di banda≈ 212 GB/s
  • Fino afino a gpt-oss 120B (MoE); 70B caricabile in Q4

Cosa ci gira (memoria necessaria in Q4)

StimaUn modello denso da 70B gira a 3-5 token/s; i modelli MoE sono molto più veloci (stime della nostra scheda Ryzen AI Max, non una misurazione).

✓ Un terzo di memoria in più rispetto al Mac Studio da 96 GB · Carica i modelli più grandi destinati al grande pubblico (gpt-oss 120B)

✗ Metà della larghezza di banda del Mac Studio · Né CUDA né macOS

Da 3 600 a 4 600 €: un PC tower completo, assemblato e testato

Preferisci un PC desktop in formato tower pronto all'uso piuttosto che una scheda da installare? Materiel.net assembla PC dedicati all'IA: il Comete IA (RTX 5070 Ti) e il Meteora IA (RTX 5080, 64 GB di RAM). Mantengono 16 GB di VRAM : modelli delle stesse dimensioni di quelli gestibili con una sola scheda, senza doverla montare.

PC assemblato Comete IA (RTX 5070 Ti 16 GB)

PC tower assemblato e testato da Materiel.net · Ryzen 7 9800X3D, SSD da 2 TB, Windows 11

  • Memoria16 GB di VRAM + 32 GB di RAM DDR5
  • Larghezza di banda896 GB/s (scheda grafica)
  • Prezzo indicativo≈ 3 650 €
  • Fino aModelli da 14B senza problemi, come con la sola scheda

Cosa ci gira (memoria necessaria in Q4)

RiferimentoStessa scheda del livello 1 200-1 500 €: paghi soprattutto un'intera macchina, montata e testata.

✓ Pronto all'uso, senza assemblaggio · Processore e SSD di fascia alta per tutti gli altri tuoi utilizzi

✗ Sempre 16 GB di VRAM · Costo molto superiore a quello di una sola scheda se hai già un PC

PC assemblato Meteora IA (RTX 5080, 64 GB di RAM)

PC tower assemblato e testato da Materiel.net · Ryzen 7 9800X3D, SSD da 2 TB, Windows 11

  • Memoria16 GB di VRAM + 64 GB di RAM DDR5
  • Larghezza di banda960 GB/s (scheda grafica)
  • Fino a14B funziona bene sulla scheda; oltre, parte del modello passa in RAM, molto più lentamente

Cosa ci gira (memoria necessaria in Q4)

RiferimentoI 64 GB di RAM permettono di caricare un MoE come Qwen 3 30B-A3B in parte nella RAM anziché sulla scheda, con una velocità notevolmente ridotta.

✓ Scheda più veloce da 16 GB + 64 GB di RAM · Pronta all'uso, senza assemblaggio

✗ 16 GB di VRAM: nessun modello 32B veloce · Allo stesso prezzo, un mini-PC o un Mac con memoria unificata carica modelli più grandi

In mobilità: PC portatile RTX 5080 o MacBook Pro M5 Max?

Un Portatile RTX 5080 16 GB mantiene CUDA e la velocità di una scheda dedicata, entro i 16 GB. Il MacBook Pro M5 Max offre più memoria e silenzio, ma il vero salto (70B, 120B) passa attraverso le sue configurazioni 64-128 GB, molto più costose.

Portatile RTX 5080 16 GB

Portatile Windows

  • Memoria16 GB di GDDR7 dedicati
  • Larghezza di banda≈ da 700 a 900 GB/s a seconda dello chassis
  • Prezzo indicativoa partire da ≈ 2 500 €
  • Fino aModelli da 14B senza difficoltà, da 24B con poco margine

Cosa ci gira (memoria necessaria in Q4)

RiferimentoStessa logica di una scheda desktop da 16 GB, un po' limitata dai limiti termici del portatile.

✓ CUDA in mobilità · Il portatile IA meno costoso con 16 GB di VRAM

✗ Rumore e riscaldamento durante le generazioni prolungate · Limite di 16 GB

MacBook Pro M5 Max 36 GB

Portatile macOS

  • Memoria36 GB unificati, di cui circa 27 GB utilizzabili dalla GPU
  • Larghezza di banda460 GB/s
  • Prezzo indicativoa partire da 4 199 € (prezzo Apple)
  • Fino aClasse 30B in Q4

Cosa ci gira (memoria necessaria in Q4)

MisurazioneNella versione da 128 GB (40 core, alimentazione da rete elettrica): gpt-oss 120B a 79,1 token/s e Qwen 3.8 27B a 68 token/s con MLX (test di un lettore con il nostro protocollo, 16/09/2026).

✓ L'unico portatile che ospita il chip M5 Max · Silenzioso, autonomia

✗ Costoso per 36 GB: per avere 64-128 GB serve una configurazione personalizzata Apple · Niente CUDA

DGX Spark, RTX 5090, Mac Studio M5 Ultra: serve puntare più in alto?

Raramente per un uso personale. Queste macchine hanno ciascuna una propria utilità specifica, ma oggi non offrono il miglior rapporto tra prezzo e velocità di generazione.
MacchinaMemoria · banda passantePrezzo indicativoIl nostro parere
NVIDIA DGX Spark128 GB · 273 GB/s≈ 6 100 – 6 600 €Per l'ecosistema NVIDIA e l'addestramento. In generazione, la sua larghezza di banda (273 GB/s) resta inferiore a quella di un Mac Studio M5 Max e appena superiore a quella di un mini-PC da 128 GB che costa la metà. Stesso chip GB10, con tempi di consegna più brevi: MSI EdgeXpert (128 GB).
RTX 509032 GB GDDR7altoLa scheda consumer più veloce: 32 GB per caricare interamente un modello da 30B. Riservata a chi ha un budget elevato, in un PC in grado di alimentarla.
Mac Studio M5 UltraDa 96 a 512 GB · fino a 1,2 TB/sa partire da 6.599 €Per eseguire a buona velocità modelli molto grandi (120B e oltre, MoE giganteschi).

Dove trovarliMSI EdgeXpert (chip GB10 del DGX Spark, 128 GB)

RTX 5090 32 GB (solo la scheda)

Mac, PC NVIDIA o mini-PC AMD: cosa cambia dal punto di vista software

PiattaformaStrumentiDa sapere
PC con scheda NVIDIA (CUDA)Ollama, LM Studio, llama.cpp, vLLMTutto funziona, anche l'addestramento (LoRA). La scelta più semplice.
Mac Apple SiliconOllama, LM Studio, llama.cpp, MLXMLX accelera spesso la generazione (+86% misurato su un 27B). Niente CUDA.
Mini-PC Ryzen AI Max, scheda RadeonOllama, LM Studio, llama.cpp (Vulkan o ROCm)Compatibilità da verificare in base allo strumento; ROCm rimane meno maturo di CUDA.

Domande frequenti

Qual è il miglior PC per l'IA locale nel 2026?

Dipende dalle dimensioni dei modelli che vuoi utilizzare. Fino a 14B, basta una scheda grafica da 16 GB (RTX 5060 Ti, oppure RTX 5070 Ti per la velocità) in un PC esistente. Per una macchina completa, un Mac mini M5 Pro (14B) o un mini-PC Ryzen AI Max+ 395 da 64 GB (30B). Per i modelli da 70B, servono da 64 a 128 GB di memoria unificata: Mac Studio M5 Max o mini-PC da 128 GB.

Quale scheda grafica scegliere per l'IA locale?

Punta ad almeno 16 GB di VRAM: la RTX 5060 Ti 16 GB per contenere la spesa, la RTX 5070 Ti per la velocità (896 GB/s), la Radeon RX 9070 XT se gli strumenti AMD fanno al caso tuo. Evita le versioni da 8 GB. Dettagli in la nostra guida per scegliere la propria GPU.

Quale mini PC scegliere per l'IA?

Un mini-PC con memoria unificata: Ryzen AI Max+ 395 da 64 GB (GMKtec EVO-X2) o 128 GB (GMKtec EVO-X2 128 GB, Minisforum MS-S1 Max), oppure un Mac mini M5 Pro se vuoi macOS. Un mini-PC classico senza una grande quantità di memoria condivisa può eseguire solo modelli piccoli.

Serve una scheda grafica o un mini-PC con memoria unificata?

La scheda grafica è più veloce (da 448 a 960 GB/s) ma limitata a 16 GB nei prodotti consumer. La memoria unificata (da 64 a 128 GB) permette di caricare modelli molto più grandi, ma la generazione con questi modelli è più lenta (da 212 a 614 GB/s a seconda della macchina). Scegli in base alla dimensione del modello che vuoi usare.

Quanto costa un PC per eseguire un LLM localmente?

Circa 750–850 € per una scheda da 16 GB da aggiungere a un PC esistente, 2.000 € per una macchina completa che fa girare modelli da 14 a 30B e 3.000–3.500 € per modelli da 70B e oltre.

È possibile eseguire un LLM senza scheda grafica?

Sì, i piccoli modelli da 3 a 8B funzionano sul processore con 16 GB di RAM, ma lentamente. Vedi la nostra guida agli LLM senza GPU.

Mac o PC per l'IA locale?

Il Mac offre molta memoria unificata, silenziosità e MLX (+86 % di velocità misurato su un 27B), ma non dispone di CUDA. Un PC NVIDIA offre più velocità per euro speso ed è compatibile con tutto, incluso l'addestramento. Un mini-PC AMD offre la maggiore quantità di memoria a parità di prezzo, con strumenti da verificare.

Quali sono gli svantaggi di un mini-PC per l'IA?

Una larghezza di banda modesta (circa 212 GB/s su Ryzen AI Max+ 395): un modello denso da 70B gira a 3-5 token/s secondo le nostre stime. Nessun supporto CUDA e memoria non espandibile dopo l'acquisto.

Per approfondire