Guida di riferimento · 16 capitoli · asset inclusi · aggiornamenti a vita

Il tuo Mac, al massimo
per l'IA locale

Il kit Mac : Il manuale di riferimento per sfruttare al massimo l'IA locale su Apple Silicon — memoria unificata, MLX a confronto con GGUF, il modello giusto per il TUO chip (da M1 a M5/M6), e tutto ciò che macOS offre in più. Per un Mac appena acquistato come per un Mac del 2020 mai spinto al massimo.

Ottieni il kit — 24 €

24 € · pagamento unico · aggiornamenti a vita inclusi

✓ Accesso immediato (online + PDF) ✓ Pagamento sicuro Stripe ✓ Rimborsabile per 30 giorni ✓ Edizione in continua evoluzione (aggiornamenti a vita)

Vedi i 16 capitoli →

Che cos'è il kit Mac?

Il kit per Mac è un manuale di riferimento composto da 16 capitoli, 21 file di asset e uno spazio online a vita. Si rivolge agli utenti di Mac Apple Silicon (chip da M1 a M5/M6, da 8 a 512 GB di memoria unificata), con tre profili hardware di riferimento che vanno dal MacBook Air 16 GB al Mac Studio 64 GB. Risultato: un primo LLM accelerato con Metal in meno di un'ora, poi memoria unificata e MLX sfruttati al massimo.

  • 16 capitoli e 21 file di asset: tabella principale, script launchd, Comandi Rapidi.
  • Copre i chip da M1 a M5/M6, con memoria unificata da 8 a 512 GB.
  • Configurazioni di riferimento: MacBook Air M2 16 GB, Mac mini M4 24 GB, Studio 64 GB.
  • Strumenti trattati: LM Studio (MLX), Ollama, Open WebUI e mlx-lm.
  • Primo LLM funzionante con accelerazione Metal attiva in meno di un'ora.
  • 24 € con un pagamento unico, aggiornamenti a vita inclusi, soddisfatti o rimborsati entro 30 giorni.
Copertina del kit Mac — Mac

✓ Per te se…

hai un Mac Apple Silicon (MacBook Air/Pro, Mac mini, Mac Studio, iMac — chip da M1 a M5/M6) e vuoi capire e sfruttare le sue caratteristiche specifiche per l'IA locale: la memoria unificata, MLX, il modello giusto per il tuo chip specifico, le prestazioni reali — sia che tu sia agli inizi, sia che tu stia già eseguendo Ollama/LM Studio senza essere sicuro di sfruttarli al massimo.

✗ Non per te se…

sei su PC o Linux (è il kit IA Locale, multi-OS) o cerchi un copilota che scriva codice nel tuo editor (è il kit Copiloto Locale, con un solo rimando a Xcode in questo kit, mai un capitolo dedicato).

24 € Pagamento unico · aggiornamenti inclusi a vita Garanzia di 30 giorni — se non sei convinto, basta un'email per ottenere il rimborso Esclusivamente per Mac — Apple Silicon (da M1 a M5/M6), Da 8 a 512 GB di memoria unificata coperti.

Perché puoi farci affidamento

Questa guida è scritta e aggiornata da il team di QuelLLM.fr — 250 modelli indicizzati, 335 guide in francese, aggiornati ogni mattina — che gestisce anche piattaforme IA in produzione tutto l'anno (RegulIA, IAPRO). Ogni comando, modello, versione e prezzo di questo manuale viene verificato confrontandolo con la fonte ufficiale alla data di pubblicazione (Apple, Ollama, LM Studio, Hugging Face) e ricontrollato a ogni edizione, sui profili delle macchine che utilizziamo personalmente. Ciò che leggi è sintetizzato, verificato, senza giri di parole. Non è una raccolta di tutorial trovati a caso. Chi c'è dietro QuelLLM →

Il problema

Un Mac Apple Silicon non è non semplicemente un PC con un logo per l'IA locale: memoria unificata condivisa con la GPU, MLX a confronto con GGUF, un limite di memoria predefinito che puoi aumentare se sai come fare — la maggior parte delle guide tratta il tuo Mac come una macchina qualsiasi e tu lasci inutilizzata metà della sua capacità.

Le informazioni sul Mac sono già disponibili, distribuite tra 21 guide gratuite del sito — una per ogni macchina, una per MLX, una per la memoria unificata. Il kit è IL metodo di riferimento: la tabella dei modelli per chip E per fascia di RAM riunita in un unico posto, gli script launchd e Comandi Rapidi pronti da incollare, il metodo per misurare le prestazioni della tua macchina — non una raccolta di tutorial da confrontare e integrare da solo.

MLX natif vs GGUF sul tuo Mac

Lo stesso modello, due formati — la scelta spiegata peggio nelle guide gratuite esistenti. Il confronto onesto:

MLX (Apple)GGUF (llama.cpp/Ollama)
Pensato per la memoria unificata fin dall'inizioSìCompatibile, non nativo
Disponibilità dei modelliuna buona parte, non tuttoLa quasi totalità
Compatibilità multi-OS (PC, Linux)No — solo Apple SiliconSì
Passa a LM StudioUn'opzione graficaUn'opzione grafica
Riga di comando (mlx-lm)Opzionale, per andare oltreCLI nativa di Ollama

Il kit ti dice in quali casi MLX offre un vero vantaggio e in quali casi GGUF rimane la scelta giusta (modello assente in MLX, necessità di compatibilità multi-OS) — mai un dogma, un metodo.

Cosa ottieni

Strumenti: LM Studio (MLX), Ollama, Open WebUI, mlx-lm. Esclusivamente su Mac Apple Silicon, 0 €/mese una volta installato.

I 16 capitoli del kit

Dal primo LLM al 100 % Metal in meno di un'ora alla lista di prezzo 2026. Niente da saltare: ogni capitolo punta ai successivi.

Parte 1 — Il Mac, un'architettura a parte per l'IA locale
  • Il tuo primo LLM 100 % Metal in un'ora
  • Memoria unificata: cosa cambia davvero (e come forzare il limite della GPU)
  • MLX o GGUF: quale scegliere, e in quali casi conta
  • La tabella di riferimento: quale modello per QUALE chip, con quanta RAM
Parte 2 — Installare, configurare, misurare
  • Quantizzazione e contesto lungo: calcola il tuo vero budget di memoria
  • Prestazioni reali: token/secondo, prefill, calore, batteria
  • Ollama come servizio: avvio automatico, rete, log (launchd)
  • Open WebUI su Mac: Docker Desktop, OrbStack o nativo
Parte 3 — Cosa se ne fa su un Mac
  • La visione in locale, accelerata nativamente da Metal
  • Modelli in francese e inglese: ciò che funziona davvero bene su Apple Silicon
  • Comandi Rapidi, Automator, Spotlight: l'IA locale in macOS
  • Il tuo Mac mini come server IA per tutta la casa
Parte 4 — Rendere affidabile, scegliere, durare
  • Confidenzialità: iCloud, Spotlight, telemetria — ciò che rimane veramente locale
  • Quando fallisce su Mac: Metal, memoria, swap
  • Quale Mac comprare per l'IA locale nel 2026
  • Questa edizione è datata — e dopo?

Edizione in continuo aggiornamento: ogni aggiornamento arricchisce questo sommario (registro degli aggiornamenti datato, cap. 16) — non dovrai riacquistare nulla alla prossima versione.

Il tuo primo LLM 100 % Metal in un'ora, passo dopo passo

Che tu parta da zero o abbia già uno strumento installato, la guida ti accompagna fino a un risultato concreto:

1 · LM Studio o Ollama

2 comandi se parti da zero (rimando completo al kit IA Locale), altrimenti passiamo direttamente al seguito.

2 · Verifica che Metal sia attivo

Monitoraggio Attività (scheda GPU) deve mostrare la GPU al lavoro, senza un passaggio silenzioso alla CPU.

3 · Il modello giusto per il tuo chip

La tabella del Capitolo 4 ti indica quale scegliere in base al tuo chip e alla tua memoria unificata — non serve indovinare.

4 · Vai oltre

Memoria unificata, MLX, launchd, Comandi Rapidi — tutto è nei capitoli successivi.

24 €
Pagamento unico · aggiornamenti a vita inclusi
Un solo acquisto per sfruttare al massimo il tuo Mac, oggi e con ogni nuovo chip Apple. Poi 0 €/mese, per sempre.
Soddisfatti o rimborsati entro 30 giorni — basta un'email.
  • Spazio online a vita: 16 capitoli sempre aggiornati (sommario completo più su)
  • La guida PDF + i 21 file di risorse (tabella principale, script launchd/Comandi Rapidi, checklist) da scaricare
  • I 3 profili di riferimento (Air, mini, Studio) e l'albero di risoluzione dei problemi Metal/memoria/swap
  • Tutte le edizioni future, a vita — appaiono nel tuo spazio
  • Accesso immediato dopo il pagamento, chiave d'accesso inviata via email
Prendo il kit — 24 €

Pagamento sicuro con Stripe. Fattura PDF inviata automaticamente · IVA non applicabile, art. 293 B del CGI.

Prendo il kit — 24 €

La verità detta con franchezza

Un Mac Apple Silicon ha punti di forza concreti per l'IA locale — e limiti altrettanto concreti che nessuna tabella sui chip può risolvere. Una guida di riferimento ti deve un quadro onesto come questo:

Il Mac guadagnamemoria unificata condivisa con la GPU (nessuna VRAM separata da sovradimensionare) · silenziosità ed efficienza energetica · MLX ottimizzato per l'architettura · tutte le funzionalità di macOS disponibili (Comandi Rapidi, launchd, Spotlight)
Dove si bloccanon tutti i modelli sono disponibili in MLX · non è possibile aggiungere memoria dopo l'acquisto (a differenza di una scheda GPU dedicata) · throttling termico effettivo su un MacBook senza ventola durante la generazione continua

Alla fine, tu sai fare

Edizione vivante — come tutti i kit QuelLLM

« Aggiornamenti a vita » non è uno slogan: l'hardware Apple cambia due volte all'anno, MLX evolve rapidamente — il kit segue l'ecosistema per te, senza farti pagare di nuovo.

CHANGELOG.md — incluso nel pack

v2026.09 (edizione attuale) — prima edizione del kit: 16 capitoli, 3 configurazioni di riferimento (MacBook Air M2 16 GB, Mac mini M4 24 GB, Mac Studio M4 Max 64 GB), 21 file di asset, tabella principale GB→modello per chip.

Le prossime edizioni (nuovi chip Apple, nuovi modelli, MLX che evolve) vengono aggiunte qui, con la data, e arrivano nel tuo spazio senza che tu debba pagare di nuovo.

Domande frequenti

Qual è la differenza rispetto al kit IA Locale?

Il kit IA Locale ti installa un assistente IA privato su Mac O su PC e si rivolge al grande pubblico su più sistemi operativi — rimane volutamente generale. Questo kit parte dal presupposto che tu abbia già un Mac e approfondisce tutto ciò che è specifico di Apple Silicon: la memoria unificata e il relativo limite per la GPU, MLX rispetto a GGUF, la tabella dei modelli per chip E per fascia di RAM (da M1 a M5/M6, da 8 a 512 GB), il metodo per misurare le tue prestazioni reali e ciò che macOS offre in più (Comandi Rapidi, launchd, Spotlight, Apple Intelligence). I due si completano, non si sovrappongono.

Funziona solo su Mac Apple Silicon ?

Sì, esclusivamente — un Mac con chip da M1 a M5/M6 (MacBook Air, MacBook Pro, Mac mini, Mac Studio, iMac). Un Mac Intel non ha memoria unificata né MLX, quindi la maggior parte del kit non è applicabile. Se usi un PC (o se non sai ancora quale Mac acquistare), inizia dal kit IA Locale o dal Cap. 15 di questo kit (griglia per decidere quale acquistare, senza link a siti di vendita).

Serve essere sviluppatore per seguire questo kit?

No. Il kit parte dal presupposto che tu sappia installare un'app e trascinare un file — i comandi del Terminale (memoria unificata al Cap. 2, launchd al Cap. 7) vengono spiegati la prima volta che compaiono, senza mai darne per acquisita la conoscenza. Alcune sezioni sono più avanzate di quelle rivolte al grande pubblico (mlx-lm da riga di comando) — sempre presentate come «per andare oltre», mai un prerequisito per proseguire.

Quanto tempo per ottenere un risultato?

Il tuo primo LLM con l'accelerazione Metal attiva, in meno di un'ora — sia che tu parta da zero (2 comandi, rimando al kit IA Locale per l'installazione completa), sia che tu abbia già LM Studio/Ollama e voglia solo verificare che Metal sia davvero in funzione, senza un ripiego silenzioso sulla CPU.

Qual è la differenza rispetto alle guide Mac gratuite del sito?

Le guide gratuite di QuelLLM.fr trattano ogni macchina o ogni argomento separatamente (una guida per ciascun Mac, MLX vs llama.cpp da un lato, ottimizzazione della memoria dall'altro). Il kit riunisce il percorso completo, fornisce la tabella dei modelli per chip × RAM che nessuna guida singola offre in forma aggiornata e completa, gli script launchd/Comandi Rapidi pronti da incollare, e rimane aggiornato a vita rispetto a un hardware Apple che cambia due volte all'anno — ciò che si paga sono l'assemblaggio e gli asset, non l'informazione grezza.

È veramente gratuito una volta installato?

Sì: il modello gira sulla tua macchina, 0 €/mese, senza account, senza limiti. Il kit stesso (guida + asset + spazio online a vita) è un acquisto unico.

Posso davvero configurare un server IA con il mio Mac mini?

Sì, il Capitolo 12 tratta proprio questo: impedire la sospensione, far funzionare Ollama come un vero servizio (launchd, Cap. 7) che rimane operativo dopo un riavvio e accedervi dagli altri dispositivi di casa — con un riferimento onesto alle opzioni di accesso remoto (VPN personale come Tailscale), senza presentare tutto questo come una checklist di sicurezza aziendale.

Le mie conversazioni e i miei modelli rimangono privati sul mio Mac?

È il principio dell'esecuzione in locale: nessun dato viene inviato all'esterno una volta caricato il modello. Il Capitolo 13 va oltre la lista di controllo generica: verifica nello specifico che iCloud Drive non sincronizzi silenziosamente la tua cartella dei modelli o delle conversazioni e che cosa indicizzi Spotlight nelle cartelle e nelle aree circostanti.

E se non mi soddisfa dopo l'acquisto?

Soddisfatti o rimborsati entro 30 giorni, basta un'email, senza giustificazioni — come per tutti i kit QuelLLM.

In che forma viene fornito e per quanto tempo?

Accesso immediato dopo il pagamento: il tuo spazio online a vita (sempre con l'ultima edizione) + il PDF e il file zip degli asset da scaricare, tuoi per sempre. Gli aggiornamenti futuri (nuovi chip Apple, nuovi modelli) compaiono nel tuo spazio senza dover pagare di nuovo.

Posso avere una fattura?

Sì, automaticamente. Appena effettuato il pagamento (Stripe), ricevi via email la tua ricevuta Stripe e la tua fattura PDF emessa da Falcon Consulting (editore di QuelLLM), con i tuoi dati — indica la tua azienda o il tuo SIREN nel campo previsto al momento del pagamento. IVA non applicabile, art. 293 B del CGI.

E se voglio più kit QuelLLM?

Il bundle « tutti i kit, a vita » include tutti i kit attuali e futuri per 49 €. Se hai già acquistato un kit a 24 €, l'upgrade al bundle ti costa 25 €, non 49 € — il coupon viene applicato automaticamente.

Che cos'è MLX su Mac?

MLX è il framework di calcolo di Apple, progettato fin dall'inizio per la memoria unificata dei chip Apple Silicon, a differenza di GGUF (llama.cpp/Ollama), che rimane compatibile ma non nativo. Il kit Mac spiega in quali casi MLX offre un vero vantaggio in termini di prestazioni e quando GGUF resta la scelta giusta (modello non disponibile in MLX, necessità di usare più sistemi operativi).

Ollama funziona bene su Mac?

Sì, nativamente e con l'accelerazione Metal della GPU — insieme a LM Studio, è una delle due possibilità per eseguire un LLM su Apple Silicon. Il kit Mac va oltre l'installazione di base: verificare che Metal funzioni davvero (senza un ripiego silenzioso sulla CPU) ed eseguire Ollama come un vero servizio tramite launchd.

Quale modello IA scegliere su Mac?

Dipende dal tuo chip e dalla tua memoria unificata, non da una regola unica: un Mac da 16 GB non punta allo stesso modello di un Mac Studio da 64 GB. Il kit Mac fornisce una tabella di riferimento che incrocia ogni chip (da M1 a M5/M6) e ogni taglio di RAM con il modello e il formato (MLX o GGUF) adatti.

Sfrutta al massimo il tuo Mac.

La guida di riferimento, dal tuo primo LLM con accelerazione Metal al server IA per tutta la famiglia sul tuo Mac mini — memoria unificata, MLX, il modello giusto per il tuo chip. Oggi, non «un giorno».

Ottieni il kit — 24 €