Guida di riferimento · 16 capitoli · asset inclusi · aggiornamenti a vita
Il tuo Mac, al massimo
per l'IA locale
Il kit Mac : Il manuale di riferimento per sfruttare al massimo l'IA locale su Apple Silicon — memoria unificata, MLX a confronto con GGUF, il modello giusto per il TUO chip (da M1 a M5/M6), e tutto ciò che macOS offre in più. Per un Mac appena acquistato come per un Mac del 2020 mai spinto al massimo.
Ottieni il kit — 24 €24 € · pagamento unico · aggiornamenti a vita inclusi
Che cos'è il kit Mac?
Il kit per Mac è un manuale di riferimento composto da 16 capitoli, 21 file di asset e uno spazio online a vita. Si rivolge agli utenti di Mac Apple Silicon (chip da M1 a M5/M6, da 8 a 512 GB di memoria unificata), con tre profili hardware di riferimento che vanno dal MacBook Air 16 GB al Mac Studio 64 GB. Risultato: un primo LLM accelerato con Metal in meno di un'ora, poi memoria unificata e MLX sfruttati al massimo.
- 16 capitoli e 21 file di asset: tabella principale, script launchd, Comandi Rapidi.
- Copre i chip da M1 a M5/M6, con memoria unificata da 8 a 512 GB.
- Configurazioni di riferimento: MacBook Air M2 16 GB, Mac mini M4 24 GB, Studio 64 GB.
- Strumenti trattati: LM Studio (MLX), Ollama, Open WebUI e mlx-lm.
- Primo LLM funzionante con accelerazione Metal attiva in meno di un'ora.
- 24 € con un pagamento unico, aggiornamenti a vita inclusi, soddisfatti o rimborsati entro 30 giorni.
✓ Per te se…
hai un Mac Apple Silicon (MacBook Air/Pro, Mac mini, Mac Studio, iMac — chip da M1 a M5/M6) e vuoi capire e sfruttare le sue caratteristiche specifiche per l'IA locale: la memoria unificata, MLX, il modello giusto per il tuo chip specifico, le prestazioni reali — sia che tu sia agli inizi, sia che tu stia già eseguendo Ollama/LM Studio senza essere sicuro di sfruttarli al massimo.
✗ Non per te se…
sei su PC o Linux (è il kit IA Locale, multi-OS) o cerchi un copilota che scriva codice nel tuo editor (è il kit Copiloto Locale, con un solo rimando a Xcode in questo kit, mai un capitolo dedicato).
Perché puoi farci affidamento
Questa guida è scritta e aggiornata da il team di QuelLLM.fr — 250 modelli indicizzati, 335 guide in francese, aggiornati ogni mattina — che gestisce anche piattaforme IA in produzione tutto l'anno (RegulIA, IAPRO). Ogni comando, modello, versione e prezzo di questo manuale viene verificato confrontandolo con la fonte ufficiale alla data di pubblicazione (Apple, Ollama, LM Studio, Hugging Face) e ricontrollato a ogni edizione, sui profili delle macchine che utilizziamo personalmente. Ciò che leggi è sintetizzato, verificato, senza giri di parole. Non è una raccolta di tutorial trovati a caso. Chi c'è dietro QuelLLM →
Il problema
Un Mac Apple Silicon non è non semplicemente un PC con un logo per l'IA locale: memoria unificata condivisa con la GPU, MLX a confronto con GGUF, un limite di memoria predefinito che puoi aumentare se sai come fare — la maggior parte delle guide tratta il tuo Mac come una macchina qualsiasi e tu lasci inutilizzata metà della sua capacità.
Le informazioni sul Mac sono già disponibili, distribuite tra 21 guide gratuite del sito — una per ogni macchina, una per MLX, una per la memoria unificata. Il kit è IL metodo di riferimento: la tabella dei modelli per chip E per fascia di RAM riunita in un unico posto, gli script launchd e Comandi Rapidi pronti da incollare, il metodo per misurare le prestazioni della tua macchina — non una raccolta di tutorial da confrontare e integrare da solo.
MLX natif vs GGUF sul tuo Mac
Lo stesso modello, due formati — la scelta spiegata peggio nelle guide gratuite esistenti. Il confronto onesto:
| MLX (Apple) | GGUF (llama.cpp/Ollama) | |
|---|---|---|
| Pensato per la memoria unificata fin dall'inizio | Sì | Compatibile, non nativo |
| Disponibilità dei modelli | una buona parte, non tutto | La quasi totalità |
| Compatibilità multi-OS (PC, Linux) | No — solo Apple Silicon | Sì |
| Passa a LM Studio | Un'opzione grafica | Un'opzione grafica |
Riga di comando (mlx-lm) | Opzionale, per andare oltre | CLI nativa di Ollama |
Il kit ti dice in quali casi MLX offre un vero vantaggio e in quali casi GGUF rimane la scelta giusta (modello assente in MLX, necessità di compatibilità multi-OS) — mai un dogma, un metodo.
Cosa ottieni
- Il tuo spazio online, per sempre — i 16 capitoli leggibili online, sempre l'ultima edizione.
- Guida completa in formato PDF — lo stesso contenuto, tuo per sempre, offline.
- 21 file di asset pronti all'uso — la tabella principale GB→modello per chip (
.md+.csv), la scheda di riferimento per la memoria unificata (comandisysctl+ LaunchDaemon), l'albero decisionale MLX/GGUF, il.plistlaunchd per eseguire Ollama come servizio, il compose di Open WebUI adattato al Mac, l'esportazione di Comandi Rapidi e altro. - 3 profili di riferimento — MacBook Air M2 16 GB (il tuo computer attuale, se ne hai uno — non più venduto nuovo, cfr. Cap. 15), Mac mini M4 24 GB, Mac Studio M4 Max 64 GB: ritrovi la tua configurazione in ogni capitolo, mai un esempio che non ti riguardi.
- Il capitolo « quando qualcosa non funziona su Mac » — un albero decisionale per ciascun sintomo (Metal non rilevato, sistema inutilizzabile durante una generazione, modello che non si carica, throttling).
- Edizione in continuo aggiornamento — ogni aggiornamento (nuovi chip Apple, nuovi modelli, evoluzioni di MLX) appare nel tuo spazio, a vita, senza dover pagare di nuovo.
Strumenti: LM Studio (MLX), Ollama, Open WebUI, mlx-lm. Esclusivamente su Mac Apple Silicon, 0 €/mese una volta installato.
I 16 capitoli del kit
Dal primo LLM al 100 % Metal in meno di un'ora alla lista di prezzo 2026. Niente da saltare: ogni capitolo punta ai successivi.
- Il tuo primo LLM 100 % Metal in un'ora
- Memoria unificata: cosa cambia davvero (e come forzare il limite della GPU)
- MLX o GGUF: quale scegliere, e in quali casi conta
- La tabella di riferimento: quale modello per QUALE chip, con quanta RAM
- Quantizzazione e contesto lungo: calcola il tuo vero budget di memoria
- Prestazioni reali: token/secondo, prefill, calore, batteria
- Ollama come servizio: avvio automatico, rete, log (launchd)
- Open WebUI su Mac: Docker Desktop, OrbStack o nativo
- La visione in locale, accelerata nativamente da Metal
- Modelli in francese e inglese: ciò che funziona davvero bene su Apple Silicon
- Comandi Rapidi, Automator, Spotlight: l'IA locale in macOS
- Il tuo Mac mini come server IA per tutta la casa
- Confidenzialità: iCloud, Spotlight, telemetria — ciò che rimane veramente locale
- Quando fallisce su Mac: Metal, memoria, swap
- Quale Mac comprare per l'IA locale nel 2026
- Questa edizione è datata — e dopo?
Edizione in continuo aggiornamento: ogni aggiornamento arricchisce questo sommario (registro degli aggiornamenti datato, cap. 16) — non dovrai riacquistare nulla alla prossima versione.
Il tuo primo LLM 100 % Metal in un'ora, passo dopo passo
Che tu parta da zero o abbia già uno strumento installato, la guida ti accompagna fino a un risultato concreto:
1 · LM Studio o Ollama
2 comandi se parti da zero (rimando completo al kit IA Locale), altrimenti passiamo direttamente al seguito.
2 · Verifica che Metal sia attivo
Monitoraggio Attività (scheda GPU) deve mostrare la GPU al lavoro, senza un passaggio silenzioso alla CPU.
3 · Il modello giusto per il tuo chip
La tabella del Capitolo 4 ti indica quale scegliere in base al tuo chip e alla tua memoria unificata — non serve indovinare.
4 · Vai oltre
Memoria unificata, MLX, launchd, Comandi Rapidi — tutto è nei capitoli successivi.
- Spazio online a vita: 16 capitoli sempre aggiornati (sommario completo più su)
- La guida PDF + i 21 file di risorse (tabella principale, script launchd/Comandi Rapidi, checklist) da scaricare
- I 3 profili di riferimento (Air, mini, Studio) e l'albero di risoluzione dei problemi Metal/memoria/swap
- Tutte le edizioni future, a vita — appaiono nel tuo spazio
- Accesso immediato dopo il pagamento, chiave d'accesso inviata via email
Pagamento sicuro con Stripe. Fattura PDF inviata automaticamente · IVA non applicabile, art. 293 B del CGI.
La verità detta con franchezza
Un Mac Apple Silicon ha punti di forza concreti per l'IA locale — e limiti altrettanto concreti che nessuna tabella sui chip può risolvere. Una guida di riferimento ti deve un quadro onesto come questo:
Alla fine, tu sai fare
- Spiegare la memoria unificata e aumentare, se necessario, il limite assegnato alla GPU (
iogpu.wired_limit_mb). - Scegliere tra MLX e GGUF in base al modello, senza gergo inutile, e avviarli entrambi se necessario.
- Trovare il modello giusto per il TUO chip e la TUA memoria unificata con una sola lettura della tabella principale.
- Far funzionare Ollama come un vero servizio macOS (launchd) e trasformare un Mac mini in un server familiare.
- Verificare di persona che niente esce dal tuo Mac (iCloud Drive, Spotlight) — non limitarsi a crederci sulla parola.
- Diagnosticare e riparare da solo i guasti specifici dei Mac (Metal, memoria, swap).
Edizione vivante — come tutti i kit QuelLLM
« Aggiornamenti a vita » non è uno slogan: l'hardware Apple cambia due volte all'anno, MLX evolve rapidamente — il kit segue l'ecosistema per te, senza farti pagare di nuovo.
v2026.09 (edizione attuale) — prima edizione del kit: 16 capitoli, 3 configurazioni di riferimento (MacBook Air M2 16 GB, Mac mini M4 24 GB, Mac Studio M4 Max 64 GB), 21 file di asset, tabella principale GB→modello per chip.
Le prossime edizioni (nuovi chip Apple, nuovi modelli, MLX che evolve) vengono aggiunte qui, con la data, e arrivano nel tuo spazio senza che tu debba pagare di nuovo.
Domande frequenti
Qual è la differenza rispetto al kit IA Locale?
Il kit IA Locale ti installa un assistente IA privato su Mac O su PC e si rivolge al grande pubblico su più sistemi operativi — rimane volutamente generale. Questo kit parte dal presupposto che tu abbia già un Mac e approfondisce tutto ciò che è specifico di Apple Silicon: la memoria unificata e il relativo limite per la GPU, MLX rispetto a GGUF, la tabella dei modelli per chip E per fascia di RAM (da M1 a M5/M6, da 8 a 512 GB), il metodo per misurare le tue prestazioni reali e ciò che macOS offre in più (Comandi Rapidi, launchd, Spotlight, Apple Intelligence). I due si completano, non si sovrappongono.
Funziona solo su Mac Apple Silicon ?
Sì, esclusivamente — un Mac con chip da M1 a M5/M6 (MacBook Air, MacBook Pro, Mac mini, Mac Studio, iMac). Un Mac Intel non ha memoria unificata né MLX, quindi la maggior parte del kit non è applicabile. Se usi un PC (o se non sai ancora quale Mac acquistare), inizia dal kit IA Locale o dal Cap. 15 di questo kit (griglia per decidere quale acquistare, senza link a siti di vendita).
Serve essere sviluppatore per seguire questo kit?
No. Il kit parte dal presupposto che tu sappia installare un'app e trascinare un file — i comandi del Terminale (memoria unificata al Cap. 2, launchd al Cap. 7) vengono spiegati la prima volta che compaiono, senza mai darne per acquisita la conoscenza. Alcune sezioni sono più avanzate di quelle rivolte al grande pubblico (mlx-lm da riga di comando) — sempre presentate come «per andare oltre», mai un prerequisito per proseguire.
Quanto tempo per ottenere un risultato?
Il tuo primo LLM con l'accelerazione Metal attiva, in meno di un'ora — sia che tu parta da zero (2 comandi, rimando al kit IA Locale per l'installazione completa), sia che tu abbia già LM Studio/Ollama e voglia solo verificare che Metal sia davvero in funzione, senza un ripiego silenzioso sulla CPU.
Qual è la differenza rispetto alle guide Mac gratuite del sito?
Le guide gratuite di QuelLLM.fr trattano ogni macchina o ogni argomento separatamente (una guida per ciascun Mac, MLX vs llama.cpp da un lato, ottimizzazione della memoria dall'altro). Il kit riunisce il percorso completo, fornisce la tabella dei modelli per chip × RAM che nessuna guida singola offre in forma aggiornata e completa, gli script launchd/Comandi Rapidi pronti da incollare, e rimane aggiornato a vita rispetto a un hardware Apple che cambia due volte all'anno — ciò che si paga sono l'assemblaggio e gli asset, non l'informazione grezza.
È veramente gratuito una volta installato?
Sì: il modello gira sulla tua macchina, 0 €/mese, senza account, senza limiti. Il kit stesso (guida + asset + spazio online a vita) è un acquisto unico.
Posso davvero configurare un server IA con il mio Mac mini?
Sì, il Capitolo 12 tratta proprio questo: impedire la sospensione, far funzionare Ollama come un vero servizio (launchd, Cap. 7) che rimane operativo dopo un riavvio e accedervi dagli altri dispositivi di casa — con un riferimento onesto alle opzioni di accesso remoto (VPN personale come Tailscale), senza presentare tutto questo come una checklist di sicurezza aziendale.
Le mie conversazioni e i miei modelli rimangono privati sul mio Mac?
È il principio dell'esecuzione in locale: nessun dato viene inviato all'esterno una volta caricato il modello. Il Capitolo 13 va oltre la lista di controllo generica: verifica nello specifico che iCloud Drive non sincronizzi silenziosamente la tua cartella dei modelli o delle conversazioni e che cosa indicizzi Spotlight nelle cartelle e nelle aree circostanti.
E se non mi soddisfa dopo l'acquisto?
Soddisfatti o rimborsati entro 30 giorni, basta un'email, senza giustificazioni — come per tutti i kit QuelLLM.
In che forma viene fornito e per quanto tempo?
Accesso immediato dopo il pagamento: il tuo spazio online a vita (sempre con l'ultima edizione) + il PDF e il file zip degli asset da scaricare, tuoi per sempre. Gli aggiornamenti futuri (nuovi chip Apple, nuovi modelli) compaiono nel tuo spazio senza dover pagare di nuovo.
Posso avere una fattura?
Sì, automaticamente. Appena effettuato il pagamento (Stripe), ricevi via email la tua ricevuta Stripe e la tua fattura PDF emessa da Falcon Consulting (editore di QuelLLM), con i tuoi dati — indica la tua azienda o il tuo SIREN nel campo previsto al momento del pagamento. IVA non applicabile, art. 293 B del CGI.
E se voglio più kit QuelLLM?
Il bundle « tutti i kit, a vita » include tutti i kit attuali e futuri per 49 €. Se hai già acquistato un kit a 24 €, l'upgrade al bundle ti costa 25 €, non 49 € — il coupon viene applicato automaticamente.
Che cos'è MLX su Mac?
MLX è il framework di calcolo di Apple, progettato fin dall'inizio per la memoria unificata dei chip Apple Silicon, a differenza di GGUF (llama.cpp/Ollama), che rimane compatibile ma non nativo. Il kit Mac spiega in quali casi MLX offre un vero vantaggio in termini di prestazioni e quando GGUF resta la scelta giusta (modello non disponibile in MLX, necessità di usare più sistemi operativi).
Ollama funziona bene su Mac?
Sì, nativamente e con l'accelerazione Metal della GPU — insieme a LM Studio, è una delle due possibilità per eseguire un LLM su Apple Silicon. Il kit Mac va oltre l'installazione di base: verificare che Metal funzioni davvero (senza un ripiego silenzioso sulla CPU) ed eseguire Ollama come un vero servizio tramite launchd.
Quale modello IA scegliere su Mac?
Dipende dal tuo chip e dalla tua memoria unificata, non da una regola unica: un Mac da 16 GB non punta allo stesso modello di un Mac Studio da 64 GB. Il kit Mac fornisce una tabella di riferimento che incrocia ogni chip (da M1 a M5/M6) e ogni taglio di RAM con il modello e il formato (MLX o GGUF) adatti.
Sfrutta al massimo il tuo Mac.
La guida di riferimento, dal tuo primo LLM con accelerazione Metal al server IA per tutta la famiglia sul tuo Mac mini — memoria unificata, MLX, il modello giusto per il tuo chip. Oggi, non «un giorno».
Ottieni il kit — 24 €