Stable Diffusion in locale: installazione e modelli
Stable Diffusion è una famiglia di modelli per immagini a pesi aperti, non un'applicazione: la si esegue in un'interfaccia locale. Per iniziare, scegli SDXL (file da 6,94 GB, 8 GB di VRAM per lavorare comodamente) in Fooocus, in ComfyUI Desktop o, su Mac, in Draw Things. SD 1.5 è adatto alle schede di fascia bassa; SD 3.5, annunciato il 22 ottobre 2024, alle schede da 12 GB e oltre. Le famiglie più recenti, come Flux o Z-Image, si usano soprattutto tramite ComfyUI.
Stability AI ha annunciato il rilascio pubblico di Stable Diffusion il 22 agosto 2022: un modello che trasforma un testo in un'immagine sul tuo computer, senza account né limiti alla quantità di immagini generate. Al 28 settembre 2026, il nome comprende tre generazioni di modelli, quattro o cinque possibili interfacce e licenze diverse tra loro. Questa guida ti aiuta a scegliere una versione e un'interfaccia, a installare tutto su Windows, Mac o Linux e a capire quali usi delle immagini sono consentiti.
#Che cos'è Stable Diffusion?
Stable Diffusion è un modello di diffusione latente. Parte da un'immagine composta da puro rumore e ne rimuove il rumore passo dopo passo, guidato dal tuo testo, fino a far emergere un'immagine coerente. Il calcolo avviene in uno spazio compresso, detto latente, il che spiega perché basti una scheda grafica di fascia consumer laddove i primi modelli di diffusione richiedevano un centro di calcolo.
Ciò che lo ha reso famoso non è la sua qualità intrinseca, ma la sua apertura. Al momento della pubblicazione nel 2022, Stability AI ha scelto la licenza CreativeML OpenRAIL-M, che descrive come «permissiva» e che autorizza usi sia commerciali sia non commerciali: i pesi si possono scaricare, modificare e riaddestrare. Esistono migliaia di varianti specializzate. Stable Diffusion non è un'applicazione: è un file di modello che esegui nell'interfaccia di tua scelta.
Il nome può trarre in inganno sul piano terminologico. Il repository di riferimento di SD 1.5 su Hugging Face si presenta oggi come un mirror del vecchio repository di RunwayML, deprecato e senza legami con questa società. Dal 2024, inoltre, i modelli aperti per la generazione di immagini più discussi provengono da altri laboratori: Flux, Qwen Image o Z-Image. Funzionano nelle stesse interfacce, ma non portano il nome Stable Diffusion.
#Versioni disponibili e quale scegliere
Immagini e video IA in locale, senza limiti: ComfyUI, Flux, Z-Image, Wan 2.2 sulla tua GPU o sul tuo Mac — workflow pronti da caricare, quadro legale incluso.
- Spazio online a vita
- PDF + file
- Aggiornamenti a vita
| Versione | Data di uscita | File principale | Risoluzione nativa | VRAM con un buon margine | Da ricordare |
|---|---|---|---|---|---|
| SD 1.5 | 2022 | 4,27 GB (v1-5-pruned-emaonly) | 512 × 512 | Da 4 a 6 GB | Leggero, con un'enorme raccolta di varianti e di LoRA. Dettagli e mani migliorabili. |
| SDXL 1.0 | luglio 2023 | 6,94 GB (sd_xl_base_1.0) | 1024 × 1024 | 8 GB: Stability AI annuncia un funzionamento corretto sulle schede da 8 GB | Il giusto punto di partenza: qualità nettamente superiore, ecosistema maturo. |
| SD 3.5 | 22 ottobre 2024 | Medium: 2,5 miliardi di parametri; Large: 8,1 miliardi; Large Turbo: versione a 4 passi | Medium: da 0,25 a 2 megapixel; Large: 1 megapixel | Medium: 9,9 GB esclusi gli encoder di testo (Stability AI). Large: più di 16 GB a 16 bit (nostro calcolo) | Maggiore aderenza al prompt. Licenza diversa, vedere più sotto. |
Due dettagli evitano errori di acquisto o di download. Innanzitutto, SD 1.5 è disponibile in due file: v1-5-pruned-emaonly.safetensors (4,27 GB), che la scheda del modello descrive come adatto all'inferenza e con un consumo inferiore di VRAM, e v1-5-pruned.safetensors (7,7 GB), destinato al riaddestramento. Per generare immagini, scegli il primo. Inoltre, SD 3.5 Large, con i suoi 8,1 miliardi di parametri, non va valutato sulla base della scheda di Medium: non contare di usarlo su una scheda da 8 GB.
Se sei alle prime armi con una scheda da 8 GB, inizia con SDXL: offre il miglior equilibrio tra qualità, velocità e documentazione disponibile. Con 12-16 GB, considera anche i modelli recenti di ComfyUI: il suo README dichiara il supporto nativo per Flux.1, Flux.2, Qwen Image e Z-Image.
#L'hardware necessario
| Il tuo hardware | Ciò che funziona bene |
|---|---|
| Scheda NVIDIA da 4 a 6 GB (GTX 1660, RTX 2060, RTX 3050) | SD 1.5. Fooocus, basato su SDXL, indica come requisiti minimi 4 GB di VRAM e 8 GB di RAM, facendo affidamento sulla memoria virtuale di Windows: lento, ma possibile. |
| Scheda NVIDIA da 8 GB (RTX 3060 Ti, RTX 4060, RTX 5060) | SDXL senza difficoltà, soglia annunciata da Stability AI |
| Scheda NVIDIA da 12 a 16 GB (RTX 3060 12 GB, RTX 4070, RTX 5070 Ti) | SDXL con LoRA e ingrandimento, SD 3.5 Medium, Z-Image Turbo (16 GB secondo la scheda), Flux in FP8 |
| GPU AMD recente (RX 7000, RX 9000) | Buono su Linux con ROCm; su Windows, supporto ROCm ufficiale in ComfyUI Desktop da gennaio 2026 |
| Mac Apple Silicon | Qualsiasi chip M: la memoria unificata funge da VRAM. Più lento di una scheda NVIDIA di fascia comparabile. |
| Nessuna scheda grafica | Tecnicamente possibile, ma molto più lento: da riservare ai test |
Prevedi anche lo spazio su disco. Un solo file SDXL pesa 6,94 GB, e le collezioni di LoRA e varianti si espandono velocemente. Fooocus consiglia di avere almeno 40 GB liberi su ogni disco se incontri l'errore « RuntimeError: CPUAllocator ».
#Quale interfaccia installare
| Interfaccia | Per chi | Punti di forza | Limiti |
|---|---|---|---|
| Fooocus | Novizi | Un campo di testo, un pulsante, impostazioni predefinite curate; meno di tre clic tra il download e la prima immagine, secondo il suo README | Solo SDXL: il progetto riceve un supporto a lungo termine limitato, con sole correzioni di bug |
| Forge (repository di lllyasviel) | Utenti dell'interfaccia a schede | L'interfaccia di AUTOMATIC1111, con un consumo di memoria inferiore e supporto per Flux | Nessun commit sul branch principale da giugno 2025; lo sviluppo prosegue tramite fork come Forge Neo |
| AUTOMATIC1111 | Chi segue vecchi tutorial | L'interfaccia storica, la più documentata | Ultima versione pubblicata a febbraio 2025, Flux non supportato |
| ComfyUI | Utenti avanzati e curiosi | Supporto nativo per modelli recenti, workflow riproducibili, progetto molto attivo | Curva di apprendimento |
| Draw Things | Mac, iPhone, iPad | Applicazione nativa, versione gratuita che calcola localmente e offline, addestramento di LoRA sull'apparecchio | Solo ecosistema Apple; sono disponibili offerte cloud a pagamento opzionali, da evitare se vuoi mantenere tutto al 100 % in locale |
- Fooocus: installarlo e generare la prima immagine
- ComfyUI: installazione e primi passi
- AUTOMATIC1111: installare Stable Diffusion WebUI
- Panorama: generare immagini localmente
#Il percorso più breve per sistema
- 01Windows con una scheda NVIDIAIl più veloce: Fooocus. Scarica l'archivio dalla pagina GitHub ufficiale, decomprimilo e avvia run.bat. Al primo avvio, i modelli vengono scaricati in Fooocus\models\checkpoints. Per uno strumento che tenga il passo con i nuovi modelli, installa invece ComfyUI Desktop, consigliato ai nuovi utenti dal README di ComfyUI.
- 02Scheda RTX 50: verifica PyTorchGli archivi tutto-in-uno di Forge indicano CUDA 12.1 e PyTorch 2.3.1 come versione consigliata. Tuttavia, le schede RTX 50 richiedono una versione recente di PyTorch: un collaboratore di AUTOMATIC1111 menziona PyTorch 2.7.0 come prima versione ufficiale a supportarle. Su una RTX 50, preferisci ComfyUI, la cui documentazione richiede CUDA 13.0 per le schede NVIDIA recenti.
- 03Mac Apple SiliconInstalla Draw Things dall'App Store: la versione gratuita esegue i calcoli in locale e offline, senza riga di comando. Non attivare le sue opzioni cloud se vuoi che nulla lasci il Mac. ComfyUI Desktop esiste anche per macOS su Apple Silicon.
- 04Linux, o scheda AMDInstallazione manuale di ComfyUI: clonazione del repository, ambiente Python, PyTorch in versione CUDA o ROCm a seconda della scheda. La procedura dettagliata è nella nostra guida a ComfyUI. Fooocus offre anche un'installazione Linux tramite Anaconda.
- 05Verificare che la GPU sia in usoDurante la generazione, il comando nvidia-smi deve mostrare la VRAM occupata e l'utilizzo della GPU vicino al 100 %. Se la generazione dell'immagine richiede diversi minuti, l'interfaccia viene eseguita sul processore: la causa è quasi sempre una versione di PyTorch inadatta.
#Dove trovare i modelli e quali evitare
Due fonti dominano. Hugging Face ospita i modelli ufficiali dei laboratori. Civitai riunisce le varianti della comunità: modelli affinati, LoRA, stili. Un LoRA è un piccolo file che aggiunge uno stile o un soggetto a un modello base senza sostituirlo. Deve corrispondere alla giusta famiglia: un LoRA SDXL non funziona su SD 1.5.
#Scrivere un prompt che funziona
- Descrivi, non ordinare
- Questi modelli non seguono le istruzioni. « Ritratto di una donna anziana, luce proveniente da una finestra, obiettivo da 85 mm, profondità di campo ridotta » funziona; « fammi una bella foto » no.
- Scrivi in inglese
- La scheda di SD 1.5 indica «Language(s): English» e un encoder di testo CLIP ViT-L/14 con parametri congelati. Il francese viene compreso, ma con meno sfumature.
- Argomento, poi contesto, poi stile
- L'ordine conta: ciò che viene prima pesa di più.
- Prompt negativo
- Elenca ciò che non vuoi vedere. Utile soprattutto in SD 1.5 e SDXL; verifica sulla scheda di un modello recente se lo tiene in considerazione.
- Mantieni il seed
- Stesso seed, stesse impostazioni, stessa immagine. Per confrontare due prompt, fissa il seed e modifica solo una cosa alla volta.
#Licenze e uso commerciale
| Modello | Licenza | Uso commerciale delle immagini |
|---|---|---|
| SD 1.5 | CreativeML OpenRAIL-M | Autorizzato: Stability AI la descrive come permissiva per gli usi commerciali e non commerciali, con restrizioni etiche sull’uso elencate nella licenza |
| SDXL 1.0 | CreativeML OpenRAIL++-M | Autorizzato, stessi principi |
| SD 3.5 | Stability AI Community License | Gratuito per un uso non commerciale, e per un uso commerciale fino a 1 milione di dollari di fatturato annuo; oltre, contattare Stability AI per una licenza aziendale. Conservi la proprietà delle immagini generate. |
La licenza del modello non risolve tutto. Il diritto d'autore su un'immagine generata e l'utilizzo dell'immagine di una persona reale dipendono dalle leggi del tuo paese, non dalla licenza del software. Questa guida descrive le licenze pubblicate dai rispettivi autori e non costituisce consulenza legale.
- Il kit Immagini IA: impostazioni per scheda grafica e workflow pronti all'uso
- Fonte: l'annuncio di Stable Diffusion 3.5 e della sua licenza
- Fonte: l'annuncio del rilascio pubblico del 2022
#FAQ
Stable Diffusion è gratuito?+
È possibile usare Stable Diffusion senza scheda grafica?+
Quale versione scegliere tra SD 1.5, SDXL e SD 3.5?+
Le mie immagini rimangono private?+
Stable Diffusion o Flux?+
È possibile usare Stable Diffusion su Mac?+
È possibile vendere le immagini generate?+
Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.