Intermedio 13 minCreativo

Scrivere un romanzo con un LLM locale: metodo e strumenti

Scrivere un libro con un'IA non significa chiederle «scrivimi un romanzo» e copiare il risultato: ne viene fuori una poltiglia tiepida. Il vero uso è come partner di scrittura: un modello che ti aiuta a dare struttura, a sbloccare una scena e a mantenere coerenti i tuoi personaggi per centinaia di pagine. Questa guida mostra come farlo con un LLM locale, con il quale il tuo manoscritto non lascia mai il tuo computer e nessun filtro di stile viene a smussare la tua prosa.

Di Léa B.·Agg. 2026-09-16·Testato su Windows, macOS e Linux

#Perché scrivere un libro con un'IA locale anziché nel cloud

Un romanzo significa mesi di lavoro e un testo che non vuoi vedere acquisito per addestrare un modello, né rifiutato perché una scena è violenta, cupa o sessualmente esplicita. I servizi cloud rivolti al grande pubblico applicano filtri sui contenuti e politiche d'uso che, per la narrativa per adulti o il noir, interrompono regolarmente lo slancio nel momento peggiore.

Un LLM eseguito sul tuo computer risolve entrambi i problemi in un colpo solo. Il testo rimane sul tuo disco: nessuna bozza, nessuno spoiler della tua trama viene inviato a terzi. E scegli tu il modello — comprese versioni senza restrizioni di stile che scrivono la scena che chiedi, senza sermoni né rifiuti. Un vantaggio non trascurabile per un progetto lungo: nessun abbonamento mensile né contatore di token che continua a girare mentre perfezioni il capitolo 12 per la decima volta.

Confidenzialità totale
Il tuo manoscritto, le tue note e la tua trama rimangono in locale. Nulla viene utilizzato per addestrare un modello di terzi.
Nessun filtro di stile
Narrativa per adulti, horror, thriller crudi: il modello scrive ciò che la scena richiede senza blocchi morali.
Costo fisso
Una volta ammortizzato l'hardware, puoi generare tutte le bozze che vuoi senza pagare in base all'utilizzo.
Disponibile offline
Scrivere in treno o in uno chalet senza rete, senza dipendere da una connessione.

#Prerequisiti: hardware e stack

Il kit IA Locale

Il tuo ChatGPT privato e gratuito sulla tua macchina in 1 ora — LM Studio, Ollama, Open WebUI, i tuoi documenti, senza cloud.

  • Spazio online a vita
  • PDF + file
  • Aggiornamenti a vita

La scrittura creativa richiede meno risorse della programmazione: non hai bisogno del modello più grande sul mercato, ma di un modello che sappia usare bene il francese e mantenere il tono. Una GPU da 12 GB (RTX 3060 12GB, RTX 4070) fa già girare comodamente un modello da 12B–14B in Q4_K_M, la taglia giusta per la prosa. Con 16 GB (RTX 4080) sali a un modello da 24B, mentre 24 GB (RTX 4090) o un Mac M4 Pro con memoria unificata aprono la porta ai modelli da 32B, capaci di rendere molte più sfumature nelle scene lunghe.

3B (~2 GB VRAM)
Supporto rapido, riformulazioni. Troppo breve per mantenere un tono su un capitolo.
7B (~5 GB)
Utilizzabile per il brainstorming e per scene brevi su una configurazione modesta da 8 GB.
14B (~9 GB)
Il punto di equilibrio per una GPU da 12 GB: prosa corretta in francese, buona memoria del contesto.
32B (~19 GB)
Il miglior compromesso tra qualità ed esecuzione in locale per un romanzo serio, a partire da 24 GB di VRAM o da un Mac con memoria unificata.

Sul piano software, lo stack più semplice resta Ollama come daemon (in ascolto su http://localhost:11434), affiancato da un’interfaccia. Open WebUI o LM Studio vanno bene per conversare liberamente; per un vero progetto di scrittura, un’interfaccia pensata per i personaggi e il contesto persistente come SillyTavern cambia la vita (vedi «Per andare oltre»).

Terminale — installare Ollama e scaricare un modello creativo
# Linux / macOS
curl -fsSL https://ollama.com/install.sh | sh

# Un modèle solide en français, quantifié Q4_K_M
ollama pull mistral-small

# Vérifier qu'il répond
ollama run mistral-small "Écris la première phrase d'un polar qui se passe à Marseille."

#Quali modelli locali scrivono meglio in francese

Non tutti i modelli offrono la stessa qualità nel francese letterario. Molti, addestrati principalmente sull'inglese, producono una prosa corretta ma piatta, con costruzioni ricalcate sull'inglese (« Elle prit une profonde respiration »). Per la narrativa, privilegia modelli noti per le loro capacità multilingui e varianti affinate per la scrittura.

Mistral Small (24B)
Di origine francese, eccellente nel francese idiomatico. La prima scelta predefinita per un romanzo: mantiene bene il tono anche su testi lunghi.
Gemma (12B–27B)
Buona prosa, stile piuttosto flessibile; il 27B se la cava più che bene nei dialoghi se hai abbastanza VRAM.
Qwen (14B–32B)
Molto capace, gestisce bene i contesti lunghi; il francese è buono ma a volte meno «naturale» di quello di Mistral.
Varianti creative ottenute tramite fine-tuning
Su Ollama e Hugging Face, modelli derivati di tipo « writer » / « storyteller » o privi di censura scrivono scene che i modelli di base rifiutano. Da testare in base al tuo genere letterario.
→
Prova prima di impegnarti
Dai lo stesso brano di prova a due o tre modelli (una scena con un dialogo teso, un paragrafo descrittivo) e confronta i risultati a orecchio. La «migliore» prosa è soggettiva: il modello che si adatta alla tua voce conta più di quello che vince i benchmark.
i
Il contesto, il fattore decisivo
Per un romanzo, la dimensione della finestra di contesto conta quanto la qualità della prosa: è questa a determinare quanto testo il modello «vede» in una volta. Punta ad almeno 16k–32k token di contesto utilizzabile e lascia VRAM libera per questo contesto, oltre a quella occupata dai pesi del modello.

#Il metodo capitolo per capitolo che funziona

L'errore da principiante è chiedere il romanzo intero. Un LLM non ha una visione d'insieme; eccelle nei compiti brevi e ben delimitati. Il metodo che funziona procede dal generale al particolare, per livelli, mantenendo sempre il controllo sulla struttura. Tu resti l'autore; il modello è uno sceneggiatore e una prima bozza a cui detti la direzione.

  1. 01
    1. Il pitch e il tema
    Formula in due frasi il tema, il genere e la posta in gioco centrale. Chiedi al modello tre o quattro varianti di frase d'apertura per trovare il taglio, poi definisci definitivamente il tuo. È la tua bussola per tutto il resto.
  2. 02
    2. La struttura in atti, poi in capitoli
    Chiedi una suddivisione in 3 atti, poi sviluppa ogni atto in capitoli, con una frase di riepilogo («cosa succede») e una frase sulla posta in gioco («cosa cambia») per ciascun capitolo. Ottieni una sinossi di una pagina che riscrivi a tuo piacimento.
  3. 03
    3. Il beat sheet del capitolo
    Prima di scrivere un capitolo, scomponi il riassunto in 5–8 « beat »: le micro-fasi della scena. Il modello lavora molto meglio su un beat preciso (« Léa scopre la lettera e capisce la menzogna ») che su « scrivi il capitolo 4 ».
  4. 04
    4. La prima stesura, beat per beat
    Genera la prosa un beat alla volta, fornendo il beat corrente e un promemoria sui personaggi presenti. Correggi o rigenera ogni passaggio prima di passare al successivo: cuci il capitolo, non lo riversi tutto in un blocco.
  5. 05
    5. La revisione
    Una volta scritto il capitolo a mano e con l'aiuto della macchina, chiedi al modello una revisione mirata: «individua le ripetizioni», «rendi i dialoghi più concisi», «segnala le incoerenze nella cronologia». Non accettare mai una riscrittura globale alla cieca.
!
Il modello non ha gusto, tu sì
Un LLM produce rapidamente testo « accettabile » e insipido. Se approvi tutto ciò che propone, il tuo romanzo avrà una voce generica. Tratta ogni output come una bozza preparata da un assistente: conserva l'idea, riscrivi la formulazione con le tue parole. La voce sei tu.

#Schede dei personaggi e bibbia dell'universo narrativo

La coerenza di un romanzo si basa su una «bibbia»: un documento di riferimento che tu e il modello consultate costantemente. Senza di essa, la tua protagonista avrà gli occhi verdi al capitolo 2 e blu al capitolo 18, e il bar all'angolo cambierà nome. Crea questo documento già quando prepari la scaletta e arricchiscilo man mano.

Scheda del personaggio
Nome, età, aspetto descritto in 3 tratti, voce/tic linguistici, obiettivo, ferita interiore, arco narrativo. Mezza pagina per ogni personaggio principale.
Bibbia dell'universo
Luoghi ricorrenti, regole del mondo (se fantascienza/fantasy), cronologia degli eventi, oggetti importanti.
Glossario del tono
Due o tre frasi di esempio della «voce del libro» che incolli all'inizio del prompt per mantenere lo stile coerente a ogni sessione.
Diario di continuità
Una riga per capitolo: ciò che sa ogni personaggio a quel punto della storia. Evita le rivelazioni che arrivano troppo presto o due volte.
esempio — fiche-personnage.md
# Léa Vasseur
- Âge : 34 ans, journaliste d'investigation à Marseille
- Apparence : cheveux courts châtains, cicatrice au sourcil gauche, toujours en veste militaire
- Voix : phrases courtes, ironie sèche, jure quand elle est acculée
- Objectif : prouver l'innocence de son frère
- Blessure : culpabilité de ne pas l'avoir cru à l'époque
- Arc : de la méfiance systématique vers la capacité à faire confiance
- Sait au ch.4 : que la lettre existe. Ignore encore : qui l'a écrite.

In pratica, incolli la scheda o le schede pertinenti all'inizio del tuo prompt prima di scrivere una scena («Ecco i personaggi presenti… scrivi ora il beat successivo»). È un RAG artigianale: inserisci il contesto utile al momento giusto anziché sperare che il modello «si ricordi».

#Mantenere la coerenza su 300 pagine

Ecco la vera sfida tecnica. Un romanzo di 300 pagine contiene circa 120.000 parole, ovvero circa 180.000 token — ben oltre la finestra di contesto di qualsiasi modello locale. Il modello non può «aver letto» tutto il tuo libro. La coerenza non deriva quindi dalla sua memoria, ma dalla tua disciplina nel fornirgli di nuovo il contesto giusto per ogni scena.

Riepiloghi in cascata
Mantieni un riassunto di una frase per capitolo. Prima di scrivere il capitolo N, fornisci i riassunti dei capitoli precedenti anziché il loro testo integrale: dieci righe bastano a inquadrare l'azione.
Finestra scorrevole
Dai al modello il testo completo dei precedenti 1 a 2 capitoli (per il tono e le transizioni) + i riassunti del resto. Tenete la continuità immediata senza esplodere il contesto.
Bibbia all'inizio del prompt
Le schede dei personaggi presenti nella scena, sistematicamente. È questo che evita le incoerenze nei dettagli.
Verifiche mirate
Periodicamente, fai rileggere un capitolo al modello con una domanda precisa: «C'è una contraddizione con questo riassunto della trama?» Individua bene gli errori fattuali quando la domanda è ben circoscritta.
i
Riassumere significa comprimere
Il tuo diario dei riassunti è un indice compresso del tuo romanzo. Più è preciso (chi sa cosa, a che punto è ogni trama secondaria), più il modello rimane coerente. Aggiornalo alla fine di ogni capitolo, mai dopo: sono cinque minuti che ti risparmiano ore di lavoro per rimediare.

#Impostazioni creative: temperatura e sampling

I parametri di campionamento modificano radicalmente il risultato. Per la narrativa, si cerca varietà e sorpresa senza cadere nell'incoerenza. La temperatura è la leva principale: se è bassa (0,3–0,6), produce una prosa sobria e prevedibile, utile per i passaggi tecnici o i riassunti; se è alta (0,8–1,1), libera l'inventiva, al prezzo di un rischio maggiore di digressioni.

Temperatura 0,8–1,0
L'intervallo giusto per la prosa narrativa: vivace senza diventare incoerente. Scendi a 0,5 per i riassunti e le schede.
top-p 0,9–0,95
Mantiene una buona varietà lessicale eliminando le scelte davvero improbabili.
Penalità di ripetizione ~1,1
Per contrastare la tendenza degli LLM a riutilizzare le stesse formulazioni. Non aumentare troppo il valore, altrimenti lo stile diventa artificiale.
Lunghezza della risposta
Limita la generazione alla lunghezza di un beat o di una scena; le risposte molto lunghe deviano e perdono il filo.
Ollama — opzioni di generazione per la narrativa
{
  "model": "mistral-small",
  "prompt": "[fiches + beat]",
  "options": {
    "temperature": 0.9,
    "top_p": 0.92,
    "repeat_penalty": 1.1,
    "num_ctx": 16384
  }
}

#Insidie comuni e risoluzione dei problemi

Prosa « IA » riconoscibile
Tic stilistici come «un brivido gli percorse la schiena», «qualunque cosa lo aspettasse». Vietali esplicitamente nel prompt e riscrivi a mano le frasi caratteristiche.
Il modello riassume invece di scrivere
Liquida una scena in tre frasi. Chiedi esplicitamente di «mostrare, non raccontare», scena per scena, con dialoghi e dettagli sensoriali.
Perdita del filo nel mezzo del capitolo
Segno che il contesto supera il limite. Riduci la lunghezza delle scene, aumenta num_ctx se la VRAM lo permette oppure riparti con un riassunto chiaro.
Rifiuto o edulcorazione
Un modello di base limita una scena cruda. Passa a una variante creativa sottoposta a fine-tuning, oppure riformula definendo chiaramente il contesto di finzione.
Tutti i personaggi parlano nello stesso modo
Inserisci la scheda « voce » di ogni personaggio e chiedi dialoghi differenziati; rileggi ad alta voce per individuare l'uniformità.

#Per approfondire

Per trasformare questo metodo in un comodo laboratorio di scrittura, tre guide del sito completano questa guida. SillyTavern offre un'interfaccia pensata per personaggi persistenti e contesti lunghi, ideale per gestire schede e scene senza dover reincollare tutto a mano. La guida sulla temperatura e sul sampling spiega come dosare con precisione la creatività del tuo modello. E se parti da zero in termini di hardware e installazione, la guida all'installazione di un LLM locale ti aiuta a configurare correttamente lo stack Ollama prima di iniziare il tuo romanzo.


Questa guida ti è stata utile?

Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.