Intermedio 12 minLM Studio

LM Studio Bionic : cos'è e a cosa serve ?

LM Studio Bionic è l'applicazione basata su agenti che LM Studio ha separato dalla sua app classica nel luglio 2026. Mentre LM Studio «storico» resta incentrato sulla chat e sul server API, Bionic aggiunge progetti agentici (Code e Work), l'analisi di documenti (PDF, fogli di calcolo, Word) e una tastiera vocale Voxtral con trascrizione 100 % locale. Questa guida presenta l'app nel suo insieme, spiega cosa resta sulla tua macchina e cosa viene eventualmente inviato nel cloud e descrive nel dettaglio le impostazioni che contano.

Di Mohamed Meguedmi·Agg. 2026-09-05·Testato su Windows, macOS e Linux
i
In breve
LM Studio Bionic è l'applicazione agente che LM Studio ha estratta dall'app classica nel luglio 2026. · Aggiunge progetti Code (sviluppo) e Work (analisi di documenti PDF, Excel, Word), più un tastiera vocale Voxtral per la trasmissione locale del 100 %. · Un modello da 7B a 14B in Q4_K_M basta per pilotare l'agente (circa 5 a 9 GB di VRAM). · Il modo device mantiene tutto localmente; il modo cloud sposta l'inferenza e esce i dati — da verificare prima di contenuti sensibili.

#Che cos'è LM Studio Bionic?

Bionic è un'applicazione distinta, sviluppata dallo stesso team di LM Studio. Anziché accumulare funzionalità agentiche nell'app di chat esistente, lo sviluppatore ha scelto di creare un prodotto separato, orientato a «fare cose» piuttosto che a «conversare». L'idea: un agente locale capace di leggere i tuoi file, scrivere codice in un progetto e mantenere un contesto di lavoro persistente, senza inviare per impostazione predefinita i tuoi dati a un servizio di terze parti.

In pratica, la parola chiave lm studio bionic indica questa app agente: apri un progetto, le assegni un compito (analizzare una cartella di PDF, rifattorizzare un pezzo di codice, riassumere un foglio di calcolo) e il modello locale esegue una serie di passaggi, concatenando lettura dei file, ragionamento e scrittura. Il motore di inferenza resta quello che conosci da LM Studio (llama.cpp / MLX al suo interno), con i tuoi modelli GGUF o MLX già scaricati.

i
App separata, motore condiviso
Bionic non sostituisce LM Studio. Le due applicazioni possono convivere e condividono la stessa cartella dei modelli. Continui a scaricare i tuoi GGUF in LM Studio classico; Bionic li riutilizza per le sue attività agentiche.

#Bionic vs LM Studio classico: quale differenza?

Il kit Agenti Locali

Hai appena visto un agente funzionare in locale. Il kit Agenti Locali ti insegna a costruirne uno che agisce davvero (cap. 1), a stabilire limiti e controlli prima di lasciarlo operare sui tuoi file (cap. 4) e a misurare se è affidabile o se dà soltanto l'impressione di esserlo (cap. 14).

  • Spazio online a vita
  • PDF + file
  • Aggiornamenti a vita

L’equivoco più comune è credere che Bionic sia un semplice aggiornamento di LM Studio. Sono due app con obiettivi distinti. Ecco come scegliere tra le due.

LM Studio classico
Chat locale, gestione e download dei modelli (GGUF/MLX da Hugging Face), server compatibile con OpenAI, supporto MCP. È il tuo hub di modelli e il tuo server di inferenza.
Bionic
App con agente: progetti persistenti (Code e Work), analisi di documenti, tastiera vocale Voxtral, esecuzione di attività in più passaggi. Orientata alla produzione di lavoro, non alla conversazione.
Punto in comune
Stesso team, stesso motore di inferenza locale, stessa libreria di modelli. Puoi mettere a disposizione un modello tramite LM Studio e lavorare in Bionic.
Quando usare l'uno o l'altro
LM Studio per parlare, testare un modello o esporre un'API. Bionic quando vuoi che un agente legga i tuoi file e produca un risultato concreto.
→
L'approccio giusto
Se il tuo bisogno è « voglio porre delle domande a un modello », rimani su LM Studio classico. Se invece è « voglio che lavori sui MIEI documenti o sul MIO codice », allora è Bionic.

#Prerequisiti e installazione

Bionic funziona sulle stesse piattaforme di LM Studio (Windows, macOS Apple Silicon, Linux). I requisiti hardware dipendono soprattutto dal modello che deciderai di eseguire localmente per pilotare l'agente.

Modello consigliato per l'agente
Un modello instruct da 7B a 14B in Q4_K_M basta per la maggior parte delle attività. Calcola circa 5 GB di VRAM per un 7B e circa 9 GB per un 14B.
Per attività di programmazione impegnative
Un modello 32B (≈19 GB in Q4) o un MoE tipo Qwen3 Coder dà risultati nettamente migliori nel ragionamento su più file.
Hardware di riferimento
RTX 3060 12GB o 4070 12GB per i modelli 7B-14B; RTX 4090 24GB o Mac M4 Pro (24-48 GB unificati) per i modelli 32B e oltre.
Trascrizione vocale
La tastiera Voxtral funziona in locale tramite un piccolo modello di trascrizione vocale; prevedi da qualche centinaio di MB a 1-2 GB di memoria aggiuntiva.
  1. 01
    1. Scaricare Bionic
    Visita il sito ufficiale di LM Studio (lmstudio.ai) e scarica il programma di installazione di Bionic per il tuo sistema operativo. È un download distinto rispetto all'app LM Studio classica.
  2. 02
    2. Indicare il percorso dei tuoi modelli
    Al primo avvio, Bionic rileva la cartella dei modelli di LM Studio. Se parti da zero, scarica prima un modello instruct nella versione classica di LM Studio, poi riavvia Bionic.
  3. 03
    3. Scegliere il modello per l'agente
    Nelle impostazioni di Bionic, seleziona il modello locale che guiderà i progetti. Inizia con un 7B-14B Q4_K_M per verificare che tutto funzioni prima di passare a un modello di fascia superiore.
  4. 04
    4. Verificare la modalità device
    Per impostazione predefinita, mantieni l'inferenza in modalità device (locale) per restare al 100 % offline. Più sotto spieghiamo in dettaglio la differenza tra device e cloud.

#Progetti Code vs Work

Il cuore di Bionic sono i progetti. Un progetto riunisce un contesto di lavoro persistente: file, storico delle attività e il comportamento dell'agente adatto al tipo di lavoro. Bionic distingue due famiglie.

Progetto Code
Pensato per lo sviluppo: l'agente legge una base di codice, comprende la struttura delle cartelle, scrive e modifica file, esegue attività di refactoring o di generazione. È l'equivalente locale di un agente di programmazione, senza inviare il tuo repository nel cloud.
Progetto Work
Orientato al lavoro d'ufficio e all'analisi: l'agente elabora documenti (PDF, Word, fogli di calcolo), produce riassunti, estrae dati e redige sintesi. Ideale per il monitoraggio informativo, la preparazione di dossier o l'analisi documentale.
Contesto persistente
Ogni progetto mantiene la propria cronologia e i file associati. Puoi chiudere Bionic e riprendere da dove eri rimasto, senza dover fornire nuovamente il contesto a ogni sessione.

La distinzione Code/Work non è solo estetica: modifica gli strumenti che l'agente può utilizzare e il modo in cui struttura le sue risposte. Un progetto Code favorisce la modifica dei file e l'esecuzione; un progetto Work favorisce la lettura, l'estrazione e la redazione.

→
Un progetto = un obiettivo
Evita di creare un progetto in cui mettere di tutto. Un progetto per base di codice o per cartella di documenti mantiene il contesto pulito e migliora notevolmente la pertinenza dell'agente, soprattutto con un modello locale di dimensioni modeste.

#Analisi di documenti, PDF e fogli di calcolo

È il punto forte dei progetti Work. Trascini i file nel progetto e l'agente li legge per rispondere alle tue richieste. Bionic gestisce nativamente diversi formati comuni di documenti da ufficio.

PDF
Estrazione del testo (e della struttura quando è chiara) per riassumere, interrogare o confrontare diversi documenti.
Fogli di calcolo
Lettura dei fogli Excel/CSV: l'agente può descrivere le colonne, calcolare semplici aggregati, individuare anomalie o produrre una sintesi numerica.
Documenti Word / testo
Riepiloghi, riscritture, estrazione delle informazioni chiave, formattazione delle note.

L'elaborazione avviene tramite il modello locale: i tuoi documenti non lasciano la macchina finché resti in modalità device. È la differenza principale rispetto a un assistente cloud: un dossier riservato (contratti, dati delle risorse umane, dati sanitari) può essere analizzato senza esfiltrazione.

!
Attenzione alla finestra di contesto
Un grande PDF o un foglio elettronico voluminoso può superare il contesto di un modello 7B. Se le risposte diventano incoerenti, suddividi il documento, aumenta la dimensione del contesto del modello, o passa a un modello con una finestra più ampia. La qualità dell'analisi dipende direttamente dal modello locale scelto.

#Tastiera vocale Voxtral: la trascrizione vocale locale

Bionic integra una tastiera vocale basata su Voxtral, un modello di riconoscimento vocale eseguito localmente. Detti la tua richiesta, che viene trascritta in testo sul tuo dispositivo e poi inviata all'agente. Nessun audio viene inviato a un servizio di trascrizione online.

100 % locale
La trascrizione avviene tramite il modello Voxtral caricato in memoria. La tua voce non passa attraverso alcun server, il che la rende utilizzabile per contenuti sensibili o in ambienti senza connessione.
Casi d’uso
Dettare una lunga istruzione all'agente, prendere appunti vocali in un progetto Work, descrivere un'attività di programmazione senza lasciare la tastiera fisica.
Lingue
Voxtral gestisce il francese e l'inglese, in particolare; la qualità dipende dal modello di riconoscimento vocale installato e dal tuo microfono.
i
Voxtral ≠ il modello di chat
Voxtral si occupa esclusivamente di convertire la voce in testo. È poi il tuo modello agente (il 7B/14B/32B che hai scelto) a elaborare il testo trascritto. I due modelli risiedono contemporaneamente in memoria — tienine conto nel tuo budget di VRAM.

#Modalità device vs cloud: ciò che rimane locale

Bionic offre due modalità di inferenza, e questa è l'impostazione più importante da comprendere per mantenere il controllo sui tuoi dati.

Modalità device (locale)
L'inferenza viene eseguita sulla tua macchina, con i tuoi modelli GGUF/MLX. Nulla esce: né i tuoi file, né i tuoi prompt, né la tua voce. È la modalità da privilegiare per il self-hosting in senso stretto.
Modalità cloud
L'inferenza viene spostata su una macchina remota, utile per eseguire modelli troppo grandi per il tuo hardware. Pratico, ma i tuoi dati lasciano la macchina — da usare solo per contenuti non sensibili.
Scelta per progetto
Puoi mantenere un progetto Work riservato in modalità device e un progetto Code meno sensibile in cloud se hai bisogno di un modello più potente. Verifica la modalità attiva prima di caricare documenti sensibili.
!
Verifica la modalità prima di trattare dati sensibili
La modalità cloud cambia la situazione sul fronte della riservatezza. Prima di trascinare un contratto o dati personali in un progetto, verifica di essere effettivamente in modalità device. È l'unica garanzia che nulla venga inviato online.

#Impostazioni che contano e impatto sulle risorse locali

Alcuni parametri fanno la differenza tra un agente lento e frustrante e un agente reattivo e affidabile.

Modello agente
La scelta numero uno. Se il modello è troppo piccolo, l'agente si perde nelle attività a più fasi; se è troppo grande, va a rilento. Un 14B Q4_K_M è un buon punto di equilibrio per iniziare.
Dimensione del contesto
Aumentala se analizzi documenti lunghi, ma controlla la VRAM — un contesto più grande consuma più memoria.
Quantization
Q4_K_M per un equilibrio tra velocità e qualità, Q5_K_M o Q8_0 se hai la VRAM e vuoi maggiore precisione sul codice.
Offloading GPU
Carica il maggior numero possibile di layer sulla GPU per aumentare la velocità. Se il modello non entra nella memoria della GPU, riduci la quantizzazione o la dimensione del modello invece di trasferirlo interamente sulla CPU.

Quanto a ciò che rimane locale: in modalità device, l'intera catena — trascrizione con Voxtral, lettura dei tuoi file, inferenza dell'agente — viene eseguita sulla tua macchina. Bionic rimane fedele alla filosofia di LM Studio: i tuoi modelli, i tuoi dati, il tuo hardware.


#Risoluzione dei problemi

Bionic non vede i miei modelli
Verifica che la cartella dei modelli punti a quella di LM Studio. Scarica almeno un modello instruct nella versione classica di LM Studio, poi riavvia Bionic.
L'agente è molto lento
Modello troppo grande per la tua VRAM: viene trasferito alla CPU tramite offload. Passa a un modello più piccolo (32B → 14B) o scendi di un livello di quantizzazione (Q8 → Q4_K_M).
Risposte incoerenti su un documento di grandi dimensioni
Il documento supera il contesto. Dividilo, aumenta la dimensione del contesto, o scegli un modello con finestra più ampia.
La dettatura vocale non si avvia
Verifica le autorizzazioni del sistema operativo per il microfono e che il modello Voxtral sia correttamente installato. La trascrizione locale richiede memoria libera oltre a quella occupata dal modello dell'agente.
Dubbio sulla privacy
Apri le impostazioni e verifica che sia attiva la modalità device. In modalità cloud, i prompt e i file vengono inviati a server remoti.

#Per approfondire

Bionic si basa sull'ecosistema LM Studio. Queste guide completano i primi passi e ti aiutano a scegliere il modello giusto per gestire i tuoi agenti.

Iniziare con il piede giusto con LM Studio
«LM Studio nel 2026: tutorial completo» — installare l'app classica, scaricare i modelli e configurare la GPU, base indispensabile prima di Bionic.
Scegliere la quantizzazione
« Scegliere la quantizzazione (Q4, Q5, Q8, FP16) » — per regolare il compromesso velocità/qualità del tuo modello agente.
RAG locale
« RAG locale con LM Studio : parlare con i tuoi documenti » — per approfondire l'analisi documentale oltre i progetti Work.
Questa guida ti è stata utile?

Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.