OpenRouter: cos'è, quanto costa e l'esecuzione in locale ?
OpenRouter è un gateway API che dà accesso a centinaia di modelli di IA (proprietari e open-weight) tramite un solo account e un formato compatibile con OpenAI. Paghi a consumo con crediti prepagati, senza ricarico sul prezzo dei token; la commissione si applica soltanto all'acquisto dei crediti (5,5% con carta, minimo 0,80 $, oppure 5% in criptovaluta). Esistono modelli «:free», limitati a 50 richieste al giorno senza crediti acquistati e a 1.000 richieste al giorno oltre i 10 $ di crediti acquistati.
OpenRouter è un servizio online che dà accesso a centinaia di modelli di IA diversi, proprietari e a pesi aperti, attraverso una sola API e un solo account. Invece di aprire un account con ogni fornitore, acquisti crediti una volta e scegli il modello per ogni richiesta. Al 20 settembre 2026, è il gateway più utilizzato dagli sviluppatori e dagli strumenti di programmazione come Cline o OpenCode. Questa pagina spiega cosa fa il servizio, quanto costa, dove transitano i tuoi dati e in quali casi un modello sulla tua macchina rimane la scelta migliore.
#OpenRouter, che cos'è?
OpenRouter è un gateway API. La società, fondata nel 2023, non addestra modelli e, per la maggior parte, non li ospita direttamente: si colloca tra la tua applicazione e i fornitori, che siano laboratori come OpenAI, Anthropic, Google o Mistral, oppure fornitori di hosting che rendono disponibili modelli a pesi aperti come Qwen, Llama o DeepSeek. Il vantaggio sta nel ruolo che svolge: un solo account, una sola chiave, una sola fattura, indipendentemente dal numero di fornitori effettivamente utilizzati dietro le quinte.
L'API segue il formato di OpenAI. Un'applicazione già scritta per OpenAI funziona modificando solo due righe: l'indirizzo base e la chiave. Il modello si sceglie con un semplice nome, nella forma fornitore/modello, permettendo di passare da uno all'altro senza toccare il resto del codice.
Il servizio guadagna esclusivamente sull'acquisto di crediti, mai sul prezzo indicato dal fornitore per ogni modello: la sua documentazione ufficiale afferma che non applica alcun margine sul prezzo dell'inferenza stessa. È una distinzione importante rispetto ad altri gateway che aggiungono un margine invisibile direttamente alla tariffa del token, rendendo più difficile il confronto con il fornitore originale.
#Come funziona
Il tuo ChatGPT privato e gratuito sulla tua macchina in 1 ora — LM Studio, Ollama, Open WebUI, i tuoi documenti, senza cloud.
- Spazio online a vita
- PDF + file
- Aggiornamenti a vita
- Un catalogo unico
- Ogni modello ha la sua scheda: prezzo per milione di token in ingresso e in uscita, dimensione del contesto, fornitori che lo offrono, velocità di generazione e latenza osservate. Le varianti di routing («:free», «:batch», tra le altre) compaiono come voci separate, ciascuna con il proprio prezzo e i propri limiti.
- Il routing tra fornitori
- Lo stesso modello aperto è spesso offerto da diversi provider a prezzi e velocità diversi. OpenRouter sceglie in base alle tue preferenze (prezzo, throughput, latenza) e passa a un altro fornitore se il primo è fuori servizio, senza che il tuo codice debba gestire autonomamente questa logica.
- Il passaggio ai modelli di riserva
- Puoi indicare una lista di modelli di riserva: se il primo non è disponibile o rifiuta la richiesta, il successivo subentra automaticamente, senza intervento manuale né interruzioni visibili sul lato dell'applicazione.
- La tua chiave personale (BYOK)
- Se hai già un account presso un fornitore, puoi collegare la tua chiave e mantenere OpenRouter come punto di accesso unico. È prevista una soglia mensile gratuita (25 000 $ di costi di inferenza ai prezzi di listino con Pay-as-you-go, 200 000 $ con Enterprise); oltre questa soglia, si applica una commissione pari al 5 % del costo normale, addebitata sui tuoi crediti OpenRouter.
#Quanto costa
Il modello economico è il pagamento anticipato. Acquisti crediti e ogni richiesta viene addebitata alla tariffa del fornitore, senza maggiorazioni sul prezzo del token secondo la documentazione ufficiale. OpenRouter guadagna attraverso una commissione applicata all'acquisto dei crediti. Non ci sono abbonamenti né impegni mensili da disdire.
| Voce | Cosa sapere |
|---|---|
| Prezzo dei token | Quello del fornitore, indicato esattamente sulla pagina del modello, senza margine aggiuntivo secondo la documentazione ufficiale. L'output costa di solito parecchie volte di più dell'input. |
| Commissione | 5,5 % pagando con carta (minimo 0,80 $) o 5 % in criptovaluta, addebitati una sola volta all'acquisto dei crediti. Secondo la documentazione ufficiale, non viene aggiunto alcun margine al prezzo indicato dal fornitore. |
| Modelli gratuiti | Alcuni modelli aperti esistono in versione gratuita, riconoscibile dal suffisso «:free», che ha il proprio prezzo (zero), la propria lunghezza del contesto e i propri punti di accesso. Limite di 50 richieste/giorno senza crediti acquistati, 1.000/giorno oltre 10 $ di crediti. |
| Rimborso | I crediti non utilizzati sono rimborsabili entro 24 ore dopo l'acquisto, secondo la FAQ ufficiale. Dopo questo periodo rimangono utilizzabili ma non sono più rimborsabili. |
| Modelli di ragionamento | I token di ragionamento, invisibili sullo schermo, vengono fatturati come output alla stessa tariffa. La fattura può essere diverse volte più alta di quanto suggerisca la sola lunghezza della risposta visualizzata. |
#Usarlo in cinque minuti
- 01Creare un account e una chiaveSu openrouter.ai, crea una chiave API e, se l'interfaccia lo consente, imposta per quella chiave un limite di spesa preciso. Una chiave distinta per ogni strumento facilita molto il monitoraggio dei consumi.
- 02Aggiungere creditiBastano pochi euro per fare delle prove con tranquillità. Le varianti gratuite funzionano senza crediti, con un limite di 50 richieste al giorno; oltre i 10 $ di crediti acquistati sull'account, questo limite sale a 1.000 richieste al giorno.
- 03Configurare il tuo strumento per usare l'APIIndirizzo base https://openrouter.ai/api/v1, la tua chiave e il nome esatto del modello. La maggior parte degli strumenti ha un'impostazione «OpenAI compatible» o un'opzione OpenRouter diretta integrata.
Il nome esatto di ogni modello è indicato nella sua scheda, nel catalogo online. Per i modelli aperti, è generalmente lo stesso identificativo usato su Hugging Face, semplicemente in minuscolo.
#Dove vanno i tuoi dati
È la domanda da porsi prima di collegarvi uno strumento professionale. Una richiesta passa attraverso due attori: OpenRouter, poi il fornitore che esegue il modello. Ciascuno ha la propria politica, ed entrambe devono essere verificate separatamente prima di ritenere che un dato sensibile possa transitare attraverso questo percorso.
La scheda Activity della dashboard permette di consultare la cronologia completa dei tuoi consumi per modello e per richiesta, aiutandoti a individuare un uso anomalo o uno strumento configurato male prima che la fattura riservi sorprese. È anche il primo posto da controllare in caso di contestazione di un importo addebitato, prima di contattare l'assistenza per un rimborso o un chiarimento.
- Lato OpenRouter
- Il servizio dichiara di non conservare il contenuto dei prompt per impostazione predefinita; è disponibile un'opzione di logging da attivare volontariamente per il debug. I metadati (modello, numero di token, timestamp) vengono conservati per la fatturazione e sono consultabili nella scheda Activity.
- Dal lato del fornitore
- Le politiche variano: alcuni fornitori di hosting conservano le richieste per un certo periodo, altri le usano per addestrare i propri modelli. La scheda di ciascun fornitore lo specifica, e un'impostazione dell'account permette di escludere tutti quelli che addestrano i modelli sui tuoi dati, invece di controllare ogni fornitore singolarmente.
- Aspetto giuridico
- I server sono per la maggior parte fuori dall'Europa. Per dati personali, fascicoli dei clienti o codice riservato, verifica cosa consentono il tuo contratto e il RGPD prima di inviare qualsiasi cosa, anche per un semplice test tecnico occasionale.
#OpenRouter o un modello locale?
| Criterio | OpenRouter | Modello locale |
|---|---|---|
| Avvio | Cinque minuti, nessun hardware | Un’installazione e una scheda grafica o un Mac adatto |
| Dimensione dei modelli | Tutto, inclusi i modelli con diverse centinaia di miliardi di parametri | Ciò che entra nella tua memoria: fino a 30 miliardi su 24 GB, 120 miliardi su un Mac con 128 GB |
| Costo | A consumo, variabile, senza un tetto naturale | Hardware una tantum, poi elettricità |
| Privacy | I tuoi dati passano attraverso due soggetti terzi | Niente lascia la macchina |
| Disponibilità | Dipende dalla rete e dai fornitori | Funziona offline |
| Limiti di frequenza | Sì, soprattutto sulle versioni gratuite | Nessuna |
| Modelli proprietari | Sì | No |
Molti dei modelli aperti offerti su OpenRouter sono esattamente quelli che puoi eseguire a casa. Nel catalogo QuelLLM, Qwen 3 14B pesa 9 GB in Q4, gpt-oss 20B 13 GB, Mistral Small 3.2 24B 14 GB: una scheda da 16 GB li esegue senza fatture né limiti. OpenRouter diventa utile per ciò che non trova spazio sul tuo hardware o per un uso troppo occasionale per giustificare l'acquisto di hardware.
Il calcolo economico dipende soprattutto dal volume. Per un uso occasionale di poche richieste a settimana, la commissione del 5,5% su una piccola ricarica di crediti resta trascurabile in valore assoluto. Per un uso intensivo — un agente di programmazione che gira tutto il giorno, un prodotto con migliaia di utenti — il costo cumulativo dei token pagati a consumo supera rapidamente quello di una scheda grafica ammortizzata su diversi anni, soprattutto per i modelli di dimensioni modeste che il tuo hardware gestisce senza difficoltà.
- Questo modello entra nella memoria della mia macchina? Il calcolatore della VRAM
- IA locale o servizio online: il confronto
#Usa i due insieme
La configurazione più razionale combina le due soluzioni. Un modello locale gestisce le attività quotidiane e tutto ciò che è riservato; un gateway cloud subentra, su richiesta, per le attività che richiedono un modello molto grande. Un proxy come LiteLLM rende il tutto accessibile tramite un unico indirizzo, con regole di routing e un budget.
In questa configurazione, l'approccio BYOK descritto sopra acquista pienamente senso: invece di pagare la commissione di OpenRouter su ogni richiesta inviata a un fornitore che utilizzi già direttamente, colleghi la tua chiave e paghi la commissione BYOK solo oltre la quota mensile gratuita. OpenRouter rimane così l'unico punto di accesso per il codice, mentre per la maggior parte del volume continui a essere fatturato dal fornitore come di consueto.
- LiteLLM: un proxy unificato per l'esecuzione in locale e nel cloud
- OpenCode + Ollama: un agente di programmazione senza costi API
- Documentazione ufficiale di OpenRouter
- Fonte: FAQ ufficiali sui costi e sulla privacy
- Fonte: dettaglio dei costi BYOK e dei modelli gratuiti
#FAQ
OpenRouter è gratuito?+
OpenRouter è affidabile e sicuro?+
Qual è la differenza tra OpenRouter e Ollama?+
OpenRouter costa di più rispetto a rivolgersi direttamente al fornitore?+
È possibile utilizzare OpenRouter con Cline, OpenCode o Open WebUI?+
Cosa è il BYOK (portare la propria chiave) su OpenRouter?+
Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.