Configurazione API personalizzata di Narratium: base URL, chiave, modello.
Updated 2026-07-29
Narratium è un client open source per roleplay e narrazione che porta la propria interfaccia e nessun modello proprio: il suo README indirizza gli utenti verso API in formato OpenAI, endpoint unificati in stile OpenRouter e Ollama locale. Punta le sue impostazioni API su https://api.apisrouter.com/v1 con una chiave e l'intero catalogo diventa il suo backend. Una cosa che questa pagina dichiara apertamente e che la maggior parte delle guide omette: il repository GitHub è archiviato, quindi usalo tenendo conto di questo fatto.
Risposta rapida: i valori di cui Narratium ha bisogno.
La connessione LLM di Narratium è la tripla standard compatibile OpenAI, inserita nelle sue impostazioni API: un base URL, una chiave API e un nome di modello. Per questo gateway sono https://api.apisrouter.com/v1, la tua chiave sk-..., e un qualsiasi id di catalogo, con deepseek-v4-flash come prima scelta sensata per il traffico narrativo. Il README del progetto raccomanda esattamente questa classe di connessione: API in formato OpenAI direttamente, un endpoint unificato multi-modello per varietà, oppure Ollama e LM Studio per modelli locali, tutti attraverso la stessa superficie di configurazione. Le etichette esatte dei campi variano tra la build web e le versioni, quindi tratta le etichette in modo approssimativo e i valori in modo esatto: l'URL termina con /v1, la chiave si incolla pulita, l'id del modello corrisponde alla stringa di catalogo carattere per carattere.
Base URL: https://api.apisrouter.com/v1
API key: sk-... (from APIsRouter)
Model: deepseek-v4-flash (typed exactly; any catalog id works)Cos'è Narratium, e il suo stato, dichiarato con chiarezza.
Narratium (Narratium/Narratium.ai su GitHub) si è proposto come il VSCode del roleplay: un client open source per narrazione guidata dall'AI, worldbuilding e fiction interattiva long-form, con compatibilità per le character card di SillyTavern, persistenza della memoria e un sistema di plugin. Il codice è sotto licenza AGPL, ha attratto rapidamente una community vera, e resta uno dei client aperti più interessanti della scena. Ecco la parte che la maggior parte delle guide di configurazione omette: il repository GitHub è archiviato e in sola lettura (GitHub mostra il 30 marzo 2026 come data di archiviazione). Archiviato non significa rotto, il codice funziona esattamente come il giorno in cui è stato congelato, ma significa che nessun maintainer sta più rilasciando fix, aggiornamenti delle dipendenze o patch di sicurezza, e le istanze hostate associate al progetto vanno considerate al massimo come best-effort. Se adotti Narratium oggi, la strada affidabile è farlo girare tu stesso dal sorgente o da una release, e l'aspettativa realistica è un set di funzionalità congelato. Questo stato cambia il consiglio sull'API in un modo specifico: un client congelato è esattamente la situazione in cui vuoi che il lato modello resti flessibile. Narratium non può più aggiungere nuove integrazioni di provider, ma un endpoint compatibile OpenAI che già parla continua a servire qualsiasi nuovo modello compaia dietro quell'endpoint. Lo schema del gateway rende di fatto a prova di futuro un client che non si muove più.
Guida alla configurazione.
Il troubleshooting segue lo schema universale: prova prima i tre valori con una richiesta curl, e se curl ha successo mentre l'app fallisce, i soliti colpevoli sono un URL con un segmento di percorso di troppo, spazi bianchi nella chiave, o un blocco CORS del browser sulle build web, visibile nella console sviluppatore. Dato che nessun maintainer rilascerà più un fix per le stranezze lato app, l'abitudine di provare prima con curl conta un po' di più qui: ti dice immediatamente su quale lato della connessione puoi effettivamente intervenire.
- Avvia Narratium: self-hosting dal sorgente GitHub o da una release (il repo è in sola lettura ma completamente clonabile), oppure usa un'istanza hostata se una di cui ti fidi è ancora operativa.
- Apri le impostazioni e trova la sezione di configurazione API / LLM.
- Seleziona il tipo di connessione in formato OpenAI anziché Ollama, dato che stai puntando a un endpoint hostato.
- Inserisci il base URL https://api.apisrouter.com/v1 e incolla la tua chiave.
- Digita l'id del modello esattamente: deepseek-v4-flash per iniziare.
- Salva e invia un breve messaggio in una nuova storia per confermare il round trip.
Card, mondi, e cosa sopravvive se te ne vai.
Narratium legge le character card compatibili con SillyTavern, ed è il singolo fatto di compatibilità più importante che lo riguarda. I tuoi personaggi sono artefatti portabili: le card scritte altrove si importano, e il lavoro che metti in persona e note di mondo non è vincolato a un client il cui sviluppo si è fermato. Se mai migrerai, SillyTavern, RisuAI e Wyvern parlano tutti lo stesso lignaggio di card, e le pagine di configurazione linkate sotto coprono ciascuno di essi. La stessa logica di portabilità si applica al lato modello. Poiché Narratium parla con un endpoint /v1 generico, nulla nella tua configurazione del provider è specifico di Narratium: la stessa chiave e lo stesso base URL si inseriscono in qualsiasi altro frontend senza modifiche. Tra card portabili e un endpoint portabile, il costo di cambio dell'intero stack si arrotonda a zero, che è la postura corretta verso qualsiasi progetto archiviato che ti piace ancora usare.
Scelta dei modelli per lo stile long-form di Narratium.
Il design di Narratium è centrato su lunghe narrazioni ramificate, il che sposta la scelta del modello verso la coerenza su orizzonti lunghi. deepseek-v4-flash sostiene le sessioni quotidiane alle tariffe più basse del catalogo con un dialogo che la community del roleplay valuta costantemente al di sopra del suo prezzo. glm-5.1 e kimi-k2.6 ruotano per varietà di voce, e glm-5.2 si guadagna i capitoli ricchi di dettagli dove la sua aderenza alle istruzioni su orizzonti lunghi supera la sua latenza di ragionamento. claude-sonnet-4-6 resta il tetto di prosa safe-for-work per i capitoli che lo meritano. Poiché il frontend reinvia il contesto della storia a ogni turno, i token di input dominano il costo, e una finestra di lavoro deliberata batte una massimale; la guida alla lunghezza del contesto linkata sotto fa i conti. La content policy non cambia per nulla di tutto questo: le policy dei modelli e i termini della piattaforma applicabili valgono come scritti, e la pagina di confronto delle policy copre quali famiglie si adattano a quali classificazioni di contenuto, in modo fattuale.
Pagamento a consumo · sotto i prezzi ufficiali
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Modello | Prezzo ufficiale | Il nostro prezzo |
|---|---|---|
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| GLM-5.1 | $0.86 / $3.43 per M | $0.90 / $3.40 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
Dovresti comunque adottare un client archiviato?
Un costo-beneficio onesto, dato che questa pagina resta comunque la guida di configurazione. A favore: il codice è aperto, l'interfaccia è genuinamente buona per storie strutturate long-form, le card sono portabili in entrata e in uscita, e un endpoint generico mantiene il lato modello aggiornato per sempre. Contro: nessuna patch di sicurezza, nessun bug fix, dipendenze che invecchiano sul posto, e qualsiasi istanza hostata che vive a tempo. Per un client hobbistico eseguito localmente contro una chiave a consumo, questo profilo di rischio è accettabile per molte persone; per qualsiasi cosa con altri utenti o dati sensibili, non lo è. La via di mezzo è quella che questa pagina ha descritto per intero: eseguilo tu stesso, mantieni il tuo investimento nei livelli portabili (card, lorebook, l'endpoint), e tratta il client come sostituibile. I frontend in questa scena vanno e vengono; una storia sostenuta da card portabili e un endpoint /v1 stabile sopravvive a tutti loro.
Domande frequenti
Come imposto un base URL API personalizzato in Narratium?
Nelle impostazioni API, scegli la connessione in formato OpenAI, poi inserisci il base URL https://api.apisrouter.com/v1, la tua chiave, e un id di modello esatto come deepseek-v4-flash. Il README raccomanda API in formato OpenAI o un endpoint unificato multi-modello, che è esattamente questa configurazione.
Narratium è ancora mantenuto?
No. Il repository GitHub è archiviato e in sola lettura (GitHub mostra il 30 marzo 2026 come data di archiviazione), quindi non vengono rilasciati fix o aggiornamenti. Il codice funziona ancora e resta clonabile; il self-hosting è il modo affidabile di usarlo, con aspettative impostate su un set di funzionalità congelato.
Narratium funziona con le character card di SillyTavern?
Sì, la compatibilità delle card con il formato SillyTavern è una delle sue funzionalità documentate, il che mantiene i tuoi personaggi portabili in entrambe le direzioni: le card si importano in Narratium, e il tuo lavoro non resta bloccato se in seguito passi a SillyTavern, RisuAI o Wyvern.
Quali modelli funzionano con Narratium tramite un gateway?
Tutto ciò che l'endpoint serve, dato che Narratium invia il nome del modello come semplice stringa: deepseek-v4-flash e glm-5.1 per il volume, kimi-k2.6 per la rotazione, glm-5.2 per i capitoli ricchi di dettagli, claude-sonnet-4-6 per la prosa safe-for-work. Cambiare è una modifica alle impostazioni, e la cronologia della chat resta con il client.
Posso eseguire Narratium completamente in locale?
Sì, in due sensi: il client si può self-hostare dal sorgente archiviato, e il suo supporto Ollama esegue modelli anche in locale. L'ibrido su cui atterrano la maggior parte delle persone è un client locale con un endpoint hostato dietro di esso, che mantiene la gestione dei dati nelle tue mani raggiungendo comunque modelli che nessuna GPU consumer può servire.
Usare un endpoint personalizzato viola qualche termine?
Narratium è open source ed è costruito esattamente per questa configurazione. Ciò che un endpoint personalizzato non cambia mai è la content policy lato modello: le regole scritte di ciascuna famiglia si applicano ovunque venga servita, e la pagina di confronto delle policy le copre in modo fattuale.