Configuración de API personalizada en Narratium: URL base, clave, modelo.
Updated 2026-07-29
Narratium es un cliente de código abierto para roleplay y narrativa que aporta su propia interfaz y ninguno de sus propios modelos: su README dirige a los usuarios hacia APIs con formato OpenAI, endpoints unificados estilo OpenRouter y Ollama local. Apunta sus ajustes de API a https://api.apisrouter.com/v1 con una clave y todo el catálogo se convierte en su backend. Una cosa que esta página dice sin rodeos y que la mayoría de las guías omite: el repositorio de GitHub está archivado, así que ejecútalo teniendo ese hecho en cuenta.
Respuesta rápida: los valores que necesita Narratium.
La conexión LLM de Narratium es el trío estándar compatible con OpenAI, introducido en sus ajustes de API: una URL base, una clave de API y un nombre de modelo. Para este gateway esos valores son https://api.apisrouter.com/v1, tu clave sk-... y cualquier id del catálogo, siendo deepseek-v4-flash la elección sensata para empezar con tráfico de historias. El README del proyecto recomienda exactamente esta clase de conexión: APIs con formato OpenAI directamente, un endpoint unificado multimodelo para variedad, u Ollama y LM Studio para modelos locales, todo a través de la misma superficie de configuración. Las etiquetas exactas de los campos varían entre la versión web y las distintas versiones, así que trata las etiquetas con flexibilidad y los valores con exactitud: la URL termina en /v1, la clave se pega limpia, el id del modelo coincide con la cadena del catálogo carácter por carácter.
Base URL: https://api.apisrouter.com/v1
API key: sk-... (from APIsRouter)
Model: deepseek-v4-flash (typed exactly; any catalog id works)Qué es Narratium, y su estado, dicho sin rodeos.
Narratium (Narratium/Narratium.ai en GitHub) se presentaba a sí mismo como el VSCode del roleplay: un cliente de código abierto para narrativa impulsada por IA, construcción de mundos y ficción interactiva de formato largo, con compatibilidad de tarjetas de personaje de SillyTavern, persistencia de memoria y un sistema de plugins. El código tiene licencia AGPL, atrajo una comunidad real con rapidez, y sigue siendo uno de los clientes abiertos más interesantes de la escena. Ahora la parte que la mayoría de las guías de configuración omiten: el repositorio de GitHub está archivado y en modo solo lectura (GitHub muestra el 30 de marzo de 2026 como fecha de archivado). Archivado no significa roto, el código funciona exactamente igual que el día en que se congeló, pero significa que ningún mantenedor está enviando correcciones, actualizaciones de dependencias ni parches de seguridad, y las instancias alojadas asociadas al proyecto deben tratarse como, en el mejor de los casos, un servicio de mejor esfuerzo. Si adoptas Narratium hoy, la ruta fiable es ejecutarlo tú mismo desde el código fuente o una release, y la expectativa realista es un conjunto de funciones congelado. Ese estado cambia el consejo sobre la API de una manera muy concreta: un cliente congelado es exactamente la situación en la que quieres que el lado del modelo se mantenga flexible. Narratium ya no puede añadir nuevas integraciones de proveedor, pero un endpoint compatible con OpenAI que ya habla sigue sirviendo cualquier modelo nuevo que aparezca detrás de ese endpoint. El patrón de gateway a efectos prácticos blinda a futuro un cliente que ya no avanza.
Recorrido de configuración.
La resolución de problemas sigue el patrón universal: primero demuestra los tres valores con una petición curl, y si curl funciona mientras la app falla, los culpables habituales son una URL con un segmento de ruta de más, espacios en blanco en la clave, o un bloqueo de CORS del navegador en las versiones web, visible en la consola de desarrollador. Como ningún mantenedor va a enviar ya una corrección para rarezas del lado de la app, el hábito de probar primero con curl importa un poco más aquí: te dice de inmediato en qué lado de la conexión puedes realmente hacer algo.
- Consigue que Narratium se ejecute: autoalójalo desde el código fuente de GitHub o una release (el repositorio es solo lectura pero se puede clonar por completo), o usa una instancia alojada si alguna en la que confíes sigue funcionando.
- Abre los ajustes y busca la sección de configuración de API / LLM.
- Selecciona el tipo de conexión con formato OpenAI en vez de Ollama, ya que estás apuntando a un endpoint alojado.
- Introduce la URL base https://api.apisrouter.com/v1 y pega tu clave.
- Escribe el id del modelo exactamente: deepseek-v4-flash para empezar.
- Guarda y envía un mensaje corto en una historia nueva para confirmar el ciclo completo.
Tarjetas, mundos, y qué sobrevive si te vas.
Narratium lee tarjetas de personaje compatibles con SillyTavern, que es el dato de compatibilidad más importante sobre él. Tus personajes son artefactos portables: las tarjetas escritas en otro sitio se importan, y el trabajo que pusiste en personas y notas de mundo no queda encerrado en un cliente cuyo desarrollo se ha detenido. Si alguna vez migras, SillyTavern, RisuAI y Wyvern hablan todos el mismo linaje de tarjetas, y las páginas de configuración enlazadas abajo cubren cada una. La misma lógica de portabilidad se aplica al lado del modelo. Como Narratium habla con un endpoint /v1 genérico, nada de tu configuración de proveedor es específico de Narratium: la misma clave y URL base encajan sin cambios en cualquier otro frontend. Entre tarjetas portables y un endpoint portable, el coste de cambiar de todo el stack se redondea a cero, que es la postura correcta ante cualquier proyecto archivado que aún disfrutas usando.
Elección de modelos para el estilo de formato largo de Narratium.
El diseño de Narratium se centra en narrativas largas y ramificadas, lo que inclina la elección de modelo hacia la consistencia en horizontes largos. deepseek-v4-flash lleva las sesiones cotidianas a las tarifas más bajas del catálogo con un diálogo que la comunidad de roleplay valora sistemáticamente por encima de su precio. glm-5.1 y kimi-k2.6 rotan para variar la voz, y glm-5.2 se gana los capítulos cargados de detalle donde su adherencia a instrucciones en horizontes largos pesa más que su latencia de razonamiento. claude-sonnet-4-6 sigue siendo el techo de prosa apta para trabajo (SFW) para los capítulos que se lo merecen. Como el frontend reenvía el contexto de la historia en cada turno, los tokens de entrada dominan el coste, y una ventana de trabajo deliberada gana a una maximal; la guía de longitud de contexto enlazada abajo hace las cuentas. La política de contenido no cambia por nada de esto: las políticas de los modelos y los términos de la plataforma aplicable rigen tal cual están escritos, y la página de políticas comparadas cubre qué familias encajan con qué clasificaciones de contenido, de forma factual.
Pago por uso · por debajo del precio oficial
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Modelo | Precio oficial | Nuestro precio |
|---|---|---|
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| GLM-5.1 | $0.86 / $3.43 per M | $0.90 / $3.40 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
¿Deberías seguir adoptando un cliente archivado?
Un análisis honesto de coste-beneficio, ya que esta página es la guía de configuración de todos modos. A favor: el código es abierto, la interfaz es genuinamente buena para historias estructuradas de formato largo, las tarjetas son portables en ambas direcciones, y un endpoint genérico mantiene el lado del modelo actualizado para siempre. En contra: sin parches de seguridad, sin correcciones de errores, dependencias envejeciendo en su sitio, y cualquier instancia alojada viviendo de prestado. Para un cliente de aficionado ejecutado en local contra una clave de pago por uso, ese perfil de riesgo es aceptable para mucha gente; para cualquier cosa con otros usuarios o datos sensibles, no lo es. El camino intermedio es el que esta página ha ido describiendo todo el tiempo: ejecútalo tú mismo, mantén tu inversión en las capas portables (tarjetas, lorebooks, el endpoint), y trata al cliente como reemplazable. Los frontends en esta escena van y vienen; una historia respaldada por tarjetas portables y un endpoint /v1 estable los sobrevive a todos.
Preguntas frecuentes
¿Cómo configuro una URL base de API personalizada en Narratium?
En los ajustes de API, elige la conexión con formato OpenAI, luego introduce la URL base https://api.apisrouter.com/v1, tu clave, y un id de modelo exacto como deepseek-v4-flash. El README recomienda APIs con formato OpenAI o un endpoint unificado multimodelo, que es precisamente esta configuración.
¿Sigue manteniéndose Narratium?
No. El repositorio de GitHub está archivado y en solo lectura (GitHub muestra el 30 de marzo de 2026 como fecha de archivado), así que no se están enviando correcciones ni actualizaciones. El código sigue funcionando y se puede clonar; autoalojarlo es la forma fiable de usarlo, con la expectativa fijada en un conjunto de funciones congelado.
¿Funciona Narratium con tarjetas de personaje de SillyTavern?
Sí, la compatibilidad de tarjetas con el formato de SillyTavern es una de sus funciones documentadas, lo que mantiene tus personajes portables en ambas direcciones: las tarjetas se importan en Narratium, y tu trabajo no queda varado si luego te mudas a SillyTavern, RisuAI o Wyvern.
¿Qué modelos funcionan con Narratium a través de un gateway?
Cualquiera que sirva el endpoint, ya que Narratium envía el nombre del modelo como una cadena simple: deepseek-v4-flash y glm-5.1 para volumen, kimi-k2.6 para rotación, glm-5.2 para capítulos cargados de detalle, claude-sonnet-4-6 para prosa apta para trabajo (SFW). Cambiar es un ajuste de configuración, y el historial de chat se queda con el cliente.
¿Puedo ejecutar Narratium completamente en local?
Sí, en dos sentidos: el cliente se autoaloja desde el código fuente archivado, y su soporte de Ollama también ejecuta modelos en local. El híbrido en el que la mayoría acaba es un cliente local con un endpoint alojado detrás, lo que mantiene el manejo de datos en tus manos mientras alcanzas modelos que ninguna GPU de consumo sirve.
¿Usar un endpoint personalizado va contra algún término?
Narratium es de código abierto y está construido exactamente para esta configuración. Lo que un endpoint personalizado nunca cambia es la política de contenido del lado del modelo: las reglas escritas de cada familia aplican dondequiera que se sirva, y la página de políticas comparadas lo cubre de forma factual.