Configuration API personnalisée de Narratium : base URL, clé, modèle.

Updated 2026-07-29

Narratium est un client open source de roleplay et d'écriture narrative qui apporte sa propre interface mais aucun modèle en propre : son README oriente les utilisateurs vers des API au format OpenAI, des endpoints unifiés façon OpenRouter, et Ollama en local. Pointez ses réglages API vers https://api.apisrouter.com/v1 avec une seule clé, et tout le catalogue devient son backend. Une chose que cette page énonce clairement, que la plupart des guides passent sous silence : le dépôt GitHub est archivé, donc faites tourner le projet en intégrant ce fait dans votre décision.

Réponse rapide : les valeurs dont Narratium a besoin.

La connexion LLM de Narratium est le triplet standard compatible OpenAI, saisi dans ses réglages API : une base URL, une clé API et un nom de modèle. Pour cette passerelle, ce sont https://api.apisrouter.com/v1, votre clé sk-..., et n'importe quel id du catalogue, deepseek-v4-flash étant le premier choix raisonnable pour du trafic narratif. Le README du projet recommande exactement cette classe de connexion : des API au format OpenAI en direct, un endpoint multi-modèle unifié pour la variété, ou Ollama et LM Studio pour des modèles locaux, le tout via la même surface de configuration. Les libellés exacts des champs varient entre la version web et les différentes versions, donc traitez les libellés avec souplesse et les valeurs à la lettre : l'URL s'arrête à /v1, la clé se colle proprement, et l'id du modèle correspond au caractère près à la chaîne du catalogue.

Base URL:  https://api.apisrouter.com/v1
API key:   sk-...              (from APIsRouter)
Model:     deepseek-v4-flash   (typed exactly; any catalog id works)

Ce qu'est Narratium, et son statut, énoncés clairement.

Narratium (Narratium/Narratium.ai sur GitHub) se présentait comme le « VSCode du roleplay » : un client open source pour l'écriture narrative pilotée par IA, la création d'univers et la fiction interactive longue, avec compatibilité des fiches de personnage SillyTavern, persistance de la mémoire et un système de plugins. Le code est sous licence AGPL, il a rapidement attiré une vraie communauté, et il reste l'un des clients ouverts les plus intéressants de la scène. Voici maintenant la partie que la plupart des guides de configuration omettent : le dépôt GitHub est archivé et en lecture seule (GitHub indique le 30 mars 2026 comme date d'archivage). Archivé ne veut pas dire cassé, le code tourne exactement aussi bien qu'au jour où il a été figé, mais cela signifie qu'aucun mainteneur ne livre plus de correctifs, de mises à jour de dépendances ou de patchs de sécurité, et que les instances hébergées associées au projet doivent être considérées au mieux comme du best-effort. Si vous adoptez Narratium aujourd'hui, la voie fiable consiste à le faire tourner vous-même depuis les sources ou une release, avec pour attente réaliste un ensemble de fonctionnalités figé. Ce statut change le conseil API d'une manière précise : un client figé est exactement la situation où vous voulez que le côté modèle reste flexible. Narratium ne peut plus ajouter de nouvelles intégrations de fournisseurs, mais un endpoint compatible OpenAI qu'il sait déjà parler continue de servir tous les nouveaux modèles qui apparaissent derrière cet endpoint. Le schéma de la passerelle rend en pratique pérenne un client qui n'évolue plus.

Étapes de configuration.

Le dépannage suit le schéma universel : prouvez d'abord les trois valeurs avec une requête curl, et si curl réussit alors que l'application échoue, les coupables habituels sont une URL avec un segment de chemin superflu, des espaces dans la clé, ou un blocage CORS du navigateur sur les versions web, visible dans la console développeur. Comme aucun mainteneur ne livrera plus de correctif pour les bizarreries côté application, l'habitude de tester curl en premier compte un peu plus ici : elle vous dit immédiatement de quel côté de la connexion vous pouvez réellement agir.

  • Faites tourner Narratium : auto-hébergez-le depuis les sources GitHub ou une release (le dépôt est en lecture seule mais reste entièrement clonable), ou utilisez une instance hébergée si l'une d'elles, en laquelle vous avez confiance, fonctionne encore.
  • Ouvrez les réglages et trouvez la section de configuration API / LLM.
  • Sélectionnez le type de connexion au format OpenAI plutôt qu'Ollama, puisque vous pointez vers un endpoint hébergé.
  • Saisissez la base URL https://api.apisrouter.com/v1 et collez votre clé.
  • Tapez l'id du modèle exactement : deepseek-v4-flash pour commencer.
  • Enregistrez et envoyez un court message dans une nouvelle histoire pour confirmer l'aller-retour.

Fiches, univers, et ce qui survit si vous partez.

Narratium lit les fiches de personnage compatibles SillyTavern, ce qui est le fait de compatibilité le plus important à son sujet. Vos personnages sont des artefacts portables : les fiches écrites ailleurs s'importent, et le travail investi dans les personas et les notes d'univers n'est pas enfermé dans un client dont le développement s'est arrêté. Si vous migrez un jour, SillyTavern, RisuAI et Wyvern parlent tous la même filiation de fiches, et les pages de configuration liées ci-dessous couvrent chacun d'eux. La même logique de portabilité s'applique côté modèle. Comme Narratium parle à un endpoint /v1 générique, rien dans votre configuration fournisseur n'est spécifique à Narratium : la même clé et la même base URL se réutilisent telles quelles dans n'importe quel autre frontend. Entre des fiches portables et un endpoint portable, le coût de changement de toute la pile s'arrondit à zéro, ce qui est la bonne posture à adopter envers tout projet archivé que vous continuez d'apprécier.

Choix de modèles pour le style long format de Narratium.

La conception de Narratium est centrée sur de longs récits ramifiés, ce qui fait pencher le choix du modèle vers la cohérence sur de longs horizons. deepseek-v4-flash porte les sessions du quotidien aux tarifs les plus bas du catalogue, avec des dialogues que la communauté du roleplay note systématiquement au-dessus de son prix. glm-5.1 et kimi-k2.6 tournent en rotation pour varier les voix, et glm-5.2 se justifie sur les chapitres riches en détails, là où son respect des instructions sur un long horizon compense sa latence de raisonnement. claude-sonnet-4-6 reste le plafond de prose SFW pour les chapitres qui le méritent. Comme le frontend renvoie le contexte de l'histoire à chaque tour, les tokens d'entrée dominent le coût, et une fenêtre de travail délibérément choisie bat une fenêtre maximale ; le guide de longueur de contexte lié ci-dessous fait le calcul. La politique de contenu n'est changée par rien de tout cela : les politiques des modèles et les conditions de plateforme applicables s'appliquent telles qu'écrites, et la page de comparaison des politiques couvre factuellement quelles familles conviennent à quelles classifications de contenu.

Paiement à l'usage · en dessous du tarif officiel

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModèlePrix officielNotre prix
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M
GLM-5.1$0.86 / $3.43 per M$0.90 / $3.40 per M
Kimi K2.6$0.95 / $4.00 per M$1.00 / $4.00 per M
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M

Faut-il quand même adopter un client archivé ?

Un bilan coûts-bénéfices honnête, puisque cette page reste de toute façon le guide de configuration. Pour : le code est ouvert, l'interface est vraiment bonne pour des histoires longues et structurées, les fiches s'importent et s'exportent librement, et un endpoint générique garde le côté modèle à jour pour toujours. Contre : aucun patch de sécurité, aucune correction de bug, des dépendances qui vieillissent sur place, et toute instance hébergée qui vit en sursis. Pour un client de loisir tournant en local contre une clé facturée à l'usage, ce profil de risque est acceptable pour beaucoup de gens ; pour tout ce qui implique d'autres utilisateurs ou des données sensibles, ça ne l'est pas. La voie médiane est celle que cette page décrit depuis le début : faites-le tourner vous-même, conservez votre investissement dans les couches portables (fiches, lorebooks, l'endpoint), et traitez le client comme remplaçable. Les frontends de cette scène vont et viennent ; une histoire adossée à des fiches portables et un endpoint /v1 stable leur survit à tous.

Questions fréquentes

Comment définir une base URL API personnalisée dans Narratium ?

Dans les réglages API, choisissez la connexion au format OpenAI, puis saisissez la base URL https://api.apisrouter.com/v1, votre clé, et un id de modèle exact comme deepseek-v4-flash. Le README recommande des API au format OpenAI ou un endpoint multi-modèle unifié, ce qui correspond précisément à cette configuration.

Narratium est-il toujours maintenu ?

Non. Le dépôt GitHub est archivé et en lecture seule (GitHub indique le 30 mars 2026 comme date d'archivage), donc plus aucun correctif ni mise à jour n'est livré. Le code tourne toujours et reste clonable ; l'auto-hébergement est le moyen fiable de l'utiliser, avec pour attente un ensemble de fonctionnalités figé.

Narratium fonctionne-t-il avec les fiches de personnage SillyTavern ?

Oui, la compatibilité des fiches avec le format SillyTavern est l'une de ses fonctionnalités documentées, ce qui garde vos personnages portables dans les deux sens : les fiches s'importent dans Narratium, et votre travail n'est pas bloqué si vous passez ensuite à SillyTavern, RisuAI ou Wyvern.

Quels modèles fonctionnent avec Narratium via une passerelle ?

Tout ce que sert l'endpoint, puisque Narratium envoie le nom du modèle comme une simple chaîne de caractères : deepseek-v4-flash et glm-5.1 pour le volume, kimi-k2.6 pour la rotation, glm-5.2 pour les chapitres riches en détails, claude-sonnet-4-6 pour la prose SFW. Changer de modèle est un simple réglage, et l'historique du chat reste dans le client.

Puis-je faire tourner Narratium entièrement en local ?

Oui, en deux sens : le client s'auto-héberge depuis les sources archivées, et son support d'Ollama fait aussi tourner des modèles en local. L'hybride sur lequel la plupart des gens se posent est un client local avec un endpoint hébergé derrière, ce qui garde le traitement des données entre vos mains tout en atteignant des modèles qu'aucun GPU grand public ne peut servir.

Utiliser un endpoint personnalisé enfreint-il des conditions d'utilisation ?

Narratium est open source et conçu exactement pour cette configuration. Ce qu'un endpoint personnalisé ne change jamais, c'est la politique de contenu côté modèle : les règles écrites de chaque famille s'appliquent quel que soit l'endroit d'où elle est servie, et la page de comparaison des politiques les couvre factuellement.