Narratium Custom-API-Setup: Base URL, Key, Modell.
Updated 2026-07-29
Narratium ist ein Open-Source-Client für Roleplay und Storytelling, der ein eigenes Interface mitbringt, aber keine eigenen Modelle: Sein README verweist Nutzer auf OpenAI-Format-APIs, OpenRouter-artige Unified-Endpoints und lokales Ollama. Richte seine API-Settings auf https://api.apisrouter.com/v1 mit einem Key, und der gesamte Katalog wird zu seinem Backend. Eine Sache, die diese Seite offen benennt, die die meisten Guides auslassen: Das GitHub-Repository ist archiviert, betreibe es also mit dieser Tatsache eingepreist.
Kurzantwort: die Werte, die Narratium braucht.
Narratiums LLM-Verbindung ist das übliche OpenAI-kompatible Tripel, eingetragen in seinen API-Settings: eine Base URL, ein API-Key und ein Modellname. Für dieses Gateway sind das https://api.apisrouter.com/v1, dein sk-...-Key, und jede beliebige Katalog-ID, wobei deepseek-v4-flash die sinnvolle erste Wahl für Story-Traffic ist. Das README des Projekts empfiehlt genau diese Verbindungsklasse: OpenAI-Format-APIs direkt, einen Unified-Multi-Model-Endpoint für Abwechslung, oder Ollama und LM Studio für lokale Modelle, alle über dieselbe Konfigurationsoberfläche. Die exakten Feldbeschriftungen unterscheiden sich zwischen Web-Build und Versionen, behandle Labels also locker und Werte exakt: Die URL endet bei /v1, der Key wird sauber eingefügt, die Modell-ID stimmt Zeichen für Zeichen mit dem Katalog-String überein.
Base URL: https://api.apisrouter.com/v1
API key: sk-... (from APIsRouter)
Model: deepseek-v4-flash (typed exactly; any catalog id works)Was Narratium ist, und sein Status, offen benannt.
Narratium (Narratium/Narratium.ai auf GitHub) präsentierte sich als VSCode für Roleplay: ein Open-Source-Client für KI-gesteuertes Storytelling, Worldbuilding und Long-Form-Interactive-Fiction, mit SillyTavern-Character-Card-Kompatibilität, Memory-Persistenz und einem Plugin-System. Der Code ist AGPL-lizenziert, er zog schnell eine echte Community an, und er bleibt einer der interessanteren offenen Clients in der Szene. Nun der Teil, den die meisten Setup-Guides auslassen: Das GitHub-Repository ist archiviert und read-only (GitHub zeigt den 30. März 2026 als Archivierungsdatum). Archiviert heißt nicht kaputt, der Code läuft genau so gut wie am Tag, an dem er eingefroren wurde, aber es heißt, dass kein Maintainer Fixes, Dependency-Updates oder Security-Patches ausliefert, und gehostete Instanzen rund um das Projekt sollten bestenfalls als Best-Effort behandelt werden. Wenn du Narratium heute einsetzt, ist der verlässliche Weg, es selbst aus dem Source oder einem Release zu betreiben, und die realistische Erwartung ist ein eingefrorener Funktionsumfang. Dieser Status verändert den API-Rat auf eine bestimmte Weise: Ein eingefrorener Client ist genau die Situation, in der die Modellseite flexibel bleiben soll. Narratium kann keine neuen Provider-Integrationen mehr hinzufügen, aber ein OpenAI-kompatibler Endpoint, den es bereits spricht, bedient weiterhin jedes neue Modell, das hinter diesem Endpoint auftaucht. Das Gateway-Pattern macht einen Client, der sich nicht mehr bewegt, effektiv zukunftssicher.
Setup-Schritt-für-Schritt.
Troubleshooting folgt dem universellen Muster: Beweise die drei Werte zuerst mit einer curl-Anfrage, und wenn curl erfolgreich ist, während die App scheitert, sind die üblichen Übeltäter eine URL mit überzähligem Pfadsegment, Whitespace im Key, oder ein Browser-CORS-Block bei Web-Builds, sichtbar in der Developer-Console. Da kein Maintainer mehr einen Fix für App-seitige Eigenheiten ausliefern wird, zählt die Curl-First-Gewohnheit hier etwas mehr: Sie sagt dir sofort, an welcher Seite der Verbindung du tatsächlich etwas tun kannst.
- Bring Narratium zum Laufen: selbst hosten aus dem GitHub-Source oder einem Release (das Repo ist read-only, aber vollständig klonbar), oder nutze eine gehostete Instanz, falls eine, der du vertraust, noch läuft.
- Öffne die Settings und finde den API-/LLM-Konfigurationsbereich.
- Wähle den OpenAI-Format-Verbindungstyp statt Ollama, da du auf einen gehosteten Endpoint zeigst.
- Trage Base URL https://api.apisrouter.com/v1 ein und füge deinen Key ein.
- Tippe die Modell-ID exakt: zum Start deepseek-v4-flash.
- Speichern und eine kurze Nachricht in einer neuen Story senden, um den Round-Trip zu bestätigen.
Cards, Welten, und was übrig bleibt, wenn du gehst.
Narratium liest SillyTavern-kompatible Character-Cards, das ist die mit Abstand wichtigste Kompatibilitätstatsache über den Client. Deine Charaktere sind portable Artefakte: anderswo geschriebene Cards importieren sich, und die Arbeit, die du in Personas und World-Notes gesteckt hast, ist nicht an einen Client gebunden, dessen Entwicklung gestoppt ist. Migrierst du irgendwann, sprechen SillyTavern, RisuAI und Wyvern alle dieselbe Card-Linie, und die unten verlinkten Setup-Seiten decken jeden davon ab. Dieselbe Portabilitäts-Logik gilt für die Modellseite. Weil Narratium mit einem generischen /v1-Endpoint spricht, ist an deinem Provider-Setup nichts Narratium-spezifisch: derselbe Key und dieselbe Base URL passen unverändert in jedes andere Frontend. Zwischen portablen Cards und einem portablen Endpoint rundet sich der Wechselaufwand des gesamten Stacks auf null — die richtige Haltung gegenüber jedem archivierten Projekt, das du weiterhin gerne nutzt.
Modellempfehlungen für Narratiums Long-Form-Stil.
Narratiums Design zentriert sich um lange, verzweigte Narrative, was die Modellwahl in Richtung Konsistenz über lange Horizonte gewichtet. deepseek-v4-flash trägt alltägliche Sessions zu den niedrigsten Katalogpreisen, mit Dialogen, die die Roleplay-Community durchweg über seinem Preis bewertet. glm-5.1 und kimi-k2.6 rotieren für Stimmenvielfalt ein, und glm-5.2 verdient sich detailreiche Kapitel, wo seine Long-Horizon-Instruction-Adherence seine Reasoning-Latenz aufwiegt. claude-sonnet-4-6 bleibt die Safe-for-Work-Prosa-Obergrenze für Kapitel, die es verdienen. Weil das Frontend Story-Kontext bei jedem Turn erneut sendet, dominieren Input-Tokens die Kosten, und ein bewusst gewähltes Arbeitsfenster schlägt ein maximales; der unten verlinkte Context-Length-Guide macht die Rechnung. Die Content Policy ändert sich dadurch nicht: Modell-Policies und geltende Plattform-Bedingungen gelten wie geschrieben, und die Policies-Compared-Seite deckt sachlich ab, welche Familien zu welchen Content-Ratings passen.
Nutzungsbasiert · unter offiziellem Preis
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Modell | Offizieller Preis | Unser Preis |
|---|---|---|
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| GLM-5.1 | $0.86 / $3.43 per M | $0.90 / $3.40 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
Solltest du trotzdem einen archivierten Client einsetzen?
Eine ehrliche Kosten-Nutzen-Abwägung, da diese Seite so oder so der Setup-Guide ist. Dafür: Der Code ist offen, das Interface ist für strukturierte Long-Form-Storys wirklich gut, Cards sind rein und raus portabel, und ein generischer Endpoint hält die Modellseite für immer aktuell. Dagegen: keine Security-Patches, keine Bugfixes, Dependencies, die vor Ort altern, und jede gehostete Instanz lebt auf geliehener Zeit. Für einen Hobby-Client, der lokal gegen einen abgerechneten Key läuft, ist dieses Risikoprofil für viele Leute akzeptabel; für alles mit anderen Nutzern oder sensiblen Daten ist es das nicht. Der Mittelweg ist der, den diese Seite die ganze Zeit beschrieben hat: Betreibe es selbst, halte deine Investition in den portablen Schichten (Cards, Lorebooks, den Endpoint), und behandle den Client als ersetzbar. Frontends in dieser Szene kommen und gehen; eine Story, die auf portablen Cards und einem stabilen /v1-Endpoint aufbaut, überlebt sie alle.
Häufige Fragen
Wie setze ich eine Custom-API-Base-URL in Narratium?
Wähle in den API-Settings die OpenAI-Format-Verbindung, trage dann Base URL https://api.apisrouter.com/v1, deinen Key und eine exakte Modell-ID wie deepseek-v4-flash ein. Das README empfiehlt OpenAI-Format-APIs oder einen Unified-Multi-Model-Endpoint — genau diese Konfiguration.
Wird Narratium noch gepflegt?
Nein. Das GitHub-Repository ist archiviert und read-only (GitHub zeigt den 30. März 2026 als Archivierungsdatum), es werden also keine Fixes oder Updates mehr ausgeliefert. Der Code läuft weiterhin und bleibt klonbar; Self-Hosting ist der verlässliche Weg, ihn zu nutzen, mit der Erwartung eines eingefrorenen Funktionsumfangs.
Funktioniert Narratium mit SillyTavern-Character-Cards?
Ja, Card-Kompatibilität mit dem SillyTavern-Format ist eines seiner dokumentierten Features, was deine Charaktere in beide Richtungen portabel hält: Cards importieren sich in Narratium, und deine Arbeit strandet nicht, wenn du später zu SillyTavern, RisuAI oder Wyvern wechselst.
Welche Modelle funktionieren über ein Gateway mit Narratium?
Alles, was der Endpoint serviert, da Narratium den Modellnamen als reinen String sendet: deepseek-v4-flash und glm-5.1 für Volumen, kimi-k2.6 für Rotation, glm-5.2 für detailreiche Kapitel, claude-sonnet-4-6 für Safe-for-Work-Prosa. Wechseln ist eine Settings-Änderung, und der Chatverlauf bleibt beim Client.
Kann ich Narratium vollständig lokal betreiben?
Ja, in zweierlei Hinsicht: Der Client lässt sich aus dem archivierten Source selbst hosten, und seine Ollama-Unterstützung lässt Modelle auch lokal laufen. Der Hybrid, bei dem die meisten Leute landen, ist ein lokaler Client mit einem gehosteten Endpoint dahinter, was die Datenhandhabung in deiner Hand hält, während er Modelle erreicht, die keine Consumer-GPU serviert.
Verstößt die Nutzung eines Custom-Endpoints gegen irgendwelche Bedingungen?
Narratium ist Open Source und für genau diese Konfiguration gebaut. Was ein Custom-Endpoint nie ändert, ist die Content Policy auf Modellseite: Die geschriebenen Regeln jeder Familie gelten, egal woher sie serviert wird, und die Policies-Compared-Seite deckt das sachlich ab.