Configuração de API personalizada do Narratium: base URL, chave, modelo.

Updated 2026-07-29

O Narratium é um cliente de código aberto para roleplay e narrativa que traz sua própria interface e nenhum modelo próprio: seu README aponta os usuários para APIs no formato OpenAI, endpoints unificados estilo OpenRouter e Ollama local. Aponte suas configurações de API para https://api.apisrouter.com/v1 com uma chave e o catálogo inteiro vira seu backend. Uma coisa que esta página afirma sem rodeios e que a maioria dos guias evita: o repositório no GitHub está arquivado, então rode-o com esse fato já precificado.

Resposta rápida: os valores que o Narratium precisa.

A conexão LLM do Narratium é o trio padrão compatível com OpenAI, inserido em suas configurações de API: uma base URL, uma chave de API e um nome de modelo. Para este gateway, esses valores são https://api.apisrouter.com/v1, sua chave sk-... e qualquer id do catálogo, sendo deepseek-v4-flash a escolha inicial sensata para tráfego de histórias. O README do projeto recomenda exatamente essa classe de conexão: APIs no formato OpenAI diretamente, um endpoint unificado multi-modelo para variedade, ou Ollama e LM Studio para modelos locais, tudo pela mesma superfície de configuração. Os rótulos exatos dos campos variam entre a versão web e as diferentes versões, então trate os rótulos com flexibilidade e os valores com exatidão: a URL termina em /v1, a chave é colada limpa, e o id do modelo corresponde à string do catálogo caractere por caractere.

Base URL:  https://api.apisrouter.com/v1
API key:   sk-...              (da APIsRouter)
Model:     deepseek-v4-flash   (digitado exatamente; qualquer id do catálogo funciona)

O que é o Narratium, e seu status, exposto sem rodeios.

O Narratium (Narratium/Narratium.ai no GitHub) se apresentava como o VSCode do roleplay: um cliente de código aberto para narrativa guiada por IA, construção de mundo e ficção interativa longa, com compatibilidade de cards de personagem do SillyTavern, persistência de memória e um sistema de plugins. O código é licenciado sob AGPL, atraiu uma comunidade real rapidamente, e continua sendo um dos clientes abertos mais interessantes do cenário. Agora a parte que a maioria dos guias de configuração omite: o repositório no GitHub está arquivado e é somente leitura (o GitHub mostra a data de arquivamento como 30 de março de 2026). Arquivado não significa quebrado, o código roda exatamente tão bem quanto no dia em que foi congelado, mas significa que nenhum mantenedor está entregando correções, atualizações de dependências ou patches de segurança, e as instâncias hospedadas associadas ao projeto devem ser tratadas, no máximo, como um esforço de melhor-esforço. Se você adotar o Narratium hoje, a rota confiável é rodá-lo você mesmo a partir do código-fonte ou de um release, e a expectativa realista é um conjunto de recursos congelado. Esse status muda o conselho sobre a API de uma forma bem específica: um cliente congelado é exatamente a situação em que você quer que o lado do modelo permaneça flexível. O Narratium não pode mais adicionar novas integrações de provedor, mas um endpoint compatível com OpenAI que ele já fala continua servindo qualquer modelo novo que apareça atrás desse endpoint. O padrão de gateway efetivamente blinda o futuro de um cliente que não está mais em movimento.

Passo a passo da configuração.

A depuração segue o padrão universal: prove os três valores com uma requisição curl primeiro, e se o curl funciona enquanto o app falha, os culpados de sempre são uma URL com um segmento de caminho extra, espaço em branco na chave, ou um bloqueio de CORS no navegador em versões web, visível no console do desenvolvedor. Já que nenhum mantenedor vai mais lançar uma correção para peculiaridades do lado do app, o hábito de testar com curl primeiro importa um pouco mais aqui: ele te diz imediatamente qual lado da conexão você realmente pode fazer algo a respeito.

  • Coloque o Narratium para rodar: auto-hospede a partir do código-fonte no GitHub ou de um release (o repositório é somente leitura mas totalmente clonável), ou use uma instância hospedada se ainda houver uma em que você confie.
  • Abra as configurações e encontre a seção de configuração de API / LLM.
  • Selecione o tipo de conexão no formato OpenAI em vez de Ollama, já que você está apontando para um endpoint hospedado.
  • Insira a base URL https://api.apisrouter.com/v1 e cole sua chave.
  • Digite o id do modelo exatamente: deepseek-v4-flash para começar.
  • Salve e envie uma mensagem curta em uma história nova para confirmar a ida e volta.

Cards, mundos, e o que sobrevive se você sair.

O Narratium lê cards de personagem compatíveis com o SillyTavern, que é o fato de compatibilidade mais importante sobre ele. Seus personagens são artefatos portáteis: cards escritos em outro lugar são importados, e o trabalho que você colocou em personas e notas de mundo não fica preso a um cliente cujo desenvolvimento parou. Se você algum dia migrar, SillyTavern, RisuAI e Wyvern todos falam a mesma linhagem de cards, e as páginas de configuração linkadas abaixo cobrem cada um. A mesma lógica de portabilidade se aplica ao lado do modelo. Como o Narratium fala com um endpoint /v1 genérico, nada na sua configuração de provedor é específico do Narratium: a mesma chave e base URL entram em qualquer outro frontend sem alteração. Entre cards portáteis e um endpoint portátil, o custo de troca de toda a pilha tende a zero, que é a postura correta para qualquer projeto arquivado que você ainda goste de usar.

Escolhas de modelo para o estilo de narrativa longa do Narratium.

O design do Narratium é centrado em narrativas longas e ramificadas, o que pesa a escolha de modelo em direção à consistência ao longo de horizontes longos. O deepseek-v4-flash carrega as sessões do dia a dia nas tarifas mais baixas do catálogo com diálogos que a comunidade de roleplay consistentemente avalia acima do seu preço. glm-5.1 e kimi-k2.6 alternam para dar variedade de voz, e glm-5.2 ganha capítulos ricos em detalhe onde sua aderência a instruções de longo horizonte compensa sua latência de raciocínio. claude-sonnet-4-6 continua sendo o teto de prosa segura para o trabalho (SFW) para os capítulos que merecem. Como o frontend reenvia o contexto da história a cada turno, os tokens de entrada dominam o custo, e uma janela de trabalho deliberada vence uma maximalista; o guia de tamanho de contexto linkado abaixo faz essa conta. A política de conteúdo não muda em nada disso: as políticas de cada modelo e os termos de plataforma aplicáveis valem como estão escritos, e a página de comparação de políticas cobre quais famílias combinam com quais classificações de conteúdo, de forma factual.

Pague pelo uso · abaixo do preço oficial

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModeloPreço oficialNosso preço
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M
GLM-5.1$0.86 / $3.43 per M$0.90 / $3.40 per M
Kimi K2.6$0.95 / $4.00 per M$1.00 / $4.00 per M
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M

Ainda vale a pena adotar um cliente arquivado?

Uma análise honesta de custo-benefício, já que esta página é o guia de configuração de qualquer forma. A favor: o código é aberto, a interface é genuinamente boa para histórias longas e estruturadas, os cards são portáteis para dentro e para fora, e um endpoint genérico mantém o lado do modelo atualizado para sempre. Contra: nenhum patch de segurança, nenhuma correção de bug, dependências envelhecendo no lugar, e qualquer instância hospedada vivendo emprestada. Para um cliente hobby rodando localmente contra uma chave medida, esse perfil de risco é aceitável para muita gente; para qualquer coisa com outros usuários ou dados sensíveis, não é. O caminho do meio é o que esta página vem descrevendo o tempo todo: rode você mesmo, mantenha seu investimento nas camadas portáteis (cards, lorebooks, o endpoint), e trate o cliente como substituível. Frontends nesse cenário vêm e vão; uma história apoiada em cards portáteis e um endpoint /v1 estável sobrevive a todos eles.

Perguntas frequentes

Como eu configuro uma base URL de API personalizada no Narratium?

Nas configurações de API, escolha a conexão no formato OpenAI, depois insira a base URL https://api.apisrouter.com/v1, sua chave, e um id de modelo exato como deepseek-v4-flash. O README recomenda APIs no formato OpenAI ou um endpoint unificado multi-modelo, que é precisamente essa configuração.

O Narratium ainda é mantido?

Não. O repositório no GitHub está arquivado e é somente leitura (o GitHub mostra 30 de março de 2026 como data de arquivamento), então nenhuma correção ou atualização está sendo lançada. O código ainda roda e continua clonável; auto-hospedar é a forma confiável de usá-lo, com expectativas ajustadas para um conjunto de recursos congelado.

O Narratium funciona com cards de personagem do SillyTavern?

Sim, a compatibilidade de cards com o formato SillyTavern é um dos seus recursos documentados, o que mantém seus personagens portáteis nas duas direções: cards são importados no Narratium, e seu trabalho não fica preso se você depois migrar para SillyTavern, RisuAI ou Wyvern.

Quais modelos funcionam com o Narratium por um gateway?

Qualquer um que o endpoint sirva, já que o Narratium envia o nome do modelo como uma string simples: deepseek-v4-flash e glm-5.1 para volume, kimi-k2.6 para alternância, glm-5.2 para capítulos ricos em detalhe, claude-sonnet-4-6 para prosa segura para o trabalho. Trocar é uma mudança de configuração, e o histórico de chat fica com o cliente.

Posso rodar o Narratium totalmente local?

Sim, em dois sentidos: o cliente se auto-hospeda a partir do código-fonte arquivado, e seu suporte a Ollama também roda modelos localmente. O híbrido em que a maioria das pessoas acaba é um cliente local com um endpoint hospedado por trás, o que mantém o tratamento de dados nas suas mãos enquanto alcança modelos que nenhuma GPU de consumidor serve.

Usar um endpoint personalizado vai contra algum termo?

O Narratium é de código aberto e feito exatamente para essa configuração. O que um endpoint personalizado nunca muda é a política de conteúdo do lado do modelo: as regras escritas de cada família se aplicam onde quer que ela seja servida, e a página de comparação de políticas cobre isso de forma factual.