راه‌اندازی API سفارشی Narratium: base URL، کلید، مدل.

Updated 2026-07-29

Narratium یک کلاینت open-source برای roleplay و داستان‌نویسی است که رابط کاربری خودش را دارد اما هیچ مدلی از خودش ندارد: README آن کاربران را به سمت API های با فرمت OpenAI، endpoint های یکپارچه به سبک OpenRouter، و Ollama محلی هدایت می‌کند. تنظیمات API آن را با یک کلید به https://api.apisrouter.com/v1 اشاره دهید و کل کاتالوگ به backend آن تبدیل می‌شود. یک نکته که این صفحه صریح بیان می‌کند و اکثر راهنماها از آن می‌گذرند: مخزن GitHub آرشیو شده است، پس این واقعیت را در تصمیم خود لحاظ کنید.

پاسخ سریع: مقادیری که Narratium نیاز دارد.

اتصال LLM در Narratium همان سه‌گانه استاندارد سازگار با OpenAI است که در تنظیمات API آن وارد می‌شود: یک base URL، یک API key، و یک نام مدل. برای این gateway این‌ها https://api.apisrouter.com/v1، کلید sk-... شما، و هر id کاتالوگ هستند؛ deepseek-v4-flash انتخاب اول منطقی برای ترافیک داستانی است. README پروژه دقیقاً همین دسته از اتصال را توصیه می‌کند: API های با فرمت OpenAI به‌طور مستقیم، یک endpoint یکپارچه چند-مدلی برای تنوع، یا Ollama و LM Studio برای مدل‌های محلی، همه از طریق همان سطح پیکربندی. برچسب‌های دقیق فیلد بین نسخه وب و نسخه‌های مختلف تفاوت دارند، پس با برچسب‌ها آسان‌گیر باشید و با مقادیر دقیق باشید: URL باید به /v1 ختم شود، کلید تمیز paste شود، id مدل کاراکتر به کاراکتر با رشته کاتالوگ مطابقت داشته باشد.

Base URL:  https://api.apisrouter.com/v1
API key:   sk-...              (from APIsRouter)
Model:     deepseek-v4-flash   (typed exactly; any catalog id works)

Narratium چیست، و وضعیت آن، به‌صورت صریح بیان‌شده.

Narratium (‏Narratium/Narratium.ai روی GitHub) خودش را به‌عنوان VSCode برای roleplay معرفی کرد: یک کلاینت open-source برای داستان‌سرایی هدایت‌شده با AI، جهان‌سازی، و داستان تعاملی بلند، با سازگاری کارت کاراکتر SillyTavern، پایداری حافظه، و یک سیستم پلاگین. کد آن با مجوز AGPL منتشر شده، به سرعت یک جامعه واقعی جذب کرد، و همچنان یکی از جالب‌ترین کلاینت‌های open در این صحنه است. حالا بخشی که اکثر راهنماهای راه‌اندازی از قلم می‌اندازند: مخزن GitHub آرشیو و فقط-خواندنی شده است (GitHub تاریخ آرشیو را ۳۰ مارس ۲۰۲۶ نشان می‌دهد). آرشیو‌شده به معنای خراب بودن نیست، کد دقیقاً همان‌طور که روز منجمد شدنش کار می‌کرد اجرا می‌شود، اما یعنی هیچ maintainer ای fix، به‌روزرسانی dependency، یا patch امنیتی منتشر نمی‌کند، و نمونه‌های hosted مرتبط با پروژه باید حداکثر به‌عنوان best-effort در نظر گرفته شوند. اگر امروز Narratium را انتخاب کنید، مسیر قابل‌اعتماد اجرای خودتان از source یا یک release است، و انتظار واقع‌بینانه یک مجموعه ویژگی منجمد است. آن وضعیت توصیه API را دقیقاً به یک شکل تغییر می‌دهد: یک کلاینت منجمد دقیقاً همان موقعیتی است که می‌خواهید سمت مدل انعطاف‌پذیر بماند. Narratium دیگر نمی‌تواند یکپارچه‌سازی provider جدید اضافه کند، اما یک endpoint سازگار با OpenAI که از قبل با آن صحبت می‌کند، به سرویس‌دهی هر مدل جدیدی که پشت آن endpoint ظاهر شود ادامه می‌دهد. الگوی gateway عملاً یک کلاینت که دیگر حرکت نمی‌کند را future-proof می‌کند.

راهنمای گام‌به‌گام راه‌اندازی.

عیب‌یابی از الگوی جهانی پیروی می‌کند: ابتدا سه مقدار را با یک درخواست curl اثبات کنید، و اگر curl موفق می‌شود در حالی که اپ شکست می‌خورد، مقصرهای معمول یک URL با یک بخش مسیر اضافه، فاصله در کلید، یا یک بلاک CORS سمت مرورگر است، که در نسخه‌های وب در developer console قابل مشاهده است. از آنجا که دیگر هیچ maintainer ای برای عجیب‌وغریبی‌های سمت اپ fix منتشر نمی‌کند، عادت curl-first اینجا کمی بیشتر اهمیت دارد: بلافاصله به شما می‌گوید کدام سمت اتصال واقعاً می‌توانید روی آن کاری انجام دهید.

  • Narratium را اجرا کنید: self-host از source یا یک release در GitHub (مخزن فقط-خواندنی است اما کاملاً clone‌پذیر)، یا از یک نمونه hosted استفاده کنید اگر یکی هست که هنوز مورد اعتمادتان کار می‌کند.
  • تنظیمات را باز کنید و بخش پیکربندی API / LLM را پیدا کنید.
  • نوع اتصال با فرمت OpenAI را به‌جای Ollama انتخاب کنید، چون به یک endpoint hosted اشاره می‌دهید.
  • base URL یعنی https://api.apisrouter.com/v1 را وارد کنید و کلید خود را paste کنید.
  • id مدل را دقیقاً تایپ کنید: deepseek-v4-flash برای شروع.
  • ذخیره کنید و یک پیام کوتاه در یک داستان تازه بفرستید تا round trip را تأیید کنید.

کارت‌ها، دنیاها، و آنچه اگر بروید باقی می‌ماند.

Narratium کارت‌های کاراکتر سازگار با SillyTavern را می‌خواند، که مهم‌ترین واقعیت سازگاری درباره آن است. کاراکترهای شما artifact های قابل حمل هستند: کارت‌های نوشته‌شده در جای دیگر import می‌شوند، و کاری که روی پرسونا و یادداشت‌های جهان گذاشته‌اید به یک کلاینت که توسعه‌اش متوقف شده قفل نیست. اگر روزی migrate کنید، SillyTavern، RisuAI، و Wyvern همه از همان تبار کارت صحبت می‌کنند، و صفحات راه‌اندازی زیر هرکدام را پوشش می‌دهند. همان منطق قابلیت‌حمل روی سمت مدل هم صدق می‌کند. چون Narratium با یک endpoint عمومی /v1 صحبت می‌کند، هیچ‌چیز درباره راه‌اندازی provider شما مختص Narratium نیست: همان کلید و base URL بدون تغییر در هر frontend دیگری قرار می‌گیرد. بین کارت‌های قابل‌حمل و یک endpoint قابل‌حمل، هزینه جابه‌جایی کل استک تقریباً صفر می‌شود، که موضع درستی نسبت به هر پروژه آرشیو‌شده‌ای است که هنوز از استفاده از آن لذت می‌برید.

انتخاب مدل برای سبک بلند-فرم Narratium.

طراحی Narratium حول روایت‌های شاخه‌ای بلند می‌چرخد، که انتخاب مدل را به سمت ثبات در افق‌های بلند سنگین می‌کند. deepseek-v4-flash session های روزمره را با پایین‌ترین نرخ‌های کاتالوگ حمل می‌کند با دیالوگی که جامعه roleplay به‌طور مداوم بالاتر از قیمتش رتبه می‌دهد. glm-5.1 و kimi-k2.6 برای تنوع صدا در چرخش می‌آیند، و glm-5.2 فصل‌های سنگین از نظر جزئیات را به‌دست می‌آورد جایی که پیروی از دستور در افق بلند آن بر تأخیر استدلالش می‌چربد. claude-sonnet-4-6 همچنان سقف نثر safe-for-work برای فصل‌هایی است که لیاقتش را دارند. چون frontend context داستان را هر turn دوباره ارسال می‌کند، token های ورودی بر هزینه غالب هستند، و یک پنجره کاری عمدی از یک پنجره حداکثری بهتر است؛ راهنمای طول context پیوندشده زیر این حساب را انجام می‌دهد. سیاست محتوا با هیچ‌کدام از این‌ها تغییر نمی‌کند: سیاست‌های مدل و شرایط پلتفرم قابل‌اجرا همان‌طور که نوشته شده‌اند اعمال می‌شوند، و صفحه مقایسه سیاست‌ها پوشش می‌دهد کدام خانواده‌ها با کدام رده‌بندی محتوا سازگارند، به‌صورت واقعی.

پرداخت بر اساس مصرف · پایین‌تر از قیمت رسمی

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

مدلقیمت رسمیقیمت ما
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M
GLM-5.1$0.86 / $3.43 per M$0.90 / $3.40 per M
Kimi K2.6$0.95 / $4.00 per M$1.00 / $4.00 per M
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M

آیا هنوز باید یک کلاینت آرشیو‌شده را انتخاب کنید؟

یک تحلیل هزینه-فایده صادقانه، چون این صفحه در هر صورت راهنمای راه‌اندازی است. به نفع: کد open است، رابط کاربری واقعاً برای داستان‌های بلند و ساختاریافته خوب است، کارت‌ها هم ورودی هم خروجی قابل‌حمل هستند، و یک endpoint عمومی سمت مدل را برای همیشه به‌روز نگه می‌دارد. برخلاف: بدون patch امنیتی، بدون رفع باگ، dependency هایی که در جا کهنه می‌شوند، و هر نمونه hosted روی زمان قرضی زندگی می‌کند. برای یک کلاینت هابی که به‌صورت محلی در برابر یک کلید متری اجرا می‌شود، آن پروفایل ریسک برای بسیاری قابل‌قبول است؛ برای هرچیزی با کاربران دیگر یا داده حساس، نیست. مسیر میانی همانی است که این صفحه در سراسر آن توصیف کرده: خودتان اجرا کنید، سرمایه‌گذاری‌تان را در لایه‌های قابل‌حمل (کارت‌ها، lorebook ها، endpoint) نگه دارید، و کلاینت را قابل‌جایگزین در نظر بگیرید. Frontend ها در این صحنه می‌آیند و می‌روند؛ یک داستان که با کارت‌های قابل‌حمل و یک endpoint پایدار پشتیبانی می‌شود از همه آن‌ها بیشتر عمر می‌کند.

پرسش‌های پرتکرار

چطور یک base URL سفارشی API در Narratium تنظیم کنم؟

در تنظیمات API، اتصال با فرمت OpenAI را انتخاب کنید، سپس base URL یعنی https://api.apisrouter.com/v1، کلید خود، و یک id دقیق مدل مثل deepseek-v4-flash را وارد کنید. README همین دسته اتصال را توصیه می‌کند: API های با فرمت OpenAI یا یک endpoint یکپارچه چند-مدلی.

آیا Narratium هنوز maintain می‌شود؟

نه. مخزن GitHub آرشیو و فقط-خواندنی است (GitHub تاریخ آرشیو را ۳۰ مارس ۲۰۲۶ نشان می‌دهد)، پس هیچ fix یا به‌روزرسانی‌ای منتشر نمی‌شود. کد همچنان اجرا می‌شود و clone‌پذیر باقی می‌ماند؛ self-hosting راه قابل‌اعتماد استفاده از آن است، با انتظارات تنظیم‌شده روی یک مجموعه ویژگی منجمد.

آیا Narratium با کارت‌های کاراکتر SillyTavern کار می‌کند؟

بله، سازگاری کارت با فرمت SillyTavern یکی از ویژگی‌های مستند آن است، که کاراکترهای شما را در هر دو جهت قابل‌حمل نگه می‌دارد: کارت‌ها به Narratium import می‌شوند، و کارتان اگر بعداً به SillyTavern، RisuAI، یا Wyvern نقل مکان کنید از دست نمی‌رود.

کدام مدل‌ها از طریق یک gateway با Narratium کار می‌کنند؟

هرچیزی که endpoint سرویس می‌دهد، چون Narratium نام مدل را به‌صورت رشته ساده ارسال می‌کند: deepseek-v4-flash و glm-5.1 برای حجم، kimi-k2.6 برای چرخش، glm-5.2 برای فصل‌های سنگین از نظر جزئیات، claude-sonnet-4-6 برای نثر safe-for-work. جابه‌جایی یک تغییر تنظیمات است، و تاریخچه چت با کلاینت می‌ماند.

آیا می‌توانم Narratium را کاملاً به‌صورت محلی اجرا کنم؟

بله، به دو معنا: کلاینت از source آرشیو‌شده self-host می‌شود، و پشتیبانی Ollama آن هم مدل‌ها را محلی اجرا می‌کند. ترکیبی که اکثر مردم به آن می‌رسند یک کلاینت محلی با یک endpoint hosted پشت آن است، که مدیریت داده را در دست شما نگه می‌دارد در حالی که به مدل‌هایی می‌رسد که هیچ GPU مصرفی سرویس نمی‌دهد.

آیا استفاده از یک endpoint سفارشی برخلاف قوانینی است؟

Narratium open source است و دقیقاً برای این پیکربندی ساخته شده. چیزی که یک endpoint سفارشی هرگز تغییر نمی‌دهد سیاست محتوای سمت مدل است: قوانین نوشته‌شده هر خانواده هرجا سرویس داده شود اعمال می‌شود، و صفحه مقایسه سیاست‌ها آن‌ها را به‌صورت واقعی پوشش می‌دهد.