راهاندازی API سفارشی Narratium: base URL، کلید، مدل.
Updated 2026-07-29
Narratium یک کلاینت open-source برای roleplay و داستاننویسی است که رابط کاربری خودش را دارد اما هیچ مدلی از خودش ندارد: README آن کاربران را به سمت API های با فرمت OpenAI، endpoint های یکپارچه به سبک OpenRouter، و Ollama محلی هدایت میکند. تنظیمات API آن را با یک کلید به https://api.apisrouter.com/v1 اشاره دهید و کل کاتالوگ به backend آن تبدیل میشود. یک نکته که این صفحه صریح بیان میکند و اکثر راهنماها از آن میگذرند: مخزن GitHub آرشیو شده است، پس این واقعیت را در تصمیم خود لحاظ کنید.
پاسخ سریع: مقادیری که Narratium نیاز دارد.
اتصال LLM در Narratium همان سهگانه استاندارد سازگار با OpenAI است که در تنظیمات API آن وارد میشود: یک base URL، یک API key، و یک نام مدل. برای این gateway اینها https://api.apisrouter.com/v1، کلید sk-... شما، و هر id کاتالوگ هستند؛ deepseek-v4-flash انتخاب اول منطقی برای ترافیک داستانی است. README پروژه دقیقاً همین دسته از اتصال را توصیه میکند: API های با فرمت OpenAI بهطور مستقیم، یک endpoint یکپارچه چند-مدلی برای تنوع، یا Ollama و LM Studio برای مدلهای محلی، همه از طریق همان سطح پیکربندی. برچسبهای دقیق فیلد بین نسخه وب و نسخههای مختلف تفاوت دارند، پس با برچسبها آسانگیر باشید و با مقادیر دقیق باشید: URL باید به /v1 ختم شود، کلید تمیز paste شود، id مدل کاراکتر به کاراکتر با رشته کاتالوگ مطابقت داشته باشد.
Base URL: https://api.apisrouter.com/v1
API key: sk-... (from APIsRouter)
Model: deepseek-v4-flash (typed exactly; any catalog id works)Narratium چیست، و وضعیت آن، بهصورت صریح بیانشده.
Narratium (Narratium/Narratium.ai روی GitHub) خودش را بهعنوان VSCode برای roleplay معرفی کرد: یک کلاینت open-source برای داستانسرایی هدایتشده با AI، جهانسازی، و داستان تعاملی بلند، با سازگاری کارت کاراکتر SillyTavern، پایداری حافظه، و یک سیستم پلاگین. کد آن با مجوز AGPL منتشر شده، به سرعت یک جامعه واقعی جذب کرد، و همچنان یکی از جالبترین کلاینتهای open در این صحنه است. حالا بخشی که اکثر راهنماهای راهاندازی از قلم میاندازند: مخزن GitHub آرشیو و فقط-خواندنی شده است (GitHub تاریخ آرشیو را ۳۰ مارس ۲۰۲۶ نشان میدهد). آرشیوشده به معنای خراب بودن نیست، کد دقیقاً همانطور که روز منجمد شدنش کار میکرد اجرا میشود، اما یعنی هیچ maintainer ای fix، بهروزرسانی dependency، یا patch امنیتی منتشر نمیکند، و نمونههای hosted مرتبط با پروژه باید حداکثر بهعنوان best-effort در نظر گرفته شوند. اگر امروز Narratium را انتخاب کنید، مسیر قابلاعتماد اجرای خودتان از source یا یک release است، و انتظار واقعبینانه یک مجموعه ویژگی منجمد است. آن وضعیت توصیه API را دقیقاً به یک شکل تغییر میدهد: یک کلاینت منجمد دقیقاً همان موقعیتی است که میخواهید سمت مدل انعطافپذیر بماند. Narratium دیگر نمیتواند یکپارچهسازی provider جدید اضافه کند، اما یک endpoint سازگار با OpenAI که از قبل با آن صحبت میکند، به سرویسدهی هر مدل جدیدی که پشت آن endpoint ظاهر شود ادامه میدهد. الگوی gateway عملاً یک کلاینت که دیگر حرکت نمیکند را future-proof میکند.
راهنمای گامبهگام راهاندازی.
عیبیابی از الگوی جهانی پیروی میکند: ابتدا سه مقدار را با یک درخواست curl اثبات کنید، و اگر curl موفق میشود در حالی که اپ شکست میخورد، مقصرهای معمول یک URL با یک بخش مسیر اضافه، فاصله در کلید، یا یک بلاک CORS سمت مرورگر است، که در نسخههای وب در developer console قابل مشاهده است. از آنجا که دیگر هیچ maintainer ای برای عجیبوغریبیهای سمت اپ fix منتشر نمیکند، عادت curl-first اینجا کمی بیشتر اهمیت دارد: بلافاصله به شما میگوید کدام سمت اتصال واقعاً میتوانید روی آن کاری انجام دهید.
- Narratium را اجرا کنید: self-host از source یا یک release در GitHub (مخزن فقط-خواندنی است اما کاملاً cloneپذیر)، یا از یک نمونه hosted استفاده کنید اگر یکی هست که هنوز مورد اعتمادتان کار میکند.
- تنظیمات را باز کنید و بخش پیکربندی API / LLM را پیدا کنید.
- نوع اتصال با فرمت OpenAI را بهجای Ollama انتخاب کنید، چون به یک endpoint hosted اشاره میدهید.
- base URL یعنی https://api.apisrouter.com/v1 را وارد کنید و کلید خود را paste کنید.
- id مدل را دقیقاً تایپ کنید: deepseek-v4-flash برای شروع.
- ذخیره کنید و یک پیام کوتاه در یک داستان تازه بفرستید تا round trip را تأیید کنید.
کارتها، دنیاها، و آنچه اگر بروید باقی میماند.
Narratium کارتهای کاراکتر سازگار با SillyTavern را میخواند، که مهمترین واقعیت سازگاری درباره آن است. کاراکترهای شما artifact های قابل حمل هستند: کارتهای نوشتهشده در جای دیگر import میشوند، و کاری که روی پرسونا و یادداشتهای جهان گذاشتهاید به یک کلاینت که توسعهاش متوقف شده قفل نیست. اگر روزی migrate کنید، SillyTavern، RisuAI، و Wyvern همه از همان تبار کارت صحبت میکنند، و صفحات راهاندازی زیر هرکدام را پوشش میدهند. همان منطق قابلیتحمل روی سمت مدل هم صدق میکند. چون Narratium با یک endpoint عمومی /v1 صحبت میکند، هیچچیز درباره راهاندازی provider شما مختص Narratium نیست: همان کلید و base URL بدون تغییر در هر frontend دیگری قرار میگیرد. بین کارتهای قابلحمل و یک endpoint قابلحمل، هزینه جابهجایی کل استک تقریباً صفر میشود، که موضع درستی نسبت به هر پروژه آرشیوشدهای است که هنوز از استفاده از آن لذت میبرید.
انتخاب مدل برای سبک بلند-فرم Narratium.
طراحی Narratium حول روایتهای شاخهای بلند میچرخد، که انتخاب مدل را به سمت ثبات در افقهای بلند سنگین میکند. deepseek-v4-flash session های روزمره را با پایینترین نرخهای کاتالوگ حمل میکند با دیالوگی که جامعه roleplay بهطور مداوم بالاتر از قیمتش رتبه میدهد. glm-5.1 و kimi-k2.6 برای تنوع صدا در چرخش میآیند، و glm-5.2 فصلهای سنگین از نظر جزئیات را بهدست میآورد جایی که پیروی از دستور در افق بلند آن بر تأخیر استدلالش میچربد. claude-sonnet-4-6 همچنان سقف نثر safe-for-work برای فصلهایی است که لیاقتش را دارند. چون frontend context داستان را هر turn دوباره ارسال میکند، token های ورودی بر هزینه غالب هستند، و یک پنجره کاری عمدی از یک پنجره حداکثری بهتر است؛ راهنمای طول context پیوندشده زیر این حساب را انجام میدهد. سیاست محتوا با هیچکدام از اینها تغییر نمیکند: سیاستهای مدل و شرایط پلتفرم قابلاجرا همانطور که نوشته شدهاند اعمال میشوند، و صفحه مقایسه سیاستها پوشش میدهد کدام خانوادهها با کدام ردهبندی محتوا سازگارند، بهصورت واقعی.
پرداخت بر اساس مصرف · پایینتر از قیمت رسمی
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| مدل | قیمت رسمی | قیمت ما |
|---|---|---|
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| GLM-5.1 | $0.86 / $3.43 per M | $0.90 / $3.40 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
آیا هنوز باید یک کلاینت آرشیوشده را انتخاب کنید؟
یک تحلیل هزینه-فایده صادقانه، چون این صفحه در هر صورت راهنمای راهاندازی است. به نفع: کد open است، رابط کاربری واقعاً برای داستانهای بلند و ساختاریافته خوب است، کارتها هم ورودی هم خروجی قابلحمل هستند، و یک endpoint عمومی سمت مدل را برای همیشه بهروز نگه میدارد. برخلاف: بدون patch امنیتی، بدون رفع باگ، dependency هایی که در جا کهنه میشوند، و هر نمونه hosted روی زمان قرضی زندگی میکند. برای یک کلاینت هابی که بهصورت محلی در برابر یک کلید متری اجرا میشود، آن پروفایل ریسک برای بسیاری قابلقبول است؛ برای هرچیزی با کاربران دیگر یا داده حساس، نیست. مسیر میانی همانی است که این صفحه در سراسر آن توصیف کرده: خودتان اجرا کنید، سرمایهگذاریتان را در لایههای قابلحمل (کارتها، lorebook ها، endpoint) نگه دارید، و کلاینت را قابلجایگزین در نظر بگیرید. Frontend ها در این صحنه میآیند و میروند؛ یک داستان که با کارتهای قابلحمل و یک endpoint پایدار پشتیبانی میشود از همه آنها بیشتر عمر میکند.
پرسشهای پرتکرار
چطور یک base URL سفارشی API در Narratium تنظیم کنم؟
در تنظیمات API، اتصال با فرمت OpenAI را انتخاب کنید، سپس base URL یعنی https://api.apisrouter.com/v1، کلید خود، و یک id دقیق مدل مثل deepseek-v4-flash را وارد کنید. README همین دسته اتصال را توصیه میکند: API های با فرمت OpenAI یا یک endpoint یکپارچه چند-مدلی.
آیا Narratium هنوز maintain میشود؟
نه. مخزن GitHub آرشیو و فقط-خواندنی است (GitHub تاریخ آرشیو را ۳۰ مارس ۲۰۲۶ نشان میدهد)، پس هیچ fix یا بهروزرسانیای منتشر نمیشود. کد همچنان اجرا میشود و cloneپذیر باقی میماند؛ self-hosting راه قابلاعتماد استفاده از آن است، با انتظارات تنظیمشده روی یک مجموعه ویژگی منجمد.
آیا Narratium با کارتهای کاراکتر SillyTavern کار میکند؟
بله، سازگاری کارت با فرمت SillyTavern یکی از ویژگیهای مستند آن است، که کاراکترهای شما را در هر دو جهت قابلحمل نگه میدارد: کارتها به Narratium import میشوند، و کارتان اگر بعداً به SillyTavern، RisuAI، یا Wyvern نقل مکان کنید از دست نمیرود.
کدام مدلها از طریق یک gateway با Narratium کار میکنند؟
هرچیزی که endpoint سرویس میدهد، چون Narratium نام مدل را بهصورت رشته ساده ارسال میکند: deepseek-v4-flash و glm-5.1 برای حجم، kimi-k2.6 برای چرخش، glm-5.2 برای فصلهای سنگین از نظر جزئیات، claude-sonnet-4-6 برای نثر safe-for-work. جابهجایی یک تغییر تنظیمات است، و تاریخچه چت با کلاینت میماند.
آیا میتوانم Narratium را کاملاً بهصورت محلی اجرا کنم؟
بله، به دو معنا: کلاینت از source آرشیوشده self-host میشود، و پشتیبانی Ollama آن هم مدلها را محلی اجرا میکند. ترکیبی که اکثر مردم به آن میرسند یک کلاینت محلی با یک endpoint hosted پشت آن است، که مدیریت داده را در دست شما نگه میدارد در حالی که به مدلهایی میرسد که هیچ GPU مصرفی سرویس نمیدهد.
آیا استفاده از یک endpoint سفارشی برخلاف قوانینی است؟
Narratium open source است و دقیقاً برای این پیکربندی ساخته شده. چیزی که یک endpoint سفارشی هرگز تغییر نمیدهد سیاست محتوای سمت مدل است: قوانین نوشتهشده هر خانواده هرجا سرویس داده شود اعمال میشود، و صفحه مقایسه سیاستها آنها را بهصورت واقعی پوشش میدهد.