הגדרת API מותאמת אישית ל-Narratium: base URL, מפתח, מודל.

Updated 2026-07-29

Narratium הוא קליינט roleplay וכתיבת סיפורים בקוד פתוח שמביא ממשק משלו וללא מודלים משלו: ה-README שלו מפנה משתמשים ל-API בפורמט OpenAI, endpoints מאוחדים בסגנון OpenRouter, ו-Ollama מקומי. כוונו את הגדרות ה-API שלו אל https://api.apisrouter.com/v1 עם מפתח אחד וכל הקטלוג הופך לבאקאנד שלו. דבר אחד שהעמוד הזה אומר בפירוש ורוב המדריכים מדלגים עליו: מאגר ה-GitHub מאורכב (archived), אז הריצו אותו עם העובדה הזו במחיר.

תשובה מהירה: הערכים ש-Narratium צריך.

החיבור ל-LLM של Narratium הוא השילוש הסטנדרטי התואם OpenAI, שמוזן בהגדרות ה-API שלו: base URL, מפתח API, ושם מודל. עבור ה-gateway הזה אלו הם https://api.apisrouter.com/v1, מפתח ה-sk-... שלכם, וכל id בקטלוג, כאשר deepseek-v4-flash היא הבחירה הראשונה ההגיונית לתעבורת סיפורים. ה-README של הפרויקט ממליץ בדיוק על סוג החיבור הזה: API בפורמט OpenAI ישירות, endpoint מאוחד מרובה-מודלים לגיוון, או Ollama ו-LM Studio למודלים מקומיים, הכל דרך אותה משטח הגדרות. תוויות השדות המדויקות משתנות בין גרסת ה-web לגרסאות אחרות, אז התייחסו לתוויות בגמישות ולערכים בדיוק: ה-URL מסתיים ב-/v1, המפתח מודבק נקי, ה-id של המודל תואם את מחרוזת הקטלוג תו לתו.

Base URL:  https://api.apisrouter.com/v1
API key:   sk-...              (from APIsRouter)
Model:     deepseek-v4-flash   (typed exactly; any catalog id works)

מה זה Narratium, ומה מצבו, נאמר בבירור.

Narratium (Narratium/Narratium.ai ב-GitHub) הציג את עצמו כ-"VSCode של roleplay": קליינט קוד פתוח לכתיבת סיפורים מונעת AI, בניית עולמות, ובדיון אינטראקטיבי ארוך-טווח, עם תאימות לקלפי דמויות של SillyTavern, שימור זיכרון, ומערכת פלאגינים. הקוד ברישיון AGPL, הוא משך קהילה אמיתית במהירות, והוא נשאר אחד הקליינטים הפתוחים המעניינים יותר בסצנה. עכשיו החלק שרוב מדריכי ההגדרה משמיטים: מאגר ה-GitHub מאורכב (archived) וקריאה-בלבד (GitHub מציג את תאריך הארכוב כ-30 במרץ 2026). ארכיון לא אומר שבור — הקוד רץ בדיוק כמו ביום שבו הוקפא — אבל זה אומר שאף מתחזק לא שולח תיקונים, עדכוני תלויות, או טלאי אבטחה, ושהאינסטנסים המאוחסנים שמשויכים לפרויקט צריכים להיחשב לכל היותר כ-best-effort. אם אתם מאמצים את Narratium היום, המסלול האמין הוא להריץ אותו בעצמכם מהמקור או מ-release, והציפייה הריאלית היא סט פיצ'רים קפוא. המצב הזה משנה את עצת ה-API בדרך אחת ספציפית: קליינט קפוא הוא בדיוק המצב שבו אתם רוצים שצד המודל יישאר גמיש. Narratium כבר לא יכול להוסיף אינטגרציות ספק חדשות, אבל endpoint תואם OpenAI שהוא כבר יודע לדבר איתו ממשיך לשרת כל מודל חדש שמופיע מאחורי ה-endpoint הזה. תבנית ה-gateway בפועל מבטיחה עתידיות לקליינט שכבר לא זז.

הדרכת הגדרה.

פתרון תקלות עוקב אחר התבנית האוניברסלית: הוכיחו את שלושת הערכים עם בקשת curl קודם, ואם curl מצליח בזמן שהאפליקציה נכשלת, החשודים הרגילים הם URL עם קטע נתיב מיותר, רווח במפתח, או חסימת CORS בדפדפן בגרסאות web, שנראית בקונסולת המפתחים. מכיוון שאף מתחזק כבר לא ישלח תיקון לתקלות בצד האפליקציה, ההרגל של curl-קודם חשוב קצת יותר כאן: הוא אומר לכם מיד באיזה צד של החיבור אתם באמת יכולים לעשות משהו.

  • הריצו את Narratium: אירוח עצמי מהמקור ב-GitHub או מ-release (המאגר קריאה-בלבד אך ניתן לשכפול במלואו), או השתמשו באינסטנס מאוחסן אם אחד כזה שאתם סומכים עליו עדיין פועל.
  • פתחו את ההגדרות ומצאו את סעיף הגדרת ה-API / LLM.
  • בחרו את סוג החיבור בפורמט OpenAI ולא Ollama, מכיוון שאתם מכוונים לעבר endpoint מאוחסן.
  • הזינו base URL https://api.apisrouter.com/v1 והדביקו את המפתח שלכם.
  • הקלידו את ה-id של המודל בדיוק: deepseek-v4-flash כדי להתחיל.
  • שמרו ושלחו הודעה קצרה אחת בסיפור חדש כדי לאשר שהמסלול עובד.

קלפים, עולמות, ומה שורד אם עוזבים.

Narratium קורא קלפי דמויות תואמי SillyTavern, וזו העובדה החשובה ביותר בהיבט התאימות שלו. הדמויות שלכם הן artifacts ניידים: קלפים שנכתבו במקום אחר מיובאים, והעבודה שהשקעתם בפרסונות והערות עולם לא נעולה לקליינט שהפיתוח שלו נעצר. אם אי פעם תעברו, SillyTavern, RisuAI, ו-Wyvern כולם דוברים את אותו שושלת קלפים, ועמודי ההגדרה המקושרים למטה מכסים כל אחד מהם. אותה לוגיקת ניידות חלה על צד המודל. מכיוון ש-Narratium מדבר עם endpoint גנרי מסוג /v1, שום דבר בהגדרת הספק שלכם אינו ספציפי ל-Narratium: אותו מפתח ואותו base URL נכנסים לכל frontend אחר ללא שינוי. בין קלפים ניידים ו-endpoint נייד, עלות המעבר של כל הסטאק מתקרבת לאפס, וזו העמדה הנכונה כלפי כל פרויקט מאורכב שאתם עדיין נהנים להשתמש בו.

בחירות מודל לסגנון ארוך-הטווח של Narratium.

העיצוב של Narratium ממוקד בנרטיבים מסתעפים ארוכים, מה שמטה את בחירת המודל לעבר עקביות לאורך אופקים ארוכים. deepseek-v4-flash נושא סשנים יומיומיים בתעריפי הקטלוג הנמוכים ביותר עם דיאלוג שקהילת ה-roleplay מדרגת בעקביות מעל למחירו. glm-5.1 ו-kimi-k2.6 מתחלפים לגיוון קולי, ו-glm-5.2 מרוויח פרקים עמוסי פרטים כאשר יכולת ההיצמדות להוראות לאורך אופקים ארוכים שלו עולה על השהיית ההיסק שלו. claude-sonnet-4-6 נשאר תקרת הפרוזה הבטוחה-לעבודה עבור פרקים שראויים לה. מכיוון שה-frontend שולח מחדש הקשר סיפור בכל תור, טוקני קלט שולטים בעלות, וחלון עבודה מכוון עדיף על אחד מקסימלי; מדריך אורך ההקשר המקושר למטה עושה את החישוב. מדיניות תוכן לא משתנה מכל זה: מדיניות המודלים ותנאי הפלטפורמה החלים חלים כפי שנכתבו, ועמוד השוואת המדיניות מכסה אילו משפחות מתאימות לאילו דירוגי תוכן, באופן עובדתי.

תשלום לפי שימוש · מתחת למחיר הרשמי

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

מודלמחיר רשמיהמחיר שלנו
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M
GLM-5.1$0.86 / $3.43 per M$0.90 / $3.40 per M
Kimi K2.6$0.95 / $4.00 per M$1.00 / $4.00 per M
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M

האם עדיין כדאי לאמץ קליינט מאורכב?

ניתוח עלות-תועלת כן, מכיוון שהעמוד הזה הוא מדריך ההגדרה בכל מקרה. בעד: הקוד פתוח, הממשק באמת טוב לסיפורים ארוכי-טווח מובנים, קלפים ניידים פנימה והחוצה, ו-endpoint גנרי שומר על צד המודל עדכני לנצח. נגד: אין טלאי אבטחה, אין תיקוני באגים, תלויות מזדקנות במקום, וכל אינסטנס מאוחסן חי על זמן שאול. עבור קליינט תחביב שרץ מקומית מול מפתח נמדד, פרופיל הסיכון הזה מקובל על הרבה אנשים; עבור כל דבר עם משתמשים אחרים או נתונים רגישים, הוא לא. המסלול האמצעי הוא זה שהעמוד הזה תיאר לאורך כולו: הריצו אותו בעצמכם, שמרו את ההשקעה שלכם בשכבות הניידות (קלפים, ספרי-עולם, ה-endpoint), והתייחסו לקליינט כניתן להחלפה. Frontends בסצנה הזו באים והולכים; סיפור שנתמך בקלפים ניידים ו-endpoint /v1 יציב שורד את כולם.

שאלות נפוצות

איך מגדירים base URL מותאם אישית ל-API ב-Narratium?

בהגדרות ה-API, בחרו את החיבור בפורמט OpenAI, ואז הזינו base URL https://api.apisrouter.com/v1, את המפתח שלכם, ו-id מדויק של מודל כמו deepseek-v4-flash. ה-README ממליץ על API בפורמט OpenAI או endpoint מאוחד מרובה-מודלים, וזו בדיוק ההגדרה הזו.

האם Narratium עדיין מתוחזק?

לא. מאגר ה-GitHub מאורכב (archived) וקריאה-בלבד (GitHub מציג את 30 במרץ 2026 כתאריך הארכוב), כך שאין תיקונים או עדכונים נשלחים. הקוד עדיין רץ ונשאר ניתן לשכפול; אירוח עצמי הוא הדרך האמינה להשתמש בו, עם ציפיות מכוונות לסט פיצ'רים קפוא.

האם Narratium עובד עם קלפי דמויות של SillyTavern?

כן, תאימות קלפים לפורמט SillyTavern היא אחד הפיצ'רים המתועדים שלו, מה שמשמר את הדמויות שלכם ניידות בשני הכיוונים: קלפים מיובאים ל-Narratium, והעבודה שלכם לא תקועה אם תעברו מאוחר יותר ל-SillyTavern, RisuAI, או Wyvern.

אילו מודלים עובדים עם Narratium דרך gateway?

כל מה שה-endpoint משרת, מכיוון ש-Narratium שולח את שם המודל כמחרוזת פשוטה: deepseek-v4-flash ו-glm-5.1 לנפח, kimi-k2.6 לגיוון, glm-5.2 לפרקים עמוסי פרטים, claude-sonnet-4-6 לפרוזה בטוחה-לעבודה. החלפה היא שינוי הגדרות, והיסטוריית הצ'אט נשארת עם הקליינט.

האם אני יכול להריץ את Narratium לגמרי מקומית?

כן, בשני מובנים: הקליינט מתארח בעצמו מהמקור המאורכב, ותמיכת ה-Ollama שלו מריצה מודלים מקומית גם כן. ההיברידי שרוב האנשים מגיעים אליו הוא קליינט מקומי עם endpoint מאוחסן מאחוריו, מה שמשאיר את הטיפול בנתונים בידיים שלכם תוך הגעה למודלים ש-GPU צרכני לא משרת.

האם שימוש ב-endpoint מותאם אישית נוגד תנאי שימוש כלשהם?

Narratium הוא קוד פתוח ובנוי בדיוק להגדרה הזו. מה שendpoint מותאם אישית לעולם לא משנה הוא מדיניות התוכן בצד המודל: הכללים הכתובים של כל משפחה חלים בכל מקום שהיא מוגשת ממנו, ועמוד השוואת המדיניות מכסה את זה עובדתית.