KoboldAI Lite על endpoint מותאם אישית תואם OpenAI.

Updated 2026-07-29

KoboldAI Lite מתחבר ל-endpoints מותאמים אישית באופן טבעי: ה-README של הפרויקט עצמו מפרט APIs בצורת OpenAI ו-Claude לצד אינסטנסי Kobold ו-AI Horde. כוונו את שדה ה-URL המותאם אישית שלו אל https://api.apisrouter.com/v1 עם המפתח שלכם, וכל מודל בקטלוג, DeepSeek, GLM, Kimi, Claude, Grok, הופך לבר-בחירה בתוך אותו ממשק סיפור, בין אם אתם משתמשים ב-Lite המאוחסן בכתובת lite.koboldai.net או בעותק המצורף ל-KoboldCpp.

תשובה מהירה: הערכים ש-Lite צריך.

פתחו את פאנל חיבור ה-AI (כפתור ה-AI בתפריט העליון של Lite), עברו מ-AI Horde ברירת המחדל לקבוצת ה-endpoint המותאמת אישית, ובחרו באפשרות התואמת OpenAI. התוויות המדויקות משתנות מעט בין הגרסאות, אבל השדות קבועים: URL של API, מפתח, ומודל שנבחר לאחר החיבור. שני פרטים ספציפיים ל-Lite עושים את רוב הנזק כשזה נכשל. ראשית, תיבת הסימון של הגרסה: Lite מציע toggle בסגנון "Add Ver. Num" שמוסיף /v1 ל-URL בשבילכם, כך שהזנת https://api.apisrouter.com עם התיבה מסומנת ו-https://api.apisrouter.com/v1 עם התיבה לא מסומנת שניהם נפתרים נכון, בעוד שהכפלת ה-/v1 לא. שנית, התמדה: היסטורית, Lite איפס URLs של endpoint מותאם אישית בחיבור מחדש, אז שמרו את ה-URL בהישג יד במקום להניח שהשדה שורד כל סשן.

API URL:  https://api.apisrouter.com/v1   (or base URL + "Add Ver. Num" ticked)
API key:  sk-...                            (from APIsRouter)
Model:    deepseek-v4-flash                 (or any catalog id after connecting)

מה זה Lite, ואיך הוא מגיע למודל מאוחסן.

KoboldAI Lite הוא ה-web UI ללא-התקנה של אקוסיסטם Kobold: אפליקציית עמוד-יחיד לכתיבת סיפורים, מצב הרפתקה, וצ'אט דמויות שרצה כולה בדפדפן שלכם. הוא מגיע בשתי צורות שחולקות אותן הגדרות: האינסטנס המאוחסן ב-lite.koboldai.net, והעותק המצורף ש-KoboldCpp משרת ב-localhost כשאתם מריצים מודלים מקומית. ה-README של הפרויקט מתאר אותו כמסוגל להתחבר ל-endpoints מותאמים אישית כולל APIs בצורת OpenAI ו-Claude, לצד אינסטנסי Kobold מקומיים ומרוחקים וה-AI Horde המבוסס-קהילה. מכיוון ש-Lite הוא אפליקציית דפדפן ללא שרת משלה, בקשות ה-API שלכם הולכות ישירות מהדפדפן אל כל endpoint שתגדירו. העיצוב הזה הוא הסיבה שמסלול ה-endpoint המותאם אישית עובד בכלל, וגם הסיבה שסעיף ה-CORS למטה קיים: ה-endpoint חייב לענות לבקשות ממקור-דפדפן, וכשאחד לא עונה, Lite מציע toggle של proxy עם טרייד-אופים ששווה להבין לפני שמפעילים אותו. עבור אנשים שמגיעים מ-AI Horde: הקסם של endpoint נמדד על פני האשכול ההתנדבותי הוא צפיות. Horde באמת חינמי עם תור; endpoint ממומן עונה מיד עם המודל המדויק שביקשתם, ובתעריפי משפחת ערך ערב של משחק עולה שבריר קטן של סנט להודעה.

הגדרה, שדה אחר שדה.

אם רשימת המודלים נשארת ריקה לאחר החיבור, הסיבות הרגילות מדורגות: /v1 כפול או חסר (בדקו את תיבת הסימון של הגרסה קודם), מפתח שהודבק עם רווח, או תוסף דפדפן שחוסם את הבקשה. אותם שלושה ערכים שעובדים בפקודת curl הם הדרך המהירה ביותר להוכיח שצד ה-endpoint בסדר ולמקם את הבעיה בדפדפן.

  • פתחו את Lite (מאוחסן או מצורף) ולחצו על כפתור ה-AI בתפריט העליון כדי לפתוח את פאנל החיבור.
  • עברו מבחירת ספק AI Horde לקבוצת ה-endpoint המותאמת אישית, ובחרו באפשרות התואמת OpenAI (התוויות משתנות מעט לפי הגרסה; אפשרות בצורת Claude יושבת לצידה).
  • הזינו את ה-URL: https://api.apisrouter.com/v1, תוך תשומת לב לתיבת הסימון של הגרסה שתוארה למעלה כך ש-/v1 יופיע בדיוק פעם אחת.
  • הדביקו את מפתח ה-sk-... שלכם לשדה המפתח.
  • התחברו, ואז בחרו מודל מהרשימה ש-Lite מביא, או הקלידו את ה-id המדויק מהקטלוג אם הגרסה שלכם מבקשת שם מודל ידני.
  • שלחו הודעה קצרה אחת בסיפור חדש כדי לאשר שהמסלול עובד לפני טעינת סשן ארוך.

אפשרות ה-endpoint של Claude, ומתי להשתמש בה.

קבוצת ה-endpoint המותאמת אישית של Lite כוללת גם אפשרות בצורת Claude ל-APIs בדיאלקט Anthropic. APIsRouter משרת גם את הדיאלקט הזה, ב-/v1/messages, כך ש-ids של claude נגישים דרך כל אחת מהדלתות. בפועל, המסלול התואם OpenAI הוא ברירת המחדל הפשוטה יותר אפילו עבור מודלי Claude, מכיוון שהגדרה אחת אז משרתת כל משפחה: claude-sonnet-4-6 לפרוזה ברמה גבוהה, deepseek-v4-flash למשחק בנפח, glm-5.2 ו-kimi-k2.6 לגיוון, הכל כשינויי שדה-מודל ולא הגדרות מחדש. איפה שהאפשרות בצורת Claude מרוויחה את מקומה היא אם אתם שומרים presets מכוונים ספציפית לפורמט הבקשה של Anthropic או מעבירים הגדרות מכלי אחר בדיאלקט Anthropic. מבחינה פונקציונלית, שני המסלולים מסתיימים באותם מודלים דרך ה-gateway הזה; בחרו אחד והישארו עקביים כך שההגדרות השמורות שלכם יישארו ניידות.

Samplers ומצבים: מה באמת חל מעל endpoint מאוחסן.

Lite חושף את כל גן חיות ה-sampler המקומי בהגדרות שלו, ורובו לא נוסע. ב-endpoints תואמי OpenAI, התיעוד של Lite עצמו מציין שרק בקרות בסגנון temperature, top-p, ו-repetition-penalty חלות; samplers אקזוטיים כמו Min-P, Top-A, או TFS הם פיצ'רים של היסק מקומי, ולמרות ש-Lite יכול לצרף אותם כשדות נוספים, endpoints מאוחסנים בדרך כלל מתעלמים מפרמטרים לא-סטנדרטיים או דוחים אותם. הגדירו temperature סביב 0.8 עד 0.9 לגיוון פרוזה, השאירו top-p ליד 0.95, ושמרו על repetition penalties נמוכים; זה כל משטח הכוונון, וזה מספיק. מצבי הכתיבה של Lite כולם עובדים מעל ה-endpoint המותאם אישית, עם הנחיה אחת: מצב instruct ממופה בצורה הטבעית ביותר על מודלי צ'אט מאוחסנים, מכיוון שהוא מייצר את חילופי התפקידים המובנים שהמודלים האלה מאומנים עליהם. כתיבה שיתופית קלאסית של סיפור עובדת גם כן; צפו למודלים שיתנהגו יותר כשותפי שיחה מאשר ממשיכי טקסט גולמיים, מכיוון שזה מה ש-endpoint של chat completions הוא. תקצוב הקשר עוקב אחר אותו כלל כמו כל frontend של roleplay: Lite שולח מחדש את הקשר הסיפור הנראה בכל תור, אז הגדירו את גודל ההקשר במכוון (חלון עבודה של 16K עד 32K מכסה סשנים ארוכים) במקום למקסם אותו רק כי חלון המודל מאפשר זאת. מדריך אורך ההקשר המקושר למטה עושה את החישוב הזה על פני מודלים.

המציאות של ה-sampler ב-endpoints תואמי OpenAI, לפי הערות ההגדרות של Lite עצמו.
הגדרהנקודת התחלההערה
Temperature0.8 עד 0.9המנוף העיקרי ששורד את הנסיעה ל-endpoint מאוחסן
Top P0.95השאירו כפי שהוא אלא אם הפלט הופך לא-קוהרנטי
Repetition penaltyנמוךערכים גבוהים משבשים שמות לאורך סיפורים ארוכים
Samplers אקזוטיים (Min-P, Top-A, TFS)התעלמופיצ'רים של היסק מקומי; endpoints מאוחסנים מפילים או דוחים אותם
גודל הקשר16K עד 32Kנשלח מחדש בכל תור; העלות עולה איתו

תשלום לפי שימוש · מתחת למחיר הרשמי

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

מודלמחיר רשמיהמחיר שלנו
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M
GLM-5.2$1.14 / $4.00 per M$1.10 / $4.00 per M
Kimi K2.6$0.95 / $4.00 per M$1.00 / $4.00 per M
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Grok 4.5$2.00 / $6.00 per M$1.60 / $4.80 per M

CORS, toggle ה-proxy, ושמירה על שפיות המפתח.

מכיוון ש-Lite קורא ל-endpoint ישירות מהדפדפן שלכם, כשל חיבור עם ערכים נכונים הוא בדרך כלל CORS: ה-endpoint דוחה בקשות ממקור-דפדפן. Lite מספק toggle של "Use CORS Proxy" בדיוק למקרה הזה, והוא ראוי לאזהרה כנה: ניתוב דרך כל proxy צד-שלישי מציב את ה-proxy הזה בתוך התעבורה שלכם, כולל המפתח ותוכן הסיפור. נסו חיבור ישיר קודם, אשרו שה-endpoint עובד דרך curl אם יש ספק, והתייחסו ל-toggle של ה-proxy כמוצא אחרון ולא כברירת מחדל. הרצת ה-Lite המצורף מ-KoboldCpp מקומי היא עוד פתרון נקי, מכיוון שאותן הגדרות endpoint מותאם אישית קיימות שם. היגיינת מפתח חשובה קצת יותר באפליקציית דפדפן: המפתח יושב בהגדרות המקומיות של הדפדפן שלכם, אז הימנעו מהדבקה שלו במחשבים משותפים או ציבוריים, ואם הוא אי פעם דולף, בטלו והנפיקו מחדש במקום לקוות. מפתחות כאן חינמיים ליצירה, אז מפתח ייעודי ל-Lite שומר על יומן השימוש קריא ורדיוס הפיצוץ קטן. הערת תוכן אחת, נאמרת בבירור: endpoint מותאם אישית משנה לאן בקשות הולכות, לא מה מודלים מתירים. מדיניות המודל upstream ותנאי השימוש של כל אינסטנס Lite שאתם משתמשים בו עדיין חלים; עמוד השוואת המדיניות המקושר למטה מכסה את הנוף עובדתית, משפחת מודל אחר משפחת מודל.

שאלות נפוצות

האם KoboldAI Lite תומך ב-endpoints מותאמים אישית תואמי OpenAI?

כן, באופן טבעי. ה-README של הפרויקט מפרט endpoints מותאמים אישית כולל APIs בצורת OpenAI ו-Claude לצד אינסטנסי Kobold ו-AI Horde. ההגדרה היא URL, מפתח, ומודל, מפאנל חיבור ה-AI בין אם ב-Lite המאוחסן או המצורף ל-KoboldCpp.

איזה URL אני מזין עבור APIsRouter ב-KoboldAI Lite?

https://api.apisrouter.com/v1, עם תיבת הסימון של הגרסה מטופלת כך ש-/v1 יופיע בדיוק פעם אחת: ה-toggle בסגנון "Add Ver. Num" של Lite מוסיף /v1 אוטומטית כשהוא מסומן. קטע גרסה כפול או חסר הוא הגורם הנפוץ ביותר לרשימת מודלים ריקה.

האם אני יכול להשתמש במודלי Claude ב-KoboldAI Lite?

כן, בשתי דרכים: דרך ה-endpoint התואם OpenAI עם id של claude כמו claude-sonnet-4-6 בשדה המודל, או דרך אפשרות ה-endpoint בצורת Claude של Lite מול /v1/messages. המסלול התואם OpenAI הוא ברירת המחדל הפשוטה יותר מכיוון שאותה הגדרה אז משרתת כל משפחה אחרת גם כן.

למה נראה שהגדרות ה-sampler שלי לא עושות כלום?

רוב גן חיות ה-sampler של Lite מיועד להיסק מקומי. מעל endpoint תואם OpenAI רק בקרות בסגנון temperature, top-p, ו-repetition-penalty חלות; endpoints מאוחסנים מתעלמים מ-samplers אקזוטיים או דוחים אותם. אם הפלט מרגיש לא נכון, כווננו temperature קודם ובדקו את ה-id של המודל שני.

למה Lite נכשל להתחבר כש-curl עובד?

כמעט תמיד CORS: Lite רץ בדפדפן שלכם, אז ה-endpoint חייב לקבל בקשות ממקור-דפדפן. אפשרויות בסדר גס: נסו שוב הגדרה ישירה נקייה, הריצו את ה-Lite המצורף עם KoboldCpp מקומי, או השתמשו ב-toggle של CORS proxy של Lite בהבנה שאז צד שלישי יושב בתוך התעבורה שלכם.

האם זה עדיף על AI Horde?

טרייד-אוף שונה. Horde באמת חינמי, מופעל על ידי מתנדבים, ובתור, עם אילו מודלים שמתנדבים מארחים. endpoint נמדד עונה מיד עם המודל המדויק שבחרתם, בתעריפי משפחת ערך שמעמידים ערב של משחק בשבריר קטן של סנט להודעה. הרבה אנשים שומרים על שניהם מוגדרים.