הוסיפו מודלי קטלוג בענן ל-Jan בלי לעזוב local-first.
Updated 2026-07-29
Jan מריצה מודלים על המחשב שלכם מטבעה, וההגדרות שלה ב-Model Providers מקבלות כל endpoint תואם OpenAI לימים שבהם local לא מספיק: הוסיפו ספק, הגדירו את ה-Base URL ל-https://api.apisrouter.com/v1, הדביקו מפתח אחד, ו-ids של Claude, GPT, Gemini, ו-DeepSeek מצטרפים למערך המקומי שלכם.
תשובה מהירה: ספק אחד ב-Settings.
פתחו את ה-Settings של Jan ועברו ל-Model Providers. לחצו על בקרת הפלוס ליד רשימת הספקים כדי להוסיף ספק מותאם אישית, תנו לו שם (APIsRouter), ובגרסאות עדכניות בחרו את פורמט ה-OpenAI API כשהדיאלוג שואל (Jan v0.8.1 הוסיפה בורר פורמט OpenAI-או-Anthropic; עבור gateway בחרו OpenAI). לאחר מכן מלאו את שני השדות שחשובים: Base URL https://api.apisrouter.com/v1 ומפתח ה-API שלכם. הוסיפו את המודלים שאתם רוצים לפי id: התיעוד של Jan מפורש שמאפיין ה-id חייב להתאים לשם המודל שה-endpoint משרת, אז העתיקו ids מרשימת הקטלוג (claude-sonnet-4-6, gpt-5.4-mini, gemini-3.5-flash) במקום להקליד מהזיכרון. שמרו, וה-ids מופיעים בבורר המודלים לצד כל מה שאתם מריצים מקומית. תוויות זזו בין גרסאות (גרסאות ישנות יותר קראו לאזור הזה Remote Engines), אז התייחסו ל-ספק, פורמט, כתובת, מפתח, מודלים כאל השלד היציב.
Name: APIsRouter
API Format: OpenAI (v0.8.1+ selector)
Base URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Models: add ids that match the endpoint, e.g.
claude-sonnet-4-6, gpt-5.4-mini, gemini-3.5-flashאיך Jan מתייחסת לספקים מרוחקים.
Jan (menloresearch ב-GitHub, כ-44K כוכבים) הוא הלקוח השולחני local-first: מודלים מורדים למחשב שלכם, רצים דרך llama.cpp, ועובדים אופליין, כאשר האפליקציה אף חושפת שרת תואם-OpenAI משלה בכתובת http://127.0.0.1:1337/v1 עבור כלים אחרים. ספקים מרוחקים הם הנתיב השני המכוון, עבור מודלים גדולים מדי להריץ מקומית או משימות שמצדיקות איכות מתקדמת. ספק מותאם אישית בפורמט OpenAI הוא תיאור endpoint פשוט: base URL, מפתח, model ids מוצהרים. שיחות מול ה-ids האלה יוצאות כבקשות chat-completions סטנדרטיות עם ה-id כמחרוזת המודל, כך ש-gateway רב-ספקים צריך בדיוק רשומה אחת. Claude לכתיבה זהירה, DeepSeek לסיכום נפח, Gemini למהירות, מפתח אחד מאחורי כולם. ההתאמה הפילוסופית טובה יותר ממה שהיא נשמעת בהתחלה. משתמשי local-first נוטים להיות מכוונים לגבי מה עוזב את המחשב, ו-gateway שומר על הנתיב המרוחק מכוון באותה מידה: endpoint אחד לחסום ב-firewall, לוג שימוש אחד לקרוא, יתרה אחת שזזה רק כשבחרתם לשלוח משהו החוצה. שום דבר בנתיב המקומי לא משתנה; המודלים שהורדתם ממשיכים לעבוד אופליין בדיוק כמו קודם.
הצהרת מודלים: חוזה ה-id.
Jan לא שולפת עבורכם את קטלוג ה-endpoint המותאם אישית; המודלים שאתם מצהירים עליהם הם המודלים שתקבלו, וה-id הוא החוזה. האיות הסמכותי מגיע מרשימת ה-/v1/models של ה-gateway, כולל סיומות גרסה. id מוצהר שסוטה מהרשימה מייצר שגיאות not-found רק כשהמודל הזה נבחר, מה שנקרא כמו ספק לא יציב עד שאתם משווים מחרוזות. הצהירו במכוון. בורר local-first עובד הכי טוב כשהשורות המרוחקות מעטות ומכוונות: id מהיר אחד לתורות מרוחקות יומיומיות (gpt-5.4-mini או claude-haiku-4-5-20251001), id מתקדם אחד לעבודה שמצדיקה עזיבת המחשב (claude-sonnet-4-6), וכל מומחה שעומס העבודה שלכם מזכה בו (deepseek-v4-flash לסיכומים רב-לשוניים ארוכים, gemini-3.5-flash כשזמן תגובה הוא הפיצ'ר). כל שורה קלה להוסיף מאוחר יותר; קטלוג שמודבק פנימה הוא רעש שאתם גוללים על פניו יומיום. אם אתם גם משתמשים בשרת ה-API המקומי של Jan כדי לשרת כלים אחרים, שמרו את המודל המנטלי ברור: השרת הזה הוא Jan שהיא ספק בכתובת 127.0.0.1:1337/v1; רשומת הספק המותאם אישית היא Jan שהיא לקוח. השניים עצמאיים, והגדרת אחד לעולם לא משפיעה על השני.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
# declare these ids verbatim in the provider's model listבחירת אילו שיחות עוזבות את המחשב.
מכיוון ששימוש מרוחק מוטען מראש ונמדד לפי מפתח, העלות של הנתיב המרוחק היא מספר שאתם קוראים, לא מנוי שאתם מנחשים. הריצו חודש של הפיצול האמיתי שלכם ולוג השימוש אומר לכם בדיוק כמה עולה לעזוב את המחשב, לפי מודל, ליום.
- תורות מרוחקות יומיומיות, שאלות מהירות, כתיבה מחדש, תרגומים, שייכות לרמה המהירה: gpt-5.4-mini ו-claude-haiku-4-5-20251001 עונים מהר ושומרים על היתרה כמעט דוממת.
- claude-sonnet-4-6 הוא הצעד-קדימה לעבודה שמודל מקומי בבירור לא יכול לשאת: ניסוח זהיר וארוך, סקירת קוד עדינה, ניתוח שתעבירו הלאה.
- gemini-3.5-flash מרוויח את שורתו בזמן תגובה; לתורות אינטראקטיביות קצרות זה מרגיש הכי קרוב לתגובתיות של מודל מקומי.
- deepseek-v4-flash היא בחירת הנפח לסיכום מסמכים ארוכים שלא הייתם מזינים למודל מקומי קטן.
- שמרו חומר פרטי על מודלים מקומיים לגמרי; הפיצול בין הנתיבים הוא הנקודה של הרצת Jan מלכתחילה.
תשלום לפי שימוש · מתחת למחיר הרשמי
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| מודל | מחיר רשמי | המחיר שלנו |
|---|---|---|
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| GPT-5.4 mini | $0.75 / $4.50 per M | $0.60 / $3.60 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
מצבי כשל ספציפיים ל-Jan.
שגיאות not-found על מודל ספציפי הן חוזה ה-id: ה-id המוצהר לא תואם לאיות ה-endpoint. השוו מול פלט ה-/v1/models תו-בתו. כשלי אימות בכל בקשה הם שדה המפתח. ספק שנשמר אבל אף פעם לא עונה בדרך כלל יש לו בעיית Base URL: הסיומת /v1 חייבת להיות נוכחת, מכיוון ש-Jan מוסיפה נתיבי route כמו /chat/completions לבסיס שאתם נותנים לה, ומקטע כפול או חסר מייצר 404. אם הספק נוצר בגרסה ישנה יותר, בדקו את פורמט ה-API: v0.8.1 הציגה את בורר OpenAI-או-Anthropic, ורשומת gateway שהוגדרה בטעות לפורמט Anthropic מדברת בדיאלקט שגוי אל endpoint /v1/chat/completions. וזכרו איזה נתיב אתם מדבגים. כשלי מודל מקומי (VRAM, quantization, הגדרות llama.cpp) וכשלים מרוחקים (URL, מפתח, ids) חולקים חלון צ'אט אבל שום דבר אחר; בורר המודלים מציג לאיזה נתיב שיחה כושלת שייכת לפני שאתם מתחילים למשוך בחוט הלא נכון.
מי מוסיף נתיב gateway ל-Jan.
- משתמשי local-first שלעיתים זקוקים לאיכות מתקדמת ורוצים שהנתיב המזדמן הזה יהיה על יתרה מוטענת מראש במקום מנוי ספק.
- מפתחים על מחשבים שלא יכולים להריץ מודלים מקומיים גדולים היטב, משתמשים ב-Jan כממשק וב-gateway לעבודה הכבדה.
- משתמשים מכווני-פרטיות שרוצים בדיוק endpoint מרוחק אחד לחשוב עליו, לחסום ב-firewall, ולבקר, במקום אחד לכל ספק.
- אנשים שמשווים פלט מקומי מול ענן על משימות אמיתיות, שם המועמדים המרוחקים הם שורות מוצהרות, לא חשבונות חדשים.
- מפתחים ללא גישה לחיוב של ספק נתון. גישה מבוססת-הטענה בלי דרישת כרטיס מסירה את התלות בהרשמה לכל ספק.
אמתו את ה-endpoint ובצעו דיבוג לתור המרוחק הראשון.
בצעו curl לרשימת המודלים ולהשלמת צ'אט אחת קודם; עם שתיהן עוברות, כל מה שנשאר נמצא ברשומת הספק. זה גם נותן לכם את האיותים המדויקים של ה-id להצהיר עליהם. בתוך Jan, שלחו הודעה קצרה אחת על ה-id המרוחק המהיר. שגיאות אימות הן המפתח; not-found הוא ה-id; שקט או 404 הם צורת ה-Base URL. אם הנתיב המרוחק עובד אבל מרגיש איטי על ה-id המתקדם, זה latency של מודל, לא בעיית הגדרה; מודלי נימוק לוקחים את הזמן שלהם על תורות ארוכות. ברגע שהתורות המרוחקות זורמות, קונסולת APIsRouter מציגה מודל לכל בקשה, ספירות טוקן, והוצאה. עבור משתמש local-first הלוג הזה הוא קריאה יוצאת דופן מספקת: זה הרשומה המלאה של כל מה שאי-פעם עזב את המחשב, לפי מודל, ליום, כאשר הנתיב המקומי תורם לזה בדיוק כלום.
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-5.4-mini",
"messages":[{"role":"user","content":"ping"}]}'שאלות נפוצות
איך מוסיפים ספק תואם OpenAI מותאם אישית ל-Jan?
Settings, Model Providers, ואז בקרת הפלוס להוספת ספק. תנו לו שם, בחרו את פורמט ה-OpenAI API בגרסאות ששואלות (v0.8.1+), הגדירו Base URL https://api.apisrouter.com/v1, הדביקו את המפתח שלכם, והצהירו על model ids שתואמים לרשימת ה-endpoint.
למה המודל המוצהר שלי מחזיר not-found?
Jan שולחת את ה-id המוצהר כלשונו כמחרוזת המודל, והתיעוד שלה דורש שה-id יתאים בדיוק לשם המודל של ה-endpoint. משכו את רשימת ה-/v1/models והעתיקו את האיות, כולל סיומות גרסה, במקום להקליד ids מהזיכרון.
האם הוספת ספק מרוחק משנה איך מודלים מקומיים עובדים?
לא. מודלים מקומיים ממשיכים לרוץ במכשיר דרך llama.cpp, כולל אופליין. רשומת הספק מוסיפה נתיב מרוחק נפרד לבורר, ושיחות נוגעות ברשת רק כשאתם בוחרים id מרוחק.
האם ה-Base URL צריך לכלול /v1?
כן: https://api.apisrouter.com/v1. Jan מוסיפה routes כמו /chat/completions לבסיס שאתם מגדירים, אז /v1 חסר מייצר 404 וגם כפול. אם בקשות נכשלות, קראו את ה-URL המורכב בשגיאה לפני ששינויים דבר אחר.
האם Jan יכולה להגיע ל-Claude ו-Gemini דרך רשומת ספק אחת?
כן. בפורמט OpenAI ה-model id נוסע כמחרוזת פשוטה, כך ש-claude-sonnet-4-6, gemini-3.5-flash, gpt-5.4-mini, ו-deepseek-v4-flash יכולים כולם להיות מוצהרים תחת רשומה אחת, מחויבים דרך מפתח אחד, ומוחלפים לכל שיחה.
האם זה אותו דבר כמו שרת ה-API המקומי של Jan?
לא. השרת המקומי בכתובת 127.0.0.1:1337/v1 הוא Jan משרתת את המודלים המקומיים שלה לכלים אחרים. רשומת הספק המותאם אישית היא Jan צורכת endpoint מרוחק. אלה פיצ'רים עצמאיים שבמקרה חולקים את פורמט ה-wire של OpenAI.