הפעילו את ה-agents של Warp מה-endpoint היסק שלכם עצמכם.
Updated 2026-07-29
Warp תומך ב-custom inference endpoints בדיוק בשביל זה: כל endpoint שמיישם את OpenAI Chat Completions API, gateways ומנתבי מודל כלולים במפורש. כוונו אותו אל https://api.apisrouter.com/v1 עם מפתח אחד, ומודלים מנותבים-endpoint מופיעים בבורר המודל של Warp בלי לצרוך קרדיטים של Warp AI.
תשובה מהירה: הגדרות, URL, מפתח, ids של מודל.
פתחו את ה-Settings של Warp וחפשו "inference endpoint" כדי לקפוץ להגדרה. הזינו את ה-URL של ה-endpoint, https://api.apisrouter.com/v1, את מפתח ה-APIsRouter שלכם כאישור, ואת ה-id או ה-ids של המודל שאתם רוצים לנתב דרכו, לדוגמה claude-sonnet-4-6 ו-gpt-5.6-sol. ברגע שנשמר, המודלים האלה מופיעים בבורר המודל של Warp לצד האפשרויות המובנות. התנהגות החיוב היא הנקודה: כשאתם בוחרים במפורש מודל מנותב-endpoint מהבורר, Warp מנתב את הבקשה דרך ה-endpoint שלכם במקום לצרוך קרדיטים של Warp AI, וההוצאה נוחתת על יתרת ה-gateway שלכם שאפשר לראות אותה לכל בקשה. התיעוד של Warp מתאר את הזרימה הזו כמשקפת את הגדרת ה-Bring Your Own API Key שלהם, אז זה ירגיש מוכר אם הגדרתם BYOK לפני כן.
Endpoint URL: https://api.apisrouter.com/v1
Credential: sk-YOUR-APISROUTER-KEY
Model id(s): claude-sonnet-4-6
gpt-5.6-sol
then: select the endpoint-routed model
in Warp's model pickerאיך Warp משתמש ב-endpoint.
Warp הוא הטרמינל האג'נטי: ה-agents שלו מנסחים פקודות, מסבירים כשלים, מריצים משימות רב-שלביות, ועורכים קוד מאותו חלון שאתם עובדים בו. התיעוד של Warp עצמו קובע את הדרישה בבירור: ה-endpoint חייב ליישם את OpenAI Chat Completions API ב-/v1/chat/completions, ופוסט ההשקה שלהם נוקב מנתבי מודל ו-gateways מאוחסנים כיעדים מיועדים, כך ש-gateway רב-ספקים הוא אזרח ממדרגה ראשונה כאן, לא טריק. שני אילוצים מתועדים ששווה לדעת לפני שמתחילים. ראשית, ה-endpoint חייב להיות נגיש ציבורית: localhost, 127.0.0.1, ו-URLs של רשת פרטית נדחים בזמן ההגדרה, מה שפוסל כיוון של Warp ישירות לשרת היסק מקומי אבל לא רלוונטי ל-gateway מאוחסן. שנית, בחירת המודל Auto של Warp תמיד צורכת קרדיטים של Warp גם כש-endpoint מותאם אישית מוגדר; רק בחירה מפורשת של מודל מנותב-endpoint מהבורר מנתבת דרך ה-endpoint שלכם. אם ההוצאה שלכם לא זזה לקונסולת ה-gateway, בדקו איזה מודל הסשן באמת השתמש בו. הזמינות תלויה בתוכנית: custom inference endpoints מוצעים בתוכניות Free ותוכניות בתשלום כשירות עבור יחידים וארגונים של עשרה אנשים או פחות, בעוד ארגונים גדולים יותר צריכים את דרגי Business או Enterprise של Warp. זה מגיע ישירות מהתיעוד של Warp ויכול להשתנות מהצד שלהם.
בחירת מודלים לעבודת agent בטרמינל.
agents של טרמינל מחייבים אחרת מצ'אט: כל הסבר פקודה, ניסיון חוזר, וסיכום פלט הוא בקשה שנושאת הקשר סשן. מכיוון ששימוש מנותב-endpoint נוחת בקונסולת ה-gateway לכל בקשה ולכל מודל, שבוע של שימוש אמיתי נותן לכם מספר כן לכל מודל מועמד, מה שעדיף על ניחוש מעמוד תמחור, כולל זה.
- claude-sonnet-4-6 כנהג היומיומי: יצירת פקודות אמינה, שימוש חזק בכלים, שיפוט טוב במשימות רב-שלביות.
- gpt-5.6-sol לעבודה ממוקדת מהירה, שם ה-latency לכל תור מעצב איך הטרמינל מרגיש.
- claude-opus-4-7 לסשנים הקשים: דיבוג על פני שירותים, שרשראות חקירה ארוכות, שינויי תשתית שאתם רוצים שינומקו בעדם.
- gpt-5.5 כ-generalist מוביל ל-A/B מול Claude על זרימות העבודה של ה-shell שלכם.
- deepseek-v4-pro כבחירת ערך לשימוש agent שגרתי בנפח גבוה שבו התעריף חשוב יותר מליטוש מוביל.
תשלום לפי שימוש · מתחת למחיר הרשמי
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| מודל | מחיר רשמי | המחיר שלנו |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
מצבי כשל ספציפיים ל-Warp.
כמו תמיד, הוכיחו את חצי ה-gateway עם שתי פקודות curl, רשימת המודלים והשלמת צ'אט אחת, לפני שאתם מדבגים את צד Warp. אם curl עובר ו-Warp נכשל, הבעיה בטופס ה-endpoint או בבחירת בורר המודל, בשום מקום אחר.
- ה-endpoint נדחה בזמן השמירה: Warp מסרב ל-URLs של localhost ורשת-פרטית בעיצוב. ה-endpoint חייב להיות נגיש ציבורית; URL של gateway מאוחסן עובר את הבדיקה הזו.
- ההוצאה עדיין פוגעת בקרדיטים של Warp: הסשן על בחירת מודל Auto, שתמיד משתמשת בקרדיטים של Warp. בחרו במפורש את המודל מנותב-endpoint בבורר.
- מודל לא נמצא: ה-id שהקלדתם בהגדרת ה-endpoint לא תואם את קטלוג ה-gateway. העתיקו ids מרשימת ה-/v1/models בית לבית.
- 401 מה-endpoint: שדה האישור מחזיק מפתח מיושן או קטוע. בצעו curl לרשימת המודלים עם אותו מפתח כדי לאשר מחוץ ל-Warp.
- הפיצ'ר לא נראה בכלל: בדקו את התוכנית שלכם. custom endpoints זמינים ליחידים וארגונים קטנים בתוכניות Free ובתשלום כשירות; ארגונים גדולים יותר צריכים Business או Enterprise לפי תיעוד Warp.
מי מנתב את Warp דרך gateway.
- מפתחים שרוצים ש-Claude יעמוד מאחורי ה-agents של Warp על יתרה משולמת מראש, עם התחלה חינמית ובלי כרטיס.
- משתמשי agent כבדים שצריכת הקרדיטים של Warp שלהם חרגה מהתוכנית, מעבירים בחירות מודל מפורשות ל-endpoint נמדד משלהם.
- קוני-מודלים שמשווים מודלי תכנות על זרימות עבודה אמיתיות בטרמינל, שם כל מועמד הוא עוד id בהגדרת ה-endpoint.
- צוותים של עשרה אנשים או פחות שמאחדים על מפתח gateway אחד כך שטרמינל, עורך, ו-agents של CI חולקים יומן שימוש יחיד.
- אנשים שכבר מריצים כלים אחרים דרך gateway ורוצים את Warp על אותו מפתח וקונסולה.
אמתו את ה-endpoint ואשרו ניתוב.
הריצו את שתי הבדיקות הסטנדרטיות עם המפתח וה-id המדויקים שהגדרתם ב-Warp. שניהם עוברים אומר שה-gateway מוכן וכל בעיה שנשארת היא בהגדרות Warp או בבחירת המודל. אז הריצו משימת agent אמיתית אחת ב-Warp עם מודל ה-endpoint נבחר במפורש, ואשרו שהבקשה מופיעה בקונסולת APIsRouter עם המודל וספירות הטוקן הצפויים. האישור היחיד הזה תופס את המלכודת של מצב-Auto מיד, ומאותה נקודה הקונסולה היא הרשומה-לכל-בקשה שלכם למה שהטרמינל באמת מוציא.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-sonnet-4-6",
"messages":[{"role":"user","content":"ping"}]}'שאלות נפוצות
איך אני מגדיר custom inference endpoint ב-Warp?
פתחו את ה-Settings של Warp, חפשו "inference endpoint", והזינו את ה-URL של ה-endpoint, האישור שלכם, וה-ids של המודלים לניתוב דרכו. עם APIsRouter ה-URL הוא https://api.apisrouter.com/v1 והמודלים מופיעים בבורר של Warp ברגע שנשמר.
האם ה-custom endpoint של Warp עובד עם gateways ומנתבי מודל?
כן, במפורש. התיעוד ופוסט ההשקה של Warp נוקבים gateways ומנתבים תואמי OpenAI כיעדים נתמכים; הדרישה היא שה-endpoint מיישם את OpenAI Chat Completions API ונגיש ציבורית.
האם בקשות מנותבות-endpoint משתמשות בקרדיטים של Warp AI שלי?
לא. כשאתם בוחרים במפורש מודל מנותב-endpoint, Warp מנתב את הבקשה דרך ה-endpoint שלכם והספק שלכם מחייב אותה, לא קרדיטים של Warp. היוצא מן הכלל הוא בחירת מודל Auto, שתמיד צורכת קרדיטים של Warp גם עם endpoint מוגדר.
למה Warp דוחה את ה-URL של ה-endpoint שלי?
Warp מסרב ל-localhost, 127.0.0.1, ו-URLs אחרים של רשת פרטית או מקומית בזמן ההגדרה; ה-endpoint חייב להיות נגיש ציבורית. URL של gateway מאוחסן כמו https://api.apisrouter.com/v1 עובר את הבדיקה הזו.
אילו תוכניות Warp כוללות custom inference endpoints?
לפי תיעוד Warp נכון לאמצע 2026: Free ותוכניות בתשלום כשירות למשתמשים יחידים ולארגונים עם עשרה אנשים או פחות; ארגונים גדולים יותר צריכים Warp Business או Enterprise. בדקו את התיעוד הנוכחי של Warp, מכיוון שסינון התוכניות שלהם.
האם אני יכול להריץ מודלי Claude ב-Warp בדרך הזו?
כן. הוסיפו את claude-sonnet-4-6 או claude-opus-4-7 כ-ids של מודל בהגדרת ה-endpoint ובחרו אותם בבורר; ה-gateway משרת אותם מעל המשטח התואם OpenAI ש-Warp מצפה לו, על אותו מפתח כמו ids של GPT ו-DeepSeek.