הריצו אפליקציות FastGPT על base URL תואם OpenAI מותאם אישית.
Updated 2026-07-29
FastGPT הנוכחי מגדיר מודלים ב-UI: הוסיפו channel תחת Account, Model Providers עם פרוטוקול OpenAI, https://api.apisrouter.com/v1 ככתובת ה-proxy, ומפתח אחד. ids של Claude, GPT, DeepSeek, GLM, Kimi, ו-Qwen מפעילים אז את בסיסי הידע וה-workflows שלכם.
תשובה מהירה: channel אחד בעמוד Model Providers.
מאז v4.8.23, FastGPT מגיע עם שכבת אגרגציית מודלים משלו (AI Proxy) ו-UI להגדרת מודלים, כך ש-endpoint מותאם אישית כבר לא דורש פריסת OneAPI נפרדת או עריכה ידנית של config.json. פתחו Account, ואז Model Providers, עברו ללשונית Model Channels, ולחצו Add Channel. הגדירו את סוג הפרוטוקול ל-OpenAI, תנו שם ל-channel, שימו את https://api.apisrouter.com/v1 בשדה כתובת ה-proxy (ה-base URL, לא נתיב הבקשה המלא), הדביקו את המפתח שלכם, ובחרו או הקלידו את ה-model ids שה-channel אמור לשרת. חזרה בלשונית המודלים, הפעילו את ה-ids שהוספתם והריצו את בדיקת הקישוריות המובנית. מאז ואילך, כל אפליקציה, בסיס ידע, וצומת workflow ב-FastGPT יכולים לבחור באותם מודלים. התיעוד דו-לשוני והתוויות משתנות בין גרסאות (doc.fastgpt.io הוא הכניסה האנגלית), אז התייחסו לזרימה, channel, פרוטוקול, base URL, מפתח, מודלים, כאל החלק היציב יותר מהניסוח המדויק.
Channel Name: APIsRouter
Protocol Type: OpenAI
Proxy URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Models: claude-sonnet-4-6, deepseek-v4-flash,
glm-5.2, qwen3.7-plus, kimi-k2.6
then: enable the models + run the connection testאיך FastGPT מנתב תעבורת מודלים.
FastGPT (labring ב-GitHub, כ-29K כוכבים) היא פלטפורמת בסיס-ידע ו-workflow ממקור סיני: datasets עם חילוץ שאלות-תשובות וחיפוש וקטורי, תזמור Flow חזותי, ואפליקציות מפורסמות עם שיתוף וגישת API. כל זה נפתר למודלים הרשומים בשכבת ההגדרה. channel הוא כלל ניתוב: ה-model ids האלה, ה-base URL הזה, המפתח הזה. בקשות יוצאות מ-FastGPT כ-chat completions סטנדרטיות עם ה-model id כמחרוזת פשוטה, וזו הסיבה ש-gateway רב-ספקים נכנס כ-channel יחיד. שכבת ה-channel גם נושאת יכולות תפעוליות שאחרת הייתם צריכים לבנות בעצמכם: מודל אחד יכול לחיות בכמה channels לאיזון עומסים, ומיפוי מודלים מאפשר ל-FastGPT לחשוף שם אחד תוך שליחת מחרוזת id שונה לספק. עבור self-hosters על גרסאות ישנות יותר, החיווט הישיר עדיין קיים: הצמד הסביבתי הקלאסי של FastGPT מכוון את הפלטפורמה לכל base תואם OpenAI, OPENAI_BASE_URL ו-CHAT_API_KEY בסביבת docker-compose, עם מודלים המוצהרים ב-config.json תחת llmModels. זה עובד, אבל נתיב ה-UI הוא לאן שהפרויקט עבר, ופריסות חדשות צריכות להתחיל שם.
הזווית האסייתית: יתרה אחת לשני עולמות המודלים.
בסיס המשתמשים של FastGPT דובר-סינית בעיקרו, והפריסה הטיפוסית שלו מערבבת מודלים אזוריים עם מערביים: GLM או Qwen לבסיסי ידע סיניים, DeepSeek לנפח, Claude או GPT היכן שליטוש התשובה הוא המוצר. כשמוגש ישירות, התמהיל הזה אומר חשבונות ב-Zhipu, Alibaba, DeepSeek, Anthropic, ו-OpenAI, כל אחד עם חיוב משלו, חלקם קשים לתשלום מצד אחד או שני של העולם. דרך channel אחד, התמהיל הוא רק עוד דיאלוגי Add Channel: glm-5.2, qwen3.7-plus, kimi-k2.6, deepseek-v4-flash, ו-claude-haiku-4-5-20251001 זה לצד זה, יתרה אחת מוטענת מראש, ללא דרישת כרטיס, ids ישר מהקטלוג. צוותים באסיה מקבלים Claude ו-GPT בלי כרטיס מערבי; צוותים מערביים מקבלים את המודלים הסיניים בלי הרשמות אזוריות. אותו בסיס ידע יכול לענות על שאילתות סיניות ב-GLM ושאילתות אנגליות ב-Claude, מנותב לכל אפליקציה. אם אתם מריצים את החיווט הסביבתי הישן במקום זאת, אותו endpoint נכנס ישירות; מוסכמת ה-base URL כוללת את הסיומת /v1, ו-FastGPT מוסיף נתיבי route כמו /chat/completions אליו.
# docker-compose environment, pre-AI-Proxy versions
OPENAI_BASE_URL=https://api.apisrouter.com/v1
CHAT_API_KEY=sk-YOUR-APISROUTER-KEY
# models declared in config.json under llmModelsבחירת מודלים לבסיסי ידע ו-flows.
מכיוון שכל id מופעל מחויב דרך מפתח אחד, השוואת מודלים היא שינוי הגדרת צומת. הצמידו שני מועמדים בשני עותקים של אותה אפליקציה, הריצו שבוע של שאלות אמיתיות, וקראו את הפיצול לפי מודל בקונסולת APIsRouter לצד השיפוט שלכם על איכות התשובה.
- שאלות-תשובות ב-dataset ויצירת תשובות על פני מקטעים מאוחזרים היא עבודת נפח: deepseek-v4-flash ו-glm-5.2 שומרים על עלות-לשאלה שטוחה על corpora דו-לשוניים.
- qwen3.7-plus ו-kimi-k2.6 הם הבחירות האזוריות ששוות בדיקה כשתשובות חייבות להיקרא באופן טבעי בסינית; איכות היצירה משתנה בין מודלים סיניים יותר מהאחזור.
- claude-haiku-4-5-20251001 היא הרמה המערבית המהירה לפריסות רב-לשוניות; עברו ל-claude-sonnet-4-6 באפליקציות הספציפיות שבהן איכות הסינתזה היא המוצר.
- צמתי workflow יורים לכל הרצה, אז flow בן חמישה צמתים מכפיל כל id שיושב בכל צומת; שימו ids מהירים בצמתי סיווג וניתוב, והוציאו על צומת התשובה.
- מודלי אינדקס וחילוץ מוגדרים בנפרד ממודלי צ'אט; ודאו שה-endpoint משרת כל id embedding שאתם מקשרים לפני בניית אינדקס סביבו.
תשלום לפי שימוש · מתחת למחיר הרשמי
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| מודל | מחיר רשמי | המחיר שלנו |
|---|---|---|
| GLM-5.2 | $1.14 / $4.00 per M | $1.10 / $4.00 per M |
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| Qwen 3.7 Plus | $0.29 / $1.14 per M | $0.30 / $1.10 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
מצבי כשל ספציפיים ל-FastGPT.
מוסכמת ה-base URL מכשילה אנשים שעוברים מכלים אחרים: FastGPT מצפה ל-base עם סיומת /v1 בשדה ה-proxy ומוסיף /chat/completions בעצמו, בעוד שהטופס למודל-מותאם-אישית שלו (פיצ'ר שונה, למודלים חד-פעמיים שעוקפים channels) רוצה את כתובת הבקשה המלאה כולל /v1/chat/completions. דעו באיזה שדה אתם נמצאים לפני הדבקה. מודל שקיים ב-channel אבל לא ניתן לבחירה באפליקציות פירושו שהוא נוסף ל-channel אבל לא הופעל בצד המודלים של ההגדרה; שתי הרשימות נפרדות, ובדיקת הקישוריות מוכיחה רק את ה-channel. מדריכים ישנים הם הסיכון הגדול ביותר. שנים של מדריכי FastGPT מניחים sidecar של OneAPI ועריכות config.json; בגרסאות נוכחיות ה-UI של Model Providers מחליף את שניהם, וערבוב שתי הגישות (חיווט סביבתי בתוספת channels) גורם לבקשות לנתב למקום שאתם לא מסתכלים עליו. בחרו שכבה אחת והגדירו אותה במלואה. שגיאות model-not-found הן בעיית הטקסט-החופשי הרגילה: ה-id ב-channel חייב להתאים בדיוק לאיות /v1/models של ה-gateway, כולל סיומות גרסה. העתיקו, אל תקלידו.
מי מנתב את FastGPT דרך gateway.
- צוותים דו-לשוניים שמערבבים GLM, Qwen, Kimi, ו-DeepSeek עם ids של Claude ו-GPT בפריסה אחת, יתרה אחת, לוג שימוש אחד.
- צוותים באסיה שרוצים מודלים מערביים מתקדמים על יתרה מוטענת מראש בלי כרטיס מערבי, וצוותים מערביים שרוצים מודלים סיניים בלי חיוב אזורי.
- self-hosters שמחליפים sidecar של OneAPI: ה-gateway משרת את החלק הרב-ספקים, ה-channels המובנים של FastGPT משרתים את חלק הניתוב.
- סוכנויות שמריצות בסיסי ידע ללקוחות על FastGPT, מודדות כל לקוח עם מפתח משלו כך שהוצאת המודל מדווחת את עצמה לכל פרויקט.
- בונים שמשווים מודלי תשובה על corpora קבועים, שבהם כל מועמד הוא רשומת channel ולא חשבון ספק.
אמתו את ה-endpoint ובצעו דיבוג לשאלה הראשונה.
בצעו curl לרשימת המודלים קודם והעתיקו ids מהפלט אל ה-channel; לאחר מכן הריצו השלמת צ'אט אחת מול ה-id שאתם מתכננים להפוך לברירת מחדל. אם שתיהן עוברות, מחצית ה-gateway מוכחת. בתוך FastGPT, השתמשו בבדיקת הקישוריות של ה-channel, ואז שאלו שאלה אחת באפליקציה מינימלית לפני מעורבות datasets. שגיאות אימות מצביעות על מפתח ה-channel; not-found על איות ה-id; שגיאות חיבור על כתובת ה-proxy או egress של ה-container, מכיוון שהשרת של FastGPT, לא הדפדפן שלכם, הוא זה שחייב להגיע ל-endpoint. אם אפליקציית dataset נכשלת היכן שאפליקציית צ'אט רגילה עובדת, הבעיה נמצאת בקישורי המודל של ה-dataset עצמו, לא ב-channel. ברגע שהשאלות זורמות, קונסולת APIsRouter מציגה מודל לכל בקשה, ספירות טוקן, והוצאה. תעבורת בסיס-ידע היא הרבה בקשות קטנות ועתירות-קלט, ותצוגת השימוש לפי מפתח היא המקום שבו פרופיל העלות האמיתי של פריסה מופיע, לפי מודל, ליום, ids סיניים ומערביים על עמוד אחד.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"glm-5.2",
"messages":[{"role":"user","content":"ping"}]}'שאלות נפוצות
איך מוסיפים base URL מותאם אישית ל-FastGPT?
בגרסאות נוכחיות, דרך ה-UI: Account, Model Providers, Model Channels, Add Channel עם פרוטוקול OpenAI, כתובת proxy https://api.apisrouter.com/v1, המפתח שלכם, וה-model ids. בגרסאות ישנות יותר, הגדירו OPENAI_BASE_URL ו-CHAT_API_KEY בסביבה והצהירו על מודלים ב-config.json.
האם כתובת ה-proxy כוללת /v1?
כן, בשדה ה-proxy של ה-channel הזינו את ה-base עם סיומת /v1 ו-FastGPT מוסיף /chat/completions בעצמו. הטופס הנפרד למודל-מותאם-אישית הוא היוצא מן הכלל: הוא לוקח את כתובת הבקשה המלאה כולל /v1/chat/completions. התאימו את המוסכמה לשדה שבו אתם משתמשים.
האם אני עדיין צריך OneAPI עם FastGPT?
לא. מאז v4.8.23 FastGPT כולל שכבת אגרגציה משלו עם ניהול channels ב-UI, ו-gateway רב-ספקים מכסה את החלק ש-OneAPI טיפל בו. הרצת שתי השכבות בו-זמנית עובדת אבל מקשה על היגיון הניתוב; פריסות חדשות צריכות להגדיר channels בלבד.
האם FastGPT יכול לערבב מודלים סיניים ומערביים ב-channel אחד?
כן. ה-channel מעביר כל model id כמחרוזת פשוטה, כך ש-glm-5.2, qwen3.7-plus, kimi-k2.6, deepseek-v4-flash, ו-claude-sonnet-4-6 יכולים לחלוק channel אחד ומפתח אחד, ניתנים לבחירה לכל אפליקציה וצומת workflow.
למה מודל ה-channel שלי לא ניתן לבחירה באפליקציות?
הוספת id ל-channel והפעלת המודל לשימוש הן שלבים נפרדים ב-UI של Model Providers. הפעילו את המודל ברשימת המודלים, ואז בדקו שוב את התפריט הנפתח של האפליקציה או הצומת; הרשאות מודל לכל אפליקציה יכולות גם לסנן מה שצוות נתון רואה.
באילו מסמכי FastGPT כדאי לסמוך לעניין הזה?
החלק הנוכחי של הגדרת מודלים ב-doc.fastgpt.io. משטח ההגדרה של FastGPT השתנה משמעותית בעידן v4.8.2x, ומדריכי צד-שלישי ישנים המתארים sidecars של OneAPI או בלוקי llmModels ערוכים ידנית כבר לא תואמים לזרימת ה-UI-first.