הריצו את סיכומי הווידאו של BibiGPT על API תואם OpenAI מותאם אישית.
Updated 2026-07-30
BibiGPT ה-self-hosted קורא את OPENAI_COMPATIBLE_BASE_URL, OPENAI_COMPATIBLE_API_KEY, ו-OPENAI_COMPATIBLE_MODEL מהסביבה שלו. הפנו את ה-base URL אל https://api.apisrouter.com/v1 וכל סיכום של Bilibili, YouTube, או פודקאסט רץ דרך ה-gateway, עם מודלים סיניים וגלובליים מאחורי מפתח אחד.
תשובה מהירה: שלושה משתני סביבה.
קובץ הסביבה לדוגמה של BibiGPT מתעד את השטח ישירות: OPENAI_COMPATIBLE_BASE_URL קובע את ה-endpoint (ברירת מחדל https://api.openai.com/v1), OPENAI_COMPATIBLE_API_KEY מחזיק את המפתח (נופל חזרה אל OPENAI_API_KEY כשלא מוגדר), ו-OPENAI_COMPATIBLE_MODEL בוחר את מודל ברירת המחדל לסיכומים. הגדירו את ה-base URL ל-https://api.apisrouter.com/v1, שימו מפתח gateway במשתנה המפתח, ובחרו כל id מהקטלוג בתור המודל. ה-base URL מאומת בשימוש: הוא חייב להתחיל ב-http:// או https://, וקווים נטויים בסוף מוסרים, כך שהצורה עם ה-/v1 למעלה נכונה בדיוק. מתחת למכסה, האפליקציה בונה ספק openai-compatible של Vercel AI SDK מהערכים האלה וקוראת ל-chatModel עם ה-id המוגדר, וזו הסיבה שכל מודל שה-endpoint משרת עובד בלי שינויי קוד.
# Optional: use OpenAI-compatible providers (falls back to OPENAI_API_KEY)
OPENAI_COMPATIBLE_API_KEY=sk-YOUR-APISROUTER-KEY
OPENAI_COMPATIBLE_BASE_URL=https://api.apisrouter.com/v1
OPENAI_COMPATIBLE_MODEL=deepseek-v4-flashמה BibiGPT שולח אל ה-endpoint.
BibiGPT (JimmyLv ב-GitHub, כ-6K כוכבים לגרסת ה-open-source v1) הוא מסכם AI בלחיצה אחת לאודיו ווידאו: הדביקו קישור Bilibili או YouTube, פודקאסט, הקלטת פגישה, או קובץ מקומי, והוא מביא את התמלול, מעבה אותו, ומאפשר לכם לשוחח עם התוכן. הוא התחיל כ-BiliGPT לסיכומי Bilibili וגדל לכלי דו-לשוני עם יורש מתארח; הגדרת הסביבה המתוארת כאן חלה על הגרסה ה-open-source ה-self-hosted. עומס העבודה בצורת תמלול: קלטים ארוכים, פלטים קצרים. שעה של דיבור היא הרבה תמלול, שהאפליקציה מחלקת לחתיכות בגודל-מודל לפני סיכום, כך שסרטון אחד יכול פירושו כמה קריאות chat-completions שטוקני הקלט שלהן מגמדים את הסיכום שהן מייצרות. מחיר-לטוקן-קלט הוא לכן כל הכלכלה, ומודלים בהקשר-ארוך מפחיתים חלוקה להרצאות ופודקאסטים ארוכים. בניית הספק פותרת ערכים במפל הגיוני: מפתח לכל-בקשה (עבור מופעים שנותנים למשתמשים להביא משלהם) גובר על OPENAI_COMPATIBLE_API_KEY, שגובר על OPENAI_API_KEY; אותו הדבר חל על ה-base URL והמודל. יש אפילו משתנה OPENAI_COMPATIBLE_KEY_PREFIXES לקבלת מפתחות שהוזנו על ידי משתמשים שהקידומות שלהם אינן sk-, מה שחשוב כשהמפתחות שהמשתמשים שלכם מחזיקים מגיעים מ-gateway ולא מ-OpenAI.
הגדרה מלאה למופע self-hosted.
BibiGPT היא אפליקציית Next.js, כך שהסביבה נעה איך שלא תפרסו: קובץ .env מקומית, משתני סביבת פרויקט ב-Vercel, או env של container ב-Docker. הגדירו את שלושת המשתנים, פרסו מחדש או הפעילו מחדש, וסיכומים מנותבים דרך ה-gateway. משתנה המודל הוא ברירת המחדל, לא מגבלה קשיחה. בקשות נושאות הגדרה לכל-סרטון ששדה ה-model שלה, כשקיים, דורס את OPENAI_COMPATIBLE_MODEL, כך שמופע יכול ברירת מחדל ל-id נפח בעוד זרימות ספציפיות מבקשות אחד חזק יותר. אם אתם מריצים את המופע עבור אחרים ונותנים להם להדביק מפתחות משלהם, הגדירו את OPENAI_COMPATIBLE_KEY_PREFIXES לכלול את קידומת המפתח של ה-gateway שלכם כך שהטופס יקבל אותם.
OPENAI_COMPATIBLE_API_KEY=sk-YOUR-APISROUTER-KEY
OPENAI_COMPATIBLE_BASE_URL=https://api.apisrouter.com/v1
OPENAI_COMPATIBLE_MODEL=deepseek-v4-flash
# accepting user-entered gateway keys in the UI:
OPENAI_COMPATIBLE_KEY_PREFIXES=sk-בחירת מודל סיכום, מזרח ומערב.
ההשוואה קלה להרצה בכנות: אותו סרטון, שני ids של מודלים, קראו את שני הסיכומים מול התמלול. לוג השימוש לפי מפתח מתמחר כל מועמד על תוכן אמיתי, ועבור עומסי תמלול ההבדל נראה מיד בעמודת טוקני הקלט.
- תוכן סיני הוא הבית של BibiGPT: הרצאות Bilibili, קליפים מ-Douyin, פודקאסטים סיניים. glm-5.2, deepseek-v4-flash, ו-kimi-k2.6 חזקים באופן נטיבי בתמלולים סיניים ויושבים מאחורי אותו endpoint כמו כל השאר.
- תוכן באנגלית ומעורב (YouTube, פודקאסטים גלובליים) מסתדר היטב עם claude-haiku-4-5-20251001 ו-gemini-3.5-flash, ששניהם נוחים עם תמלולים ארוכים ורועשים.
- הפיצול הזה הוא הטיעון המעשי לסין-בתוספת-גלובלי עבור gateway: endpoint אחד, מפתח אחד, ודריסת המודל לכל-סרטון בוחרת את המשפחה הנכונה לכל מקור תוכן במקום לכפות ספק אחד על שניהם.
- הרצאות ארוכות מתגמלות הקשר ארוך. פחות חתיכות פירושו פחות קריאות וסיכום קוהרנטי יותר; בדקו id בהקשר-ארוך מול התוכן הארוך ביותר שלכם לפני שאתם מתקננים.
- מופעי נפח (צוות שמסכם כל מה שהם צופים) צריכים ברירת מחדל ל-deepseek-v4-flash ולהעצים באופן סלקטיבי; הצורה הכבדה-בקלט הופכת תמחור-שכבה-מהירה לצוברת.
תשלום לפי שימוש · מתחת למחיר הרשמי
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| מודל | מחיר רשמי | המחיר שלנו |
|---|---|---|
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| GLM-5.2 | $1.14 / $4.00 per M | $1.10 / $4.00 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
מצבי כשל ספציפיים ל-BibiGPT.
שרשרת הנפילה-חזרה יכולה להפתיע אתכם. אם OPENAI_COMPATIBLE_API_KEY ריק, האפליקציה נופלת חזרה בשקט אל OPENAI_API_KEY. זה נוח עד ששניהם מצביעים על שירותים שונים: base URL של gateway עם מפתח OpenAI מייצר שגיאות אימות שנראות כמו בעיות gateway. כשהניתוב משתנה, הגדירו את הזוג עם הקידומת compatible יחד ואל תשאירו OPENAI_API_KEY מיושן שמצביע למקום אחר, או ודאו שהוא מחזיק את אותו מפתח gateway. מאמת ה-base URL דוחה ערכים בלי scheme, אז host גולמי נכשל מהר עם שגיאה ברורה; כללו https:// ואת הנתיב /v1. קווים נטויים בסוף מנורמלים החוצה, כך ששתי הצורות עובדות שם. ids של מודלים הם מחרוזות מדויקות מול רשימת ה-/v1/models של ה-endpoint; טעות הקלדה ב-OPENAI_COMPATIBLE_MODEL מכשילה את הסיכום הראשון עם model-not-found. זכרו גם את הדריסה לכל-סרטון: אם זרימה אחת ממשיכה להשתמש במודל ישן, משהו מעביר model מפורש בהגדרת הבקשה. הבאת התמלול היא צנרת נפרדת. אם סרטון לא מניב סיכום מכיוון שכתוביות או אודיו לא ניתנו להבאה, זו צינור התוכן (APIs של פלטפורמות, זמינות כתוביות), לא ה-endpoint של ה-LLM. משתני הסביבה במדריך הזה מזיזים רק את קריאות הסיכום. ושימו לב ששירות bibigpt.co המתארח מנהל את המודלים שלו; המשתנים האלה מגדירים את ה-v1 ה-open-source שאתם פורסים בעצמכם.
מי מנתב את BibiGPT דרך gateway.
- צופים דו-לשוניים שמסכמים גם Bilibili וגם YouTube, מזווגים ids חזקים בסינית עם גלובליים מאחורי מפתח אחד במקום ספק אחד לכל שפה.
- self-hosters בהגדרות קרובות-לסין שם endpoint תואם OpenAI יחיד שגם משרת GLM, DeepSeek, ו-Kimi מסיר את בעיית החיוב מרובה-הספקים לגמרי.
- צוותים שמריצים מסכם משותף לפגישות והרצאות, מודדים שימוש לפי מפתח וברירת מחדל ל-ids בשכבת נפח.
- מאזיני פודקאסטים כבדים, שם שעות תמלול בשבוע הופכות תמחור טוקני-קלט לכל סיפור העלות.
- מפתחים ללא גישה לחיוב של ספק נתון. גישה מבוססת-הטענה בלי דרישת כרטיס מסירה את התלות בהרשמה לכל ספק.
אמתו את ה-endpoint ובצעו דיבוג לסיכום הראשון.
רשמו את המודלים שהמפתח שלכם יכול לכתוב אליהם ואשרו שה-id ב-OPENAI_COMPATIBLE_MODEL נמצא ביניהם; הבדיקה היחידה הזו מונעת את רוב כשלי ההרצה הראשונה. לאחר מכן סכמו משהו קצר. שגיאת אימות אומרת שהמפתח שנפתר לא תואם ל-base URL, ובהתחשב בשרשרת הנפילה-חזרה, הדפיסו איזה משתנה באמת סיפק את המפתח לפני שאתם מניחים. model-not-found היא טעות הקלדה ב-id. שגיאת scheme בעת ההפעלה היא base URL שחסר לו https://. סיכום שאף פעם לא מתחיל למרות endpoint בריא הוא הבאת התמלול שנכשלת לפני כל קריאת LLM. ברגע שסיכומים זורמים, קונסולת APIsRouter מציגה מודל לכל בקשה, ספירות טוקן, והוצאה. סיכום תמלול הוא עומס העבודה הכבד-בקלט הברור ביותר שקיים, ושבוע של נתוני שימוש אומר לכם את העלות האמיתית לשעת תוכן לכל מודל, וזה המספר ששווה לייעל.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50שאלות נפוצות
האם BibiGPT תומך ב-base URL תואם OpenAI מותאם אישית?
כן. ה-v1 ה-self-hosted מתעד את OPENAI_COMPATIBLE_BASE_URL, OPENAI_COMPATIBLE_API_KEY, ו-OPENAI_COMPATIBLE_MODEL בקובץ הסביבה לדוגמה שלו, ובונה ממנו את ספק ה-AI SDK. הגדירו את ה-base URL אל endpoint ה-gateway כולל /v1.
האם BibiGPT יכול לסכם עם מודלי GLM, DeepSeek, Kimi, או Claude?
כן. ה-id של המודל המוגדר מועבר אל ה-endpoint כמחרוזת פשוטה, כך שכל id מהקטלוג עובד: glm-5.2 ו-kimi-k2.6 לתוכן סיני, claude-haiku-4-5-20251001 או gemini-3.5-flash לתוכן גלובלי, הכל על מפתח אחד.
מה קורה אם OPENAI_COMPATIBLE_API_KEY לא מוגדר?
האפליקציה נופלת חזרה אל OPENAI_API_KEY. זה בסדר כששניהם מצביעים על אותו שירות, ומבלבל כשלא; כשמשתמשים ב-gateway, הגדירו את המפתח עם הקידומת compatible במפורש.
האם משתמשים יכולים להביא מפתחות gateway משלהם במופע משותף?
כן. מפתחות לכל-בקשה דורסים את הסביבה, ו-OPENAI_COMPATIBLE_KEY_PREFIXES שולט אילו קידומות מפתח הממשק מקבל, כך שפריסה משותפת יכולה לקחת מפתחות gateway שהוזנו על ידי משתמשים.
למה סרטונים ארוכים עולים יותר ממה שאורך הסיכום מרמז?
מכיוון שהתמלול הוא הקלט. שעה של דיבור היא מספר גדול של טוקני קלט, מחולקת לכמה קריאות, בעוד פלט הסיכום קטן. מחיר טוקני-קלט וטיפול בהקשר-ארוך מניעים את העלות, ולוג השימוש מציג אותה לכל סרטון.
האם המשתנים האלה חלים על שירות bibigpt.co המתארח?
לא. השירות המתארח מנהל את המודלים שלו בצד השרת. משתני הסביבה OPENAI_COMPATIBLE_* מגדירים את BibiGPT v1 ה-open-source שאתם פורסים בעצמכם.