הריצו את מנוע התשובות של Perplexica על base URL מותאם אישית של OpenAI.
Updated 2026-07-29
Perplexica, ששונתה שמו ל-Vane ב-upstream, מגדירה את ספק ה-OpenAI שלה עם API Key ושדה Base URL. הגדירו את ה-Base URL ל-https://api.apisrouter.com/v1, הוסיפו את ה-model ids שאתם רוצים, וכל תשובת חיפוש מסונתזת דרך ה-gateway עם Claude, GPT, DeepSeek, או Gemini מאחורי מפתח אחד.
תשובה מהירה: שדה Base URL אחד, שני דורות הגדרה.
בגרסאות נוכחיות, ספק ה-OpenAI של Perplexica חושף בדיוק שני שדות נדרשים: API Key ו-Base URL, ניתנים לעריכה במסך ההגדרה הראשונית וב-UI ההגדרות, עם מיפויי סביבה מתועדים OPENAI_API_KEY ו-OPENAI_BASE_URL. הגדירו את ה-Base URL ל-https://api.apisrouter.com/v1, הדביקו מפתח gateway, ואז הוסיפו את מודלי הצ'אט שאתם רוצים לפי ה-ids המדויקים מהקטלוג. הספק מעביר את ה-model id כמחרוזת פשוטה דרך /v1/chat/completions, כך ש-ids של Claude ו-DeepSeek עובדים דרך סלוט הספק "OpenAI". בגרסאות Perplexica ישנות יותר (דור ה-config.toml, עד לקו v1.10 ו-v1.11), אותה יכולת היא ספק ה-CUSTOM_OPENAI: בלוק [MODELS.CUSTOM_OPENAI] עם מפתחות API_KEY, API_URL, ו-MODEL_NAME. שני הדורות מוצגים למטה, אז התאימו את ההגדרה לגרסה שאתם באמת מריצים.
# the settings UI fields map to these documented env vars
export OPENAI_API_KEY=sk-APIsRouter-...
export OPENAI_BASE_URL=https://api.apisrouter.com/v1
# then add chat models by id in Settings, e.g. claude-sonnet-4-6איך Perplexica עונה על שאלה, ואיפה ה-LLM יושב.
Perplexica (ItzCrazyKns ב-GitHub, כ-36K כוכבים) הוא מנוע התשובות הקוד-פתוח המוכר ביותר בסגנון Perplexity: הוא לוקח שאלה, מריץ חיפושי web אמיתיים דרך מופע SearxNG מצורף, קורא את התוצאות, ומגרים LLM לסנתז תשובה עם ציטוטים. מצבי חיפוש (speed, balanced, quality) מחליפים עומק אחזור מול latency, ומצבי focus מצמצמים מקורות ל-web, דיונים, או מאמרים אקדמיים. ב-2026 הפרויקט שונה שמו ל-Vane ב-upstream, כשתמונת ה-Docker הלכה בעקבותיו; הארכיטקטורה ומערכת הספקים עברו איתו, כך שכל מה שכאן חל תחת שני השמות. סלוט ה-LLM הוא היכן שאיכות הסינתזה והעלות חיים. כל תשובה היא קריאה אחת או יותר של chat-completions שנושאת את המקורות המאוחזרים כהקשר, מה שהופך מנוע תשובות לעומס עבודה עתיר-טוקני-קלט: המודל קורא הרבה יותר ממה שהוא כותב. מערכת הספקים מתייחסת ל-OpenAI כאחד מכמה backends (Ollama, Anthropic, Gemini, Groq, ואחרים), וספק ה-OpenAI הוא זה עם Base URL הניתן לעריכה חופשית, מה שהופך אותו לנקודת האחיזה של ה-gateway. התנהגות אחת לדעת מראש: כש-Base URL הוא כל דבר אחר מלבד endpoint ה-OpenAI המקורי, Perplexica מציגה במכוון רשימת מודלי ברירת מחדל ריקה ומשתמשת ברשומות המודל שאתם מוסיפים לספק בעצמכם. זה מכוון, מכיוון שהיא לא יכולה לדעת מה endpoint מותאם אישית משרת. הוספת claude-sonnet-4-6 או deepseek-v4-flash כרשומת מודל היא החצי השני של ההגדרה, לא עקיפה.
הגדרה מלאה: גרסאות נוכחיות ו-config.toml הישן.
גרסאות נוכחיות מגדירות הכל באפליקציה. בהפעלה ראשונה מסך ההגדרה שואל לספקים; לאחר מכן אותם שדות חיים ב-Settings. בחרו את ספק OpenAI, הגדירו API Key ו-Base URL, ואז הוסיפו רשומות מודל צ'אט עם ה-ids שאתם מתכננים להשתמש בהם. ה-ids חייבים להתאים בדיוק לקטלוג ה-gateway, וכל רשומה שאתם מוסיפים מופיעה בבורר המודלים ליד תיבת החיפוש. הדור הישן הוא מבוסס-קובץ. אם ההתקנה שלכם עדיין יש לה config.toml, אתם על דור ה-CUSTOM_OPENAI: מלאו את הבלוק למטה והפעילו מחדש את ה-container. MODEL_NAME לוקח model id אחד, ש-UI מציע אז כאפשרות ה-OpenAI המותאמת אישית.
[MODELS.CUSTOM_OPENAI]
API_KEY = "sk-YOUR-APISROUTER-KEY"
API_URL = "https://api.apisrouter.com/v1"
MODEL_NAME = "claude-sonnet-4-6"בחירת מודל סינתזה למנוע תשובות.
מכיוון שבורר המודלים קורא כל רשומה שהוספתם מול Base URL אחד, בדיקת A/B של מודלי סינתזה טריוויאלית: שאלו את אותה שאלה בשתי לשוניות עם שתי רשומות והשוו ציטוטים. לוג השימוש לפי מפתח מתמחר את התשובות של כל מודל, שזו הדרך הכנה להחליט האם סינתזה מתקדמת מרוויחה את הטוקנים שלה על תמהיל השאילתות שלכם.
- טוקני קלט שולטים. תשובה במצב quality יכולה לדחוף הקשרים מאוחזרים גדולים ל-prompt, אז המחיר לטוקן-קלט של ה-id שלכם קובע את עלות החיפוש, לא התשובה הקצרה שהוא כותב חזרה.
- claude-sonnet-4-6 היא ברירת המחדל החזקה לסינתזה עם ציטוטים: היא עוקבת היטב אחר הוראות עיגון-מקורות ונשארת קוהרנטית כשקטעים רבים סותרים.
- מופעים אישיים או צוותיים בנפח גבוה מסתדרים היטב על claude-haiku-4-5-20251001, gemini-3.5-flash, או deepseek-v4-flash: תשובות נשארות מעוגנות והעלות לחיפוש יורדת מספיק כדי להשאיר את מצב quality דלוק.
- שמרו id מתקדם כרשומה שנייה. רשומות מודל יושבות זו לצד זו בבורר, אז הסלמת שאלה קשה אחת ל-gpt-5.5 היא שינוי תפריט נפתח, לא עריכת הגדרה.
- מצב focus אקדמי מתגמל מודלים בהקשר-ארוך, מכיוון שתקצירים וקטעי מאמרים גדולים יותר מקטעי web.
תשלום לפי שימוש · מתחת למחיר הרשמי
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| מודל | מחיר רשמי | המחיר שלנו |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
מצבי כשל ספציפיים ל-Perplexica.
רשימת המודלים הריקה היא הקלאסית. אתם מגדירים את ה-Base URL, הבורר הופך ריק, וזה נראה שבור. זה לא: עם Base URL שאינו ברירת המחדל, Perplexica מציגה רק את רשומות המודל שאתם מוסיפים לספק. הוסיפו את ה-ids שלכם והם יופיעו. Embeddings הם סלוט נפרד. Perplexica משתמשת במודלי embedding ל-reranking של תוצאות, וספק ה-OpenAI משרת embeddings מאותו Base URL ומפתח. אם ה-gateway שלכם לא משרת את ה-embedding id שאתם מגדירים שם, reranking נשבר בעוד תשובות הצ'אט ממשיכות לעבוד. הפיצול הנקי הוא לשמור על embeddings בספק ה-Transformers המקומי, שרץ על המכשיר בלי API בכלל, ולנתב רק סינתזת צ'אט דרך ה-gateway. שינוי השם מכשיל מדריכים. Perplexica ו-Vane הם אותו פרויקט; מדריכים ישנים מזכירים את תמונת ה-Docker perplexica ואת config.toml, בניות נוכחיות מגיעות כ-vane עם הגדרות בתוך האפליקציה ו-volume נתונים מתמיד. אם להתקנה שלכם אין config.toml, אל תיצרו אחד, הוא לא נקרא; הגדירו דרך ה-UI או משתני הסביבה המתועדים במקום זאת. SearxNG עצמאי. אם תשובות מתדרדרות או חיפושים מחזירים כלום, זה container ה-SearxNG או הגדרת פורמט ה-JSON שלו, לא endpoint ה-LLM. ה-Base URL מזיז רק קריאות צ'אט ו-embedding.
מי מנתב את Perplexica דרך gateway.
- self-hosters שמחליפים מנוי Perplexity ורוצים סינתזה באיכות מתקדמת לכל חיפוש במחירי טוקן, עם מפתח אחד במקום חשבון ספק לכל משפחת מודלים.
- צוותים שמריצים מנוע תשובות משותף, שם לוג השימוש לפי מפתח הופך "כמה חיפוש עולה לנו" למספר לכל מודל.
- הגדרות ממוקדות-פרטיות ששומרות אחזור מקומי לחלוטין (SearxNG בתוספת embeddings מקומיים) ומנתבות רק את קריאת הסינתזה הסופית החוצה דרך endpoint אחד ניתן-לביקורת.
- חובבים שמשווים מודלי סינתזה על שאלות זהות: כל מועמד הוא רשומת מודל אחת מול אותו Base URL.
- מפתחים ללא גישה לחיוב של ספק נתון. גישה מבוססת-הטענה בלי דרישת כרטיס מסירה את התלות בהרשמה לכל ספק.
אמתו את ה-endpoint ובצעו דיבוג לחיפוש הראשון.
אשרו שה-gateway משרת את ה-ids שהוספתם לפני שאתם מאשימים את האפליקציה; הרשומות בספק חייבות להתאים בדיוק לפלט ה-/v1/models. כשלי הרצה ראשונה עוקבים אחר תבנית. "No chat model providers configured" אומר ששדות הספק לא נשמרו או שרשימת המודלים עדיין ריקה; הוסיפו לפחות רשומת מודל צ'אט אחת. 401 בלוגי השרת אומר שהמפתח לא תואם ל-endpoint בשדה Base URL. שגיאת model-not-found היא טעות הקלדה ב-id ברשומת מודל. שגיאות reranking עם תשובות שעובדות מצביעות על סלוט ה-embedding, שם ספק ה-Transformers המקומי מציל אתכם. ואם שום דבר לא השתנה אחרי עריכת משתני סביבה, זכרו שההגדרה נשמרת ב-volume הנתונים; שדות שכבר נשמרו ב-UI מנצחים שינוי env מאוחר יותר, אז ערכו אותם ב-Settings. ברגע שהחיפושים זורמים, קונסולת APIsRouter מציגה מודל לכל בקשה, ספירות טוקן, והוצאה. מנועי תשובות עתירי-קלט, וראיית המספר האמיתי של טוקנים-לחיפוש עבור תמהיל השאילתות שלכם מנצחת כל הערכה.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50שאלות נפוצות
האם Perplexica הוא אותו פרויקט כמו Vane?
כן. המאגר ב-upstream שונה שמו ל-Vane ב-2026, ותמונת ה-Docker הלכה בעקבותיו. מערכת הספקים, אינטגרציית SearxNG, ושדה ה-Base URL המתוארים כאן זהים תחת שני השמות; רק שחרורים ישנים עדיין משתמשים בשם Perplexica וב-config.toml.
האם Perplexica יכולה להשתמש במודלי Claude או DeepSeek לתשובות?
כן. ספק ה-OpenAI מעביר model ids כמחרוזות פשוטות לכל Base URL שאתם מגדירים. הוסיפו claude-sonnet-4-6 או deepseek-v4-flash כרשומות מודל מול ה-Base URL של ה-gateway והם יופיעו בבורר המודלים כמו כל אפשרות אחרת.
למה רשימת המודלים ריקה אחרי ששיניתי את ה-Base URL?
זה מכוון. עם Base URL שאינו ברירת המחדל, Perplexica לא יכולה להניח אילו מודלים ה-endpoint משרת, אז היא מציגה רק את הרשומות שאתם מוסיפים לספק בעצמכם. הוסיפו את ה-ids שלכם ב-Settings והם מופיעים מיד.
מה הם מפתחות ה-CUSTOM_OPENAI הישנים בהגדרה?
בדור ה-config.toml (עד לקו v1.10 ו-v1.11), הבלוק [MODELS.CUSTOM_OPENAI] לוקח API_KEY, API_URL, ו-MODEL_NAME. הגדירו את API_URL ל-endpoint ה-gateway כולל /v1 ואת MODEL_NAME ל-id אחד מהקטלוג, ואז הפעילו מחדש.
האם embeddings גם מנותבים דרך ה-Base URL המותאם אישית?
אם אתם מגדירים מודלי embedding על ספק ה-OpenAI, כן, הם משתמשים באותו Base URL ומפתח. רוב הגדרות ה-gateway שומרות על embeddings בספק ה-Transformers המקומי במקום זאת, שלא צריך API כלל ומשאיר את ה-reranking עצמאי מ-endpoint הצ'אט.
האם משתני הסביבה OPENAI_API_KEY ו-OPENAI_BASE_URL עדיין עובדים?
כן, הם מיפויי ה-env המתועדים עבור שני השדות של ספק ה-OpenAI בגרסאות נוכחיות. שימו לב שערכים שכבר נשמרו דרך ה-UI של ההגדרות נשארים ב-volume הנתונים, אז ערכו שם אם האפליקציה כבר הוגדרה פעם אחת.