Jalankan enjin jawapan Perplexica pada base URL OpenAI custom.
Updated 2026-07-29
Perplexica, dinamakan semula Vane di upstream, mengkonfigurasi penyedia OpenAI-nya dengan medan API Key dan Base URL. Tetapkan Base URL kepada https://api.apisrouter.com/v1, tambah id model yang anda mahu, dan setiap jawapan carian mensintesis melalui gateway dengan Claude, GPT, DeepSeek, atau Gemini di sebalik satu kunci.
Jawapan pantas: satu medan Base URL, dua generasi config.
Pada keluaran semasa, penyedia OpenAI Perplexica mendedahkan tepat dua medan diperlukan: API Key dan Base URL, boleh disunting dalam skrin persediaan dan UI settings, dengan pemetaan environment yang didokumentasikan OPENAI_API_KEY dan OPENAI_BASE_URL. Tetapkan Base URL kepada https://api.apisrouter.com/v1, tampal kunci gateway, kemudian tambah chat model yang anda mahu mengikut id katalog tepatnya. Penyedia meneruskan id model sebagai rentetan biasa melalui /v1/chat/completions, jadi id Claude dan DeepSeek berfungsi melalui slot penyedia "OpenAI". Pada keluaran Perplexica lebih lama (generasi config.toml, sehingga barisan v1.10 dan v1.11), keupayaan yang sama ialah penyedia CUSTOM_OPENAI: blok [MODELS.CUSTOM_OPENAI] dengan kunci API_KEY, API_URL, dan MODEL_NAME. Kedua-dua generasi ditunjukkan di bawah, jadi padankan persediaan dengan versi yang benar-benar anda jalankan.
# the settings UI fields map to these documented env vars
export OPENAI_API_KEY=sk-APIsRouter-...
export OPENAI_BASE_URL=https://api.apisrouter.com/v1
# then add chat models by id in Settings, e.g. claude-sonnet-4-6Bagaimana Perplexica menjawab soalan, dan di mana LLM duduk.
Perplexica (ItzCrazyKns di GitHub, lebih kurang 36K bintang) ialah enjin jawapan sumber terbuka gaya Perplexity yang paling terkenal: ia mengambil soalan, menjalankan carian web sebenar melalui instans SearxNG yang dibundel, membaca hasilnya, dan mempunyai LLM mensintesis jawapan yang dipetik. Mod carian (speed, balanced, quality) menukar kedalaman retrieval dengan latensi, dan mod focus menyempitkan sumber kepada web, perbincangan, atau kertas akademik. Pada 2026 projek itu dinamakan semula Vane di upstream, dengan imej Docker turut mengikut; seni bina dan sistem penyedia terus digunakan, jadi segala-galanya di sini terpakai di bawah mana-mana nama. Slot LLM adalah tempat kualiti sintesis dan kos wujud. Setiap jawapan adalah satu atau lebih panggilan chat-completions yang membawa sumber yang diambil sebagai konteks, yang menjadikan enjin jawapan beban kerja token-input tinggi: model membaca jauh lebih banyak daripada yang ditulisnya. Sistem penyedia melayan OpenAI sebagai salah satu daripada beberapa backend (Ollama, Anthropic, Gemini, Groq, dan lain-lain), dan penyedia OpenAI adalah yang mempunyai Base URL boleh disunting secara bebas, yang menjadikannya cangkuk gateway. Satu tingkah laku untuk diketahui terlebih dahulu: apabila Base URL adalah apa sahaja selain endpoint OpenAI stok, Perplexica dengan sengaja menunjukkan senarai model lalai kosong dan menggunakan entri model yang anda tambah sendiri kepada penyedia. Itu adalah dengan reka bentuk, kerana ia tidak dapat mengetahui apa yang dilayani endpoint custom. Menambah claude-sonnet-4-6 atau deepseek-v4-flash sebagai entri model adalah separuh kedua persediaan, bukan workaround.
Persediaan penuh: keluaran semasa dan config.toml warisan.
Keluaran semasa mengkonfigurasi segala-galanya dalam app. Pada but pertama skrin persediaan bertanya tentang penyedia; selepas itu medan yang sama wujud dalam Settings. Pilih penyedia OpenAI, tetapkan API Key dan Base URL, kemudian tambah entri chat model dengan id yang anda rancang gunakan. Id itu mesti sepadan tepat dengan katalog gateway, dan setiap entri yang anda tambah muncul dalam pemilih model bersebelahan kotak carian. Generasi warisan adalah berasaskan fail. Jika pemasangan anda masih mempunyai config.toml, anda berada pada generasi CUSTOM_OPENAI: isikan blok di bawah dan mula semula kontainer. MODEL_NAME mengambil satu id model, yang kemudian ditawarkan UI sebagai pilihan OpenAI custom.
[MODELS.CUSTOM_OPENAI]
API_KEY = "sk-YOUR-APISROUTER-KEY"
API_URL = "https://api.apisrouter.com/v1"
MODEL_NAME = "claude-sonnet-4-6"Memilih model sintesis untuk enjin jawapan.
Kerana pemilih model membaca apa sahaja entri yang anda tambah terhadap satu Base URL, ujian A/B model sintesis adalah remeh: tanya soalan yang sama dalam dua tab dengan dua entri dan bandingkan petikan. Log penggunaan per-kunci menilai harga jawapan setiap model, cara jujur untuk memutuskan sama ada sintesis frontier berbaloi tokennya atas campuran pertanyaan anda.
- Token input mendominasi. Jawapan mod-kualiti boleh menolak konteks besar yang diambil ke dalam prompt, jadi harga per-token-input id anda menetapkan kos carian, bukan jawapan pendek yang ditulis kembali.
- claude-sonnet-4-6 ialah lalai yang kuat untuk sintesis yang dipetik: ia mengikut arahan berasaskan-sumber dengan baik dan kekal koheren apabila banyak petikan tidak bersetuju.
- Instans peribadi atau pasukan volum tinggi berjalan baik pada claude-haiku-4-5-20251001, gemini-3.5-flash, atau deepseek-v4-flash: jawapan kekal berasaskan dan kos per-carian jatuh cukup untuk membiarkan mod kualiti terpasang.
- Kekalkan id frontier sebagai entri kedua. Entri model duduk bersebelahan dalam pemilih, jadi meningkatkan satu soalan sukar kepada gpt-5.5 adalah perubahan dropdown, bukan edit config.
- Mod focus akademik memberi ganjaran kepada model konteks-panjang, kerana abstrak dan petikan kertas lebih besar berbanding petikan web.
Bayar mengikut penggunaan · bawah harga rasmi
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Harga Rasmi | Harga Kami |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
Mod kegagalan khusus Perplexica.
Senarai model kosong adalah yang klasik. Anda tetapkan Base URL, pemilih menjadi kosong, dan ia kelihatan rosak. Ia tidak: dengan Base URL bukan-lalai, Perplexica hanya menyenaraikan entri model yang anda tambah kepada penyedia. Tambah id anda dan ia muncul. Embeddings adalah slot berasingan. Perplexica menggunakan embedding model untuk reranking hasil, dan penyedia OpenAI melayani embeddings daripada Base URL dan kunci yang sama. Jika gateway anda tidak melayani id embedding yang anda konfigurasikan di sana, reranking pecah manakala jawapan sembang terus berfungsi. Pemisahan bersih ialah mengekalkan embeddings pada penyedia Transformers tempatan, yang berjalan pada mesin tanpa sebarang API, dan hanya menghalakan sintesis sembang melalui gateway. Penamaan semula menyilapkan panduan. Perplexica dan Vane adalah projek yang sama; tutorial lama merujuk imej Docker perplexica dan config.toml, binaan semasa dihantar sebagai vane dengan tetapan dalam-app dan volum data berkekalan. Jika pemasangan anda tiada config.toml, jangan cipta satu, ia tidak dibaca; konfigurasikan melalui UI atau env var yang didokumentasikan sebaliknya. SearxNG adalah bebas. Jika jawapan merosot atau carian tidak mengembalikan apa-apa, itu adalah kontainer SearxNG atau tetapan format-JSON-nya, bukan endpoint LLM. Base URL hanya memindahkan panggilan sembang dan embedding.
Siapa yang menghalakan Perplexica melalui gateway.
- Self-hoster yang menggantikan langganan Perplexity yang mahukan sintesis berkualiti frontier per carian pada harga token, dengan satu kunci dan bukan akaun vendor setiap keluarga model.
- Pasukan yang menjalankan enjin jawapan dikongsi, di mana log penggunaan per-kunci menukar "berapa kos carian kepada kami" menjadi nombor per model.
- Persediaan berfokus-privasi yang mengekalkan retrieval sepenuhnya tempatan (SearxNG ditambah embeddings tempatan) dan hanya menghalakan panggilan sintesis akhir keluar melalui satu endpoint yang boleh diaudit.
- Peminat yang membandingkan model sintesis pada soalan yang sama: setiap calon adalah satu entri model terhadap Base URL yang sama.
- Pembangun tanpa akses kepada pengebilan vendor tertentu. Akses berasaskan top-up tanpa keperluan kad menghapuskan kebergantungan pendaftaran setiap penyedia.
Sahkan endpoint dan nyahpepijat carian pertama.
Sahkan gateway melayani id yang anda tambah sebelum menyalahkan app; entri dalam penyedia mesti sepadan tepat dengan output /v1/models. "No chat model providers configured" bermaksud medan penyedia tidak disimpan atau senarai model masih kosong; tambah sekurang-kurangnya satu entri chat model. 401 dalam log pelayan bermaksud kunci tidak sepadan dengan endpoint dalam medan Base URL. Ralat model-not-found adalah kesilapan taip id dalam entri model. Ralat reranking dengan jawapan yang berfungsi menunjuk kepada slot embedding, tempat penyedia Transformers tempatan menyelamatkan anda. Dan jika tiada apa berubah selepas menyunting pembolehubah environment, ingat config berkekalan dalam volum data; medan yang sudah disimpan dalam UI menang atas perubahan env kemudian, jadi editnya dalam Settings. Sebaik sahaja carian mengalir, konsol APIsRouter menunjukkan model per permintaan, kiraan token, dan perbelanjaan. Enjin jawapan adalah berat input, dan melihat nombor token-per-carian sebenar untuk campuran pertanyaan anda mengatasi mana-mana anggaran.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50Soalan lazim
Adakah Perplexica projek yang sama dengan Vane?
Ya. Repositori upstream dinamakan semula Vane pada 2026, dan imej Docker mengikut. Sistem penyedia, integrasi SearxNG, dan medan Base URL yang diterangkan di sini adalah sama di bawah kedua-dua nama; hanya keluaran warisan masih menggunakan nama Perplexica dan config.toml.
Bolehkah Perplexica menggunakan model Claude atau DeepSeek untuk jawapan?
Ya. Penyedia OpenAI meneruskan id model sebagai rentetan biasa kepada apa sahaja Base URL yang anda tetapkan. Tambah claude-sonnet-4-6 atau deepseek-v4-flash sebagai entri model terhadap Base URL gateway dan ia muncul dalam pemilih model seperti mana-mana pilihan lain.
Mengapa senarai model kosong selepas saya menukar Base URL?
Dengan reka bentuk. Dengan Base URL bukan-lalai, Perplexica tidak dapat menganggap model mana yang dilayani endpoint, jadi ia hanya menyenaraikan entri yang anda tambah sendiri kepada penyedia. Tambah id anda dalam Settings dan ia muncul serta-merta.
Apakah kunci config CUSTOM_OPENAI warisan?
Pada generasi config.toml (sehingga barisan v1.10 dan v1.11), blok [MODELS.CUSTOM_OPENAI] mengambil API_KEY, API_URL, dan MODEL_NAME. Tetapkan API_URL kepada endpoint gateway termasuk /v1 dan MODEL_NAME kepada satu id katalog, kemudian mula semula.
Adakah embeddings turut menghalakan melalui Base URL custom?
Jika anda mengkonfigurasi embedding model pada penyedia OpenAI, ya, ia menggunakan Base URL dan kunci yang sama. Kebanyakan persediaan gateway mengekalkan embeddings pada penyedia Transformers tempatan sebaliknya, yang tidak memerlukan API dan membiarkan reranking bebas daripada endpoint sembang.
Adakah pembolehubah environment OPENAI_API_KEY dan OPENAI_BASE_URL masih berfungsi?
Ya, ia adalah pemetaan env yang didokumentasikan untuk dua medan penyedia OpenAI pada keluaran semasa. Ambil perhatian bahawa nilai yang sudah disimpan melalui UI settings berkekalan dalam volum data, jadi editnya di sana jika app sudah dikonfigurasikan sekali.