Kuasakan ejen Warp daripada endpoint inferens anda sendiri.
Updated 2026-07-29
Warp menyokong endpoint inferens custom untuk tepat ini: mana-mana endpoint yang melaksanakan OpenAI Chat Completions API, gateway dan penghala model termasuk secara eksplisit. Arahkannya ke https://api.apisrouter.com/v1 dengan satu kunci, dan model yang dihalakan endpoint muncul dalam pemilih model Warp tanpa menggunakan kredit Warp AI.
Jawapan pantas: tetapan, URL, kunci, id model.
Buka Settings Warp dan cari "inference endpoint" untuk melompat ke konfigurasi. Masukkan URL endpoint, https://api.apisrouter.com/v1, kunci APIsRouter anda sebagai kelayakan, dan id model atau model yang anda mahu hala melaluinya, contohnya claude-sonnet-4-6 dan gpt-5.6-sol. Sebaik sahaja disimpan, model itu muncul dalam pemilih model Warp bersebelahan pilihan terbina. Tingkah laku pengebilan adalah intinya: apabila anda secara eksplisit memilih model yang dihalakan endpoint daripada pemilih, Warp menghalakan permintaan melalui endpoint anda dan bukan menggunakan kredit AI Warp, dan kosnya mendarat pada baki gateway anda di mana anda boleh melihatnya per permintaan. Dokumentasi Warp menerangkan aliran ini sebagai mencerminkan persediaan Bring Your Own API Key mereka, jadi ia akan terasa biasa jika anda pernah mengkonfigurasi BYOK sebelum ini.
Endpoint URL: https://api.apisrouter.com/v1
Credential: sk-YOUR-APISROUTER-KEY
Model id(s): claude-sonnet-4-6
gpt-5.6-sol
kemudian: pilih model yang dihalakan endpoint
dalam pemilih model WarpBagaimana Warp menggunakan endpoint.
Warp ialah terminal agentic: ejennya merangka arahan, menerangkan kegagalan, menjalankan tugas berbilang langkah, dan mengedit kod daripada tetingkap yang sama anda bekerja. Dokumentasi Warp sendiri menyatakan keperluan secara jelas: endpoint mesti melaksanakan OpenAI Chat Completions API di /v1/chat/completions, dan siaran pelancaran mereka menamakan penghala model dan gateway yang dihoskan sebagai sasaran yang dimaksudkan, jadi gateway berbilang vendor adalah warganegara kelas pertama di sini, bukan helah. Dua kekangan terdokumentasi berbaloi diketahui sebelum anda bermula. Pertama, endpoint mesti boleh dicapai secara awam: localhost, 127.0.0.1, dan URL rangkaian peribadi ditolak pada masa konfigurasi, yang menghalang mengarahkan Warp terus ke pelayan inferens tempatan tetapi tidak relevan untuk gateway yang dihoskan. Kedua, pemilihan model Auto Warp sentiasa menggunakan kredit Warp walaupun endpoint custom dikonfigurasi; hanya memilih secara eksplisit model yang dihalakan endpoint daripada pemilih menghalakan melalui endpoint anda. Jika perbelanjaan anda tidak bergerak ke konsol gateway, semak model mana yang sebenarnya digunakan sesi itu. Ketersediaan bergantung pelan: endpoint inferens custom ditawarkan pada pelan Free dan berbayar yang layak untuk individu dan organisasi sepuluh orang atau kurang, manakala organisasi lebih besar memerlukan tier Business atau Enterprise Warp. Itu terus daripada dokumen Warp dan boleh berubah pada pihak mereka.
Memilih model untuk kerja ejen terminal.
Ejen terminal dibilkan berbeza daripada sembang: setiap penerangan arahan, cubaan semula, dan ringkasan output adalah permintaan membawa konteks sesi. Kerana penggunaan yang dihalakan endpoint mendarat dalam konsol gateway per permintaan dan per model, seminggu penggunaan sebenar memberi anda nombor jujur setiap model calon, yang mengatasi meneka daripada halaman harga, termasuk yang ini.
- claude-sonnet-4-6 sebagai pemandu harian: penjanaan arahan yang boleh diharap, penggunaan alat yang kukuh, pertimbangan yang baik pada tugas berbilang langkah.
- gpt-5.6-sol untuk kerja terhad pantas, di mana kependaman per giliran membentuk rasa terminal.
- claude-opus-4-7 untuk sesi sukar: penyahpepijatan merentas perkhidmatan, rantaian penyiasatan panjang, perubahan infrastruktur yang anda mahu ditaakul dengan teliti.
- gpt-5.5 sebagai generalis frontier untuk A/B berbanding Claude pada aliran kerja shell anda sendiri.
- deepseek-v4-pro sebagai pilihan nilai untuk penggunaan ejen volum tinggi rutin di mana kadar lebih penting daripada kilauan frontier.
Bayar mengikut penggunaan · bawah harga rasmi
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Harga Rasmi | Harga Kami |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Mod kegagalan khusus Warp.
Seperti biasa, buktikan separuh gateway dengan dua arahan curl, senarai model dan satu chat completion, sebelum menyahpepijat sisi Warp. Jika curl lulus dan Warp gagal, masalahnya berada dalam borang endpoint atau pemilihan pemilih model, tiada di tempat lain.
- Endpoint ditolak semasa simpan: Warp menolak URL localhost dan rangkaian peribadi mengikut reka bentuk. Endpoint mesti boleh dicapai secara awam; URL gateway yang dihoskan lulus semakan ini.
- Perbelanjaan masih mengena kredit Warp: sesi berada pada pemilihan model Auto, yang sentiasa menggunakan kredit Warp. Pilih secara eksplisit model yang dihalakan endpoint dalam pemilih.
- Model tidak ditemui: id yang anda taip ke dalam konfigurasi endpoint tidak sepadan katalog gateway. Salin id daripada senarai /v1/models bait demi bait.
- 401 daripada endpoint: medan kelayakan membawa kunci lapuk atau terpotong. Curl senarai model dengan kunci yang sama untuk sahkan di luar Warp.
- Ciri langsung tidak kelihatan: semak pelan anda. Endpoint custom tersedia untuk individu dan organisasi kecil pada pelan Free dan berbayar yang layak; organisasi lebih besar memerlukan Business atau Enterprise mengikut dokumen Warp.
Siapa yang menghalakan Warp melalui gateway.
- Pembangun yang mahu Claude di sebalik ejen Warp pada baki prabayar, dengan permulaan percuma dan tanpa kad.
- Pengguna ejen berat yang penggunaan kredit Warp-nya melebihi pelan mereka, memindahkan pilihan model eksplisit ke endpoint berukur mereka sendiri.
- Pembeli model membandingkan model pengekodan pada aliran kerja terminal sebenar, di mana setiap calon adalah satu lagi id dalam konfigurasi endpoint.
- Pasukan sepuluh orang atau kurang yang menstandardkan satu kunci gateway supaya ejen terminal, editor, dan CI berkongsi satu log penggunaan.
- Orang yang sudah menjalankan alat lain melalui gateway yang mahu Warp pada kunci dan konsol yang sama.
Sahkan endpoint dan sahkan penghalaan.
Jalankan dua semakan standard dengan kunci dan id tepat yang anda konfigurasikan dalam Warp. Kedua-duanya lulus bermaksud gateway sedia dan mana-mana isu yang tinggal berada dalam tetapan Warp atau pemilihan model. Kemudian jalankan satu tugas ejen sebenar dalam Warp dengan model endpoint dipilih secara eksplisit, dan sahkan permintaan itu muncul dalam konsol APIsRouter dengan model dan kiraan token yang dijangka. Satu pengesahan itu menangkap kekeliruan mod-Auto dengan segera, dan sejak itu konsol adalah rekod per-permintaan anda mengenai apa yang sebenarnya dibelanjakan terminal.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-sonnet-4-6",
"messages":[{"role":"user","content":"ping"}]}'Soalan lazim
Bagaimana saya mengkonfigurasi endpoint inferens custom dalam Warp?
Buka Settings Warp, cari "inference endpoint", dan masukkan URL endpoint, kelayakan anda, dan id model untuk dihalakan melaluinya. Dengan APIsRouter URL itu ialah https://api.apisrouter.com/v1 dan model muncul dalam pemilih Warp sebaik sahaja disimpan.
Adakah endpoint custom Warp berfungsi dengan gateway dan penghala model?
Ya, secara eksplisit. Dokumentasi Warp dan siaran pelancaran menamakan gateway dan penghala serasi OpenAI sebagai sasaran yang disokong; keperluannya ialah endpoint melaksanakan OpenAI Chat Completions API dan boleh dicapai secara awam.
Adakah permintaan yang dihalakan endpoint menggunakan kredit AI Warp saya?
Tidak. Apabila anda secara eksplisit memilih model yang dihalakan endpoint, Warp menghalakan permintaan melalui endpoint anda dan penyedia anda membilkannya, bukan kredit Warp. Pengecualiannya ialah pemilihan model Auto, yang sentiasa menggunakan kredit Warp walaupun endpoint dikonfigurasi.
Mengapa Warp menolak URL endpoint saya?
Warp menolak localhost, 127.0.0.1, dan URL rangkaian peribadi atau tempatan lain pada masa konfigurasi; endpoint mesti boleh dicapai secara awam. URL gateway yang dihoskan seperti https://api.apisrouter.com/v1 lulus semakan ini.
Pelan Warp mana yang termasuk endpoint inferens custom?
Mengikut dokumen Warp sekitar pertengahan 2026: pelan Free dan berbayar yang layak untuk pengguna individu dan organisasi sepuluh orang atau kurang; organisasi lebih besar memerlukan Warp Business atau Enterprise. Semak dokumentasi semasa Warp, kerana had pelan adalah milik mereka untuk diubah.
Bolehkah saya menjalankan model Claude dalam Warp dengan cara ini?
Ya. Tambah claude-sonnet-4-6 atau claude-opus-4-7 sebagai id model dalam konfigurasi endpoint dan pilihnya dalam pemilih; gateway melayaninya melalui permukaan serasi OpenAI yang diharapkan Warp, pada kunci yang sama seperti id GPT dan DeepSeek.