Jalankan agent Warp dari inference endpoint Anda sendiri.
Updated 2026-07-29
Warp mendukung custom inference endpoint untuk tepat ini: endpoint apa pun yang mengimplementasikan OpenAI Chat Completions API, gateway dan model router secara eksplisit termasuk. Arahkan ke https://api.apisrouter.com/v1 dengan satu key, dan model yang dirutekan-endpoint muncul di picker model Warp tanpa menghabiskan credit Warp AI.
Jawaban singkat: pengaturan, URL, key, id model.
Buka Settings Warp dan cari "inference endpoint" untuk langsung ke konfigurasinya. Masukkan URL endpoint, https://api.apisrouter.com/v1, key APIsRouter Anda sebagai kredensial, dan id model atau beberapa id yang ingin Anda rutekan melaluinya, misalnya claude-sonnet-4-6 dan gpt-5.6-sol. Setelah disimpan, model itu muncul di picker model Warp di samping opsi bawaan. Perilaku billing-nya adalah intinya: saat Anda secara eksplisit memilih model yang dirutekan-endpoint dari picker, Warp merutekan request melalui endpoint Anda alih-alih menghabiskan credit AI Warp, dan biayanya mendarat di saldo gateway Anda di mana Anda bisa melihatnya per request. Dokumentasi Warp menjelaskan alur ini sebagai mencerminkan setup Bring Your Own API Key mereka, jadi ini akan terasa familiar jika Anda pernah mengonfigurasi BYOK sebelumnya.
Endpoint URL: https://api.apisrouter.com/v1
Credential: sk-YOUR-APISROUTER-KEY
Id model: claude-sonnet-4-6
gpt-5.6-sol
lalu: pilih model yang dirutekan-endpoint
di picker model WarpBagaimana Warp menggunakan endpoint.
Warp adalah terminal agentic: agent-nya menyusun perintah, menjelaskan kegagalan, menjalankan tugas multi-langkah, dan mengedit kode dari jendela yang sama tempat Anda bekerja. Dokumentasi Warp sendiri menyatakan syaratnya secara jelas: endpoint harus mengimplementasikan OpenAI Chat Completions API di /v1/chat/completions, dan postingan peluncurannya menyebut model router dan gateway hosted sebagai target yang dituju, jadi gateway multi-vendor adalah warga kelas satu di sini, bukan trik. Dua batasan terdokumentasi layak diketahui sebelum Anda mulai. Pertama, endpoint harus bisa dijangkau publik: localhost, 127.0.0.1, dan URL private network ditolak saat konfigurasi, yang mengesampingkan mengarahkan Warp langsung ke server inference lokal tapi tidak relevan untuk gateway hosted. Kedua, pemilihan model Auto Warp selalu menghabiskan credit Warp bahkan saat endpoint kustom dikonfigurasi; hanya memilih model yang dirutekan-endpoint secara eksplisit dari picker yang dirutekan melalui endpoint Anda. Jika pengeluaran Anda tidak berpindah ke konsol gateway, cek model mana yang sebenarnya digunakan sesi tersebut. Ketersediaannya tergantung paket: custom inference endpoint ditawarkan pada paket Free dan paket berbayar yang memenuhi syarat untuk individu dan organisasi sepuluh orang atau kurang, sementara organisasi lebih besar butuh tier Business atau Enterprise Warp. Itu langsung dari dokumentasi Warp dan bisa berubah di sisi mereka.
Memilih model untuk kerja agent terminal.
Agent terminal ditagih berbeda dari chat: setiap penjelasan perintah, percobaan ulang, dan ringkasan output adalah request yang membawa context sesi. Karena penggunaan yang dirutekan-endpoint mendarat di konsol gateway per request dan per model, seminggu penggunaan nyata memberi Anda angka jujur per model kandidat, yang mengalahkan menebak dari halaman harga, termasuk yang ini.
- claude-sonnet-4-6 sebagai daily driver: generasi perintah yang bisa diandalkan, penggunaan tool yang kuat, penilaian bagus pada tugas multi-langkah.
- gpt-5.6-sol untuk kerja terlingkup cepat, di mana latensi per giliran membentuk rasa terminal.
- claude-opus-4-7 untuk sesi sulit: debugging lintas layanan, rantai investigasi panjang, perubahan infrastruktur yang ingin Anda pikirkan matang-matang.
- gpt-5.5 sebagai generalist frontier untuk di-A/B melawan Claude pada workflow shell Anda sendiri.
- deepseek-v4-pro sebagai pilihan value untuk penggunaan agent volume-tinggi rutin di mana tarif lebih penting dari polesan frontier.
Bayar sesuai pemakaian · di bawah harga resmi
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Harga Resmi | Harga Kami |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Mode kegagalan spesifik Warp.
Seperti biasa, buktikan separuh gateway dengan dua perintah curl, listing model dan satu chat completion, sebelum debug sisi Warp. Jika curl lolos dan Warp gagal, masalahnya ada di form endpoint atau pilihan picker model, tidak di tempat lain.
- Endpoint ditolak saat disimpan: Warp menolak URL localhost dan private-network by design. Endpoint harus bisa dijangkau publik; URL gateway hosted lolos pemeriksaan ini.
- Pengeluaran masih mengenai credit Warp: sesinya berada di pemilihan model Auto, yang selalu menggunakan credit Warp. Pilih model yang dirutekan-endpoint secara eksplisit di picker.
- Model tidak ditemukan: id yang Anda ketik ke konfigurasi endpoint tidak cocok dengan katalog gateway. Salin id dari listing /v1/models byte demi byte.
- 401 dari endpoint: field kredensial menyimpan key yang basi atau terpotong. Curl listing model dengan key yang sama untuk konfirmasi di luar Warp.
- Fitur tidak terlihat sama sekali: cek paket Anda. Endpoint kustom tersedia untuk individu dan organisasi kecil pada paket Free dan berbayar yang memenuhi syarat; organisasi lebih besar butuh Business atau Enterprise per dokumentasi Warp.
Siapa yang merutekan Warp melalui gateway.
- Developer yang ingin Claude di balik agent Warp pada saldo prabayar, dengan mulai gratis dan tanpa kartu.
- Pengguna agent berat yang konsumsi credit Warp-nya melebihi paket mereka, memindahkan pilihan model eksplisit ke endpoint bermeter mereka sendiri.
- Model shopper yang membandingkan model coding pada workflow terminal nyata, di mana setiap kandidat adalah satu id lagi di konfigurasi endpoint.
- Tim sepuluh orang atau kurang yang menstandarkan satu key gateway agar agent terminal, editor, dan CI berbagi satu log penggunaan.
- Orang yang sudah menjalankan tool lain melalui gateway yang ingin Warp pada key dan konsol yang sama.
Verifikasi endpoint dan konfirmasi routing.
Jalankan dua pemeriksaan standar dengan key dan id persis yang Anda konfigurasikan di Warp. Keduanya lolos berarti gateway siap dan masalah tersisa apa pun ada di pengaturan Warp atau pemilihan model. Lalu jalankan satu tugas agent nyata di Warp dengan model endpoint dipilih secara eksplisit, dan konfirmasi request muncul di konsol APIsRouter dengan model dan hitungan token yang diharapkan. Konfirmasi tunggal itu langsung menangkap jebakan mode-Auto, dan sejak itu konsol adalah catatan per-request Anda tentang apa yang sebenarnya dihabiskan terminal.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-sonnet-4-6",
"messages":[{"role":"user","content":"ping"}]}'Pertanyaan umum
Bagaimana cara mengonfigurasi custom inference endpoint di Warp?
Buka Settings Warp, cari "inference endpoint", dan masukkan URL endpoint, kredensial Anda, dan id model yang dirutekan melaluinya. Dengan APIsRouter URL-nya adalah https://api.apisrouter.com/v1 dan model muncul di picker Warp setelah disimpan.
Apakah endpoint kustom Warp berfungsi dengan gateway dan model router?
Ya, secara eksplisit. Dokumentasi dan postingan peluncuran Warp menyebut gateway dan router OpenAI-compatible sebagai target yang didukung; syaratnya adalah endpoint mengimplementasikan OpenAI Chat Completions API dan bisa dijangkau publik.
Apakah request yang dirutekan-endpoint menggunakan credit AI Warp saya?
Tidak. Saat Anda secara eksplisit memilih model yang dirutekan-endpoint, Warp merutekan request melalui endpoint Anda dan provider Anda yang menagihnya, bukan credit Warp. Pengecualiannya adalah pemilihan model Auto, yang selalu menghabiskan credit Warp bahkan dengan endpoint dikonfigurasi.
Mengapa Warp menolak URL endpoint saya?
Warp menolak localhost, 127.0.0.1, dan URL private atau local network lainnya saat konfigurasi; endpoint harus bisa dijangkau publik. URL gateway hosted seperti https://api.apisrouter.com/v1 lolos pemeriksaan ini.
Paket Warp mana yang mencakup custom inference endpoint?
Menurut dokumentasi Warp per pertengahan 2026: Free dan paket berbayar yang memenuhi syarat untuk pengguna individu dan organisasi sepuluh orang atau kurang; organisasi lebih besar butuh Warp Business atau Enterprise. Cek dokumentasi Warp terkini, karena gating paket adalah hak mereka untuk mengubah.
Bisakah saya menjalankan model Claude di Warp dengan cara ini?
Ya. Tambahkan claude-sonnet-4-6 atau claude-opus-4-7 sebagai id model di konfigurasi endpoint dan pilih di picker; gateway melayaninya melalui permukaan OpenAI-compatible yang diharapkan Warp, pada key yang sama dengan id GPT dan DeepSeek.