Patakbuhin ang mga agent ng Warp mula sa sarili mong inference endpoint.
Updated 2026-07-29
Sinusuportahan ng Warp ang mga custom inference endpoint para eksakto rito: anumang endpoint na nagpapatupad ng OpenAI Chat Completions API, kasama nang tahasan ang mga gateway at model router. Ituro ito sa https://api.apisrouter.com/v1 gamit ang isang key, at lumilitaw ang mga model na naka-route sa endpoint sa model picker ng Warp nang hindi kumakain ng mga Warp AI credit.
Mabilisang sagot: settings, URL, key, mga model id.
Buksan ang Settings ng Warp at hanapin ang "inference endpoint" para tumalon sa configuration. Ilagay ang URL ng endpoint, https://api.apisrouter.com/v1, ang iyong key ng APIsRouter bilang credential, at ang model id o mga id na gusto mong iruta rito, halimbawa claude-sonnet-4-6 at gpt-5.6-sol. Kapag na-save, lilitaw ang mga model na iyon sa model picker ng Warp katabi ng mga built-in na opsyon. Ang behavior sa billing ang punto: kapag tahasan mong pinili ang isang model na naka-route sa endpoint mula sa picker, iniruruta ng Warp ang request sa pamamagitan ng endpoint mo sa halip na kumain ng AI credits ng Warp, at napupunta ang gastos sa balanse ng gateway mo kung saan makikita mo ito bawat request. Inilalarawan ng dokumentasyon ng Warp ang flow na ito bilang sumasalamin sa kanilang Bring Your Own API Key setup, kaya pamilyar ito kung na-configure mo na ang BYOK dati.
Endpoint URL: https://api.apisrouter.com/v1
Credential: sk-YOUR-APISROUTER-KEY
Model id(s): claude-sonnet-4-6
gpt-5.6-sol
then: select the endpoint-routed model
in Warp's model pickerPaano ginagamit ng Warp ang endpoint.
Ang Warp ang agentic na terminal: nagpaplano ang mga agent nito ng mga command, ipinapaliwanag ang mga pagkabigo, nagpapatakbo ng mga multi-step na gawain, at nag-e-edit ng code mula sa parehong window kung saan ka nagtatrabaho. Malinaw na sinasabi ng sariling dokumentasyon ng Warp ang requirement: dapat ipatupad ng endpoint ang OpenAI Chat Completions API sa /v1/chat/completions, at pinapangalanan ng launch post nila ang mga model router at hosted gateway bilang mga inaasahang target, kaya first-class citizen dito ang isang multi-vendor na gateway, hindi isang trick. Dalawang naka-document na hangganan ang mahalagang malaman bago magsimula. Una, dapat publicly reachable ang endpoint: tinatanggihan ang localhost, 127.0.0.1, at mga private network URL sa oras ng configuration, na hindi pumapayag sa pagtuturo diretso ng Warp sa isang lokal na inference server pero walang kinalaman sa isang hosted na gateway. Pangalawa, palaging kumakain ng Warp credits ang Auto model selection ng Warp kahit na naka-configure ang isang custom endpoint; ang tahasang pagpili lamang ng isang model na naka-route sa endpoint mula sa picker ang dumadaan sa endpoint mo. Kung hindi lumilipat sa gateway console ang gastos mo, suriin kung aling model talaga ang ginamit ng session. Nakasalalay sa plan ang availability: inaalok ang mga custom inference endpoint sa Free at mga eligible na paid plan para sa mga indibidwal at organisasyon na sampu o mas kaunti ang tao, habang kailangan ng mas malalaking organisasyon ang Business o Enterprise tiers ng Warp. Diretso itong galing sa dokumentasyon ng Warp at maaaring magbago sa panig nila.
Pagpili ng mga model para sa trabaho ng agent sa terminal.
Iba ang billing ng mga agent sa terminal kaysa sa chat: bawat paliwanag ng command, retry, at buod ng output ay isang request na may dalang session context. Dahil napupunta ang paggamit na naka-route sa endpoint sa gateway console bawat request at bawat model, ibinibigay ng isang linggo ng tunay na paggamit ang tapat na bilang bawat kandidatong model, na mas maganda kaysa sa paghula mula sa isang pricing page, kabilang ito.
- Ang claude-sonnet-4-6 bilang daily driver: maaasahang command generation, malakas na tool use, magandang judgment sa mga multi-step na gawain.
- Ang gpt-5.6-sol para sa mabilis na naka-scope na trabaho, kung saan hinuhubog ng latency kada turn kung ano ang pakiramdam ng terminal.
- Ang claude-opus-4-7 para sa mahihirap na session: debugging sa iba't ibang serbisyo, mahahabang investigative chain, mga pagbabago sa infrastructure na gusto mong pag-isipang mabuti.
- Ang gpt-5.5 bilang frontier na generalist na i-A/B laban sa Claude sa sarili mong workflow sa shell.
- Ang deepseek-v4-pro bilang value pick para sa high-volume na routine na paggamit ng agent kung saan mas mahalaga ang rate kaysa sa frontier na kinis.
Pay-as-you-go · mas mababa sa opisyal na presyo
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Opisyal na Presyo | Aming Presyo |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Mga failure mode na specific sa Warp.
Gaya ng dati, patunayan muna ang panig ng gateway gamit ang dalawang curl command, ang model listing at isang chat completion, bago i-debug ang panig ng Warp. Kung pumasa ang curl at nabigo ang Warp, nasa endpoint form o sa pagpili ng model picker ang problema, wala nang iba.
- Tinanggihan ang endpoint sa oras ng pag-save: tinatanggihan ng Warp ang localhost at mga private-network URL nang sadya. Dapat publicly reachable ang endpoint; pumapasa dito ang isang hosted na gateway URL.
- Tumatama pa rin sa Warp credits ang paggasta: nasa Auto model selection ang session, na palaging gumagamit ng Warp credits. Tahasang piliin ang model na naka-route sa endpoint sa picker.
- Hindi mahanap ang model: hindi tumutugma sa katalogo ng gateway ang id na tini-type mo sa endpoint config. Kopyahin ang mga id mula sa listahan ng /v1/models byte for byte.
- 401 mula sa endpoint: nakaupo sa credential field ang isang lipas o naputol na key. I-curl ang model listing gamit ang parehong key para kumpirmahin sa labas ng Warp.
- Hindi lumitaw ang feature: suriin ang plan mo. Available ang mga custom endpoint para sa mga indibidwal at maliliit na organisasyon sa Free at mga eligible na paid plan; kailangan ng mas malalaking organisasyon ang Business o Enterprise ayon sa dokumentasyon ng Warp.
Sino ang nagru-route ng Warp sa pamamagitan ng isang gateway.
- Mga developer na gustong makita ang Claude sa likod ng mga agent ng Warp sa isang prepaid balance, na may libreng simula at walang kailangang card.
- Mabibigat na user ng agent na lumaki na ang paggamit ng Warp credits kaysa sa plan nila, na inililipat ang mga tahasang pili ng model sa sarili nilang metered na endpoint.
- Mga model shopper na nagkukumpara ng coding models sa tunay na workflow sa terminal, kung saan ang bawat kandidato ay isa pang id sa endpoint config.
- Mga team na sampu o mas kaunti ang tao na nagsa-standardize sa isang gateway key para magbahagi ng iisang usage log ang terminal, editor, at CI agents.
- Mga taong nagpapatakbo na ng ibang tools sa pamamagitan ng isang gateway na gustong makita ang Warp sa parehong key at console.
I-verify ang endpoint at kumpirmahin ang routing.
Patakbuhin ang dalawang standard na check gamit ang eksaktong key at id na na-configure mo sa Warp. Kapag parehong pumasa, handa na ang gateway at anumang natitirang isyu ay nasa settings o pagpili ng model ng Warp. Pagkatapos, patakbuhin ang isang tunay na gawain ng agent sa Warp na tahasang napili ang model ng endpoint, at kumpirmahin na lumilitaw ang request sa APIsRouter console na may inaasahang model at token counts. Ang isang kumpirmasyong iyon ay agad na nahuhuli ang gotcha ng Auto-mode, at mula noon ang console ang per-request na rekord mo ng talagang ginagastos ng terminal.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-sonnet-4-6",
"messages":[{"role":"user","content":"ping"}]}'Mga madalas itanong
Paano ako mag-co-configure ng custom inference endpoint sa Warp?
Buksan ang Settings ng Warp, hanapin ang "inference endpoint", at ilagay ang URL ng endpoint, ang iyong credential, at ang mga model id na iruruta rito. Sa APIsRouter, ang URL ay https://api.apisrouter.com/v1 at lilitaw ang mga model sa picker ng Warp kapag na-save.
Gumagana ba ang custom endpoint ng Warp sa mga gateway at model router?
Oo, tahasan. Pinapangalanan ng dokumentasyon at launch post ng Warp ang mga OpenAI-compatible na gateway at router bilang sinusuportahang target; ang requirement ay ipatupad ng endpoint ang OpenAI Chat Completions API at publicly reachable ito.
Gumagamit ba ng aking Warp AI credits ang mga request na naka-route sa endpoint?
Hindi. Kapag tahasan mong pinili ang isang model na naka-route sa endpoint, iniruruta ng Warp ang request sa pamamagitan ng endpoint mo at binibill ito ng provider mo, hindi ng Warp credits. Ang eksepsiyon ay ang Auto model selection, na palaging kumakain ng Warp credits kahit naka-configure ang isang endpoint.
Bakit tinatanggihan ng Warp ang aking endpoint URL?
Tinatanggihan ng Warp ang localhost, 127.0.0.1, at ibang private o local network URL sa oras ng configuration; dapat publicly reachable ang endpoint. Pumapasa sa check na ito ang isang hosted na gateway URL tulad ng https://api.apisrouter.com/v1.
Aling mga plan ng Warp ang may kasamang custom inference endpoints?
Ayon sa dokumentasyon ng Warp sa kalagitnaan ng 2026: Free at mga eligible na paid plan para sa mga indibidwal na user at organisasyon na sampu o mas kaunti ang tao; kailangan ng mas malalaking organisasyon ang Warp Business o Enterprise. Suriin ang kasalukuyang dokumentasyon ng Warp, dahil maaari nilang baguhin ang plan gating.
Maaari ba akong magpatakbo ng mga model ng Claude sa Warp sa paraang ito?
Oo. Idagdag ang claude-sonnet-4-6 o claude-opus-4-7 bilang mga model id sa endpoint config at piliin ang mga ito sa picker; si-serve ito ng gateway sa pamamagitan ng OpenAI-compatible na surface na inaasahan ng Warp, sa parehong key tulad ng mga id ng GPT at DeepSeek.