Warp کے agents کو اپنے inference endpoint سے طاقت دیں۔

Updated 2026-07-29

Warp بالکل اسی مقصد کے لیے custom inference endpoints سپورٹ کرتا ہے: کوئی بھی endpoint جو OpenAI Chat Completions API implement کرے، gateways اور model routers واضح طور پر شامل ہیں۔ اسے ایک key کے ساتھ https://api.apisrouter.com/v1 پر point کریں، اور endpoint-routed models Warp AI credits استعمال کیے بغیر Warp کے model picker میں ظاہر ہو جاتے ہیں۔

فوری جواب: settings، URL، key، model ids۔

Warp کی Settings کھولیں اور configuration تک پہنچنے کے لیے "inference endpoint" search کریں۔ endpoint URL درج کریں، https://api.apisrouter.com/v1، اپنی APIsRouter key credential کے طور پر، اور وہ model id یا ids جنہیں آپ اس کے ذریعے route کرنا چاہتے ہیں، مثلاً claude-sonnet-4-6 اور gpt-5.6-sol۔ Save ہونے کے بعد، وہ models built-in options کے ساتھ Warp کے model picker میں ظاہر ہو جاتی ہیں۔ Billing رویہ ہی اصل بات ہے: جب آپ picker سے کوئی endpoint-routed model واضح طور پر منتخب کریں، تو Warp request کو Warp کے AI credits استعمال کرنے کی بجائے آپ کے endpoint کے ذریعے route کرتا ہے، اور لاگت آپ کے gateway balance پر آتی ہے جہاں آپ اسے فی-request دیکھ سکتے ہیں۔ Warp کی docs اس flow کو ان کے Bring Your Own API Key setup جیسا بیان کرتی ہیں، تو اگر آپ نے پہلے BYOK configure کیا ہو تو یہ جانا پہچانا لگے گا۔

Endpoint URL:  https://api.apisrouter.com/v1
Credential:    sk-YOUR-APISROUTER-KEY
Model id(s):   claude-sonnet-4-6
               gpt-5.6-sol

then: select the endpoint-routed model
      in Warp's model picker

Warp endpoint کیسے استعمال کرتا ہے۔

Warp agentic terminal ہے: اس کے agents commands تیار کرتے ہیں، failures کی وضاحت کرتے ہیں، multi-step tasks چلاتے ہیں، اور اسی window سے code edit کرتے ہیں جس میں آپ کام کرتے ہیں۔ Warp کی اپنی documentation صاف طور پر requirement بیان کرتی ہے: endpoint کو /v1/chat/completions پر OpenAI Chat Completions API implement کرنا چاہیے، اور ان کی launch post model routers اور hosted gateways کو intended targets کے طور پر نام دیتی ہے، تو ایک multi-vendor gateway یہاں first-class citizen ہے، کوئی trick نہیں۔ شروع کرنے سے پہلے دو documented constraints جاننے کے قابل ہیں۔ پہلی، endpoint کو publicly reachable ہونا چاہیے: localhost، 127.0.0.1، اور private network URLs configuration time پر رد کر دیے جاتے ہیں، جو Warp کو براہ راست local inference server پر point کرنے کو روکتا ہے مگر ایک hosted gateway کے لیے غیر متعلقہ ہے۔ دوسری، Warp کا Auto model selection ہمیشہ Warp credits استعمال کرتا ہے چاہے custom endpoint configured ہو؛ صرف picker سے واضح طور پر ایک endpoint-routed model چننا آپ کے endpoint کے ذریعے route کرتا ہے۔ اگر آپ کی spend gateway console میں نہ move ہو رہی ہو، تو چیک کریں session نے اصل میں کون سا model استعمال کیا۔ Availability plan-dependent ہے: custom inference endpoints Free اور دس یا کم لوگوں والے افراد اور organizations کے لیے eligible paid plans پر پیش کیے جاتے ہیں، جبکہ بڑی organizations کو Warp کے Business یا Enterprise tiers چاہئیں۔ یہ سیدھا Warp کی docs سے آتا ہے اور ان کی طرف سے بدل سکتا ہے۔

Terminal agent کام کے لیے models چننا۔

Terminal agents chat سے مختلف طرح bill ہوتے ہیں: ہر command explanation، retry، اور output summary ایک request ہے جو session context لے جاتی ہے۔ چونکہ endpoint-routed استعمال gateway console میں فی-request اور فی-model آتا ہے، حقیقی استعمال کا ایک ہفتہ آپ کو ہر candidate model کے لیے ایک ایماندار عدد دیتا ہے، جو کسی pricing صفحے سے اندازہ لگانے سے بہتر ہے، اسی صفحے سمیت۔

  • daily driver کے طور پر claude-sonnet-4-6: بھروسے مند command generation، مضبوط tool use، multi-step tasks پر اچھا judgment۔
  • تیز scoped کام کے لیے gpt-5.6-sol، جہاں فی-turn latency طے کرتی ہے terminal کیسا محسوس ہوتا ہے۔
  • مشکل sessions کے لیے claude-opus-4-7: services کے پار debugging، لمبی investigative chains، infrastructure تبدیلیاں جن پر آپ سوچ سمجھ کر reasoning چاہتے ہیں۔
  • gpt-5.5 وہ frontier generalist ہے جسے آپ اپنے shell workflows پر Claude کے مقابلے A/B کر سکتے ہیں۔
  • زیادہ حجم والے routine agent استعمال کے لیے value انتخاب کے طور پر deepseek-v4-pro جہاں rate frontier polish سے زیادہ اہم ہو۔

استعمال کے مطابق ادائیگی · سرکاری قیمت سے کم

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ماڈلسرکاری قیمتہماری قیمت
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
DeepSeek V4 Pro$0.43 / $0.87 per M$0.40 / $0.90 per M

Warp سے مخصوص failure modes۔

ہمیشہ کی طرح، Warp کے side کو debug کرنے سے پہلے دو curl commands، models listing اور ایک chat completion، سے gateway کا حصہ ثابت کریں۔ اگر curl pass ہو جائے اور Warp fail ہو، تو مسئلہ endpoint form یا model picker انتخاب میں ہے، اور کہیں نہیں۔

  • Save کے وقت endpoint رد ہوا: Warp design کے مطابق localhost اور private-network URLs سے انکار کرتا ہے۔ endpoint publicly reachable ہونا چاہیے؛ ایک hosted gateway URL یہ چیک pass کر لیتا ہے۔
  • Spend اب بھی Warp credits پر لگ رہی ہے: session Auto model selection پر ہے، جو ہمیشہ Warp credits استعمال کرتی ہے۔ picker میں endpoint-routed model واضح طور پر چنیں۔
  • Model نہیں ملا: آپ نے endpoint config میں جو id ٹائپ کی وہ gateway catalog سے میچ نہیں کرتی۔ /v1/models فہرست سے ids حرف بہ حرف copy کریں۔
  • Endpoint سے 401: credential field میں پرانی یا کٹی ہوئی key ہے۔ Warp کے باہر اسی key کے ساتھ models listing curl کر کے confirm کریں۔
  • Feature بالکل نظر نہیں آتا: اپنا plan چیک کریں۔ Warp کی docs کے مطابق Custom endpoints افراد اور چھوٹی orgs کے لیے Free اور eligible paid plans پر دستیاب ہیں؛ بڑی organizations کو Business یا Enterprise چاہیے۔

Warp کو gateway کے ذریعے کون route کرتا ہے۔

  • وہ developers جو Warp کے agents کے پیچھے Claude ایک prepaid balance پر چاہتے ہیں، مفت شروعات اور بغیر کارڈ کے۔
  • بھاری agent users جن کا Warp credit استعمال ان کے plan سے بڑھ گیا، واضح model انتخاب کو اپنے metered endpoint پر منتقل کر رہے ہیں۔
  • وہ model shoppers جو حقیقی terminal workflows پر coding models کا موازنہ کرتے ہیں، جہاں ہر candidate endpoint config میں محض ایک اور id ہے۔
  • دس یا کم افراد والی teams جو ایک gateway key پر standardize کرتی ہیں تاکہ terminal، editor، اور CI agents ایک ہی usage log share کریں۔
  • وہ لوگ جو پہلے سے دوسرے tools کو gateway کے ذریعے چلا رہے ہیں اور Warp کو اسی key اور console پر چاہتے ہیں۔

Endpoint verify کریں اور routing confirm کریں۔

Warp میں configure کی گئی exact key اور id کے ساتھ دو معیاری checks چلائیں۔ دونوں کا pass ہونا ظاہر کرتا ہے کہ gateway تیار ہے اور باقی کوئی بھی مسئلہ Warp کی settings یا model انتخاب میں ہے۔ پھر Warp میں endpoint model کو واضح طور پر منتخب کر کے ایک حقیقی agent task چلائیں، اور confirm کریں کہ request متوقع model اور token counts کے ساتھ APIsRouter console میں ظاہر ہوتی ہے۔ وہ ایک confirmation فوراً Auto-mode گڑبڑ پکڑ لیتا ہے، اور اس کے بعد console آپ کا فی-request record ہے کہ terminal اصل میں کیا خرچ کرتا ہے۔

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-sonnet-4-6",
       "messages":[{"role":"user","content":"ping"}]}'

عمومی سوالات

میں Warp میں custom inference endpoint کیسے configure کروں؟

Warp کی Settings کھولیں، "inference endpoint" search کریں، اور endpoint URL، اپنی credential، اور اس کے ذریعے route کرنے کے لیے model ids درج کریں۔ APIsRouter کے ساتھ URL https://api.apisrouter.com/v1 ہے اور save ہونے کے بعد models Warp کے picker میں ظاہر ہو جاتی ہیں۔

کیا Warp کا custom endpoint gateways اور model routers کے ساتھ کام کرتا ہے؟

جی ہاں، واضح طور پر۔ Warp کی documentation اور launch post OpenAI-compatible gateways اور routers کو سپورٹڈ targets کے طور پر نام دیتے ہیں؛ requirement یہ ہے کہ endpoint OpenAI Chat Completions API implement کرے اور publicly reachable ہو۔

کیا endpoint-routed requests میری Warp AI credits استعمال کرتی ہیں؟

نہیں۔ جب آپ کسی endpoint-routed model کو واضح طور پر منتخب کریں، Warp request کو آپ کے endpoint کے ذریعے route کرتا ہے اور آپ کا provider اسے bill کرتا ہے، Warp credits نہیں۔ استثنا Auto model selection ہے، جو endpoint configured ہونے کے باوجود ہمیشہ Warp credits استعمال کرتی ہے۔

Warp میرا endpoint URL کیوں رد کرتا ہے؟

Warp configuration time پر localhost، 127.0.0.1، اور دیگر private یا local network URLs سے انکار کرتا ہے؛ endpoint publicly reachable ہونا چاہیے۔ https://api.apisrouter.com/v1 جیسا hosted gateway URL یہ چیک pass کر لیتا ہے۔

کون سے Warp plans custom inference endpoints شامل کرتے ہیں؟

2026 کے وسط تک Warp کی docs کے مطابق: انفرادی users اور دس یا کم افراد والی organizations کے لیے Free اور eligible paid plans؛ بڑی organizations کو Warp Business یا Enterprise چاہیے۔ Warp کی موجودہ documentation چیک کریں، چونکہ plan gating ان کی طرف سے بدل سکتی ہے۔

کیا میں اس طرح Warp میں Claude models چلا سکتا ہوں؟

جی ہاں۔ endpoint config میں model ids کے طور پر claude-sonnet-4-6 یا claude-opus-4-7 شامل کریں اور انہیں picker میں منتخب کریں؛ gateway انہیں اسی OpenAI-compatible surface پر سرو کرتا ہے جسے Warp چاہتا ہے، GPT اور DeepSeek ids کے ساتھ اسی key پر۔