আপনার নিজের inference endpoint থেকে Warp-এর agent চালান।

Updated 2026-07-29

Warp ঠিক এই জন্যই কাস্টম inference endpoint সাপোর্ট করে: OpenAI Chat Completions API implement করে এমন যেকোনো endpoint, gateway এবং model router explicitly অন্তর্ভুক্ত। এক key দিয়ে এটাকে https://api.apisrouter.com/v1-এ point করুন, এবং endpoint-routed model Warp AI credit খরচ না করেই Warp-এর model picker-এ দেখা যায়।

দ্রুত উত্তর: settings, URL, key, model id।

Warp-এর Settings খুলুন এবং configuration-এ যেতে "inference endpoint" search করুন। endpoint URL enter করুন, https://api.apisrouter.com/v1, credential হিসেবে আপনার APIsRouter key, এবং আপনি এর মধ্য দিয়ে route করতে চান এমন model id, উদাহরণ হিসেবে claude-sonnet-4-6 এবং gpt-5.6-sol। Save হয়ে গেলে, সেই model গুলো built-in option-গুলোর পাশে Warp-এর model picker-এ দেখা যায়। Billing behavior-ই মূল বিষয়: আপনি picker থেকে explicitly একটা endpoint-routed model select করলে, Warp Warp-এর AI credit খরচ করার বদলে আপনার endpoint দিয়ে request route করে, এবং cost আপনার gateway balance-এ পড়ে যেখানে আপনি এটা per request দেখতে পারেন। Warp-এর docs এই flow-কে তাদের Bring Your Own API Key setup-এর mirror হিসেবে বর্ণনা করে, তাই আপনি আগে BYOK configure করে থাকলে এটা পরিচিত মনে হবে।

Endpoint URL:  https://api.apisrouter.com/v1
Credential:    sk-YOUR-APISROUTER-KEY
Model id(s):   claude-sonnet-4-6
               gpt-5.6-sol

then: select the endpoint-routed model
      in Warp's model picker

Warp কীভাবে endpoint ব্যবহার করে।

Warp হলো agentic terminal: এর agent command draft করে, failure explain করে, multi-step task চালায়, এবং আপনি যে window-এ কাজ করেন সেখান থেকেই code edit করে। Warp-এর নিজের documentation স্পষ্টভাবে requirement বলে: endpoint-কে অবশ্যই /v1/chat/completions-এ OpenAI Chat Completions API implement করতে হবে, এবং তাদের launch post model router এবং hosted gateway-কে intended target হিসেবে নাম দেয়, তাই একটা multi-vendor gateway এখানে first-class citizen, কোনো trick নয়। শুরু করার আগে দুটো documented constraint জানার যোগ্য। প্রথমত, endpoint-কে অবশ্যই publicly reachable হতে হবে: localhost, 127.0.0.1, এবং private network URL configuration time-এ প্রত্যাখ্যাত হয়, যা Warp-কে সরাসরি একটা local inference server-এ point করা বাতিল করে দেয় কিন্তু একটা hosted gateway-এর জন্য irrelevant। দ্বিতীয়ত, Warp-এর Auto model selection একটা কাস্টম endpoint configure থাকলেও সবসময় Warp credit খরচ করে; শুধু picker থেকে explicitly একটা endpoint-routed model pick করলেই আপনার endpoint দিয়ে route হয়। আপনার spend gateway console-এ না গেলে, session আসলে কোন model ব্যবহার করেছে তা check করুন। Availability plan-dependent: কাস্টম inference endpoint দশ বা তার কম মানুষের individual এবং organization-এর জন্য Free এবং eligible paid plan-এ offer করা হয়, যেখানে বড় organization-এর দরকার Warp-এর Business বা Enterprise tier। এটা সরাসরি Warp-এর docs থেকে এসেছে এবং তাদের দিক থেকে বদলাতে পারে।

Terminal agent কাজের জন্য model বেছে নেওয়া।

Terminal agent chat-এর চেয়ে ভিন্নভাবে বিল হয়: প্রতিটা command explanation, retry, এবং output summary session context বহনকারী একটা request। endpoint-routed usage যেহেতু per request এবং per model gateway console-এ পড়ে, real usage-এর এক সপ্তাহ প্রতি candidate model-এর জন্য একটা honest সংখ্যা দেয়, যা এই পেজ সহ যেকোনো pricing page থেকে অনুমান করার চেয়ে ভালো।

  • daily driver হিসেবে claude-sonnet-4-6: dependable command generation, strong tool use, multi-step task-এ ভালো judgment।
  • fast scoped কাজের জন্য gpt-5.6-sol, যেখানে per-turn latency terminal-টা কেমন মনে হয় তা shape করে।
  • hard session-এর জন্য claude-opus-4-7: service জুড়ে debugging, লম্বা investigative chain, infrastructure change যা আপনি reason করে দেখতে চান।
  • আপনার নিজের shell workflow-এ Claude-এর বিরুদ্ধে A/B করার জন্য frontier generalist হিসেবে gpt-5.5।
  • high-volume routine agent ব্যবহারের জন্য value pick হিসেবে deepseek-v4-pro, যেখানে frontier polish-এর চেয়ে rate বেশি গুরুত্বপূর্ণ।

ব্যবহার অনুযায়ী পেমেন্ট · অফিশিয়াল মূল্যের নিচে

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

মডেলঅফিশিয়াল মূল্যআমাদের মূল্য
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
DeepSeek V4 Pro$0.43 / $0.87 per M$0.40 / $0.90 per M

Warp-specific failure mode।

সবসময়ের মতো, Warp-এর দিক debug করার আগে দুটো curl command দিয়ে gateway অংশ প্রমাণ করুন, models listing এবং একটা chat completion। curl pass করলে এবং Warp fail করলে, সমস্যাটা endpoint form বা model picker selection-এ, অন্য কোথাও নয়।

  • Save time-এ endpoint প্রত্যাখ্যাত: Warp design অনুযায়ী localhost এবং private-network URL প্রত্যাখ্যান করে। endpoint-কে অবশ্যই publicly reachable হতে হবে; একটা hosted gateway URL এই check pass করে।
  • Spend তবুও Warp credit-এ লাগছে: session Auto model selection-এ আছে, যা সবসময় Warp credit ব্যবহার করে। picker-এ explicitly endpoint-routed model pick করুন।
  • Model not found: আপনি endpoint config-এ যে id টাইপ করেছেন তা gateway catalog-এর সাথে মেলে না। /v1/models listing থেকে byte for byte id copy করুন।
  • endpoint থেকে 401: credential field একটা stale বা truncated key ধরে রেখেছে। Warp-এর বাইরে confirm করতে একই key দিয়ে models listing curl করুন।
  • Feature একদমই দেখা যাচ্ছে না: আপনার plan check করুন। কাস্টম endpoint individual এবং ছোট org-এর জন্য Free এবং eligible paid plan-এ available; Warp-এর docs অনুযায়ী বড় organization-এর দরকার Business বা Enterprise।

কারা একটা gateway দিয়ে Warp route করে।

  • Developer যারা একটা prepaid balance-এ Warp-এর agent-এর পেছনে Claude চান, একটা বিনামূল্যের শুরু এবং কোনো card ছাড়াই।
  • Heavy agent ব্যবহারকারী যাদের Warp credit consumption তাদের plan ছাড়িয়ে গেছে, explicit model pick-কে তাদের নিজের metered endpoint-এ move করছেন।
  • Model shopper যারা real terminal workflow-এ coding model তুলনা করেন, যেখানে প্রতিটা candidate endpoint config-এ আরেকটা id।
  • দশ বা তার কম মানুষের team যারা এক gateway key standardize করে যাতে terminal, editor, এবং CI agent এক single usage log শেয়ার করে।
  • মানুষ যারা ইতিমধ্যে অন্য tool একটা gateway দিয়ে চালাচ্ছেন এবং একই key ও console-এ Warp চান।

Endpoint verify করুন এবং routing confirm করুন।

আপনি Warp-এ যে exact key এবং id configure করেছেন তা দিয়ে দুটো standard check চালান। দুটোই pass করা মানে gateway ready এবং বাকি যেকোনো issue Warp-এর settings বা model selection-এ। তারপর Warp-এ explicitly selected endpoint model দিয়ে একটা real agent task চালান, এবং confirm করুন request expected model ও token count সহ APIsRouter console-এ দেখা যাচ্ছে। সেই একটা confirmation সাথে সাথেই Auto-mode gotcha ধরে ফেলে, এবং তারপর থেকে console-ই terminal আসলে কী খরচ করে তার আপনার per-request রেকর্ড।

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-sonnet-4-6",
       "messages":[{"role":"user","content":"ping"}]}'

সাধারণ প্রশ্ন

Warp-এ কীভাবে একটা কাস্টম inference endpoint configure করব?

Warp-এর Settings খুলুন, "inference endpoint" search করুন, এবং endpoint URL, আপনার credential, এবং এর মধ্য দিয়ে route করার model id enter করুন। APIsRouter দিয়ে URL হলো https://api.apisrouter.com/v1 এবং save হয়ে গেলে model গুলো Warp-এর picker-এ দেখা যায়।

Warp-এর কাস্টম endpoint কি gateway এবং model router-এর সাথে কাজ করে?

হ্যাঁ, explicitly। Warp-এর documentation এবং launch post OpenAI-compatible gateway এবং router-কে supported target হিসেবে নাম দেয়; requirement হলো endpoint OpenAI Chat Completions API implement করে এবং publicly reachable।

Endpoint-routed request কি আমার Warp AI credit ব্যবহার করে?

না। আপনি explicitly একটা endpoint-routed model select করলে, Warp আপনার endpoint দিয়ে request route করে এবং আপনার provider এটা বিল করে, Warp credit নয়। ব্যতিক্রম হলো Auto model selection, যা endpoint configure থাকলেও সবসময় Warp credit খরচ করে।

Warp কেন আমার endpoint URL প্রত্যাখ্যান করে?

Warp configuration time-এ localhost, 127.0.0.1, এবং অন্যান্য private বা local network URL প্রত্যাখ্যান করে; endpoint-কে অবশ্যই publicly reachable হতে হবে। https://api.apisrouter.com/v1-এর মতো একটা hosted gateway URL এই check pass করে।

কোন Warp plan-এ কাস্টম inference endpoint অন্তর্ভুক্ত?

2026-এর মাঝামাঝি অনুযায়ী Warp-এর docs অনুসারে: individual user এবং দশ বা তার কম মানুষের organization-এর জন্য Free এবং eligible paid plan; বড় organization-এর দরকার Warp Business বা Enterprise। Warp-এর বর্তমান documentation check করুন, যেহেতু plan gating বদলানো তাদের এখতিয়ার।

আমি কি এভাবে Warp-এ Claude মডেল চালাতে পারি?

হ্যাঁ। endpoint config-এ model id হিসেবে claude-sonnet-4-6 বা claude-opus-4-7 যোগ করুন এবং picker-এ সেগুলো select করুন; gateway Warp যে OpenAI-compatible surface আশা করে তার উপর সেগুলো serve করে, GPT এবং DeepSeek id-র মতো একই key-তে।