Kilo Code کو کسی بھی کیٹلاگ model پر OpenAI Compatible کے ذریعے چلائیں۔
Updated 2026-07-30
Kilo Code gateways کے لیے بنایا گیا ایک custom-provider flow لے کر آتا ہے: Provider API کے طور پر OpenAI Compatible چنیں، Base URL کو https://api.apisrouter.com/v1 پر سیٹ کریں، ایک key paste کریں، اور Kilo /v1/models سے model list auto-fetch کر لیتا ہے۔ Claude، Kimi، اور Codex-class ids agent کے لیے interchangeable backends بن جاتے ہیں۔
فوری جواب: ایک custom provider entry۔
Kilo Code کی settings gear icon کے ذریعے کھولیں، Providers tab پر جائیں، اور custom provider option منتخب کریں۔ اسے ایک Provider ID اور display name دیں، Provider API کو OpenAI Compatible پر سیٹ کریں، Base URL کو https://api.apisrouter.com/v1 پر، اور اپنی key paste کریں۔ ایک بار Base URL اور key valid ہو جائیں، تو Kilo endpoint کی /v1/models listing query کرتا ہے اور ہر available id کا ایک searchable picker پیش کرتا ہے، تو آپ claude-sonnet-4-6 یا kimi-k2.7-code کو blind type کرنے کی بجائے list سے منتخب کرتے ہیں۔ Models manually بھی شامل کی جا سکتی ہیں، اور اگر آپ کو ضرورت ہو تو custom HTTP headers کو key-value pairs کے طور پر سپورٹ کیا جاتا ہے۔ Save کریں، اور agent کا اگلا task gateway کے ذریعے route ہو جاتا ہے۔
Provider ID: apisrouter
Display name: APIsRouter
Provider API: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API key: sk-YOUR-APISROUTER-KEY
Models: pick from the auto-fetched list
(e.g. claude-sonnet-4-6, kimi-k2.7-code)Kilo Code provider کو کیسے استعمال کرتا ہے۔
Kilo Code (تقریباً 26K GitHub stars) VS Code کے لیے ایک open-source AI coding agent ہے: یہ plan کرتا ہے، files edit کرتا ہے، commands چلاتا ہے، اور approval gates کے ساتھ failures پر iterate کرتا ہے، Roo اور Cline کی lineage میں۔ اس loop کی ایک مخصوص traffic shape ہے: لمبا context اندر، tool calls اور diffs باہر، فی task کئی turns، جو backing model کو quality lever اور cost driver دونوں بنا دیتا ہے۔ OpenAI Compatible provider اس loop کو standard chat completions کے طور پر آپ کے Base URL پر بھیجتا ہے، model id کو ایک plain string کے طور پر۔ wire format vendors کی پرواہ نہیں کرتا، جو حقیقی model shopping کو ممکن بناتا ہے: claude-sonnet-4-6، kimi-k2.7-code، اور gpt-5.6-sol ایک provider کے پیچھے interchangeable entries ہیں، تین vendor accounts اور تین billing setups کی بجائے۔ فی-model tuning، token limits، tool-calling behavior، اور variants کے لیے kilo.jsonc config file موجود ہے، جسے آپ براہ راست edit کر سکتے ہیں جب کسی model کو ایسی settings چاہیے ہوں جو UI expose نہ کرے۔ declared limits model کی documentation سے سیٹ کریں، optimism سے نہیں: agent context کو aggressively pack کرتا ہے، اور ایک overstated window بالکل سب سے بڑے tasks پر fail ہوتی ہے۔
Kilo کی loop کے لیے coding models چننا۔
Kilo کے modes مختلف قسم کے کام کو مختلف configuration رکھنے دیتے ہیں، اور اسے exploit کرنے کا ایماندار طریقہ empirical ہے: ایک ہفتے کے لیے ایک ہی class کا task دو ids پر چلائیں، پھر gateway console میں فی-model spend پڑھیں اس کے ساتھ کہ آپ کو کتنی بار intervene کرنا پڑا۔ Agent loops کسی model کو استعمال کرنے کا سب سے token-intensive طریقہ ہیں، تو فرق قابلِ پیمائش ہے، vibes نہیں۔
- claude-sonnet-4-6 قابلِ بھروسہ default ہے: strong tool calling، صاف diffs، اور کسی command کے task کے بیچ میں fail ہونے پر اچھی recovery۔
- kimi-k2.7-code لمبے agentic sessions کے لیے volume pick ہے، code-tuned اور اس many-turn loop کے لیے priced ہے جو Kilo حقیقت میں چلاتا ہے۔
- gpt-5.6-sol جلدی scoped edits اور test-fixing runs کے لیے موزوں ہے جہاں فی-turn latency session کو shape دیتی ہے۔
- claude-opus-4-7 مشکل tasks پر اپنی rate کا حق کماتا ہے: cross-file refactors، architecture work، ایسا debugging جسے context میں پوری picture چاہیے۔
- gpt-5.5 وہ frontier generalist ہے جسے benchmark tables کی بجائے آپ کی اپنی repository پر Claude کے خلاف A/B کرنے کے قابل ہے۔
استعمال کے مطابق ادائیگی · سرکاری قیمت سے کم
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| ماڈل | سرکاری قیمت | ہماری قیمت |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Kilo Code سے مخصوص failure modes۔
معیاری ترتیب میں debug کریں: models listing پر curl کریں، exact id کے ساتھ ایک completion پر curl کریں، اور تبھی Kilo کی settings adjust کریں۔ دو commands gateway مسائل کو editor configuration سے صاف طور پر الگ کر دیتے ہیں۔
- Model picker خالی آتا ہے: Base URL یا key غلط ہے، کیونکہ picker ایک live /v1/models call سے populate ہوتا ہے۔ انہی values کے ساتھ listing پر curl کر کے تصدیق کریں۔
- ہر request پر 404: Base URL نے اپنا /v1 کھو دیا، یا آپ نے وہاں پورا /chat/completions path paste کر دیا جہاں صرف base چاہیے تھا۔ Kilo مکمل endpoint URLs قبول کرتا ہے، مگر صرف اگر وہ درست chat-completions route کی طرف اشارہ کریں۔
- کسی task کے اندر گہرائی میں truncated یا بھولنے والا behavior: kilo.jsonc میں declared context limits اس سے تجاوز کرتی ہیں جو model حقیقت میں سپورٹ کرتا ہے۔ documented values استعمال کریں۔
- Tool calls execute ہونے کی بجائے narrate ہوتی ہیں: منتخب id function calling میں کمزور ہے۔ settings چھیڑنے سے پہلے model choice کو configuration سے الگ کرنے کے لیے task دوبارہ claude-sonnet-4-6 پر چلائیں۔
- docs کا Azure-specific نوٹ: Azure GPT-5 deployments وہ max_tokens field رد کرتی ہیں جو custom OpenAI-compatible providers بھیجتے ہیں، تو Azure کو Kilo کا native azure provider استعمال کرنا چاہیے۔ gateway کے لیے غیر متعلقہ، مگر اگر آپ دونوں ٹیسٹ کریں تو یہ ایک confusing error کی وضاحت کرتا ہے۔
Kilo Code کو gateway کے ذریعے کون route کرتا ہے۔
- وہ developers جو چاہتے ہیں Claude ایک الگ Anthropic billing relationship کے بغیر agent چلائے، ایک prepaid balance پر مفت، card-less شروعات کے ساتھ۔
- وہ model shoppers جو auto-fetched picker استعمال کرتے ہوئے اپنی حقیقی repository میں حقیقی tasks پر coding ids trial کرتے ہیں۔
- وہ heavy users جو planning-grade کام کے لیے ایک frontier model کو لمبی execution sessions کے لیے ایک volume model کے ساتھ pair کرتے ہیں۔
- وہ teams جو ایک shared vendor bill کو reverse-engineer کرنے کی بجائے per-key usage سے فی developer agent spend meter کرتی ہیں۔
- وہ لوگ جو پہلے سے دوسرے tools کو ایک gateway کے ذریعے route کر رہے ہیں اور VS Code agent کو اسی key اور usage log پر چاہتے ہیں۔
Endpoint verify کریں اور پہلا task چلائیں۔
editor configure کرنے سے پہلے curl سے gateway کا آدھا حصہ ثابت کریں: models list کریں، پھر جس id کو منتخب کرنے کا ارادہ ہے اس کے ساتھ ایک completion بھیجیں۔ جب دونوں pass ہو جائیں، جو کچھ باقی رہتا ہے وہ provider form میں ہے۔ پھر Kilo کو ایک واضح goal کے ساتھ ایک چھوٹا حقیقی task دیں اور پہلے turns دیکھیں۔ صاف tool calls اور sensible edits کا مطلب ہے id loop کے لیے موزوں ہے؛ hard errors تینوں fields کی طرف map ہوتی ہیں۔ ایک بار tasks چلنے لگیں، APIsRouter console per-request model، tokens، اور spend دکھاتا ہے، جہاں agent استعمال کا ایک ہفتہ فی model ایک ٹھوس نمبر بن جاتا ہے۔
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'عمومی سوالات
میں Kilo Code میں ایک OpenAI-compatible provider کیسے شامل کروں؟
Settings gear ← Providers tab ← custom provider۔ Provider API کو OpenAI Compatible پر سیٹ کریں، Base URL کو https://api.apisrouter.com/v1 پر، اور اپنی key paste کریں۔ Kilo پھر /v1/models سے model list auto-fetch کر لیتا ہے اور آپ ایک searchable list سے ids منتخب کرتے ہیں۔
کیا Kilo Code اس provider کے ذریعے Claude models چلا سکتا ہے؟
جی ہاں۔ provider model id کو standard chat completions پر ایک plain string کے طور پر forward کرتا ہے، تو claude-sonnet-4-6 اور claude-opus-4-7 اسی طرح کام کرتے ہیں جیسے GPT ids کرتی ہیں، ایک ہی key پر، اور vendor بدلنا صرف picker میں ایک انتخاب ہے۔
provider شامل کرنے کے بعد model list خالی کیوں ہے؟
auto-fetch ایک live /v1/models call سے populate ہوتا ہے، تو خالی list کا مطلب ہے Base URL یا key غلط ہے۔ انہی values کے ساتھ listing پر curl کریں؛ اگر وہ کام کرے، تو دوبارہ چیک کریں کہ آپ نے provider form میں دراصل کیا save کیا۔ Models manually بھی شامل کی جا سکتی ہیں۔
میں کسی custom model کے لیے context window اور token limits کہاں سیٹ کروں؟
kilo.jsonc میں، Kilo کی config file، جو فی-model token limits، tool-calling settings، اور ایسی variants رکھتی ہے جو provider form سے آگے ہیں۔ model کی documented values استعمال کریں؛ overstated limits سب سے بڑے tasks پر fail ہوتی ہیں۔
کیا API key کا form میں جانا ضروری ہے؟
key field معمول کا راستہ ہے، مگر یہ optional ہے اگر آپ authentication کو custom headers کے ذریعے handle کریں، جسے provider form key-value pairs کے طور پر سپورٹ کرتا ہے۔ ایک standard gateway setup کے لیے، key field ہی درست انتخاب ہے۔
مجھے کیسے پتا چلے کہ Kilo Code کے ایک ہفتے کی قیمت کیا ہے؟
APIsRouter console میں per-key usage view پڑھیں: فی request اور فی model tokens اور spend۔ Agent tasks فی task درجنوں requests ہوتے ہیں، تو log ہی آپ کے usage pattern کی قیمت کا واحد ایماندار پیمانہ ہے۔