agent های Warp را از endpoint استنتاج خودتان قدرت دهید.
Updated 2026-07-29
Warp دقیقاً برای همین از endpoint های استنتاج سفارشی پشتیبانی میکند: هر endpoint ای که API OpenAI Chat Completions را پیادهسازی میکند، gateway ها و model router ها صریح شامل. آن را با یک کلید به https://api.apisrouter.com/v1 اشاره دهید، و مدلهای مسیردهیشده از طریق endpoint بدون مصرف اعتبار Warp AI در انتخابگر مدل Warp ظاهر میشوند.
پاسخ سریع: تنظیمات، URL، کلید، id های مدل.
تنظیمات Warp را باز کنید و «inference endpoint» را جستجو کنید تا به پیکربندی بپرید. URL endpoint یعنی https://api.apisrouter.com/v1، کلید APIsRouter خود را بهعنوان credential، و id یا id های مدلی که میخواهید از طریق آن مسیردهی کنید، مثلاً claude-sonnet-4-6 و gpt-5.6-sol را وارد کنید. بعد از ذخیره، آن مدلها در کنار گزینههای built-in در انتخابگر مدل Warp ظاهر میشوند. رفتار صورتحساب همان نکته اصلی است: وقتی صریح یک مدل مسیردهیشده از endpoint را از انتخابگر انتخاب میکنید، Warp درخواست را از طریق endpoint شما بهجای مصرف اعتبار AI خود Warp مسیردهی میکند، و هزینه روی موجودی gateway شما فرود میآید جایی که میتوانید آن را به ازای هر درخواست ببینید. مستندات Warp این جریان را بهعنوان آینهای از تنظیمات Bring Your Own API Key آنها توصیف میکند، پس اگر قبلاً BYOK را پیکربندی کردهاید آشنا خواهد بود.
Endpoint URL: https://api.apisrouter.com/v1
Credential: sk-YOUR-APISROUTER-KEY
Model id(s): claude-sonnet-4-6
gpt-5.6-sol
then: select the endpoint-routed model
in Warp's model pickerWarp چطور از endpoint استفاده میکند.
Warp ترمینال agentic است: agent های آن دستورات را پیشنویس میکنند، شکستها را توضیح میدهند، وظایف چند-مرحلهای را اجرا میکنند، و کد را از همان پنجرهای که کار میکنید ویرایش میکنند. مستندات خود Warp الزام را صریح بیان میکند: endpoint باید API OpenAI Chat Completions را در /v1/chat/completions پیادهسازی کند، و پست انتشار آنها model router ها و gateway های hosted را بهعنوان اهداف مورد نظر نام میبرد، پس یک gateway چند-vendor اینجا یک شهروند درجهیک است، نه یک ترفند. دو محدودیت مستند ارزش دانستن قبل از شروع را دارند. اول، endpoint باید عمومی قابلدسترس باشد: localhost، 127.0.0.1، و URL های شبکه خصوصی در زمان پیکربندی رد میشوند، که اشاره مستقیم Warp به یک سرور استنتاج محلی را منتفی میکند اما برای یک gateway hosted بیربط است. دوم، انتخاب مدل Auto در Warp همیشه اعتبار Warp را مصرف میکند حتی وقتی یک endpoint سفارشی پیکربندی شده باشد؛ فقط انتخاب صریح یک مدل مسیردهیشده از endpoint از انتخابگر از طریق endpoint شما مسیردهی میشود. اگر هزینه شما به کنسول gateway منتقل نمیشود، چک کنید session واقعاً از کدام مدل استفاده کرده. دسترسیپذیری وابسته به پلن است: endpoint های استنتاج سفارشی روی پلنهای Free و پرداختی واجد-شرایط برای افراد و سازمانهای ده نفر یا کمتر ارائه میشوند، در حالی که سازمانهای بزرگتر به ردههای Business یا Enterprise Warp نیاز دارند. این مستقیم از مستندات Warp است و میتواند از سمت آنها تغییر کند.
انتخاب مدل برای کار agent ترمینال.
agent های ترمینال متفاوت از چت صورتحساب میشوند: هر توضیح دستور، تلاش مجدد، و خلاصه خروجی یک درخواست حامل context session است. چون usage مسیردهیشده از endpoint روی کنسول gateway به ازای هر درخواست و هر مدل فرود میآید، یک هفته استفاده واقعی یک عدد صادقانه به ازای هر مدل کاندید به شما میدهد، که از حدسزدن از یک صفحه قیمتگذاری، شامل همین صفحه، بهتر است.
- claude-sonnet-4-6 بهعنوان انتخاب روزانه: تولید دستور قابلاعتماد، استفاده ابزار قوی، قضاوت خوب روی وظایف چند-مرحلهای.
- gpt-5.6-sol برای کار scope-محدود سریع، جایی که latency هر turn حس ترمینال را شکل میدهد.
- claude-opus-4-7 برای session های سخت: عیبیابی در سرویسها، زنجیرههای تحقیقی بلند، تغییرات infrastructure که میخواهید کاملاً استدلال شوند.
- gpt-5.5 بهعنوان عمومیگرای مرزی برای A/B کردن در برابر Claude روی workflow های شل خودتان.
- deepseek-v4-pro بهعنوان انتخاب اقتصادی برای استفاده agent روزمره با حجم بالا جایی که نرخ بیش از صیقل مرزی اهمیت دارد.
پرداخت بر اساس مصرف · پایینتر از قیمت رسمی
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| مدل | قیمت رسمی | قیمت ما |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
حالتهای شکست مختص Warp.
همیشه، نیمه gateway را با دو دستور curl، فهرست مدلها و یک chat completion، قبل از عیبیابی سمت Warp اثبات کنید. اگر curl موفق شود و Warp شکست بخورد، مشکل در فرم endpoint یا انتخاب انتخابگر مدل است، هیچ جای دیگر.
- endpoint در زمان ذخیره رد میشود: Warp عمداً URL های localhost و شبکه-خصوصی را رد میکند. endpoint باید عمومی قابلدسترس باشد؛ یک URL gateway hosted این چک را میگذراند.
- هزینه همچنان به اعتبار Warp میخورد: session روی انتخاب مدل Auto است، که همیشه از اعتبار Warp استفاده میکند. مدل مسیردهیشده از endpoint را صریح در انتخابگر انتخاب کنید.
- مدل پیدا نشد: id ای که در پیکربندی endpoint تایپ کردهاید با کاتالوگ gateway مطابقت ندارد. id ها را دقیقاً کاراکتر به کاراکتر از فهرست /v1/models کپی کنید.
- 401 از endpoint: فیلد credential یک کلید کهنه یا کوتاهشده نگه میدارد. فهرست مدلها را با همان کلید curl کنید تا بیرون از Warp تأیید کنید.
- ویژگی اصلاً قابلمشاهده نیست: پلن خود را چک کنید. endpoint های سفارشی برای افراد و سازمانهای کوچک روی پلنهای Free و پرداختی واجد-شرایط در دسترساند؛ سازمانهای بزرگتر طبق مستندات Warp به Business یا Enterprise نیاز دارند.
چه کسانی Warp را از طریق یک gateway مسیردهی میکنند.
- توسعهدهندگانی که میخواهند Claude پشت agent های Warp روی یک موجودی پیشپرداخت باشد، با شروع رایگان و بدون کارت.
- کاربران سنگین agent که مصرف اعتبار Warp آنها از پلنشان فراتر رفته، انتخابهای صریح مدل را روی endpoint متریشده خودشان منتقل میکنند.
- خریداران مدل که مدلهای کدنویسی را روی workflow های واقعی ترمینال مقایسه میکنند، جایی که هر کاندید یک id دیگر در پیکربندی endpoint است.
- تیمهای ده نفر یا کمتر که روی یک کلید gateway استاندارد میشوند پس agent های ترمینال، ویرایشگر، و CI یک لاگ usage مشترک دارند.
- افرادی که از قبل ابزارهای دیگر را از طریق یک gateway اجرا میکنند و میخواهند Warp روی همان کلید و کنسول باشد.
endpoint را تأیید کنید و مسیردهی را تأیید کنید.
دو چک استاندارد را با همان کلید و id دقیقی که در Warp پیکربندی کردهاید اجرا کنید. موفقیت هر دو یعنی gateway آماده است و هر مشکل باقیمانده در تنظیمات Warp یا انتخاب مدل است. سپس یک وظیفه واقعی agent در Warp با مدل endpoint صریح انتخابشده اجرا کنید، و تأیید کنید درخواست در کنسول APIsRouter با مدل و شمارش token مورد انتظار ظاهر میشود. آن تأیید تکی گیر حالت Auto را فوراً میگیرد، و از آن به بعد کنسول رکورد هر-درخواست شماست که ترمینال واقعاً چقدر خرج میکند.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-sonnet-4-6",
"messages":[{"role":"user","content":"ping"}]}'پرسشهای پرتکرار
چطور یک endpoint استنتاج سفارشی در Warp پیکربندی کنم؟
تنظیمات Warp را باز کنید، «inference endpoint» را جستجو کنید، و URL endpoint، credential خود، و id های مدل برای مسیردهی از طریق آن را وارد کنید. با APIsRouter، URL یعنی https://api.apisrouter.com/v1 است و مدلها بعد از ذخیره در انتخابگر Warp ظاهر میشوند.
آیا endpoint سفارشی Warp با gateway ها و model router ها کار میکند؟
بله، صریح. مستندات و پست انتشار Warp gateway ها و router های سازگار با OpenAI را بهعنوان اهداف پشتیبانیشده نام میبرند؛ الزام این است که endpoint API OpenAI Chat Completions را پیادهسازی کند و عمومی قابلدسترس باشد.
آیا درخواستهای مسیردهیشده از endpoint اعتبار Warp AI من را مصرف میکنند؟
نه. وقتی صریح یک مدل مسیردهیشده از endpoint را انتخاب میکنید، Warp درخواست را از طریق endpoint شما مسیردهی میکند و provider شما آن را صورتحساب میکند، نه اعتبار Warp. استثنا انتخاب مدل Auto است، که همیشه اعتبار Warp را مصرف میکند حتی با یک endpoint پیکربندیشده.
چرا Warp URL endpoint من را رد میکند؟
Warp localhost، 127.0.0.1، و سایر URL های شبکه خصوصی یا محلی را در زمان پیکربندی رد میکند؛ endpoint باید عمومی قابلدسترس باشد. یک URL gateway hosted مثل https://api.apisrouter.com/v1 این چک را میگذراند.
کدام پلنهای Warp endpoint های استنتاج سفارشی را شامل میشوند؟
طبق مستندات Warp تا اواسط ۲۰۲۶: پلنهای Free و پرداختی واجد-شرایط برای کاربران منفرد و سازمانهای ده نفر یا کمتر؛ سازمانهای بزرگتر به Warp Business یا Enterprise نیاز دارند. مستندات فعلی Warp را چک کنید، چون gating پلن حق تغییر آنها است.
آیا میتوانم مدلهای Claude را در Warp به این روش اجرا کنم؟
بله. claude-sonnet-4-6 یا claude-opus-4-7 را بهعنوان id مدل در پیکربندی endpoint اضافه کنید و آنها را در انتخابگر انتخاب کنید؛ gateway آنها را روی سطح سازگار با OpenAI که Warp انتظار دارد سرویس میدهد، روی همان کلید id های GPT و DeepSeek.