agent های Warp را از endpoint استنتاج خودتان قدرت دهید.

Updated 2026-07-29

Warp دقیقاً برای همین از endpoint های استنتاج سفارشی پشتیبانی می‌کند: هر endpoint ای که API OpenAI Chat Completions را پیاده‌سازی می‌کند، gateway ها و model router ها صریح شامل. آن را با یک کلید به https://api.apisrouter.com/v1 اشاره دهید، و مدل‌های مسیردهی‌شده از طریق endpoint بدون مصرف اعتبار Warp AI در انتخاب‌گر مدل Warp ظاهر می‌شوند.

پاسخ سریع: تنظیمات، URL، کلید، id های مدل.

تنظیمات Warp را باز کنید و «inference endpoint» را جستجو کنید تا به پیکربندی بپرید. URL endpoint یعنی https://api.apisrouter.com/v1، کلید APIsRouter خود را به‌عنوان credential، و id یا id های مدلی که می‌خواهید از طریق آن مسیردهی کنید، مثلاً claude-sonnet-4-6 و gpt-5.6-sol را وارد کنید. بعد از ذخیره، آن مدل‌ها در کنار گزینه‌های built-in در انتخاب‌گر مدل Warp ظاهر می‌شوند. رفتار صورت‌حساب همان نکته اصلی است: وقتی صریح یک مدل مسیردهی‌شده از endpoint را از انتخاب‌گر انتخاب می‌کنید، Warp درخواست را از طریق endpoint شما به‌جای مصرف اعتبار AI خود Warp مسیردهی می‌کند، و هزینه روی موجودی gateway شما فرود می‌آید جایی که می‌توانید آن را به ازای هر درخواست ببینید. مستندات Warp این جریان را به‌عنوان آینه‌ای از تنظیمات Bring Your Own API Key آن‌ها توصیف می‌کند، پس اگر قبلاً BYOK را پیکربندی کرده‌اید آشنا خواهد بود.

Endpoint URL:  https://api.apisrouter.com/v1
Credential:    sk-YOUR-APISROUTER-KEY
Model id(s):   claude-sonnet-4-6
               gpt-5.6-sol

then: select the endpoint-routed model
      in Warp's model picker

Warp چطور از endpoint استفاده می‌کند.

Warp ترمینال agentic است: agent های آن دستورات را پیش‌نویس می‌کنند، شکست‌ها را توضیح می‌دهند، وظایف چند-مرحله‌ای را اجرا می‌کنند، و کد را از همان پنجره‌ای که کار می‌کنید ویرایش می‌کنند. مستندات خود Warp الزام را صریح بیان می‌کند: endpoint باید API OpenAI Chat Completions را در /v1/chat/completions پیاده‌سازی کند، و پست انتشار آن‌ها model router ها و gateway های hosted را به‌عنوان اهداف مورد نظر نام می‌برد، پس یک gateway چند-vendor اینجا یک شهروند درجه‌یک است، نه یک ترفند. دو محدودیت مستند ارزش دانستن قبل از شروع را دارند. اول، endpoint باید عمومی قابل‌دسترس باشد: localhost، 127.0.0.1، و URL های شبکه خصوصی در زمان پیکربندی رد می‌شوند، که اشاره مستقیم Warp به یک سرور استنتاج محلی را منتفی می‌کند اما برای یک gateway hosted بی‌ربط است. دوم، انتخاب مدل Auto در Warp همیشه اعتبار Warp را مصرف می‌کند حتی وقتی یک endpoint سفارشی پیکربندی شده باشد؛ فقط انتخاب صریح یک مدل مسیردهی‌شده از endpoint از انتخاب‌گر از طریق endpoint شما مسیردهی می‌شود. اگر هزینه شما به کنسول gateway منتقل نمی‌شود، چک کنید session واقعاً از کدام مدل استفاده کرده. دسترسی‌پذیری وابسته به پلن است: endpoint های استنتاج سفارشی روی پلن‌های Free و پرداختی واجد-شرایط برای افراد و سازمان‌های ده نفر یا کمتر ارائه می‌شوند، در حالی که سازمان‌های بزرگ‌تر به رده‌های Business یا Enterprise Warp نیاز دارند. این مستقیم از مستندات Warp است و می‌تواند از سمت آن‌ها تغییر کند.

انتخاب مدل برای کار agent ترمینال.

agent های ترمینال متفاوت از چت صورت‌حساب می‌شوند: هر توضیح دستور، تلاش مجدد، و خلاصه خروجی یک درخواست حامل context session است. چون usage مسیردهی‌شده از endpoint روی کنسول gateway به ازای هر درخواست و هر مدل فرود می‌آید، یک هفته استفاده واقعی یک عدد صادقانه به ازای هر مدل کاندید به شما می‌دهد، که از حدس‌زدن از یک صفحه قیمت‌گذاری، شامل همین صفحه، بهتر است.

  • claude-sonnet-4-6 به‌عنوان انتخاب روزانه: تولید دستور قابل‌اعتماد، استفاده ابزار قوی، قضاوت خوب روی وظایف چند-مرحله‌ای.
  • gpt-5.6-sol برای کار scope-محدود سریع، جایی که latency هر turn حس ترمینال را شکل می‌دهد.
  • claude-opus-4-7 برای session های سخت: عیب‌یابی در سرویس‌ها، زنجیره‌های تحقیقی بلند، تغییرات infrastructure که می‌خواهید کاملاً استدلال شوند.
  • gpt-5.5 به‌عنوان عمومی‌گرای مرزی برای A/B کردن در برابر Claude روی workflow های شل خودتان.
  • deepseek-v4-pro به‌عنوان انتخاب اقتصادی برای استفاده agent روزمره با حجم بالا جایی که نرخ بیش از صیقل مرزی اهمیت دارد.

پرداخت بر اساس مصرف · پایین‌تر از قیمت رسمی

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

مدلقیمت رسمیقیمت ما
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
DeepSeek V4 Pro$0.43 / $0.87 per M$0.40 / $0.90 per M

حالت‌های شکست مختص Warp.

همیشه، نیمه gateway را با دو دستور curl، فهرست مدل‌ها و یک chat completion، قبل از عیب‌یابی سمت Warp اثبات کنید. اگر curl موفق شود و Warp شکست بخورد، مشکل در فرم endpoint یا انتخاب انتخاب‌گر مدل است، هیچ جای دیگر.

  • endpoint در زمان ذخیره رد می‌شود: Warp عمداً URL های localhost و شبکه-خصوصی را رد می‌کند. endpoint باید عمومی قابل‌دسترس باشد؛ یک URL gateway hosted این چک را می‌گذراند.
  • هزینه همچنان به اعتبار Warp می‌خورد: session روی انتخاب مدل Auto است، که همیشه از اعتبار Warp استفاده می‌کند. مدل مسیردهی‌شده از endpoint را صریح در انتخاب‌گر انتخاب کنید.
  • مدل پیدا نشد: id ای که در پیکربندی endpoint تایپ کرده‌اید با کاتالوگ gateway مطابقت ندارد. id ها را دقیقاً کاراکتر به کاراکتر از فهرست /v1/models کپی کنید.
  • 401 از endpoint: فیلد credential یک کلید کهنه یا کوتاه‌شده نگه می‌دارد. فهرست مدل‌ها را با همان کلید curl کنید تا بیرون از Warp تأیید کنید.
  • ویژگی اصلاً قابل‌مشاهده نیست: پلن خود را چک کنید. endpoint های سفارشی برای افراد و سازمان‌های کوچک روی پلن‌های Free و پرداختی واجد-شرایط در دسترس‌اند؛ سازمان‌های بزرگ‌تر طبق مستندات Warp به Business یا Enterprise نیاز دارند.

چه کسانی Warp را از طریق یک gateway مسیردهی می‌کنند.

  • توسعه‌دهندگانی که می‌خواهند Claude پشت agent های Warp روی یک موجودی پیش‌پرداخت باشد، با شروع رایگان و بدون کارت.
  • کاربران سنگین agent که مصرف اعتبار Warp آن‌ها از پلن‌شان فراتر رفته، انتخاب‌های صریح مدل را روی endpoint متری‌شده خودشان منتقل می‌کنند.
  • خریداران مدل که مدل‌های کدنویسی را روی workflow های واقعی ترمینال مقایسه می‌کنند، جایی که هر کاندید یک id دیگر در پیکربندی endpoint است.
  • تیم‌های ده نفر یا کمتر که روی یک کلید gateway استاندارد می‌شوند پس agent های ترمینال، ویرایشگر، و CI یک لاگ usage مشترک دارند.
  • افرادی که از قبل ابزارهای دیگر را از طریق یک gateway اجرا می‌کنند و می‌خواهند Warp روی همان کلید و کنسول باشد.

endpoint را تأیید کنید و مسیردهی را تأیید کنید.

دو چک استاندارد را با همان کلید و id دقیقی که در Warp پیکربندی کرده‌اید اجرا کنید. موفقیت هر دو یعنی gateway آماده است و هر مشکل باقی‌مانده در تنظیمات Warp یا انتخاب مدل است. سپس یک وظیفه واقعی agent در Warp با مدل endpoint صریح انتخاب‌شده اجرا کنید، و تأیید کنید درخواست در کنسول APIsRouter با مدل و شمارش token مورد انتظار ظاهر می‌شود. آن تأیید تکی گیر حالت Auto را فوراً می‌گیرد، و از آن به بعد کنسول رکورد هر-درخواست شماست که ترمینال واقعاً چقدر خرج می‌کند.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-sonnet-4-6",
       "messages":[{"role":"user","content":"ping"}]}'

پرسش‌های پرتکرار

چطور یک endpoint استنتاج سفارشی در Warp پیکربندی کنم؟

تنظیمات Warp را باز کنید، «inference endpoint» را جستجو کنید، و URL endpoint، credential خود، و id های مدل برای مسیردهی از طریق آن را وارد کنید. با APIsRouter، URL یعنی https://api.apisrouter.com/v1 است و مدل‌ها بعد از ذخیره در انتخاب‌گر Warp ظاهر می‌شوند.

آیا endpoint سفارشی Warp با gateway ها و model router ها کار می‌کند؟

بله، صریح. مستندات و پست انتشار Warp gateway ها و router های سازگار با OpenAI را به‌عنوان اهداف پشتیبانی‌شده نام می‌برند؛ الزام این است که endpoint API OpenAI Chat Completions را پیاده‌سازی کند و عمومی قابل‌دسترس باشد.

آیا درخواست‌های مسیردهی‌شده از endpoint اعتبار Warp AI من را مصرف می‌کنند؟

نه. وقتی صریح یک مدل مسیردهی‌شده از endpoint را انتخاب می‌کنید، Warp درخواست را از طریق endpoint شما مسیردهی می‌کند و provider شما آن را صورت‌حساب می‌کند، نه اعتبار Warp. استثنا انتخاب مدل Auto است، که همیشه اعتبار Warp را مصرف می‌کند حتی با یک endpoint پیکربندی‌شده.

چرا Warp URL endpoint من را رد می‌کند؟

Warp localhost، 127.0.0.1، و سایر URL های شبکه خصوصی یا محلی را در زمان پیکربندی رد می‌کند؛ endpoint باید عمومی قابل‌دسترس باشد. یک URL gateway hosted مثل https://api.apisrouter.com/v1 این چک را می‌گذراند.

کدام پلن‌های Warp endpoint های استنتاج سفارشی را شامل می‌شوند؟

طبق مستندات Warp تا اواسط ۲۰۲۶: پلن‌های Free و پرداختی واجد-شرایط برای کاربران منفرد و سازمان‌های ده نفر یا کمتر؛ سازمان‌های بزرگ‌تر به Warp Business یا Enterprise نیاز دارند. مستندات فعلی Warp را چک کنید، چون gating پلن حق تغییر آن‌ها است.

آیا می‌توانم مدل‌های Claude را در Warp به این روش اجرا کنم؟

بله. claude-sonnet-4-6 یا claude-opus-4-7 را به‌عنوان id مدل در پیکربندی endpoint اضافه کنید و آن‌ها را در انتخاب‌گر انتخاب کنید؛ gateway آن‌ها را روی سطح سازگار با OpenAI که Warp انتظار دارد سرویس می‌دهد، روی همان کلید id های GPT و DeepSeek.