ขับเคลื่อน agent ของ Warp ด้วย inference endpoint ของคุณเอง

Updated 2026-07-29

Warp รองรับ custom inference endpoint ไว้พอดีสำหรับกรณีนี้: endpoint ใด ๆ ที่ implement OpenAI Chat Completions API ได้ ระบุ gateway และ model router ไว้ชัดเจน ชี้มันไปที่ https://api.apisrouter.com/v1 พร้อม key เดียว แล้วโมเดลที่ route ผ่าน endpoint จะปรากฏใน model picker ของ Warp โดยไม่กิน Warp AI credit

คำตอบสั้น ๆ: settings, URL, key, model id

เปิด Settings ของ Warp แล้วค้นหา "inference endpoint" เพื่อกระโดดไปที่การตั้งค่า กรอก URL ของ endpoint คือ https://api.apisrouter.com/v1, key ของ APIsRouter เป็น credential และ model id ที่คุณต้องการ route ผ่านมัน เช่น claude-sonnet-4-6 และ gpt-5.6-sol เมื่อบันทึกแล้ว โมเดลเหล่านั้นจะปรากฏใน model picker ของ Warp คู่กับตัวเลือกที่มีมาให้ พฤติกรรมการเก็บเงินคือประเด็นสำคัญ: เมื่อคุณเลือกโมเดลที่ route ผ่าน endpoint อย่างชัดเจนจาก picker Warp จะ route request ผ่าน endpoint ของคุณแทนที่จะกิน Warp AI credit และค่าใช้จ่ายจะไปตกที่ยอดคงเหลือของ gateway ซึ่งคุณเห็นได้ต่อ request เอกสารของ Warp อธิบาย flow นี้ว่าเลียนแบบการตั้งค่า Bring Your Own API Key ของพวกเขา ดังนั้นถ้าคุณเคยตั้งค่า BYOK มาก่อนจะรู้สึกคุ้นเคย

Endpoint URL:  https://api.apisrouter.com/v1
Credential:    sk-YOUR-APISROUTER-KEY
Model id(s):   claude-sonnet-4-6
               gpt-5.6-sol

then: select the endpoint-routed model
      in Warp's model picker

Warp ใช้ endpoint อย่างไร

Warp คือ terminal แบบ agentic: agent ของมันร่างคำสั่ง, อธิบายความล้มเหลว, รันงานหลายขั้นตอน และแก้ไขโค้ดจากหน้าต่างเดียวกับที่คุณทำงานอยู่ เอกสารของ Warp เองระบุข้อกำหนดไว้ตรง ๆ: endpoint ต้อง implement OpenAI Chat Completions API ที่ /v1/chat/completions และโพสต์เปิดตัวของพวกเขาระบุ model router และ hosted gateway เป็นเป้าหมายที่ตั้งใจไว้ ดังนั้น gateway หลาย vendor จึงเป็นพลเมืองชั้นหนึ่งที่นี่ ไม่ใช่ทางลัด มีข้อจำกัดที่มีเอกสารรองรับสองอย่างที่ควรรู้ก่อนเริ่ม อย่างแรก endpoint ต้องเข้าถึงได้แบบสาธารณะ: localhost, 127.0.0.1 และ URL ของ network ส่วนตัวจะถูกปฏิเสธตอนตั้งค่า ซึ่งตัด option การชี้ Warp ไปที่ inference server ในเครื่องโดยตรง แต่ไม่มีผลกับ gateway แบบ hosted อย่างที่สอง การเลือกโมเดลแบบ Auto ของ Warp จะกิน Warp credit เสมอแม้จะตั้งค่า custom endpoint ไว้แล้ว มีแค่การเลือกโมเดลที่ route ผ่าน endpoint อย่างชัดเจนจาก picker เท่านั้นที่ route ผ่าน endpoint ของคุณ ถ้าค่าใช้จ่ายของคุณไม่ขยับไปที่ console ของ gateway ให้เช็กว่า session นั้นใช้โมเดลอะไรจริง ๆ ความพร้อมใช้งานขึ้นกับ plan: custom inference endpoint เปิดให้ใช้ใน Free และ paid plan ที่มีสิทธิ์สำหรับบุคคลและองค์กรที่มีคนสิบคนหรือน้อยกว่า ส่วนองค์กรที่ใหญ่กว่าต้องใช้ tier Business หรือ Enterprise ของ Warp ข้อมูลนี้มาจากเอกสารของ Warp โดยตรงและอาจเปลี่ยนแปลงได้ในฝั่งพวกเขา

เลือกโมเดลสำหรับงาน agent ใน terminal

agent ใน terminal เก็บเงินต่างจากแชท: การอธิบายคำสั่งแต่ละครั้ง การลองใหม่ และการสรุปผลลัพธ์ล้วนเป็น request ที่แบก session context ไปด้วย เพราะ usage ที่ route ผ่าน endpoint ไปตกที่ console ของ gateway ต่อ request และต่อโมเดล หนึ่งสัปดาห์ของการใช้งานจริงให้ตัวเลขที่ตรงไปตรงมาต่อโมเดลตัวเลือก ซึ่งดีกว่าการเดาจากหน้าราคา รวมถึงหน้านี้ด้วย

  • claude-sonnet-4-6 เป็นตัวขับเคลื่อนประจำวัน: สร้างคำสั่งได้น่าเชื่อถือ ใช้ tool ได้แข็งแรง ตัดสินใจดีในงานหลายขั้นตอน
  • gpt-5.6-sol สำหรับงานที่กำหนดขอบเขตชัดและต้องการความเร็ว ที่ latency ต่อเทิร์นมีผลต่อความรู้สึกของ terminal
  • claude-opus-4-7 สำหรับ session ยาก: การ debug ข้ามหลาย service, สายการสืบสวนยาว ๆ, การเปลี่ยนแปลง infrastructure ที่คุณต้องการให้คิดผ่านอย่างละเอียด
  • gpt-5.5 เป็น generalist ระดับ frontier สำหรับ A/B เทียบกับ Claude บน shell workflow ของคุณเอง
  • deepseek-v4-pro เป็นตัวเลือกด้าน value สำหรับงาน agent ปริมาณมากที่เป็นกิจวัตร ซึ่งราคาสำคัญกว่าความเนี้ยบระดับ frontier

จ่ายตามการใช้งาน · ถูกกว่าราคาทางการ

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

โมเดลราคาทางการราคาของเรา
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
DeepSeek V4 Pro$0.43 / $0.87 per M$0.40 / $0.90 per M

รูปแบบความล้มเหลวเฉพาะของ Warp

เหมือนเดิม พิสูจน์ฝั่ง gateway ด้วย curl สองคำสั่ง รายการโมเดลกับ chat completion หนึ่งครั้ง ก่อนจะ debug ฝั่ง Warp ถ้า curl ผ่านแต่ Warp ล้มเหลว ปัญหาอยู่ในฟอร์ม endpoint หรือการเลือกใน model picker ไม่มีที่อื่นแล้ว

  • endpoint ถูกปฏิเสธตอนบันทึก: Warp ปฏิเสธ localhost และ URL ของ private-network ตามการออกแบบ endpoint ต้องเข้าถึงได้แบบสาธารณะ URL ของ gateway แบบ hosted ผ่านการตรวจสอบนี้
  • ค่าใช้จ่ายยังตกที่ Warp credit: session อยู่บนการเลือกโมเดลแบบ Auto ซึ่งใช้ Warp credit เสมอ เลือกโมเดลที่ route ผ่าน endpoint อย่างชัดเจนใน picker
  • โมเดลไม่พบ: id ที่คุณพิมพ์ลงในการตั้งค่า endpoint ไม่ตรงกับแคตตาล็อกของ gateway ก็อปปี้ id จากรายการ /v1/models ให้ตรงทุกตัวอักษร
  • 401 จาก endpoint: ฟิลด์ credential เก็บ key ที่เก่าหรือถูกตัดทอน curl รายการโมเดลด้วย key เดียวกันเพื่อยืนยันนอก Warp
  • มองไม่เห็น feature เลย: เช็ก plan ของคุณ custom endpoint เปิดให้ใช้สำหรับบุคคลและองค์กรเล็กบน Free และ paid plan ที่มีสิทธิ์ องค์กรที่ใหญ่กว่าต้องใช้ Business หรือ Enterprise ตามเอกสารของ Warp

ใครที่ใช้ Warp ผ่าน gateway

  • นักพัฒนาที่ต้องการให้ Claude อยู่หลัง agent ของ Warp บนยอดคงเหลือแบบเติมเงินล่วงหน้า เริ่มต้นฟรีและไม่ต้องใช้บัตร
  • ผู้ใช้ agent หนักที่การใช้ Warp credit เกิน plan ของตัวเอง ย้ายการเลือกโมเดลอย่างชัดเจนไปที่ endpoint แบบมิเตอร์ของตัวเอง
  • นักช้อปโมเดลที่เปรียบเทียบโมเดลเขียนโค้ดบน workflow terminal จริง แต่ละตัวเลือกเป็นแค่ id เพิ่มขึ้นในการตั้งค่า endpoint
  • ทีมสิบคนหรือน้อยกว่าที่ทำ gateway key เดียวเป็นมาตรฐาน ให้ terminal, editor และ agent ของ CI ใช้ usage log เดียวกัน
  • คนที่รันเครื่องมืออื่นผ่าน gateway อยู่แล้วและต้องการให้ Warp ใช้ key และ console เดียวกัน

ตรวจสอบ endpoint และยืนยันการ route

รันการเช็กมาตรฐานสองคำสั่งด้วย key และ id เป๊ะ ๆ ที่คุณตั้งค่าไว้ใน Warp ถ้าทั้งสองผ่าน แปลว่า gateway พร้อมแล้ว และปัญหาที่เหลืออยู่ในการตั้งค่าหรือการเลือกโมเดลของ Warp จากนั้นรันงาน agent จริงหนึ่งงานใน Warp โดยเลือกโมเดล endpoint อย่างชัดเจน แล้วยืนยันว่า request ปรากฏใน console ของ APIsRouter ด้วยโมเดลและจำนวน token ที่คาดไว้ การยืนยันครั้งเดียวนี้จับความผิดพลาดของโหมด Auto ได้ทันที และจากนั้นเป็นต้นไป console คือบันทึกต่อ request ว่า terminal ใช้จ่ายอะไรไปจริง ๆ

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-sonnet-4-6",
       "messages":[{"role":"user","content":"ping"}]}'

คำถามที่พบบ่อย

ตั้งค่า custom inference endpoint ใน Warp อย่างไร?

เปิด Settings ของ Warp ค้นหา "inference endpoint" แล้วกรอก URL ของ endpoint, credential และ model id ที่จะ route ผ่านมัน สำหรับ APIsRouter URL คือ https://api.apisrouter.com/v1 และโมเดลจะปรากฏใน picker ของ Warp เมื่อบันทึกแล้ว

custom endpoint ของ Warp ใช้กับ gateway และ model router ได้ไหม?

ได้ ชัดเจน เอกสารและโพสต์เปิดตัวของ Warp ระบุ gateway และ router แบบ OpenAI-compatible เป็นเป้าหมายที่รองรับ ข้อกำหนดคือ endpoint ต้อง implement OpenAI Chat Completions API และเข้าถึงได้แบบสาธารณะ

request ที่ route ผ่าน endpoint ใช้ Warp AI credit ของฉันไหม?

ไม่ใช้ เมื่อคุณเลือกโมเดลที่ route ผ่าน endpoint อย่างชัดเจน Warp จะ route request ผ่าน endpoint ของคุณและ provider ของคุณเป็นคนเก็บเงิน ไม่ใช่ Warp credit ข้อยกเว้นคือการเลือกโมเดลแบบ Auto ซึ่งใช้ Warp credit เสมอแม้จะตั้งค่า endpoint ไว้แล้ว

ทำไม Warp ปฏิเสธ URL ของ endpoint ฉัน?

Warp ปฏิเสธ localhost, 127.0.0.1 และ URL ของ network ส่วนตัวหรือในเครื่องอื่น ๆ ตอนตั้งค่า endpoint ต้องเข้าถึงได้แบบสาธารณะ URL ของ gateway แบบ hosted อย่าง https://api.apisrouter.com/v1 ผ่านการตรวจสอบนี้

Warp plan ไหนรองรับ custom inference endpoint?

ตามเอกสารของ Warp ณ กลางปี 2026: Free และ paid plan ที่มีสิทธิ์สำหรับผู้ใช้รายบุคคลและองค์กรที่มีคนสิบคนหรือน้อยกว่า องค์กรที่ใหญ่กว่าต้องใช้ Warp Business หรือ Enterprise เช็กเอกสารปัจจุบันของ Warp เพราะการจำกัดตาม plan เป็นสิ่งที่พวกเขาเปลี่ยนได้

รันโมเดล Claude ใน Warp ด้วยวิธีนี้ได้ไหม?

ได้ เพิ่ม claude-sonnet-4-6 หรือ claude-opus-4-7 เป็น model id ในการตั้งค่า endpoint แล้วเลือกใน picker gateway เสิร์ฟมันผ่าน surface แบบ OpenAI-compatible ที่ Warp ต้องการ ด้วย key เดียวกับ id ของ GPT และ DeepSeek