KoboldAI Lite บน custom OpenAI-compatible endpoint
Updated 2026-07-29
KoboldAI Lite เชื่อมต่อกับ custom endpoint ได้แบบ native: README ของโปรเจกต์เองระบุ API รูปแบบ OpenAI และ Claude ไว้คู่กับ Kobold instance และ AI Horde ชี้ฟิลด์ custom URL ไปที่ https://api.apisrouter.com/v1 พร้อม key ของคุณ แล้วทุกโมเดลในแคตตาล็อก ไม่ว่า DeepSeek, GLM, Kimi, Claude, Grok จะเลือกได้ใน interface เดียวกัน ไม่ว่าคุณจะใช้ hosted Lite ที่ lite.koboldai.net หรือชุดที่มากับ KoboldCpp
คำตอบสั้น ๆ: ค่าที่ Lite ต้องการ
เปิดแผง AI connection (ปุ่ม AI ในเมนูบนสุดของ Lite) สลับจาก AI Horde ที่เป็นค่าเริ่มต้นไปยังกลุ่ม custom endpoint แล้วเลือกตัวเลือก OpenAI-compatible ชื่อฟิลด์ที่แน่นอนขยับเล็กน้อยระหว่าง build แต่ฟิลด์หลักคงที่: API URL, key และโมเดลที่เลือกหลังเชื่อมต่อ รายละเอียดเฉพาะของ Lite สองอย่างนี้คือสาเหตุความล้มเหลวส่วนใหญ่ อย่างแรก checkbox เวอร์ชัน: Lite มี toggle แบบ "Add Ver. Num" ที่เติม /v1 ต่อท้าย URL ให้อัตโนมัติ ดังนั้นการกรอก https://api.apisrouter.com พร้อมติ๊ก box กับ https://api.apisrouter.com/v1 แบบไม่ติ๊ก ทั้งสองแบบให้ผลถูกต้องเท่ากัน ในขณะที่การใส่ /v1 ซ้ำสองครั้งจะไม่ถูกต้อง อย่างที่สอง การคงค่า: Lite เคยรีเซ็ต custom endpoint URL เมื่อเชื่อมต่อใหม่ ดังนั้นเก็บ URL ไว้ใกล้มือแทนที่จะสมมติว่าฟิลด์นี้จะคงอยู่ทุก session
API URL: https://api.apisrouter.com/v1 (or base URL + "Add Ver. Num" ticked)
API key: sk-... (from APIsRouter)
Model: deepseek-v4-flash (or any catalog id after connecting)Lite คืออะไร และเข้าถึงโมเดลที่ hosted อย่างไร
KoboldAI Lite คือ web UI แบบไม่ต้องติดตั้งของระบบนิเวศ Kobold: single-page app สำหรับเขียนเรื่อง, adventure mode และ character chat ที่รันในเบราว์เซอร์ทั้งหมด มันมีสองรูปแบบที่ใช้ค่าตั้งค่าเดียวกัน: hosted instance ที่ lite.koboldai.net และชุดที่มากับตัวซึ่ง KoboldCpp เสิร์ฟที่ localhost เมื่อคุณรันโมเดลในเครื่อง README ของโปรเจกต์บอกว่ามันเชื่อมต่อกับ custom endpoint ได้ รวมถึง API รูปแบบ OpenAI และ Claude คู่กับ Kobold instance ทั้งในเครื่องและระยะไกล และ AI Horde แบบ crowdsourced เพราะ Lite เป็น browser app ที่ไม่มี server ของตัวเอง request API ของคุณจึงวิ่งจากเบราว์เซอร์ไปยัง endpoint ที่คุณตั้งค่าโดยตรง การออกแบบแบบนี้คือเหตุผลที่เส้นทาง custom-endpoint ใช้งานได้เลย และก็เป็นเหตุผลที่ส่วน CORS ด้านล่างมีอยู่: endpoint ต้องตอบ request ที่มาจาก browser-origin ได้ และเมื่อไม่ตอบ Lite มี proxy toggle ให้ ซึ่งมีข้อแลกเปลี่ยนที่ควรเข้าใจก่อนเปิดใช้ สำหรับคนที่มาจาก AI Horde: จุดดึงดูดของ endpoint แบบมิเตอร์เมื่อเทียบกับ cluster อาสาสมัครคือความคาดเดาได้ Horde ฟรีจริง ๆ แต่มีคิว endpoint ที่มีทุนสนับสนุนตอบทันทีด้วยโมเดลที่คุณขอเป๊ะ ๆ และในราคาโมเดลระดับ value ค่าใช้จ่ายเล่นทั้งเย็นอยู่ที่เศษเสี้ยวเล็ก ๆ ของหนึ่งเซนต์ต่อข้อความ
ตั้งค่าทีละฟิลด์
ถ้ารายการโมเดลว่างเปล่าหลังเชื่อมต่อ สาเหตุที่พบบ่อยเรียงตามลำดับคือ: /v1 ซ้ำหรือขาดหาย (เช็ก checkbox เวอร์ชันก่อน), key ที่วางมีช่องว่างปนอยู่ หรือ extension ของเบราว์เซอร์บล็อก request การพิสูจน์ว่าค่าทั้งสามทำงานได้ใน curl command เป็นวิธีเร็วที่สุดในการยืนยันว่าฝั่ง endpoint ไม่มีปัญหา แล้วโฟกัสไปที่เบราว์เซอร์
- เปิด Lite (hosted หรือที่มากับตัว) แล้วคลิกปุ่ม AI ในเมนูบนสุดเพื่อเปิดแผงเชื่อมต่อ
- สลับตัวเลือก provider จาก AI Horde ไปยังกลุ่ม custom endpoint แล้วเลือกตัวเลือก OpenAI-compatible (ชื่อต่างกันเล็กน้อยตาม build มีตัวเลือกแบบ Claude อยู่ข้าง ๆ)
- กรอก URL: https://api.apisrouter.com/v1 โดยระวัง checkbox เวอร์ชันที่กล่าวไว้ข้างต้นให้ /v1 ปรากฏเพียงครั้งเดียว
- วาง key sk-... ของคุณลงในฟิลด์ key
- เชื่อมต่อแล้วเลือกโมเดลจากรายการที่ Lite ดึงมา หรือพิมพ์ model id ให้ตรงเป๊ะถ้า build ของคุณต้องการชื่อโมเดลแบบ manual
- ส่งข้อความสั้น ๆ หนึ่งข้อความในเรื่องใหม่เพื่อยืนยัน round trip ก่อนโหลด session ยาว
ตัวเลือก Claude endpoint และเมื่อไหร่ควรใช้
กลุ่ม custom endpoint ของ Lite ยังมีตัวเลือกแบบ Claude สำหรับ API สำเนียง Anthropic ด้วย APIsRouter รองรับสำเนียงนั้นเช่นกัน ที่ /v1/messages ดังนั้น claude id เข้าถึงได้ทั้งสองประตู ในทางปฏิบัติเส้นทาง OpenAI-compatible เป็นค่าเริ่มต้นที่ง่ายกว่าแม้กับโมเดล Claude เพราะการตั้งค่าเดียวจะเสิร์ฟทุกตระกูล: claude-sonnet-4-6 สำหรับงานเขียนระดับสูง, deepseek-v4-flash สำหรับการเล่นปริมาณมาก, glm-5.2 และ kimi-k2.6 สำหรับหมุนเวียน ทั้งหมดเป็นแค่การเปลี่ยนฟิลด์โมเดลไม่ใช่การตั้งค่าใหม่ ที่ตัวเลือกแบบ Claude คุ้มค่าคือถ้าคุณเก็บ preset ที่ปรับจูนไว้เฉพาะสำหรับรูปแบบ request ของ Anthropic หรือย้ายค่าตั้งค่ามาจากเครื่องมือสำเนียง Anthropic อื่น ในทางปฏิบัติทั้งสองเส้นทางไปจบที่โมเดลเดียวกันผ่าน gateway นี้ เลือกทางใดทางหนึ่งแล้วคงเส้นคงวาไว้ เพื่อให้ค่าตั้งค่าที่บันทึกไว้ยังพกพาได้
Sampler และโหมด: อะไรที่ใช้ได้จริงบน hosted endpoint
Lite เปิด sampler ในเครื่องแบบเต็มสวนสัตว์ในการตั้งค่า และส่วนใหญ่ไม่ถูกส่งผ่านไปด้วย บน OpenAI-compatible endpoint เอกสารของ Lite เองระบุว่ามีแค่ temperature, top-p และตัวควบคุมสไตล์ repetition-penalty ที่ใช้ได้จริง sampler แปลก ๆ อย่าง Min-P, Top-A หรือ TFS เป็น feature ของ local inference และแม้ Lite จะแนบมันเป็นฟิลด์เพิ่มเติมได้ hosted endpoint โดยทั่วไปจะไม่สนใจหรือปฏิเสธ parameter ที่ไม่มาตรฐาน ตั้ง temperature ไว้ราว 0.8 ถึง 0.9 เพื่อความหลากหลายของงานเขียน, top-p ไว้ใกล้ 0.95 และคง repetition penalty ไว้ต่ำ นั่นคือพื้นที่ปรับแต่งทั้งหมด และก็เพียงพอแล้ว โหมดการเขียนของ Lite ทำงานได้หมดผ่าน custom endpoint พร้อมข้อแนะนำหนึ่งอย่าง: instruct mode เข้ากับ chat model แบบ hosted ได้เป็นธรรมชาติที่สุด เพราะมันสร้างการแลกเปลี่ยนแบบมี role ที่มีโครงสร้าง ซึ่งเป็นสิ่งที่โมเดลเหล่านั้นถูกฝึกมา classic story co-writing ก็ใช้ได้เช่นกัน คาดหวังว่าโมเดลจะทำตัวเหมือนคู่สนทนามากกว่าเครื่องต่อข้อความดิบ ๆ เพราะนั่นคือสิ่งที่ chat completions endpoint เป็น การจัดการ context เป็นไปตามกฎเดียวกับ frontend roleplay ทุกตัว: Lite ส่ง context ของเรื่องที่มองเห็นซ้ำทุกเทิร์น ดังนั้นตั้งขนาด context อย่างตั้งใจ (working window 16K ถึง 32K ครอบคลุม session ยาว ๆ) แทนที่จะเปิดเต็มเพราะ window ของโมเดลอนุญาต คู่มือ context-length ที่ลิงก์ด้านล่างคำนวณเรื่องนี้ข้ามโมเดลไว้แล้ว
| การตั้งค่า | จุดเริ่มต้น | หมายเหตุ |
|---|---|---|
| Temperature | 0.8 ถึง 0.9 | ตัวปรับหลักที่ยังใช้ได้จริงหลังส่งไปถึง hosted endpoint |
| Top P | 0.95 | อย่าไปแตะถ้าผลลัพธ์ยังไม่เพี้ยน |
| Repetition penalty | ต่ำ | ค่าสูงจะทำให้ชื่อในเรื่องยาวเพี้ยน |
| Sampler แปลก ๆ (Min-P, Top-A, TFS) | เมิน | เป็น feature ของ local-inference; hosted endpoint จะทิ้งหรือปฏิเสธ |
| ขนาด context | 16K ถึง 32K | ส่งซ้ำทุกเทิร์น ต้นทุนแปรผันตามนี้ |
จ่ายตามการใช้งาน · ถูกกว่าราคาทางการ
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| โมเดล | ราคาทางการ | ราคาของเรา |
|---|---|---|
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| GLM-5.2 | $1.14 / $4.00 per M | $1.10 / $4.00 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Grok 4.5 | $2.00 / $6.00 per M | $1.60 / $4.80 per M |
CORS, proxy toggle และการดูแล key ให้ปลอดภัย
เพราะ Lite เรียก endpoint ตรงจากเบราว์เซอร์ของคุณ การเชื่อมต่อล้มเหลวทั้งที่ค่าถูกต้องมักเป็นเรื่อง CORS: endpoint ปฏิเสธ request ที่มาจาก browser-origin Lite มี toggle "Use CORS Proxy" ไว้สำหรับกรณีนี้พอดี และมันสมควรได้รับคำเตือนตรงไปตรงมา: การส่งผ่าน proxy ของบุคคลที่สามใด ๆ จะทำให้ proxy นั้นอยู่ในเส้นทาง traffic ของคุณ รวมถึง key และเนื้อหาเรื่องราวด้วย ลองเชื่อมต่อตรงก่อน ยืนยันว่า endpoint ทำงานผ่าน curl ถ้าไม่แน่ใจ และมอง proxy toggle เป็นทางเลือกสุดท้ายไม่ใช่ค่าเริ่มต้น การรัน Lite ที่มากับ KoboldCpp ในเครื่องเป็นทางออกที่สะอาดอีกทาง เพราะค่าตั้งค่า custom-endpoint แบบเดียวกันมีอยู่ที่นั่นด้วย การดูแล key สำคัญขึ้นอีกนิดบน browser app: key อยู่ในค่าตั้งค่า local ของเบราว์เซอร์ ดังนั้นหลีกเลี่ยงการวางมันลงในเครื่องที่แชร์หรือเครื่องสาธารณะ และถ้ามันหลุดออกไปเมื่อไหร่ ให้ revoke แล้วออกใหม่แทนที่จะหวังว่าจะไม่เป็นไร key ที่นี่สร้างได้ฟรี ดังนั้น key เฉพาะสำหรับ Lite ช่วยให้ usage log อ่านง่ายและวงรัศมีความเสียหายเล็กลง หมายเหตุเรื่องเนื้อหาข้อหนึ่ง บอกตรง ๆ: custom endpoint เปลี่ยนแค่ว่า request ไปที่ไหน ไม่เปลี่ยนว่าโมเดลอนุญาตอะไร นโยบายโมเดลต้นทางและข้อกำหนดของ Lite instance ที่คุณใช้ยังคงบังคับใช้อยู่ หน้าเปรียบเทียบนโยบายที่ลิงก์ด้านล่างครอบคลุมภาพรวมตามข้อเท็จจริง ตระกูลโมเดลต่อตระกูลโมเดล
คำถามที่พบบ่อย
KoboldAI Lite รองรับ custom OpenAI-compatible endpoint ไหม?
รองรับแบบ native README ของโปรเจกต์ระบุ custom endpoint รวมถึง API รูปแบบ OpenAI และ Claude คู่กับ Kobold instance และ AI Horde การตั้งค่าคือ URL, key และโมเดล จากแผง AI connection ทั้งใน hosted หรือ Lite ที่มากับ KoboldCpp
ต้องกรอก URL อะไรสำหรับ APIsRouter ใน KoboldAI Lite?
https://api.apisrouter.com/v1 โดยจัดการ checkbox เวอร์ชันให้ /v1 ปรากฏเพียงครั้งเดียว: toggle แบบ "Add Ver. Num" ของ Lite จะเติม /v1 ให้อัตโนมัติเมื่อติ๊ก การใส่ segment เวอร์ชันซ้ำหรือขาดหายเป็นสาเหตุที่พบบ่อยที่สุดของรายการโมเดลว่างเปล่า
ใช้โมเดล Claude ใน KoboldAI Lite ได้ไหม?
ได้ สองทาง: ผ่าน OpenAI-compatible endpoint ด้วย claude id เช่น claude-sonnet-4-6 ในฟิลด์โมเดล หรือผ่านตัวเลือก endpoint แบบ Claude ของ Lite ที่ /v1/messages เส้นทาง OpenAI-compatible เป็นค่าเริ่มต้นที่ง่ายกว่าเพราะค่าตั้งค่าเดียวกันเสิร์ฟทุกตระกูลอื่นด้วย
ทำไมค่าตั้งค่า sampler ของฉันดูเหมือนไม่มีผลอะไร?
sampler ส่วนใหญ่ของ Lite ใช้สำหรับ local inference บน OpenAI-compatible endpoint มีแค่ temperature, top-p และตัวควบคุมสไตล์ repetition-penalty ที่ใช้ได้ hosted endpoint จะเมินหรือปฏิเสธ sampler แปลก ๆ ถ้าผลลัพธ์รู้สึกผิดปกติ ให้ปรับ temperature ก่อนแล้วเช็ก model id เป็นอันดับสอง
ทำไม Lite เชื่อมต่อไม่ได้ทั้งที่ curl ทำงาน?
เกือบทุกครั้งคือ CORS: Lite รันในเบราว์เซอร์ของคุณ ดังนั้น endpoint ต้องยอมรับ request ที่มาจาก browser-origin ตัวเลือกเรียงตามลำดับคร่าว ๆ: ลองตั้งค่าตรงแบบสะอาดใหม่, รัน Lite ที่มากับ KoboldCpp ในเครื่อง หรือใช้ toggle CORS proxy ของ Lite โดยเข้าใจว่าบุคคลที่สามจะอยู่ในเส้นทาง traffic ของคุณ
วิธีนี้ดีกว่า AI Horde ไหม?
เป็นการแลกเปลี่ยนที่ต่างกัน Horde ฟรีจริง ๆ รันโดยอาสาสมัครและมีคิว ด้วยโมเดลที่อาสาสมัคร host ไว้ endpoint แบบมิเตอร์ตอบทันทีด้วยโมเดลที่คุณเลือกเป๊ะ ๆ ในราคาระดับ value ที่ทำให้การเล่นทั้งเย็นอยู่ที่เศษเสี้ยวเล็ก ๆ ของหนึ่งเซนต์ต่อข้อความ หลายคนตั้งค่าไว้ทั้งสองแบบพร้อมกัน