FastGPT app-কে একটা কাস্টম OpenAI-compatible base URL-এ চালান।
Updated 2026-07-29
Current FastGPT UI-তে model configure করে: OpenAI protocol সহ Account, Model Providers-এর নিচে একটা channel যোগ করুন, proxy address হিসেবে https://api.apisrouter.com/v1, এবং এক key। Claude, GPT, DeepSeek, GLM, Kimi, এবং Qwen id তখন আপনার knowledge base এবং workflow চালায়।
দ্রুত উত্তর: Model Providers page-এ একটা channel।
v4.8.23 থেকে, FastGPT নিজস্ব model-aggregation layer (AI Proxy) এবং একটা model-configuration UI শিপ করে, তাই একটা কাস্টম endpoint-এর জন্য আর আলাদা OneAPI deployment বা হাতে-edited config.json দরকার হয় না। Account খুলুন, তারপর Model Providers, Model Channels tab-এ switch করুন, এবং Add Channel click করুন। protocol type-কে OpenAI সেট করুন, channel-এর নাম দিন, proxy address field-এ https://api.apisrouter.com/v1 দিন (base URL, পূর্ণ request path না), আপনার key paste করুন, এবং channel যেসব model serve করবে তা select বা type করুন। models tab-এ ফিরে, আপনার যোগ করা id enable করুন এবং built-in connectivity test চালান। এরপর থেকে, প্রতিটা FastGPT app, knowledge base, এবং workflow node সেই model select করতে পারবে। docs bilingual এবং release জুড়ে label পাল্টায় (doc.fastgpt.io হলো English entry), তাই exact wording-এর বদলে flow-কেই stable ধরুন: channel, protocol, base URL, key, model।
Channel Name: APIsRouter
Protocol Type: OpenAI
Proxy URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Models: claude-sonnet-4-6, deepseek-v4-flash,
glm-5.2, qwen3.7-plus, kimi-k2.6
then: enable the models + run the connection testFastGPT কীভাবে model traffic route করে।
FastGPT (GitHub-এ labring, প্রায় 29K star) হলো Chinese-origin knowledge-base এবং workflow platform: QA extraction এবং vector search সহ dataset, visual Flow orchestration, এবং sharing ও API access সহ published app। এর সবকিছুই configuration layer-এ registered model-এ resolve করে। একটা channel একটা routing rule: এই model id, এই base URL, এই key। Request FastGPT থেকে standard chat completions হিসেবে model id-কে একটা plain string হিসেবে সহ বের হয়, যে কারণে একটা multi-vendor gateway একটা single channel হিসেবে fit করে। channel layer অন্যথায় আপনাকে নিজে বানাতে হতো এমন operational feature-ও বহন করে: একটা model load balancing-এর জন্য একাধিক channel-এ থাকতে পারে, এবং model mapping FastGPT-কে একটা নাম expose করতে দেয় যখন provider-কে ভিন্ন id string পাঠায়। পুরনো version-এ self-hoster-দের জন্য, direct wiring এখনো আছে: FastGPT-এর classic environment pair platform-কে যেকোনো OpenAI-compatible base-এ point করে, docker-compose environment-এ OPENAI_BASE_URL এবং CHAT_API_KEY, config.json-এ llmModels-এর নিচে declared model সহ। এটা কাজ করে, কিন্তু UI path-ই যেখানে project move করেছে, এবং নতুন deployment সেখান থেকেই শুরু করা উচিত।
এশিয়া অ্যাঙ্গেল: দুই model জগতের জন্য এক balance।
FastGPT-এর user base ব্যাপকভাবে Chinese-speaking, এবং এর typical deployment regional model-কে Western model-এর সাথে মেশায়: Chinese knowledge base-এর জন্য GLM বা Qwen, volume-এর জন্য DeepSeek, উত্তরের polish যেখানে product সেখানে Claude বা GPT। সরাসরি served হলে, এই মিশ্রণ কষ্টকর, কারণ DeepSeek, Zhipu, Anthropic, এবং OpenAI প্রত্যেকে আলাদাভাবে bill করে এবং কিছু বিশ্বের এক পাশ থেকে বা অন্য পাশ থেকে pay করা কষ্টকর। একটা channel দিয়ে, মিশ্রণটা শুধু আরো Add Channel dialog: Chinese-heavy corpus-এর জন্য glm-5.2 এবং qwen3.7-plus, kimi-k2.6, deepseek-v4-flash, এবং claude-haiku-4-5-20251001 পাশাপাশি, এক prepaid balance, কোনো card requirement না, catalog থেকে সরাসরি id। এশিয়ার team পায় Claude এবং GPT কোনো Western card ছাড়াই; Western team পায় Chinese model কোনো regional sign-up ছাড়াই। একই knowledge base GLM-এ Chinese query এবং Claude-এ English query-র উত্তর দিতে পারে, per app routed। যদি এর বদলে legacy environment wiring চালান, একই endpoint সরাসরি drop হয়ে যায়; base URL convention /v1 suffix অন্তর্ভুক্ত করে, এবং FastGPT এতে /chat/completions-এর মতো route path append করে।
# docker-compose environment, pre-AI-Proxy versions
OPENAI_BASE_URL=https://api.apisrouter.com/v1
CHAT_API_KEY=sk-YOUR-APISROUTER-KEY
# models declared in config.json under llmModelsKnowledge base এবং flow-এর জন্য model বেছে নেওয়া।
যেহেতু প্রতিটা enabled id এক key দিয়ে bill হয়, model তুলনা করা একটা node-setting change। একই app-এর দুই কপিতে দুইটা candidate pin করুন, এক সপ্তাহের real প্রশ্ন চালান, এবং APIsRouter console-এ per-model split আপনার নিজের answer quality-র বিচারের পাশে পড়ুন।
- Retrieved chunk-এর উপর Dataset QA এবং answer generation volume কাজ: deepseek-v4-flash এবং glm-5.2 bilingual corpus-এ per-question cost flat রাখে।
- যখন উত্তর native Chinese-এ পড়তে হবে তখন qwen3.7-plus এবং kimi-k2.6 test করার যোগ্য regional pick; Chinese model জুড়ে generation quality retrieval-এর চেয়ে বেশি ভিন্ন হয়।
- Mixed-language deployment-এর জন্য claude-haiku-4-5-20251001 fast Western tier; synthesis quality যেখানে product সেখানে specific app-এ claude-sonnet-4-6-এ step up করুন।
- Workflow node প্রতি run fire করে, তাই একটা five-node flow প্রতিটা node-এ যে id বসে তা বহুগুণ করে; classification এবং routing node-এ fast id বসান, এবং answer node-এ খরচ করুন।
- Index এবং extraction model chat model থেকে আলাদাভাবে configured; যে embedding id bind করছেন তার চারপাশে index rebuild করার আগে confirm করুন endpoint সেটা serve করে কিনা।
ব্যবহার অনুযায়ী পেমেন্ট · অফিশিয়াল মূল্যের নিচে
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| মডেল | অফিশিয়াল মূল্য | আমাদের মূল্য |
|---|---|---|
| GLM-5.2 | $1.14 / $4.00 per M | $1.10 / $4.00 per M |
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| Qwen 3.7 Plus | $0.29 / $1.14 per M | $0.30 / $1.10 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
FastGPT-specific failure mode।
base URL convention অন্য tool থেকে আসা মানুষকে ধাক্কা দেয়: FastGPT proxy field-এ /v1-suffixed base আশা করে এবং নিজেই /chat/completions append করে, যেখানে এর custom-model form (একটা ভিন্ন feature, channel বাইপাস করা one-off model-এর জন্য) /v1/chat/completions সহ পূর্ণ request URL চায়। paste করার আগে জেনে নিন কোন field-এ আছেন। যে model channel-এ আছে কিন্তু app-এ selectable না তার মানে channel-এ যোগ করা হয়েছে কিন্তু configuration-এর models side-এ enable করা হয়নি; দুটো list আলাদা, এবং connectivity test শুধু channel-ই প্রমাণ করে। পুরনো tutorial-ই সবচেয়ে বড় বিপদ। FastGPT-এর বছরের পর বছরের guide একটা OneAPI sidecar এবং config.json edit ধরে নেয়; current version-এ Model Providers UI দুটোকেই replace করে, এবং দুটো approach একসাথে মেশানো (env wiring প্লাস channel) request-কে এমন জায়গায় route করে যা আপনি দেখছেন না। একটা layer বেছে নিন এবং পুরোপুরি configure করুন। Model-not-found error usual free-text সমস্যা: channel-এর id-কে gateway-এর /v1/models spelling-এর সাথে exactly মিলতে হবে, version suffix সহ। Type না করে copy করুন।
কারা একটা gateway দিয়ে FastGPT route করে।
- Bilingual team যারা এক deployment-এ, এক balance-এ, এক usage log-এ GLM, Qwen, Kimi, এবং DeepSeek-কে Claude এবং GPT id-র সাথে মেশায়।
- এশিয়ার team যারা কোনো Western card ছাড়াই prepaid balance-এ Western frontier model চায়, এবং Western team যারা regional billing ছাড়াই Chinese model চায়।
- একটা OneAPI sidecar replace করা Self-hoster: gateway multi-vendor অংশ serve করে, FastGPT-এর built-in channel routing অংশ serve করে।
- Agency যারা FastGPT-তে client knowledge base চালায়, প্রতিটাকে নিজস্ব key দিয়ে meter করে যাতে model spend নিজেই per project report করে।
- Builder যারা fixed corpus-এ answer model তুলনা করছে, যেখানে প্রতিটা candidate একটা vendor account না বরং একটা channel entry।
Endpoint verify করুন এবং প্রথম প্রশ্ন debug করুন।
প্রথমে model listing curl করুন এবং output থেকে channel-এ id copy করুন; তারপর যে id-কে default বানাতে চান তার বিরুদ্ধে একটা chat completion চালান। দুটোই pass করলে, gateway অংশ প্রমাণিত। FastGPT-এর ভেতরে, channel connectivity test ব্যবহার করুন, তারপর dataset জড়ানোর আগে একটা minimal app-এ একটা প্রশ্ন জিজ্ঞাসা করুন। Authentication error channel key-এর দিকে ইঙ্গিত করে; not-found id spelling-এর দিকে; connection error proxy URL বা container egress-এর দিকে, যেহেতু FastGPT server-কেই endpoint-এ পৌঁছাতে হবে, আপনার browser-কে না। যদি একটা plain chat app কাজ করা সত্ত্বেও dataset app fail করে, সমস্যা dataset-এর নিজস্ব model binding-এ, channel-এ না। একবার প্রশ্ন চললে, APIsRouter console per-request model, token count, এবং spend দেখায়। Knowledge-base traffic অনেক ছোট, input-heavy request, এবং per-key usage view-ই হলো যেখানে একটা deployment-এর real cost profile দেখা যায়, per model, per day, Chinese এবং Western id এক page-এ।
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"glm-5.2",
"messages":[{"role":"user","content":"ping"}]}'সাধারণ প্রশ্ন
আমি কীভাবে FastGPT-তে একটা কাস্টম base URL যোগ করব?
Current version-এ, UI দিয়ে: Account, Model Providers, Model Channels, protocol OpenAI, proxy URL https://api.apisrouter.com/v1, আপনার key, এবং model id সহ Add Channel। পুরনো version-এ, environment-এ OPENAI_BASE_URL এবং CHAT_API_KEY সেট করুন এবং config.json-এ model declare করুন।
Proxy URL-এ কি /v1 অন্তর্ভুক্ত থাকে?
হ্যাঁ, channel-এর proxy field-এ /v1-suffixed base দিন এবং FastGPT নিজেই /chat/completions append করে। আলাদা custom-model form ব্যতিক্রম: এটা /v1/chat/completions সহ পূর্ণ request URL নেয়। যে field ব্যবহার করছেন তার সাথে convention মেলান।
FastGPT-এর সাথে কি এখনো OneAPI দরকার?
না। v4.8.23 থেকে FastGPT UI-তে channel management সহ নিজস্ব aggregation layer bundle করে, এবং একটা multi-vendor gateway OneAPI যে অংশ handle করত তা কভার করে। দুটো layer একসাথে চালানো কাজ করে কিন্তু routing reason করা কঠিন করে তোলে; নতুন deployment শুধু channel configure করা উচিত।
FastGPT কি এক channel-এ Chinese এবং Western model মেশাতে পারে?
হ্যাঁ। channel প্রতিটা model id-কে একটা plain string হিসেবে forward করে, তাই glm-5.2, qwen3.7-plus, kimi-k2.6, deepseek-v4-flash, এবং claude-sonnet-4-6 এক channel এবং এক key share করতে পারে, প্রতি app এবং প্রতি workflow node-এ selectable।
আমার channel model কেন app-এ selectable না?
Model Providers UI-তে channel-এ id যোগ করা এবং model ব্যবহারের জন্য enable করা আলাদা step। models list-এ model enable করুন, তারপর app বা node dropdown আবার check করুন; per-app model permission-ও একটা team কী দেখে তা filter করতে পারে।
এর জন্য কোন FastGPT docs trust করা উচিত?
doc.fastgpt.io-তে current model-configuration section। v4.8.2x era-তে FastGPT-এর configuration surface যথেষ্ট পাল্টেছে, এবং OneAPI sidecar বা হাতে-edited llmModels block বর্ণনা করা পুরনো third-party tutorial আর UI-first flow-এর সাথে মেলে না।