Jalankan app FastGPT di base URL OpenAI-compatible custom.

Updated 2026-07-29

FastGPT versi saat ini mengonfigurasi model di UI: tambahkan channel di Account, Model Providers dengan protokol OpenAI, https://api.apisrouter.com/v1 sebagai alamat proxy, dan satu key. Id Claude, GPT, DeepSeek, GLM, Kimi, dan Qwen lalu menggerakkan knowledge base dan workflow Anda.

Jawaban singkat: satu channel di halaman Model Providers.

Sejak v4.8.23, FastGPT menyertakan lapisan agregasi model sendiri (AI Proxy) dan UI konfigurasi model, jadi endpoint custom tidak lagi butuh deployment OneAPI terpisah atau config.json yang diedit manual. Buka Account, lalu Model Providers, pindah ke tab Model Channels, dan klik Add Channel. Set protocol type ke OpenAI, beri nama channel-nya, masukkan https://api.apisrouter.com/v1 di field alamat proxy (base URL-nya, bukan path request lengkap), tempel key Anda, dan pilih atau ketik id model yang harus dilayani channel. Kembali di tab models, aktifkan id yang Anda tambahkan dan jalankan tes konektivitas bawaan. Sejak saat itu, setiap app, knowledge base, dan node workflow FastGPT bisa memilih model tersebut. Dokumentasinya dwibahasa dan labelnya bergeser antar rilis (doc.fastgpt.io adalah entri bahasa Inggris), jadi perlakukan flow, channel, protocol, base URL, key, models, sebagai bagian yang stabil alih-alih kata-kata persisnya.

Channel Name:   APIsRouter
Protocol Type:  OpenAI
Proxy URL:      https://api.apisrouter.com/v1
API Key:        sk-YOUR-APISROUTER-KEY
Models:         claude-sonnet-4-6, deepseek-v4-flash,
                glm-5.2, qwen3.7-plus, kimi-k2.6

then: enable the models + run the connection test

Bagaimana FastGPT merutekan traffic model.

FastGPT (labring di GitHub, sekitar 29K bintang) adalah platform knowledge-base dan workflow asal China: dataset dengan ekstraksi QA dan vector search, orkestrasi Flow visual, dan app yang dipublikasikan dengan sharing dan akses API. Semuanya me-resolve ke model yang terdaftar di lapisan konfigurasi. Channel adalah aturan routing: id model ini, base URL ini, key ini. Request keluar dari FastGPT sebagai chat completions standar dengan id model sebagai string biasa, itulah sebabnya gateway multi-vendor pas masuk sebagai satu channel. Lapisan channel juga membawa fitur operasional yang jika tidak Anda harus bangun sendiri: satu model bisa hidup di beberapa channel untuk load balancing, dan model mapping membiarkan FastGPT mengekspos satu nama sementara mengirim string id berbeda ke provider. Untuk self-hoster di versi lama, pengkabelan langsung masih ada: pasangan environment klasik FastGPT mengarahkan platform ke base OpenAI-compatible mana pun, OPENAI_BASE_URL dan CHAT_API_KEY di environment docker-compose, dengan model dideklarasikan di config.json di bawah llmModels. Ini berfungsi, tapi jalur UI adalah tempat proyek ini bergerak, dan deployment baru sebaiknya mulai di sana.

Sudut pandang Asia: satu saldo untuk dua dunia model.

Basis pengguna FastGPT sangat berbahasa Mandarin, dan deployment tipikalnya mencampur model regional dengan model Barat: GLM atau Qwen untuk knowledge base Mandarin, DeepSeek untuk volume, Claude atau GPT di tempat kehalusan jawaban adalah produknya. Dilayani langsung, campuran itu berarti akun di Zhipu, Alibaba, DeepSeek, Anthropic, dan OpenAI, masing-masing dengan billing sendiri, sebagian sulit dibayar dari satu sisi dunia atau sisi lainnya. Melalui satu channel, campuran itu jadi daftar model: glm-5.2, qwen3.7-plus, kimi-k2.6, deepseek-v4-flash, dan claude-haiku-4-5-20251001 berdampingan, satu saldo prabayar, tanpa syarat kartu, id langsung dari katalog. Tim di Asia mendapat Claude dan GPT tanpa kartu Barat; tim Barat mendapat model Mandarin tanpa sign-up regional. Knowledge base yang sama bisa menjawab query Mandarin di GLM dan query Inggris di Claude, dirutekan per app. Jika Anda menjalankan pengkabelan environment lama, endpoint yang sama tetap bisa dipasang langsung; konvensi base URL menyertakan suffix /v1, dan FastGPT menambahkan path route seperti /chat/completions ke sana.

# docker-compose environment, pre-AI-Proxy versions
OPENAI_BASE_URL=https://api.apisrouter.com/v1
CHAT_API_KEY=sk-YOUR-APISROUTER-KEY
# models declared in config.json under llmModels

Memilih model untuk knowledge base dan flow.

Karena setiap id yang diaktifkan ditagih melalui satu key, membandingkan model adalah perubahan pengaturan node. Pin dua kandidat di dua salinan app yang sama, jalankan seminggu pertanyaan nyata, dan baca pemisahan per-model di konsol APIsRouter di sebelah penilaian Anda sendiri atas kualitas jawaban.

  • QA dataset dan generasi jawaban di atas chunk yang diambil adalah kerja volume: deepseek-v4-flash dan glm-5.2 menjaga biaya per-pertanyaan tetap datar pada corpus dwibahasa.
  • qwen3.7-plus dan kimi-k2.6 adalah pilihan regional yang layak diuji saat jawaban harus terbaca natif dalam bahasa Mandarin; kualitas generasi bervariasi lebih banyak antar model Mandarin dibanding retrieval.
  • claude-haiku-4-5-20251001 adalah tier Barat yang cepat untuk deployment bahasa campuran; naik ke claude-sonnet-4-6 di app spesifik di mana kualitas sintesis adalah produknya.
  • Node workflow terpicu per run, jadi flow lima-node melipatgandakan id apa pun yang duduk di setiap node; taruh id cepat di node klasifikasi dan routing, dan belanjakan di node jawaban.
  • Model index dan ekstraksi dikonfigurasi terpisah dari chat model; konfirmasi endpoint melayani id embedding apa pun yang Anda ikat sebelum membangun ulang index di sekitarnya.

Bayar sesuai pemakaian · di bawah harga resmi

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModelHarga ResmiHarga Kami
GLM-5.2$1.14 / $4.00 per M$1.10 / $4.00 per M
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M
Qwen 3.7 Plus$0.29 / $1.14 per M$0.30 / $1.10 per M
Kimi K2.6$0.95 / $4.00 per M$1.00 / $4.00 per M
Claude Haiku 4.5 20251001$1.00 / $5.00 per M$0.80 / $4.00 per M

Mode kegagalan spesifik FastGPT.

Konvensi base URL menjegal orang yang berpindah dari tool lain: FastGPT mengharapkan base ber-suffix /v1 di field proxy dan menambahkan /chat/completions sendiri, sementara form custom-model-nya (fitur berbeda, untuk model sekali pakai yang melewati channel) menginginkan URL request lengkap termasuk /v1/chat/completions. Ketahui field mana yang Anda pakai sebelum menempel. Model yang ada di channel tapi tidak bisa dipilih di app berarti sudah ditambahkan ke channel tapi belum diaktifkan di sisi models konfigurasi; kedua daftar itu terpisah, dan tes konektivitas hanya membuktikan channel-nya. Tutorial lama adalah bahaya terbesar. Bertahun-tahun panduan FastGPT mengasumsikan sidecar OneAPI dan edit config.json; di versi saat ini UI Model Providers menggantikan keduanya, dan mencampur dua pendekatan (pengkabelan env plus channel) membuat request merutekan ke tempat yang tidak Anda lihat. Pilih satu lapisan dan konfigurasikan sepenuhnya. Error model-not-found adalah masalah teks-bebas yang biasa: id di channel harus cocok persis dengan ejaan /v1/models gateway, termasuk suffix versi. Salin, jangan ketik.

Siapa yang merutekan FastGPT melalui gateway.

  • Tim dwibahasa yang mencampur GLM, Qwen, Kimi, dan DeepSeek dengan id Claude dan GPT dalam satu deployment, satu saldo, satu log penggunaan.
  • Tim di Asia yang menginginkan model frontier Barat dengan saldo prabayar tanpa kartu Barat, dan tim Barat yang menginginkan model Mandarin tanpa billing regional.
  • Self-hoster yang menggantikan sidecar OneAPI: gateway melayani bagian multi-vendor, channel bawaan FastGPT melayani bagian routing.
  • Agency yang menjalankan knowledge base klien di FastGPT, memeteri setiap klien dengan key sendiri agar pengeluaran model melaporkan dirinya per project.
  • Builder yang membandingkan model jawaban pada corpus tetap, di mana setiap kandidat adalah entri channel alih-alih akun vendor.

Verifikasi endpoint dan debug pertanyaan pertama.

Curl listing model dulu dan salin id dari output ke channel; lalu jalankan satu chat completion terhadap id yang Anda rencanakan jadi default. Jika keduanya lolos, separuh gateway sudah terbukti. Di dalam FastGPT, pakai tes konektivitas channel, lalu ajukan satu pertanyaan di app minimal sebelum melibatkan dataset. Error autentikasi menunjuk ke key channel; not-found ke ejaan id; error koneksi ke proxy URL atau egress container, karena server FastGPT-lah yang harus mencapai endpoint. Jika app dataset gagal padahal app chat biasa berfungsi, masalahnya ada di binding model dataset itu sendiri, bukan channel-nya. Setelah pertanyaan mengalir, konsol APIsRouter menunjukkan model per request, hitungan token, dan pengeluaran. Traffic knowledge-base adalah banyak request kecil yang input-heavy, dan tampilan penggunaan per-key adalah tempat profil biaya nyata deployment muncul, per model, per hari, id Mandarin dan Barat di satu halaman.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"glm-5.2",
       "messages":[{"role":"user","content":"ping"}]}'

Pertanyaan umum

Bagaimana cara menambahkan base URL custom ke FastGPT?

Di versi saat ini, melalui UI: Account, Model Providers, Model Channels, Add Channel dengan protocol OpenAI, proxy URL https://api.apisrouter.com/v1, key Anda, dan id model. Di versi lama, set OPENAI_BASE_URL dan CHAT_API_KEY di environment dan deklarasikan model di config.json.

Apakah proxy URL menyertakan /v1?

Ya, di field proxy channel masukkan base ber-suffix /v1 dan FastGPT menambahkan /chat/completions sendiri. Form custom-model yang terpisah adalah pengecualian: ia menerima URL request lengkap termasuk /v1/chat/completions. Cocokkan konvensinya dengan field yang Anda pakai.

Apakah saya masih butuh OneAPI dengan FastGPT?

Tidak. Sejak v4.8.23 FastGPT menyertakan lapisan agregasi sendiri dengan manajemen channel di UI, dan gateway multi-vendor mencakup bagian yang ditangani OneAPI. Menjalankan kedua lapisan sekaligus berfungsi tapi membuat routing lebih sulit dinalar; deployment baru sebaiknya hanya mengonfigurasi channel.

Bisakah FastGPT mencampur model Mandarin dan Barat dalam satu channel?

Ya. Channel meneruskan setiap id model sebagai string biasa, jadi glm-5.2, qwen3.7-plus, kimi-k2.6, deepseek-v4-flash, dan claude-sonnet-4-6 bisa berbagi satu channel dan satu key, bisa dipilih per app dan per node workflow.

Mengapa model channel saya tidak bisa dipilih di app?

Menambahkan id ke channel dan mengaktifkan model untuk dipakai adalah langkah terpisah di UI Model Providers. Aktifkan model di daftar models, lalu cek lagi dropdown app atau node; izin model per-app juga bisa menyaring apa yang dilihat tim tertentu.

Dokumentasi FastGPT mana yang harus dipercaya untuk ini?

Bagian konfigurasi model saat ini di doc.fastgpt.io. Permukaan konfigurasi FastGPT berubah signifikan di era v4.8.2x, dan tutorial pihak ketiga lama yang mendeskripsikan sidecar OneAPI atau blok llmModels yang diedit manual tidak lagi cocok dengan flow UI-first.