Chạy app FastGPT trên một base URL tương thích OpenAI tùy chỉnh.
Updated 2026-07-29
FastGPT hiện tại cấu hình model trong giao diện: thêm một channel dưới Account, Model Providers với giao thức OpenAI, https://api.apisrouter.com/v1 làm địa chỉ proxy, và một key. Id Claude, GPT, DeepSeek, GLM, Kimi, và Qwen sau đó cấp năng lượng cho knowledge base và workflow của bạn.
Câu trả lời nhanh: một channel trên trang Model Providers.
Từ v4.8.23, FastGPT có sẵn lớp tổng hợp model riêng (AI Proxy) và giao diện cấu hình model, nên một endpoint tùy chỉnh không còn cần một deployment OneAPI riêng hoặc chỉnh tay config.json nữa. Mở Account, sau đó Model Providers, chuyển sang tab Model Channels, và nhấn Add Channel. Đặt loại giao thức thành OpenAI, đặt tên channel, điền https://api.apisrouter.com/v1 vào field địa chỉ proxy (base URL, không phải đường dẫn request đầy đủ), dán key của bạn, và chọn hoặc gõ các model id mà channel nên phục vụ. Quay lại tab model, bật các id bạn đã thêm và chạy kiểm tra kết nối có sẵn. Từ đó, mọi app, knowledge base, và node workflow của FastGPT có thể chọn các model đó. Tài liệu song ngữ và nhãn thay đổi giữa các bản phát hành (doc.fastgpt.io là điểm vào tiếng Anh), nên hãy coi flow, channel, protocol, base URL, key, models, là phần ổn định thay vì câu chữ chính xác.
Channel Name: APIsRouter
Protocol Type: OpenAI
Proxy URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Models: claude-sonnet-4-6, deepseek-v4-flash,
glm-5.2, qwen3.7-plus, kimi-k2.6
then: enable the models + run the connection testCách FastGPT định tuyến lưu lượng model.
FastGPT (labring trên GitHub, khoảng 29K star) là nền tảng knowledge-base và workflow có nguồn gốc Trung Quốc: dataset với trích xuất QA và tìm kiếm vector, điều phối Flow trực quan, và app đã xuất bản với chia sẻ và truy cập API. Tất cả đều phân giải về các model đã đăng ký trong lớp cấu hình. Một channel là một quy tắc định tuyến: những model id này, base URL này, key này. Request rời FastGPT dưới dạng chat completions chuẩn với model id là một chuỗi thuần, đây là lý do một gateway đa vendor lắp vừa như một channel duy nhất. Lớp channel cũng mang các tính năng vận hành mà nếu không bạn phải tự xây: một model có thể sống trong nhiều channel để cân bằng tải, và ánh xạ model cho phép FastGPT phơi ra một tên trong khi gửi cho provider một chuỗi id khác. Với người tự host trên phiên bản cũ hơn, cách nối dây trực tiếp vẫn tồn tại: cặp môi trường cổ điển của FastGPT trỏ nền tảng vào bất kỳ base tương thích OpenAI nào, OPENAI_BASE_URL và CHAT_API_KEY trong môi trường docker-compose, với model khai báo trong config.json dưới llmModels. Nó vẫn hoạt động, nhưng con đường giao diện là nơi dự án đã chuyển tới, và các deployment mới nên bắt đầu ở đó.
Góc độ châu Á: một số dư cho cả hai thế giới model.
Cộng đồng người dùng FastGPT chủ yếu nói tiếng Trung, và deployment điển hình của nó trộn model khu vực với model phương Tây: GLM hoặc Qwen cho knowledge base tiếng Trung, DeepSeek cho khối lượng lớn, Claude hoặc GPT nơi độ tinh tế câu trả lời là sản phẩm. Phục vụ trực tiếp, sự pha trộn đó nghĩa là tài khoản tại Zhipu, Alibaba, DeepSeek, Anthropic, và OpenAI, mỗi cái có billing riêng, một số khó thanh toán từ phía này hoặc phía kia của thế giới. Qua một channel, sự pha trộn chỉ là một danh sách model: glm-5.2, qwen3.7-plus, kimi-k2.6, deepseek-v4-flash, và claude-haiku-4-5-20251001 cạnh nhau, một số dư trả trước, không yêu cầu thẻ, id thẳng từ catalog. Các đội ở châu Á có được Claude và GPT mà không cần thẻ phương Tây; đội phương Tây có được model Trung Quốc mà không cần đăng ký khu vực. Cùng một knowledge base có thể trả lời câu hỏi tiếng Trung trên GLM và câu hỏi tiếng Anh trên Claude, định tuyến theo từng app. Nếu bạn chạy cách nối dây môi trường cũ thay vào đó, cùng endpoint lắp vào trực tiếp; quy ước base URL bao gồm hậu tố /v1, và FastGPT nối thêm route path như /chat/completions vào đó.
# docker-compose environment, pre-AI-Proxy versions
OPENAI_BASE_URL=https://api.apisrouter.com/v1
CHAT_API_KEY=sk-YOUR-APISROUTER-KEY
# models declared in config.json under llmModelsChọn model cho knowledge base và flow.
Vì mỗi id đã bật thanh toán qua một key, so sánh model chỉ là một lần đổi cài đặt node. Ghim hai ứng viên vào hai bản sao của cùng app, chạy một tuần câu hỏi thực tế, và đọc phân tách theo từng model trong console APIsRouter cạnh phán đoán của chính bạn về chất lượng câu trả lời.
- QA dataset và sinh câu trả lời trên đoạn truy xuất là công việc khối lượng lớn: deepseek-v4-flash và glm-5.2 giữ chi phí mỗi câu hỏi ổn định trên corpus song ngữ.
- qwen3.7-plus và kimi-k2.6 là lựa chọn khu vực đáng thử khi câu trả lời phải đọc tự nhiên bằng tiếng Trung; chất lượng sinh văn bản khác biệt giữa các model Trung Quốc nhiều hơn so với truy xuất.
- claude-haiku-4-5-20251001 là tầng phương Tây nhanh cho deployment đa ngôn ngữ; nâng cấp lên claude-sonnet-4-6 ở các app cụ thể nơi chất lượng tổng hợp là sản phẩm.
- Node workflow chạy theo từng lần, nên một flow năm node nhân lên bất kỳ id nào ngồi trong mỗi node; đặt id nhanh vào node phân loại và định tuyến, và chi tiền vào node trả lời.
- Model index và trích xuất được cấu hình riêng biệt với chat model; xác nhận endpoint phục vụ bất kỳ id embedding nào bạn gắn trước khi xây lại một index xoay quanh nó.
Trả theo mức sử dụng · thấp hơn giá chính thức
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Mô hình | Giá chính thức | Giá của chúng tôi |
|---|---|---|
| GLM-5.2 | $1.14 / $4.00 per M | $1.10 / $4.00 per M |
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
| Qwen 3.7 Plus | $0.29 / $1.14 per M | $0.30 / $1.10 per M |
| Kimi K2.6 | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
Các kiểu lỗi đặc thù của FastGPT.
Quy ước base URL làm vấp người chuyển từ công cụ khác: FastGPT kỳ vọng base có hậu tố /v1 trong field proxy và tự nối thêm /chat/completions, trong khi form model tùy chỉnh của nó (một tính năng khác, cho các model đơn lẻ bỏ qua channel) muốn URL request đầy đủ bao gồm /v1/chat/completions. Biết bạn đang ở field nào trước khi dán. Một model tồn tại trong channel nhưng không chọn được trong app nghĩa là nó được thêm vào channel nhưng chưa được bật ở phía model của cấu hình; hai danh sách này riêng biệt, và kiểm tra kết nối chỉ chứng minh channel. Hướng dẫn cũ là mối nguy lớn nhất. Nhiều năm hướng dẫn FastGPT giả định một sidecar OneAPI và chỉnh tay config.json; trên phiên bản hiện tại, giao diện Model Providers thay thế cả hai, và trộn hai cách tiếp cận (nối dây env cộng channel) khiến request định tuyến tới nơi bạn không để ý. Chọn một lớp và cấu hình nó đầy đủ. Lỗi model-not-found là vấn đề văn bản tự do thường gặp: id trong channel phải khớp chính xác cách viết /v1/models của gateway, gồm cả hậu tố phiên bản. Sao chép, đừng gõ tay.
Ai định tuyến FastGPT qua một gateway.
- Các đội song ngữ trộn GLM, Qwen, Kimi, và DeepSeek với id Claude và GPT trong một deployment, một số dư, một log sử dụng.
- Các đội ở châu Á muốn model phương Tây đỉnh cao trên số dư trả trước mà không cần thẻ phương Tây, và đội phương Tây muốn model Trung Quốc mà không cần billing khu vực.
- Người tự host thay thế một sidecar OneAPI: gateway phục vụ phần đa vendor, channel có sẵn của FastGPT phục vụ phần định tuyến.
- Agency chạy knowledge base khách hàng trên FastGPT, đo lường mỗi khách hàng bằng key riêng để chi tiêu model tự báo cáo theo từng project.
- Người xây dựng so sánh model trả lời trên corpus cố định, nơi mỗi ứng viên là một entry channel thay vì một tài khoản vendor.
Xác minh endpoint và debug câu hỏi đầu tiên.
Curl danh sách model trước và sao chép id từ output vào channel; sau đó chạy một chat completion nhắm vào id bạn định đặt làm mặc định. Nếu cả hai qua, nửa gateway đã được chứng minh. Bên trong FastGPT, dùng kiểm tra kết nối của channel, sau đó hỏi một câu trong một app tối thiểu trước khi liên quan tới dataset. Lỗi xác thực chỉ tới key channel; not-found chỉ tới cách viết id; lỗi kết nối chỉ tới proxy URL hoặc egress container, vì chính server FastGPT mới cần với tới endpoint. Nếu một app dataset thất bại nơi một app chat thuần hoạt động, vấn đề nằm ở ràng buộc model riêng của dataset, không phải channel. Khi câu hỏi đã chạy, console APIsRouter hiển thị model theo từng request, số lượng token, và chi tiêu. Lưu lượng knowledge-base là nhiều request nhỏ, nặng đầu vào, và góc nhìn sử dụng theo từng key là nơi hồ sơ chi phí thực của một deployment hiện ra, theo từng model, từng ngày, id Trung Quốc và phương Tây trên cùng một trang.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"glm-5.2",
"messages":[{"role":"user","content":"ping"}]}'Câu hỏi thường gặp
Làm sao để thêm một base URL tùy chỉnh vào FastGPT?
Trên phiên bản hiện tại, qua giao diện: Account, Model Providers, Model Channels, Add Channel với protocol OpenAI, proxy URL https://api.apisrouter.com/v1, key của bạn, và các model id. Trên phiên bản cũ hơn, đặt OPENAI_BASE_URL và CHAT_API_KEY trong môi trường và khai báo model trong config.json.
Proxy URL có gồm /v1 không?
Có, trong field proxy của channel hãy nhập base có hậu tố /v1 và FastGPT tự nối thêm /chat/completions. Form model tùy chỉnh riêng biệt là ngoại lệ: nó nhận URL request đầy đủ gồm /v1/chat/completions. Khớp quy ước với field bạn đang dùng.
Tôi có còn cần OneAPI với FastGPT không?
Không. Từ v4.8.23, FastGPT đóng gói sẵn lớp tổng hợp riêng với quản lý channel trong giao diện, và một gateway đa vendor bao phủ phần OneAPI từng đảm nhiệm. Chạy cả hai lớp cùng lúc vẫn hoạt động nhưng khiến việc suy luận định tuyến khó hơn; deployment mới chỉ nên cấu hình channel.
FastGPT có thể trộn model Trung Quốc và phương Tây trong một channel không?
Có. Channel chuyển tiếp mỗi model id dưới dạng chuỗi thuần, nên glm-5.2, qwen3.7-plus, kimi-k2.6, deepseek-v4-flash, và claude-sonnet-4-6 có thể chia sẻ một channel và một key, chọn được theo từng app và từng node workflow.
Vì sao model channel của tôi không chọn được trong app?
Thêm một id vào channel và bật model để sử dụng là hai bước riêng biệt trong giao diện Model Providers. Bật model trên danh sách model, rồi kiểm tra lại dropdown app hoặc node; quyền model theo từng app cũng có thể lọc những gì một đội nhất định thấy.
Tôi nên tin tài liệu FastGPT nào cho việc này?
Mục cấu hình model hiện tại trên doc.fastgpt.io. Bề mặt cấu hình của FastGPT thay đổi đáng kể ở giai đoạn v4.8.2x, và các hướng dẫn bên thứ ba cũ mô tả sidecar OneAPI hoặc chỉnh tay khối llmModels không còn khớp với luồng ưu tiên giao diện.