Jalankan app Dify pada endpoint serasi OpenAI-API.
Updated 2026-07-29
Dify menyediakan penyedia serasi OpenAI-API khusus untuk ini: pasang daripada Marketplace, tambah setiap model dengan idnya, https://api.apisrouter.com/v1 sebagai API Base URL, dan satu kunci. Chatflow, agent, dan workflow anda kemudian berjalan pada mana-mana model katalog, termasuk Claude dan DeepSeek.
Jawapan pantas: pasang penyedia, tambah model mengikut id.
Dalam Dify, buka Settings dan pergi ke Model Provider. Sejak Dify 1.0, penyedia adalah plugin: cari OpenAI-API-compatible (diterbitkan oleh langgenius) dalam senarai atau pasang daripada Marketplace, kemudian klik Add Model pada kadnya. Dialog itu adalah per-model: pilih Model Type (LLM untuk chat model), masukkan id katalog yang tepat dalam Model Name, tampal kunci anda dalam API Key, dan tetapkan API Base URL kepada https://api.apisrouter.com/v1. Biarkan Completion mode pada Chat, kemudian tetapkan Model context size dan Upper bound for max tokens kepada had yang didokumentasikan bagi id yang anda tambah. Simpan, dan model muncul dalam senarai penyedia, boleh dipilih daripada dropdown model setiap app. Ulang dialog itu untuk setiap id yang anda mahu; dua minit per model, sekali sahaja.
Model Type: LLM
Model Name: claude-sonnet-4-6
API Key: sk-YOUR-APISROUTER-KEY
API Base URL: https://api.apisrouter.com/v1
Completion mode: Chat
Model context size: 200000
Upper bound for max tokens: 64000Bagaimana Dify bertutur dengan penyedia serasi.
Dify (langgenius di GitHub, lebih kurang 149K bintang) ialah platform app LLM sumber terbuka terkemuka: workflow visual, node agent, pipeline RAG atas knowledge base, dan app diterbitkan dengan endpoint API sendiri. Setiap node LLM dalam stack itu menyelesaikan kepada model yang didaftarkan di bawah sesuatu penyedia. Penyedia OpenAI-API-compatible sengaja bersifat generik. Setiap model yang anda tambah ialah rekod berdikari, id, endpoint, kunci, had, dan Dify menghantar permintaan chat-completions standard ke base URL yang dikonfigurasikan dengan Model Name anda sebagai rentetan model. Tiada apa dalam permintaan itu mengambil kisah vendor mana yang melatih model, jadi claude-sonnet-4-6 dan deepseek-v4-pro sah di sini sama seperti mana-mana id GPT, dan model berbeza malah boleh menunjuk ke endpoint berbeza jika anda pernah memerlukannya. Pendaftaran per-model yang terasa seperti geseran juga adalah permukaan kawalan: nilai context size dan max-tokens yang anda masukkan adalah apa yang digunakan orkestrator Dify untuk membelanjakan prompt, memotong sejarah perbualan, dan mengesahkan tetapan node. Masukkan nombor jujur daripada dokumentasi model. Lebih nyatakan konteks menghasilkan permintaan yang ditolak endpoint; kurang nyatakan memotong secara senyap konteks yang node RAG anda berusaha ambil.
Medan yang benar-benar berfungsi.
Model Name ialah nilai wire: ia mesti sepadan dengan senarai /v1/models gateway aksara demi aksara, kerana ia bergerak dalam setiap permintaan. Nama paparan model pilihan hanya melabel semula UI. Completion mode harus kekal pada Chat untuk setiap model dalam katalog semasa; pilihan Completion wujud untuk endpoint text-completion warisan dan menghasilkan permintaan cacat terhadap chat model. Model context size dan Upper bound for max tokens ialah pasangan yang orang tergesa-gesa. Context size ialah tetingkap keseluruhan model; upper bound mengehadkan berapa banyak token output yang boleh diminta node. Dify melalaikan kedua-duanya kepada 4096, jauh di bawah apa yang disokong model semasa, dan membiarkan lalai secara senyap melumpuhkan RAG dokumen panjang dan penjanaan bentuk panjang. Tetapkan daripada dokumentasi model, bukan daripada tabiat. Pemilih keupayaan penting apabila app anda menggunakannya: Vision Support hanya untuk id yang menerima input imej, dan tetapan function-call untuk sepadan dengan sokongan tool-use model, kerana node agent bergantung padanya. Dakwaan keupayaan yang salah gagal pada masa larian dalam workflow, tempat yang lebih perlahan untuk nyahpepijat berbanding dialog ini. Jika workspace anda turut menggunakan embedding atau rerank model, penyedia yang sama mendaftarkannya di bawah entri Model Type sendiri terhadap base URL yang sama; sahkan id tertentu dilayani endpoint sebelum menyambungkan tetapan knowledge-base kepadanya.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
# register these ids verbatim as Model Name entriesMemilih model untuk workflow dan agent.
Halaman overview Dify sendiri menunjukkan token per app, tetapi pandangan penggunaan per-kunci dalam konsol APIsRouter menambah pecahan per-model merentasi semua app pada halaman yang sama, nombor yang memutuskan id mana yang mengekalkan slot.
- Node LLM workflow adalah volum: langkah klasifikasi, ekstraksi, penghalaan, peringkasan yang menembak pada setiap larian. claude-haiku-4-5-20251001, gpt-5.4-mini, dan gemini-3.5-flash mengekalkan kos per-larian rata.
- Node agent dan langkah penaakulan kompleks layak mendapat claude-sonnet-4-6, dan penggunaan alatnya yang boleh dipercayai lebih penting dalam agent berbanding skor benchmark mentah.
- Node jawapan RAG membawa konteks yang diambil pada setiap panggilan, jadi harga input mendominasi; deepseek-v4-pro berbaloi diuji di mana retrieval berat dan jawapan panjang.
- Daftarkan id pantas dan id kuat untuk peranan yang sama dan A/B kannya per node: dalam Dify, menukar model node adalah dropdown, bukan migrasi.
- App yang diterbitkan mewarisi pilihan model node mereka, jadi keputusan dropdown yang anda buat dalam editor adalah ekonomi unit app yang anda hantar.
Bayar mengikut penggunaan · bawah harga rasmi
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Harga Rasmi | Harga Kami |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| GPT-5.4 mini | $0.75 / $4.50 per M | $0.60 / $3.60 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Mod kegagalan khusus Dify.
Penyedia hilang daripada senarai bermaksud plugin tidak dipasang: sejak Dify 1.0 penyedia OpenAI-API-compatible dihantar sebagai plugin Marketplace, dan instans self-hosted baharu bermula tanpanya. Pasang sekali per workspace. Model yang disimpan tetapi memberi ralat pada penggunaan pertama biasanya salah satu daripada tiga perkara: Model Name yang tidak sepadan dengan ejaan katalog, base URL yang hilang /v1-nya (Dify melampirkan laluan route seperti /chat/completions kepada apa yang anda masukkan), atau nilai context/max-token melebihi apa yang diterima model. Ralat muncul dalam log app atau workflow; pembetulan kembali dalam dialog Add Model. Node agent gagal sedangkan node sembang biasa berfungsi menunjuk kepada tetapan keupayaan function-calling, atau model yang penggunaan alatnya tidak memenuhi apa yang diharapkan strategi agent. Uji agent terhadap claude-sonnet-4-6 dahulu untuk memisahkan masalah konfigurasi daripada pilihan model. Dan pada instans self-hosted di sebalik peraturan egress ketat, ingat kontainer api Dify itulah yang perlu mencapai endpoint, bukan pelayar anda; curl dari dalam kontainer itu menyelesaikan persoalan konektiviti dengan pantas.
Siapa yang menghalakan Dify melalui gateway.
- Pasukan yang membina app LLM yang mahukan Claude, GPT, Gemini, dan DeepSeek boleh dipilih per node tanpa menyelenggara akaun vendor setiap penyedia.
- Self-hoster yang menjalankan Dify untuk alat dalaman, di mana satu kunci dalam satu penyedia mengekalkan seluruh perbelanjaan cloud workspace pada satu log penggunaan.
- Pembina yang membandingkan model pada workflow sebenar: setiap calon adalah dialog Add Model dan pertukaran dropdown, bukan integrasi baharu.
- Pembangun tanpa akses kepada pengebilan vendor tertentu. Akses berasaskan top-up tanpa keperluan kad menghapuskan kebergantungan pendaftaran setiap penyedia.
- Agensi yang menghantar app klien pada Dify yang memerlukan kunci per-projek supaya perbelanjaan model setiap klien melaporkan dirinya sendiri.
Sahkan endpoint dan nyahpepijat larian pertama.
Curl senarai model dahulu dan daftarkan id daripada outputnya; Model Name yang ditaip tangan adalah punca utama ralat not-found kerana medan itu teks bebas. Kemudian jalankan satu chat completion terhadap id yang anda daftarkan, dengan kunci yang sama. Dalam Dify, uji dalam app scratch sebelum menyambungkan workflow produksi: tambah node LLM, pilih model baharu, jalankan sekali. Ralat pengesahan menunjuk kepada medan API Key; not-found kepada Model Name; ralat sambungan kepada base URL atau egress kontainer; ralat panjang kepada nilai context dan max-token. Sebaik sahaja larian mengalir, konsol APIsRouter menunjukkan model per permintaan, kiraan token, dan perbelanjaan. Workflow menggandakan panggilan LLM dengan cara yang sukar dianggarkan mata daripada editor, dan log penggunaan adalah tempat profil token sebenar pipeline lima-node menjadi kelihatan, per model, per hari.
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-4-5-20251001",
"messages":[{"role":"user","content":"ping"}]}'Soalan lazim
Bagaimana saya menambah penyedia serasi OpenAI-API ke Dify?
Settings, Model Provider, kemudian pasang plugin OpenAI-API-compatible daripada Marketplace jika ia tidak tersenarai. Klik Add Model pada kadnya dan daftarkan setiap id dengan Model Name, API Key, dan API Base URL https://api.apisrouter.com/v1.
Apa yang dikawal oleh Model context size dan Upper bound for max tokens?
Context size memberitahu Dify tetingkap keseluruhan model, digunakan untuk membelanjakan prompt dan sejarah; upper bound mengehadkan token output yang diminta. Kedua-duanya melalai kepada 4096, terlalu rendah untuk model semasa, jadi tetapkan daripada had yang didokumentasikan model apabila anda mendaftarkannya.
Bolehkah Dify menjalankan Claude atau DeepSeek melalui penyedia ini?
Ya. Penyedia menghantar rentetan Model Name ke base URL anda melalui chat completions standard, jadi mana-mana id yang dilayani gateway berfungsi: claude-sonnet-4-6, deepseek-v4-pro, gemini-3.5-flash, dan id GPT bersebelahan, satu kunci untuk semuanya.
Patutkah API Base URL merangkumi /v1?
Ya: https://api.apisrouter.com/v1. Dify melampirkan laluan route kepada apa yang anda masukkan, jadi /v1 yang hilang menghasilkan ralat sambungan atau 404 pada penggunaan pertama, dan menampal laluan penuh /chat/completions menggandakan route.
Adakah satu konfigurasi merangkumi semua app Dify saya?
Model didaftarkan per workspace, jadi setiap app, workflow, dan agent dalam workspace boleh memilihnya sebaik sahaja ditambah. Berbilang workspace atau environment mengulangi persediaan, yang juga membenarkan setiap satu membawa kunci sendiri untuk laporan penggunaan berasingan.
Mengapa penyedia OpenAI-API-compatible hilang daripada Dify saya?
Sejak Dify 1.0, penyedia model dihantar sebagai plugin, dan instans self-hosted bermula tanpa satu pun dipasang. Buka Marketplace, pasang OpenAI-API-compatible oleh langgenius, dan kad itu muncul di bawah tetapan Model Provider dengan tindakan Add Model.