Jalankan ringkasan video BibiGPT pada API serasi OpenAI custom.

Updated 2026-07-30

BibiGPT self-hosted membaca OPENAI_COMPATIBLE_BASE_URL, OPENAI_COMPATIBLE_API_KEY, dan OPENAI_COMPATIBLE_MODEL daripada environment-nya. Arahkan base URL ke https://api.apisrouter.com/v1 dan setiap ringkasan Bilibili, YouTube, atau podcast berjalan melalui gateway, dengan model Cina dan global di sebalik satu kunci.

Jawapan pantas: tiga pembolehubah environment.

Fail environment contoh BibiGPT mendokumentasikan permukaan secara terus: OPENAI_COMPATIBLE_BASE_URL menetapkan endpoint (lalai https://api.openai.com/v1), OPENAI_COMPATIBLE_API_KEY memegang kunci (kembali kepada OPENAI_API_KEY apabila tidak ditetapkan), dan OPENAI_COMPATIBLE_MODEL memilih model lalai untuk ringkasan. Tetapkan base URL kepada https://api.apisrouter.com/v1, letakkan kunci gateway dalam pembolehubah kunci, dan pilih mana-mana id katalog sebagai model. Base URL disahkan semasa digunakan: ia mesti bermula dengan http:// atau https://, dan slash hujung ditanggalkan, jadi bentuk /v1 di atas adalah tepat betul. Di sebalik tabir, aplikasi membina penyedia serasi-openai Vercel AI SDK daripada nilai ini dan memanggil chatModel dengan id yang dikonfigurasikan, sebab itu mana-mana model yang dilayani endpoint berfungsi tanpa perubahan kod.

# Pilihan: guna penyedia serasi OpenAI (kembali kepada OPENAI_API_KEY)
OPENAI_COMPATIBLE_API_KEY=sk-YOUR-APISROUTER-KEY
OPENAI_COMPATIBLE_BASE_URL=https://api.apisrouter.com/v1
OPENAI_COMPATIBLE_MODEL=deepseek-v4-flash

Apa yang BibiGPT hantar kepada endpoint.

BibiGPT (JimmyLv di GitHub, lebih kurang 6K bintang untuk v1 sumber terbuka) adalah peringkas AI satu-klik untuk audio dan video: tampal pautan Bilibili atau YouTube, podcast, rakaman mesyuarat, atau fail setempat, dan ia mengambil transkrip, memadatkannya, dan membenarkan anda berbual dengan kandungan itu. Ia bermula sebagai BiliGPT untuk ringkasan Bilibili dan berkembang menjadi alat dwibahasa dengan pengganti yang dihoskan; konfigurasi environment yang diterangkan di sini terpakai kepada versi self-hosted sumber terbuka. Beban kerja berbentuk transkrip: input panjang, output pendek. Sejam pertuturan adalah banyak transkrip, yang aplikasi cebiskan kepada bahagian bersaiz model sebelum meringkaskan, jadi satu video boleh bermaksud beberapa panggilan chat-completions yang token inputnya jauh mengatasi ringkasan yang dihasilkannya. Harga per-token-input justeru adalah keseluruhan ekonomi, dan model konteks panjang mengurangkan pencebisan untuk kuliah dan podcast panjang. Pembinaan penyedia menyelesaikan nilai dalam lata yang munasabah: kunci per-permintaan (untuk instans yang membenarkan pengguna bawa kunci sendiri) mengatasi OPENAI_COMPATIBLE_API_KEY, yang mengatasi OPENAI_API_KEY; perkara yang sama terpakai kepada base URL dan model. Malah ada pembolehubah OPENAI_COMPATIBLE_KEY_PREFIXES untuk menerima kunci yang dimasukkan pengguna yang awalannya bukan sk-, yang penting apabila kunci yang dipegang pengguna anda datang daripada gateway berbanding OpenAI.

Persediaan penuh untuk instans self-hosted.

BibiGPT adalah aplikasi Next.js, jadi environment bergerak mengikut cara anda deploy: fail .env secara setempat, pembolehubah environment projek pada Vercel, atau env kontainer dalam Docker. Tetapkan tiga pembolehubah, deploy semula atau mulakan semula, dan ringkasan menghalakan melalui gateway. Pembolehubah model adalah lalai, bukan had keras. Permintaan membawa config per-video yang medan modelnya, apabila hadir, menulis ganti OPENAI_COMPATIBLE_MODEL, jadi instans boleh melalaikan id volum sementara aliran tertentu meminta yang lebih kuat. Jika anda menjalankan instans untuk orang lain dan membenarkan mereka menampal kunci sendiri, tetapkan OPENAI_COMPATIBLE_KEY_PREFIXES untuk merangkumi awalan kunci gateway anda supaya borang menerimanya.

OPENAI_COMPATIBLE_API_KEY=sk-YOUR-APISROUTER-KEY
OPENAI_COMPATIBLE_BASE_URL=https://api.apisrouter.com/v1
OPENAI_COMPATIBLE_MODEL=deepseek-v4-flash

# menerima kunci gateway yang dimasukkan pengguna dalam UI:
OPENAI_COMPATIBLE_KEY_PREFIXES=sk-

Memilih model ringkasan, Timur dan Barat.

Perbandingan mudah dijalankan secara jujur: video yang sama, dua id model, baca kedua-dua ringkasan berbanding transkrip. Log penggunaan per-kunci menetapkan harga setiap calon pada kandungan sebenar, dan untuk beban kerja transkrip, perbezaan itu kelihatan segera dalam lajur token-input.

  • Kandungan Cina adalah gelanggang asal BibiGPT: kuliah Bilibili, klip Douyin, podcast Cina. glm-5.2, deepseek-v4-flash, dan kimi-k2.6 kuat secara asli pada transkrip Cina dan duduk di sebalik endpoint yang sama seperti segala-galanya.
  • Kandungan Inggeris dan campuran (YouTube, podcast global) berjaya baik pada claude-haiku-4-5-20251001 dan gemini-3.5-flash, kedua-duanya selesa dengan transkrip panjang yang bising.
  • Pembahagian ini adalah hujah praktikal China-plus-global untuk gateway: satu endpoint, satu kunci, dan override model per-video memilih keluarga yang betul mengikut sumber kandungan berbanding memaksa satu vendor untuk kedua-duanya.
  • Kuliah panjang mengganjari konteks panjang. Kurang cebisan bermaksud kurang panggilan dan ringkasan yang lebih koheren; uji id konteks-panjang terhadap kandungan terpanjang anda sebelum menyeragamkan.
  • Instans volum (pasukan meringkaskan segala yang mereka tonton) patut melalaikan kepada deepseek-v4-flash dan mempertingkat secara selektif; bentuk berat-input menjadikan harga tier-pantas berganda.

Bayar mengikut penggunaan · bawah harga rasmi

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModelHarga RasmiHarga Kami
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M
GLM-5.2$1.14 / $4.00 per M$1.10 / $4.00 per M
Kimi K2.6$0.95 / $4.00 per M$1.00 / $4.00 per M
Claude Haiku 4.5 20251001$1.00 / $5.00 per M$0.80 / $4.00 per M
Gemini 3.5 Flash$1.50 / $9.00 per M$1.20 / $7.20 per M

Mod kegagalan khusus BibiGPT.

Rantaian fallback boleh mengejutkan anda. Jika OPENAI_COMPATIBLE_API_KEY kosong, aplikasi kembali secara senyap kepada OPENAI_API_KEY. Itu mudah sehingga kedua-duanya menunjuk kepada perkhidmatan berbeza: base URL gateway dengan kunci OpenAI menghasilkan ralat pengesahan yang kelihatan seperti masalah gateway. Apabila penghalaan berubah, tetapkan pasangan berawalan-compatible bersama dan jangan tinggalkan OPENAI_API_KEY lapuk menunjuk ke tempat lain, atau pastikan ia memegang kunci gateway yang sama. Pengesah base URL menolak nilai tanpa skema, jadi hos kosong gagal segera dengan ralat yang jelas; sertakan https:// dan laluan /v1. Slash hujung dinormalkan, jadi kedua-dua bentuk berfungsi di situ. Id model adalah rentetan tepat terhadap senarai /v1/models endpoint; kesilapan taip dalam OPENAI_COMPATIBLE_MODEL menggagalkan ringkasan pertama dengan model-not-found. Ingat juga override per-video: jika satu aliran terus menggunakan model lama, sesuatu menghantar model eksplisit dalam config permintaan. Pengambilan transkrip adalah paip berasingan. Jika video tidak menghasilkan ringkasan kerana sari kata atau audio tidak dapat diambil, itu adalah paip kandungan (API platform, ketersediaan sari kata), bukan endpoint LLM. Env var dalam panduan ini hanya menggerakkan panggilan ringkasan. Dan ambil perhatian perkhidmatan bibigpt.co yang dihoskan menguruskan modelnya sendiri; pembolehubah ini mengkonfigurasikan v1 sumber terbuka yang anda deploy sendiri.

Siapa yang menghalakan BibiGPT melalui gateway.

  • Penonton dwibahasa yang meringkaskan Bilibili dan YouTube kedua-duanya, memadankan id kuat-Cina dengan yang global di sebalik satu kunci berbanding satu vendor per bahasa.
  • Self-hoster dalam persediaan berdekatan-China di mana satu endpoint serasi OpenAI yang juga melayani GLM, DeepSeek, dan Kimi menghapuskan masalah pengebilan multi-vendor sepenuhnya.
  • Pasukan yang menjalankan peringkas dikongsi untuk mesyuarat dan kuliah, mengukur penggunaan per kunci dan melalaikan kepada id tier-volum.
  • Pendengar podcast tegar, di mana berjam-jam transkrip seminggu menjadikan harga token-input keseluruhan cerita kos.
  • Pembangun tanpa akses kepada pengebilan vendor tertentu. Akses berasaskan top-up tanpa keperluan kad menghapuskan kebergantungan pendaftaran setiap penyedia.

Sahkan endpoint dan nyahpepijat ringkasan pertama.

Senaraikan model yang boleh dicapai kunci anda dan sahkan id dalam OPENAI_COMPATIBLE_MODEL berada di antaranya; semakan tunggal itu mengelakkan kebanyakan kegagalan larian-pertama. Kemudian ringkaskan sesuatu yang pendek. Ralat pengesahan bermaksud kunci yang diselesaikan tidak sepadan dengan base URL, dan memandangkan rantaian fallback, cetak pembolehubah mana yang sebenarnya membekalkan kunci sebelum menganggap. Model-not-found adalah kesilapan taip id. Ralat skema semasa startup adalah base URL yang kehilangan https://. Ringkasan yang tidak pernah bermula walaupun endpoint sihat adalah pengambilan transkrip yang gagal di hulu daripada sebarang panggilan LLM. Sebaik sahaja ringkasan mengalir, konsol APIsRouter menunjukkan model per permintaan, kiraan token, dan perbelanjaan. Ringkasan transkrip adalah beban kerja berat-input paling jelas yang wujud, dan seminggu data penggunaan memberitahu anda kos sebenar per jam kandungan untuk setiap model, iaitu angka yang berbaloi dioptimumkan.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

Soalan lazim

Adakah BibiGPT menyokong base URL serasi OpenAI custom?

Ya. v1 self-hosted mendokumentasikan OPENAI_COMPATIBLE_BASE_URL, OPENAI_COMPATIBLE_API_KEY, dan OPENAI_COMPATIBLE_MODEL dalam fail environment contohnya, dan membina penyedia AI SDK-nya daripadanya. Tetapkan base URL kepada endpoint gateway termasuk /v1.

Bolehkah BibiGPT meringkaskan dengan model GLM, DeepSeek, Kimi, atau Claude?

Ya. Id model yang dikonfigurasikan dihantar kepada endpoint sebagai rentetan biasa, jadi mana-mana id katalog berfungsi: glm-5.2 dan kimi-k2.6 untuk kandungan Cina, claude-haiku-4-5-20251001 atau gemini-3.5-flash untuk kandungan global, semuanya pada satu kunci.

Apa yang berlaku jika OPENAI_COMPATIBLE_API_KEY tidak ditetapkan?

Aplikasi kembali kepada OPENAI_API_KEY. Itu baik apabila kedua-duanya menunjuk kepada perkhidmatan yang sama, dan mengelirukan apabila tidak; apabila menggunakan gateway, tetapkan kunci berawalan-compatible secara eksplisit.

Bolehkah pengguna membawa kunci gateway sendiri pada instans dikongsi?

Ya. Kunci per-permintaan menulis ganti environment, dan OPENAI_COMPATIBLE_KEY_PREFIXES mengawal awalan kunci mana yang diterima antara muka, jadi deployment dikongsi boleh menerima kunci gateway yang dimasukkan pengguna.

Mengapa video panjang berkos lebih daripada yang dicadangkan panjang ringkasan?

Kerana transkrip adalah input. Sejam pertuturan adalah bilangan besar token input, dicebiskan kepada beberapa panggilan, sementara output ringkasan kecil. Harga token-input dan pengendalian konteks-panjang menggerakkan kos, dan log penggunaan menunjukkannya per video.

Adakah pembolehubah ini terpakai kepada perkhidmatan bibigpt.co yang dihoskan?

Tidak. Perkhidmatan yang dihoskan menguruskan modelnya sendiri di sisi pelayan. Pembolehubah environment OPENAI_COMPATIBLE_* mengkonfigurasikan BibiGPT v1 sumber terbuka yang anda deploy sendiri.