Cài đặt API tùy chỉnh cho Narratium: base URL, key, model.

Updated 2026-07-29

Narratium là client roleplay và kể chuyện mã nguồn mở, tự mang giao diện riêng nhưng không có model riêng: README của nó hướng người dùng tới các API định dạng OpenAI, endpoint hợp nhất kiểu OpenRouter, và Ollama chạy local. Trỏ cài đặt API của nó vào https://api.apisrouter.com/v1 với một key và toàn bộ catalog trở thành backend của nó. Một điều trang này nói thẳng mà hầu hết hướng dẫn khác bỏ qua: repository GitHub đã bị archive, nên hãy chạy nó với thực tế đó đã được tính đến.

Câu trả lời nhanh: các giá trị Narratium cần.

Kết nối LLM của Narratium là bộ ba tiêu chuẩn tương thích OpenAI, nhập trong phần cài đặt API của nó: một base URL, một API key, và một tên model. Với gateway này đó là https://api.apisrouter.com/v1, key sk-... của bạn, và bất kỳ id nào trong catalog, deepseek-v4-flash là lựa chọn đầu tiên hợp lý cho traffic kể chuyện. README của dự án khuyến nghị chính xác loại kết nối này: API định dạng OpenAI trực tiếp, một endpoint đa model hợp nhất để đa dạng hóa, hoặc Ollama và LM Studio cho model local, tất cả qua cùng một bề mặt cấu hình. Nhãn field chính xác thay đổi giữa bản web và các phiên bản, nên hãy coi nhãn một cách linh hoạt còn giá trị thì chính xác: URL kết thúc ở /v1, key dán sạch, model id khớp chuỗi catalog từng ký tự một.

Base URL:  https://api.apisrouter.com/v1
API key:   sk-...              (from APIsRouter)
Model:     deepseek-v4-flash   (typed exactly; any catalog id works)

Narratium là gì, và tình trạng của nó, nói thẳng.

Narratium (Narratium/Narratium.ai trên GitHub) tự giới thiệu mình như VSCode cho roleplay: một client mã nguồn mở cho kể chuyện do AI dẫn dắt, xây dựng thế giới, và hư cấu tương tác dài kỳ, tương thích thẻ nhân vật SillyTavern, lưu trữ trí nhớ, và hệ thống plugin. Code được cấp phép AGPL, nó thu hút một cộng đồng thực sự nhanh chóng, và vẫn là một trong những client mở thú vị hơn trong giới này. Giờ đến phần mà hầu hết hướng dẫn cài đặt bỏ qua: repository GitHub đã bị archive và chỉ đọc (GitHub hiển thị ngày archive là 30 tháng 3 năm 2026). Archived không có nghĩa là hỏng, code vẫn chạy tốt y như ngày nó bị đóng băng, nhưng nghĩa là không có maintainer nào đang phát hành bản vá, cập nhật dependency, hay bản vá bảo mật, và các instance hosted liên quan tới dự án nên được coi là best-effort là cùng. Nếu bạn dùng Narratium hôm nay, con đường đáng tin cậy là tự chạy nó từ source hoặc một bản release, và kỳ vọng thực tế là một tập tính năng đã đóng băng. Tình trạng đó thay đổi lời khuyên về API theo một cách cụ thể: một client đã đóng băng chính là tình huống bạn muốn phía model vẫn linh hoạt. Narratium không thể thêm tích hợp provider mới nữa, nhưng một endpoint tương thích OpenAI mà nó đã nói được tiếp tục phục vụ bất kỳ model mới nào xuất hiện phía sau endpoint đó. Mẫu hình gateway thực chất giúp một client không còn tiến triển vẫn không bị lỗi thời.

Hướng dẫn cài đặt từng bước.

Debug tuân theo mẫu hình phổ quát: chứng minh ba giá trị bằng một request curl trước, và nếu curl thành công trong khi app thất bại, thủ phạm thường gặp là URL có đoạn path thừa, khoảng trắng trong key, hoặc chặn CORS trên trình duyệt với bản web, có thể thấy trong developer console. Vì sẽ không có maintainer nào phát hành bản vá cho các trục trặc phía app nữa, thói quen curl-trước quan trọng hơn một chút ở đây: nó cho bạn biết ngay lập tức phía nào của kết nối bạn thực sự có thể làm gì đó.

  • Chạy Narratium: tự host từ source GitHub hoặc một bản release (repo chỉ đọc nhưng vẫn clone được đầy đủ), hoặc dùng một instance hosted nếu bạn tin tưởng một cái vẫn còn hoạt động.
  • Mở cài đặt và tìm phần cấu hình API / LLM.
  • Chọn kiểu kết nối định dạng OpenAI thay vì Ollama, vì bạn đang trỏ vào một endpoint hosted.
  • Nhập base URL https://api.apisrouter.com/v1 và dán key của bạn.
  • Gõ chính xác model id: deepseek-v4-flash để bắt đầu.
  • Lưu và gửi một tin nhắn ngắn trong một câu chuyện mới để xác nhận round trip.

Thẻ nhân vật, thế giới, và những gì còn lại nếu bạn rời đi.

Narratium đọc được thẻ nhân vật tương thích SillyTavern, đây là sự thật tương thích quan trọng nhất về nó. Nhân vật của bạn là những tài sản di động: thẻ viết ở nơi khác import được, và công sức bạn bỏ vào persona và world note không bị khóa vào một client đã ngừng phát triển. Nếu bạn từng di chuyển, SillyTavern, RisuAI, và Wyvern đều nói cùng một dòng thẻ, và các trang cài đặt liên kết bên dưới bao phủ từng cái. Cùng logic di động đó áp dụng cho phía model. Vì Narratium nói chuyện với một endpoint /v1 chung, không có gì trong cấu hình provider của bạn là đặc thù của Narratium: cùng key và base URL đó nhét được vào bất kỳ frontend nào khác mà không đổi gì. Giữa thẻ di động và endpoint di động, chi phí chuyển đổi của toàn bộ stack gần như bằng không, đó là tư thế đúng đắn với bất kỳ dự án đã archive nào bạn vẫn thích dùng.

Lựa chọn model cho phong cách kể chuyện dài kỳ của Narratium.

Thiết kế của Narratium tập trung vào các mạch truyện phân nhánh dài, điều này nghiêng lựa chọn model về hướng nhất quán qua chân trời dài hơn là số lượng. deepseek-v4-flash gánh vác các phiên hàng ngày với mức giá thấp nhất catalog cùng đối thoại mà cộng đồng roleplay liên tục đánh giá cao hơn mức giá của nó. glm-5.1 và kimi-k2.6 xoay vòng để đa dạng giọng văn, và glm-5.2 xứng đáng với các chương chi tiết nặng nơi khả năng theo chỉ dẫn trong chân trời dài của nó vượt trên độ trễ lý luận. claude-sonnet-4-6 vẫn là trần văn xuôi an toàn-cho-công-việc cho các chương xứng đáng với nó. Vì frontend gửi lại context câu chuyện mỗi lượt, input token chiếm ưu thế về chi phí, và một cửa sổ làm việc có chủ đích tốt hơn một cửa sổ tối đa; hướng dẫn độ dài context liên kết bên dưới tính toán điều đó. Chính sách nội dung không đổi bởi bất cứ điều gì ở đây: chính sách model và điều khoản nền tảng áp dụng đúng như đã viết, và trang so sánh chính sách bao phủ họ model nào phù hợp mức phân loại nào, một cách khách quan.

Trả theo mức sử dụng · thấp hơn giá chính thức

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

Mô hìnhGiá chính thứcGiá của chúng tôi
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M
GLM-5.1$0.86 / $3.43 per M$0.90 / $3.40 per M
Kimi K2.6$0.95 / $4.00 per M$1.00 / $4.00 per M
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M

Bạn có nên vẫn dùng một client đã archive?

Một phép tính chi phí-lợi ích trung thực, vì trang này là hướng dẫn cài đặt dù thế nào đi nữa. Ủng hộ: code mở, giao diện thực sự tốt cho các câu chuyện dài kỳ có cấu trúc, thẻ di động ra vào tự do, và một endpoint chung giữ phía model luôn cập nhật mãi mãi. Phản đối: không bản vá bảo mật, không sửa lỗi, dependency già đi tại chỗ, và bất kỳ instance hosted nào cũng đang sống nhờ thời gian vay mượn. Với một client hobby chạy local dùng key trả theo lượng dùng, hồ sơ rủi ro đó chấp nhận được với nhiều người; với bất cứ thứ gì có người dùng khác hoặc dữ liệu nhạy cảm, thì không. Con đường giữa là điều trang này đã mô tả xuyên suốt: tự chạy nó, giữ khoản đầu tư của bạn ở các lớp di động (thẻ, lorebook, endpoint), và coi client là có thể thay thế. Frontend trong giới này đến rồi đi; một câu chuyện được hậu thuẫn bởi thẻ di động và một endpoint /v1 ổn định sẽ tồn tại lâu hơn tất cả chúng.

Câu hỏi thường gặp

Làm sao để đặt base URL API tùy chỉnh trong Narratium?

Trong cài đặt API, chọn kết nối định dạng OpenAI, sau đó nhập base URL https://api.apisrouter.com/v1, key của bạn, và một model id chính xác như deepseek-v4-flash. README khuyến nghị API định dạng OpenAI hoặc một endpoint đa model hợp nhất, chính xác là cấu hình này.

Narratium còn được bảo trì không?

Không. Repository GitHub đã bị archive và chỉ đọc (GitHub hiển thị 30/3/2026 là ngày archive), nên không có bản vá hay cập nhật nào được phát hành. Code vẫn chạy và vẫn clone được; tự host là cách dùng đáng tin cậy, với kỳ vọng đặt ở một tập tính năng đã đóng băng.

Narratium có hoạt động với thẻ nhân vật SillyTavern không?

Có, tương thích thẻ với định dạng SillyTavern là một trong những tính năng có tài liệu của nó, giữ cho nhân vật của bạn di động theo cả hai hướng: thẻ import vào Narratium, và công sức của bạn không bị mắc kẹt nếu sau này bạn chuyển sang SillyTavern, RisuAI, hoặc Wyvern.

Model nào hoạt động với Narratium qua một gateway?

Bất cứ gì endpoint phục vụ, vì Narratium gửi tên model như một chuỗi văn bản thuần: deepseek-v4-flash và glm-5.1 cho khối lượng lớn, kimi-k2.6 để xoay vòng, glm-5.2 cho các chương chi tiết nặng, claude-sonnet-4-6 cho văn xuôi an toàn-cho-công-việc. Đổi model là một thay đổi cài đặt, và lịch sử chat vẫn ở lại với client.

Tôi có thể chạy Narratium hoàn toàn local không?

Có, theo hai nghĩa: client tự host từ source đã archive, và hỗ trợ Ollama của nó cũng chạy model local. Kiểu lai mà hầu hết mọi người chọn là một client local với một endpoint hosted phía sau, giữ việc xử lý dữ liệu trong tay bạn trong khi vẫn với tới các model mà không GPU tiêu dùng nào phục vụ được.

Dùng một endpoint tùy chỉnh có vi phạm điều khoản nào không?

Narratium là mã nguồn mở và được xây dựng chính xác cho cấu hình này. Điều mà một endpoint tùy chỉnh không bao giờ thay đổi là chính sách nội dung phía model: quy tắc bằng văn bản của mỗi họ model áp dụng bất kể nó được phục vụ từ đâu, và trang so sánh chính sách bao phủ điều đó một cách khách quan.