Chạy Cline trên bất kỳ model nào trong catalog qua OpenAI Compatible.
Updated 2026-07-29
Dropdown API Provider của Cline có sẵn OpenAI Compatible chính xác cho việc này: Base URL https://api.apisrouter.com/v1, một key, và model id bạn muốn dẫn dắt agent. Id Claude, Kimi, và lớp Codex trở thành các backend lập trình hoán đổi được, với chế độ Plan và Act mỗi cái đều ghim được model riêng.
Câu trả lời nhanh: ba field trong cài đặt của Cline.
Mở panel Cline trong VS Code và nhấn biểu tượng bánh răng cài đặt. Trong dropdown API Provider chọn OpenAI Compatible, sau đó điền ba field: Base URL https://api.apisrouter.com/v1, key của bạn vào API Key, và id catalog chính xác vào field model, ví dụ claude-sonnet-4-6. Vì Cline không thể biết một endpoint tùy ý làm được gì, provider phơi bày các tùy chọn cấu hình model bạn nên đặt trung thực: kích thước context window, max output token, và các cờ năng lực như hỗ trợ ảnh, cộng với giá input và output tùy chọn để hiển thị chi phí của chính Cline khớp thực tế. Đặt window và giới hạn theo tài liệu của model. Lưu, và agent chạy tác vụ tiếp theo qua gateway; id có thể hoán đổi bất cứ lúc nào mà không đụng vào workflow của bạn.
API Provider: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Model: claude-sonnet-4-6
Model config: context window + max output tokens
from the model's documentation,
image support only if the id has itCách Cline dùng model đã cấu hình.
Cline (khoảng 65K star GitHub) là agent lập trình tự động cho VS Code: nó đọc codebase của bạn, chỉnh sửa file, chạy lệnh terminal, và lặp lại trên các thất bại, với các cổng phê duyệt của con người trên đường đi. Vòng lặp đó ngốn model theo một hình dạng cụ thể: context dài (cây file, diff, output terminal) đi vào, tool call và code đi ra, nhiều lượt cho mỗi tác vụ. Provider OpenAI Compatible gửi vòng lặp đó dưới dạng chat completions chuẩn tới Base URL của bạn với model id như một chuỗi văn bản thuần. Vendor không quan trọng với định dạng dây (wire format), đây chính là điều khiến việc chọn model trở nên thực tế ở đây: claude-sonnet-4-6, kimi-k2.7-code, và gpt-5.6-sol là các backend hoán đổi được đằng sau cùng ba field, thay vì ba cấu hình provider riêng với ba tài khoản vendor. Các cờ năng lực cần được chăm chút vì agent phụ thuộc vào chúng. Cline lên kế hoạch dựa trên những gì bạn khai báo: bật hỗ trợ ảnh cho phép nó gửi screenshot tới một model có thể không chấp nhận chúng, và một context window bị khai khống quá mức mời gọi các lỗi context bị cắt sâu bên trong các tác vụ dài. Khai báo những gì tài liệu model nói, không phải những gì bạn hy vọng.
Plan và Act: hai chế độ, hai model.
Cline chia công việc thành chế độ Plan, nơi nó khám phá codebase và xây chiến lược mà không chỉnh sửa, và chế độ Act, nơi nó thực thi. Cấu hình API theo sát sự chia tách này: với tùy chọn dùng-model-khác-nhau được bật, cài đặt hiển thị các tab theo từng chế độ và mỗi chế độ ghi nhớ provider và model riêng, tự động chuyển khi bạn bật tắt. Kinh tế học của sự chia tách này chính là trọng tâm. Chế độ Plan là nơi lý luận sâu được đền đáp: claude-opus-4-7 hoặc gpt-5.5 đọc codebase và viết ra cách tiếp cận. Chế độ Act là nhiều lượt gọi tool nhanh thực thi một kế hoạch đã tồn tại, chính xác là hồ sơ của kimi-k2.7-code hoặc claude-sonnet-4-6. Vì cả hai chế độ đều tính tiền qua cùng key gateway, việc ghép cặp là một lựa chọn cài đặt thay vì một dự án đa vendor. Một lưu ý trung thực từ issue tracker: chọn model theo từng chế độ từng có những trục trặc cụ thể với provider OpenAI Compatible, bao gồm báo cáo về chế độ Act âm thầm tái dùng model Plan. Sau khi cấu hình sự chia tách, chạy một tác vụ và xác nhận trong header tác vụ model nào thực sự phục vụ mỗi chế độ, và kiểm tra log sử dụng của bạn; chỉ coi sự chia tách là đã xác minh sau khi bạn thấy cả hai id xuất hiện.
Plan mode: claude-opus-4-7 (read, reason, strategize)
Act mode: kimi-k2.7-code (execute, edit, run, iterate)
verify: run one task, check which id served each mode,
then confirm both ids appear in the usage logChọn model lập trình cho vòng lặp agent.
Vòng lặp agent nhân bội chi tiêu token theo cách chat không bao giờ làm; một tác vụ Cline đơn lẻ có thể là hàng chục request mang theo context file. Điều đó khiến lựa chọn model đo lường được: chạy cùng lớp tác vụ trên hai id trong một tuần và đọc chi tiêu theo từng model cạnh tần suất bạn phải can thiệp.
- claude-sonnet-4-6 là câu trả lời mặc định cho công việc chế độ Act: gọi tool đáng tin cậy, diff mạnh, và đủ khả năng phán đoán để phục hồi từ các lệnh thất bại.
- kimi-k2.7-code là lựa chọn khối lượng lớn cho các phiên agent dài; tinh chỉnh cho code, nhanh, và định giá cho vòng lặp nhiều lượt mà Cline thực sự chạy.
- gpt-5.6-sol xứng đáng một vị trí cho các chỉnh sửa phạm vi hẹp nhanh và các lượt sửa test, nơi độ trễ mỗi lượt định hình cảm giác của phiên làm việc.
- claude-opus-4-7 thuộc về chế độ Plan trên các tác vụ khó: thay đổi kiến trúc, refactor xuyên file, debug cần cả bức tranh toàn cảnh.
- gpt-5.5 là đối thủ tổng quát mạnh để A/B với Claude trong chế độ Plan trên chính codebase của bạn, không phải trên benchmark.
Trả theo mức sử dụng · thấp hơn giá chính thức
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Mô hình | Giá chính thức | Giá của chúng tôi |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Các kiểu lỗi đặc thù của Cline.
Hành vi bị cắt hoặc mất trí nhớ sâu trong một tác vụ là do khai báo context window: đặt đúng cửa sổ tài liệu hóa của model, và nhớ rằng Cline nhồi context file một cách mạnh tay, nên một window bị khai khống thất bại đúng vào các tác vụ lớn nhất, khó chịu nhất. Sự kỳ quặc trong tool call, edit sai dạng, hoặc agent tường thuật thay vì hành động thường nghĩa là id được chọn yếu ở gọi hàm; chuyển sang claude-sonnet-4-6 để tách vấn đề cấu hình khỏi vấn đề chọn model trước khi đổ lỗi cho setup. Các lỗi cứng ánh xạ gọn gàng: xác thực là field key; model-not-found là lỗi chính tả id đối chiếu danh sách /v1/models; lỗi 404 trên mọi request là Base URL thiếu /v1 hoặc bị nhân đôi. Provider gắn thêm các đường dẫn route vào base bạn cung cấp. Và lưu ý theo từng chế độ nhắc lại một lần nữa, vì nó tốn tiền thật khi bị bỏ sót: nếu bạn cấu hình model Plan và Act khác nhau, hãy xác minh cả hai id thực sự phục vụ đúng chế độ trên một tác vụ thực. Một fallback âm thầm về model Plan đắt tiền cho mọi lượt Act là kiểu điều mà log sử dụng bắt được ngay ngày đầu và một sao kê thẻ bắt được vào cuối tháng.
Ai định tuyến Cline qua một gateway.
- Lập trình viên muốn Claude dẫn dắt agent của họ mà không cần quan hệ thanh toán với Anthropic, trên số dư trả trước không cần thẻ để bắt đầu.
- Người chọn model so sánh model lập trình trên các tác vụ thực trong codebase thực của họ, nơi mỗi ứng viên chỉ là một chỉnh sửa field model.
- Người dùng Cline nặng ghép một model Plan đắt tiền với một model Act nhanh để giữ các phiên dài phải chăng mà không mất chất lượng lên kế hoạch.
- Đội muốn đo chi tiêu agent theo từng lập trình viên hoặc từng dự án với mức dùng theo từng key, thay vì đoán từ một hóa đơn vendor chung.
- Lập trình viên đã định tuyến công cụ terminal và editor qua một gateway muốn agent VS Code trên cùng key và log.
Xác minh endpoint và debug tác vụ đầu tiên.
Curl danh sách model và một chat completion trước, với đúng id bạn định cấu hình. Cả hai đều qua nghĩa là nửa gateway đã xong và mọi triệu chứng còn lại nằm trong cài đặt provider. Sau đó cho Cline một tác vụ thực nhỏ, một file, mục tiêu rõ ràng, và quan sát các lượt đầu tiên. Tool call sạch và edit hợp lý nghĩa là id và cờ năng lực phù hợp. Lỗi ánh xạ vào ba field; hành vi agent kỳ lạ ánh xạ vào lựa chọn model hoặc năng lực đã khai báo. Nếu bạn bật model theo từng chế độ, tác vụ đầu tiên này cũng là lượt xác minh cho sự chia tách đó. Một khi tác vụ chạy trôi chảy, console APIsRouter hiển thị model theo từng request, số lượng token, và chi tiêu. Vòng lặp agent là cách dùng model tốn token nhiều nhất, và góc nhìn sử dụng theo từng key là nơi một tuần dùng Cline trở thành một con số cụ thể, theo từng model, từng ngày, từng chế độ nếu bạn tách key.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Câu hỏi thường gặp
Làm sao để dùng một endpoint tương thích OpenAI với Cline?
Mở cài đặt Cline trong VS Code, chọn OpenAI Compatible trong dropdown API Provider, và đặt Base URL https://api.apisrouter.com/v1, API key của bạn, và model id. Điền context window và max output tokens theo tài liệu của model.
Cline có thể chạy model Claude qua provider này không?
Có. Provider chuyển tiếp model id như một chuỗi văn bản thuần qua chat completions chuẩn, nên claude-sonnet-4-6 và claude-opus-4-7 hoạt động y hệt id GPT, một key cho tất cả, và đổi vendor là một chỉnh sửa field model.
Chế độ Plan và chế độ Act có thể dùng model khác nhau không?
Có. Bật tùy chọn dùng-model-khác-nhau trong cấu hình API của Cline và mỗi chế độ có tab riêng với provider và model riêng. Tuy nhiên hãy xác minh sự chia tách trên một tác vụ thực: lựa chọn theo từng chế độ từng có báo cáo trục trặc với provider OpenAI Compatible, bao gồm chế độ Act tái dùng model Plan.
Tôi nên đặt gì cho context window và max output tokens?
Giá trị tài liệu hóa của model, không phải default hay hy vọng. Cline nhồi context file dài vào request, nên một window bị khai khống thất bại trên các tác vụ lớn nhất và một window bị khai thấp cắt bớt code khỏi context. Max output tokens giới hạn mỗi phản hồi, đặt theo những gì id cho phép.
Vì sao Cline hành xử tệ ở tool call với một số model?
Vòng lặp agent phụ thuộc vào gọi hàm đáng tin cậy, và các id khác biệt rất nhiều ở đó. Nếu edit ra sai dạng hoặc agent tường thuật thay vì hành động, hãy test cùng tác vụ trên claude-sonnet-4-6; nếu nó sửa được hành vi, đó là lựa chọn model, không phải cấu hình.
Làm sao để biết một tuần dùng Cline thực sự tốn bao nhiêu?
Góc nhìn sử dụng theo từng key trong console APIsRouter hiển thị token và chi tiêu theo từng request và từng model. Tác vụ agent là hàng chục request mỗi cái, nên log là thước đo trung thực duy nhất; bảng hiển thị chi phí trong app của Cline cũng hữu ích nếu bạn nhập các field giá tùy chọn.