Kilo Code を、OpenAI Compatible 経由で任意のカタログモデルで動かす。
Updated 2026-07-30
Kilo Code は、ゲートウェイ向けに作られたカスタムプロバイダーのフローを備えています。Provider API に OpenAI Compatible を選び、Base URL を https://api.apisrouter.com/v1 に設定し、キーを1つ貼り付ければ、Kilo は /v1/models からモデル一覧を自動取得します。Claude・Kimi・Codex クラスの id が、エージェントの相互に入れ替え可能なバックエンドになります。
早わかり: カスタムプロバイダーのエントリを1つ。
歯車アイコンから Kilo Code の設定を開き、Providers タブに進み、カスタムプロバイダーのオプションを選びます。Provider ID と表示名を付け、Provider API を OpenAI Compatible に、Base URL を https://api.apisrouter.com/v1 に設定し、あなたのキーを貼り付けてください。 Base URL とキーが有効になると、Kilo はエンドポイントの /v1/models 一覧を問い合わせ、利用可能なすべての id を検索可能なピッカーとして提示します。そのため claude-sonnet-4-6 や kimi-k2.7-code を、盲目的に入力するのではなく一覧から選べます。モデルは手動で追加することもでき、必要であればキーバリューのペアとしてカスタム HTTP ヘッダーもサポートされています。保存すれば、エージェントの次のタスクはゲートウェイ経由でルーティングされます。
Provider ID: apisrouter
Display name: APIsRouter
Provider API: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API key: sk-YOUR-APISROUTER-KEY
Models: pick from the auto-fetched list
(e.g. claude-sonnet-4-6, kimi-k2.7-code)Kilo Code が、プロバイダーをどう使うか。
Kilo Code(GitHub スター数はおよそ26K)は、VS Code 向けのオープンソース AI コーディングエージェントです。計画を立て、ファイルを編集し、コマンドを実行し、承認ゲートを設けながら失敗を反復します。Roo や Cline の系譜にあります。そのループには特有のトラフィックの形があります。長い文脈が入り、ツール呼び出しと diff が出て、タスクごとに多くのターンがあります。これが、バックエンドとなるモデルを、品質のレバーであると同時にコストの駆動要因にしています。 OpenAI Compatible プロバイダーは、そのループを標準的なチャット補完として、あなたの Base URL に対して、モデル id をそのままの文字列として送ります。ワイヤーフォーマットはベンダーを気にしないため、これが本当の意味でのモデル選びを可能にします。claude-sonnet-4-6、kimi-k2.7-code、gpt-5.6-sol は、3つのベンダーアカウントと3つの請求設定ではなく、1つのプロバイダーの裏で相互に入れ替え可能なエントリです。 モデルごとのチューニング、トークン上限、ツール呼び出しの挙動、バリアントは、kilo.jsonc の設定ファイルに存在し、UI が公開していない設定が必要なモデルではこれを直接編集できます。宣言する上限は、モデルのドキュメントに基づくものにしてください。楽観ではなく。エージェントは文脈を積極的に詰め込むため、過大申告された window は、まさに最大のタスクで失敗します。
Kilo のループのためのコーディングモデル選び。
Kilo のモードは、異なる種類の作業に異なる設定を持たせられるため、それを活用する誠実な方法は経験的なものです。同じ種類のタスクを2つの id で1週間走らせ、その後ゲートウェイのコンソールでモデルごとの支出を、どれくらい介入が必要だったかと並べて読んでください。エージェントループは、モデルを使う中で最もトークンを消費する使い方であるため、その差は感覚ではなく測定可能です。
- claude-sonnet-4-6 は頼れるデフォルトです。強力なツール呼び出し、クリーンな diff、コマンドがタスクの途中で失敗したときの良好なリカバリー。
- kimi-k2.7-code は、長時間のエージェントセッション向けのボリューム選択で、コード向けにチューニングされ、Kilo が実際に走らせる多ターンのループ向けに価格設定されています。
- gpt-5.6-sol は、素早いスコープ限定の編集やテスト修正の実行に向いており、ターンごとのレイテンシがセッションを左右する場面に適しています。
- claude-opus-4-7 は、難しいタスクでその単価に見合います。複数ファイルにまたがるリファクタリング、アーキテクチャ作業、全体像を文脈に入れる必要のあるデバッグです。
- gpt-5.5 は、ベンチマークの表ではなくあなた自身のリポジトリで Claude と A/B すべきフロンティアの汎用モデルです。
従量課金 · 公式価格より安い
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| モデル | 公式価格 | 当社価格 |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Kilo Code に特有の失敗パターン。
標準的な順序でデバッグしてください。モデル一覧を curl し、正確な id で1回の補完を curl し、その後だけ Kilo の設定を調整する。2つのコマンドが、ゲートウェイの問題とエディタの設定をきれいに切り分けます。
- モデルピッカーが空で出てくる: Base URL かキーが間違っています。ピッカーはライブな /v1/models 呼び出しから populate されるからです。同じ値で一覧を curl して確認してください。
- すべてのリクエストで 404: Base URL が /v1 を失っているか、ベースが入るべき場所に完全な /chat/completions パスを貼り付けています。Kilo は完全なエンドポイント URL を受け付けますが、それが正しいチャット補完のルートを指している場合に限られます。
- タスクの奥深くで途切れる、あるいは記憶を失ったような挙動: kilo.jsonc で宣言された文脈上限が、モデルが実際にサポートする値を超えています。ドキュメント記載の値を使ってください。
- ツール呼び出しが実行ではなく説明として現れる: 選んだ id が function calling に弱いということです。設定と切り分けるために、claude-sonnet-4-6 でタスクを再実行してみてください。
- ドキュメントにある Azure 固有の注記: Azure の GPT-5 デプロイは、カスタムの OpenAI 互換プロバイダーが送る max_tokens フィールドを拒否するため、Azure は Kilo のネイティブな azure プロバイダーを使うべきです。ゲートウェイには無関係ですが、両方をテストした場合の紛らわしいエラーの説明になります。
ゲートウェイ経由で Kilo Code を使うのは誰か。
- 別の Anthropic の請求関係を持つことなく、Claude にエージェントを動かしてほしい開発者で、無料でカード不要の始め方をする前払い残高の上で使う人。
- 自動取得されたピッカーを使って、実際のリポジトリの実タスクでコーディング id を試すモデルショッパー。
- プランニング級の作業向けにフロンティアモデルを、長い実行セッション向けにボリュームモデルを組み合わせるヘビーユーザー。
- 共有ベンダー請求を逆算するのではなく、キーごとの利用状況で開発者ごとのエージェント支出を計測するチーム。
- すでに他のツールをゲートウェイ経由でルーティングしていて、VS Code のエージェントも同じキーと利用ログに乗せたい人。
エンドポイントを検証し、最初のタスクを実行する。
エディタを設定する前に curl でゲートウェイ側を証明してください。モデルを一覧し、選ぶつもりの id で1回補完を送ります。両方が通れば、残るものはすべてプロバイダーのフォームの中にあります。 次に、明確な目標を持つ小さな実タスクを Kilo に与え、最初の数ターンを見てください。クリーンなツール呼び出しと理にかなった編集は、その id がループに合っていることを意味し、はっきりしたエラーは3つのフィールドに対応します。タスクが流れ始めたら、APIsRouter コンソールがリクエストごとのモデル、トークン数、支出を表示し、1週間のエージェント利用が、モデルごとの具体的な数字になる場所です。
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'よくある質問
Kilo Code に OpenAI 互換プロバイダーを追加するにはどうすればよいですか?
設定の歯車 → Providers タブ → カスタムプロバイダー。Provider API を OpenAI Compatible に、Base URL を https://api.apisrouter.com/v1 に設定し、あなたのキーを貼り付けます。Kilo はその後 /v1/models からモデル一覧を自動取得し、検索可能な一覧から id を選べます。
Kilo Code は、このプロバイダー経由で Claude モデルを動かせますか?
はい。プロバイダーはモデル id を標準的なチャット補完でそのままの文字列として転送するため、claude-sonnet-4-6 や claude-opus-4-7 も GPT の id と同じように動作し、キー1つで、ベンダーの切り替えはピッカーの選択で済みます。
プロバイダーを追加した後にモデル一覧が空になるのはなぜですか?
自動取得はライブな /v1/models 呼び出しから populate されるため、一覧が空なのは Base URL かキーが間違っていることを意味します。同じ値で一覧を curl してみてください。それが動くなら、プロバイダーのフォームに実際に保存した内容を再確認してください。モデルは手動で追加することもできます。
カスタムモデルの文脈ウィンドウやトークン上限はどこで設定しますか?
Kilo の設定ファイルである kilo.jsonc です。プロバイダーのフォームが公開していない、モデルごとのトークン上限・ツール呼び出しの設定・バリアントを持っています。モデルのドキュメント記載の値を使ってください。過大申告された上限は最大のタスクで失敗します。
API キーは必ずフォームに入力しなければなりませんか?
キーのフィールドが標準的な経路ですが、プロバイダーのフォームがキーバリューのペアとしてサポートするカスタムヘッダーで認証を処理する場合は任意です。標準的なゲートウェイのセットアップでは、キーのフィールドが正しい選択です。
1週間の Kilo Code の利用がいくらかかったか、どうやって知りますか?
APIsRouter コンソールのキーごとの利用状況ビューを読んでください。リクエストごと、モデルごとのトークン数と支出です。エージェントのタスクはそれぞれ数十件のリクエストなので、ログこそが、あなたの利用パターンが実際にいくらかかるかを知る唯一誠実な方法です。