金融エージェントAPIコストの計上
Updated 2026-09-05
一つの返答ではなく、完全なリサーチジョブを測定します。ワークフローを比較する前に、モデル使用量をソース処理、定量計算、レビュー結果へ結び付けます。
コストを見積もる前に作業単位を選ぶ
一つの企業ブリーフ、一つの決算比較、一つのウォッチリスト更新、一つの定量実験のどれを測定するか定義します。マルチエージェントアプリケーションは、その単位の中で多数のモデルリクエストを作る可能性があります。技術的に完了したタスクと、レビュアーが承認した成果物を分けます。承認済み成果物単位のコストには、コスト・レスポンス指標が見落とすリトライと却下作業が含まれます。モデルを比較するときはタスク定義を固定します。そうしなければ、安い実行が単に少ないソースを読んだか、必要なレビュー段階を省いた可能性があります。

ジョブに結び付いたリクエスト台帳を保つ
ジョブ識別情報、段階、モデル役割、要求モデル、観測したリクエスト識別情報、試行番号、最終状態を記録します。利用できる場合はトークン使用量と適用される請求記録を保持します。クライアントのタイムアウトは、計算が行われなかったことや無料だったことの証拠ではありません。照合できるまで課金を未解決状態にします。広い読者と共有するコスト台帳にキー、非公開プロンプト、ライセンスされたソース文書全体を入れないでください。
{
"job_id": "REQUIRED",
"stage": "research_synthesis",
"model_role": "review",
"requested_model": "CURRENT_CATALOG_MODEL_ID",
"request_id": null,
"attempt": 1,
"input_tokens": null,
"output_tokens": null,
"charge": null,
"billing_status": "unreconciled",
"artifact_status": "pending"
}実際の課金契約を適用する
選択したモデルの現在の料金ソースを使い、見積もりとともにそのバージョンまたは取得日を記録します。契約に従って通常入力、キャッシュ入力、出力、その他の課金カテゴリーを区別します。合計入力にすでに含まれるキャッシュ部分を二重計上しないでください。公式プロバイダーの料金とゲートウェイ料金は別の契約です。どちらかをもう一方へ黙って置き換えてはいけません。レスポンスに使用量がない場合は、利用可能なら権威ある請求証拠を使い、それまでは不確かさを保持します。
| コスト項目 | 保持する証拠 | よくある誤り |
|---|---|---|
| モデルリクエスト | 使用量カテゴリーと請求額 | 無関係なプロバイダー料金を適用する |
| リトライ | 試行と親リクエストの識別情報 | 失敗したが課金された試行を落とす |
| キャッシュ | キャッシュの意味と課金カテゴリー | ローカル再利用を課金割引と仮定する |
| 埋め込み | モデル、入力範囲、料金 | 通常のチャットとして数える |
| 未解決リクエスト | 状態と照合タスク | 不明なコストをゼロに置き換える |
金融リサーチのLLM以外の部分を計上する
金融データアクセス、文書抽出、保存、ローカル計算、人間のレビューを別カテゴリーとして加えます。Qlibの実験やFinRLの訓練実行は、チャットリクエストを作らずに大きなリソースを消費することがあります。FinGPTノートブックは、リモートエージェント会話とローカルセンチメント推論を組み合わせる可能性があります。これらの経路を分けることで、最適化が役立つ場所を説明できます。共有サブスクリプションやインフラコストを報告するなら、各タスクが独立した課金を生んだように装わず、配分方法を明記します。
マルチエージェントのコストが増える理由を理解する
TradingAgentsには別々のモデル役割と反復するリサーチ段階があり、合計は実際のソース量と設定ラウンドに依存します。他のフレームワークでは、調整、検索、リトライ、コード改訂の反復が加わります。名前付きエージェントの数から見積もらず、ログからこれらの操作を数えます。同じ長い提出書類が複数のプロンプトで繰り返されることがあります。コンテキストがどこで再利用され、追加レビューが独立した受け入れ上の利益を生むかを調べます。グラフが大きいだけで、より経済的または正確なリサーチワークフローになるわけではありません。
証拠を保ちながら繰り返し作業を減らす
ソースとパーサーのバージョンごとに一度文書を抽出し、下流の段階へ範囲を限定した証拠パケットを渡します。入力と数式の識別情報で決定論的な計算を再利用します。議論ラウンドとリトライ試行に上限を設け、実際のタスク要件に応じてモデル役割を選びます。リクエスト数だけでなく、承認済み出力への効果を検証します。積極的な要約で重要な但し書きを落としたり、キャッシュ再利用で古い提出書類を返したりする可能性があります。各最適化には、古い入力を検出してレビュー用に元のソースを保持する方法が必要です。
同じタスクパケットでワークフローを比較する
同じ発行体集合、締め日、ソースパケット、受け入れ基準を使います。完成した成果物、却下した成果物、部分的なジョブ、人間の修正を記録します。一つの有利な実行を選ぶのではなく、結果として生じたタスクコストの分布を比較します。スケジュールされたウォッチリストでは、変化なしイベントと新しいソースイベントを分けます。作業が異なるためです。定量リサーチでは、試した仮説の数とローカル計算を含めます。後で測定した数値を公開するなら、比較が何を含むか別のレビュアーが分かるよう、設定と証拠の境界を添えます。
証拠と測定状態
このページは計上方法を提供するもので、レポート単価の測定値や現在のモデル料金表ではありません。公式プロジェクトソースは異なる実行時責任を確立し、現在の料金ページは商業条件を提供します。このガイドのためにAPIsRouter金融ワークフローの使用量台帳は生成していません。測定済みケースには、秘匿化したリクエスト証拠、照合済み料金、モデル以外のリソースコスト、承認済み成果物数を含めます。
よくある質問
TradingAgentsの分析1回にはいくらかかりますか?
実際のモデル、ソース量、ラウンド、リトライによって異なります。普遍的な分析単価を仮定せず、範囲を限定したタスクを実行してリクエスト台帳を照合してください。
失敗したリクエストは数えるべきですか?
課金証拠が料金を示す場合は含めます。不確かな試行は照合まで未解決のままにし、ゼロコストを割り当てないでください。
アプリケーションのキャッシュでプロバイダー料金は下がりますか?
必ずしも下がりません。リクエスト自体を避けることはありますが、プロバイダーのプロンプトキャッシュには独自の課金上の意味があります。どの仕組みが実際に起きたか記録してください。
QlibとFinRLのコストはAPI請求の一部ですか?
中核計算は別のリソースカテゴリーです。接続したLLMエージェントにAPI料金が発生する場合もありますが、実験識別情報で結合して管理します。
最も公平な比較の分母は何ですか?
明確に定義した承認済み成果物または実験を使い、失敗試行とレビュー作業を明示した配分方法で含めます。