Astra API cost mula usage hanggang tinanggap na work

Updated 2026-09-05

I-account nang hiwalay ang ordinary input, cache read, cache write, at output. Gamitin ang kasalukuyang opisyal na rate card at kumpletong request ledger sa pagtantiya ng task.

Piliin muna ang billing system bago ang rate

Gumagamit ang direct Astra API request ng OpenAI Platform billing. Gumagamit ang ChatGPT-authenticated Codex work ng subscription o workspace allowance at credit. Hiwalay na inilalathala ng OpenAI ang mga ito, kaya ang Codex credit rate ay hindi dollar price bawat API token at ang kasamang subscription turn ay hindi API receipt.

Para sa direct request, buksan ang opisyal na API pricing page at piliin ang naaangkop na gpt-6-astra rate para sa service tier, context band, at processing arrangement. Itabi sa estimate ang rate-card URL at petsa ng obserbasyon. Buuin ang calculation mula sa request-level usage, saka ihambing ang total sa Platform usage record at bill mo. Mas madaling matutukoy dito ang pagkakaiba sa pagpili ng rate o nawawalang request.

Paghahambing ng access sa pamamagitan ng Codex subscription, direktang access sa OpenAI Platform API, at model catalog at billing ng isang aggregator.
Ilustrasyon ng access at billing. Malayang i-verify ang napiling account at provider.

Kunin ang eksaktong Responses usage field

Dinudokumento ng opisyal na prompt-caching guide ang input_tokens, input_tokens_details.cached_tokens, at input_tokens_details.cache_write_tokens. Magkahiwalay na category sa loob ng input ang cached read at cache write, kaya ibawas ang parehong ito bago kalkulahin ang ordinary input. Maaaring ma-understate ang request na nagsusulat ng cache kung ipagpapalagay na ordinary input rate ang bawat uncached token.

Dinudokumento ng reasoning guide ang output_tokens at output_tokens_details.reasoning_tokens. Kasama na ang reasoning token sa output usage; huwag itong idagdag muli bilang hiwalay na billed token category. Panatilihin ang total_tokens bilang usage total, hindi count na imu-multiply sa isang blended rate. Itala ang buong usage object upang hindi umasa ang susunod na reconciliation sa kulang na text-only log.

Mga source: OpenAI prompt-caching at reasoning guide, kinuha noong September 5, 2026. Para sa Responses ang mga field path na ito.
Field ng ResponsesKahuluganParaan ng accounting
usage.input_tokensKabuuang input tokenHatiin sa ordinary input, cache read, at cache write
usage.input_tokens_details.cached_tokensCached input tokenIlapat ang cached-input rate
usage.input_tokens_details.cache_write_tokensInput token na isinulat sa cacheIlapat ang cache-write rate
usage.output_tokensOutput token kasama ang reasoningIlapat nang isang beses ang output rate
usage.output_tokens_details.reasoning_tokensReasoning sa loob ng outputPanatilihin bilang diagnostic subset
usage.total_tokensKabuuang input at output usagePanatilihin para sa reconciliation

Kalkulahin ang token subtotal nang walang double counting

Itakda ang I bilang input token, C bilang cached input, W bilang cache-write input, at O bilang output token. Ang ordinary input ay I - C - W. Kapag ang rate na R_input, R_cached, R_write, at R_output ay naka-quote sa parehong currency bawat milyong token, ang token subtotal ay ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000.

Tumatanggap ang offline function sa ibaba ng naobserbahang usage at hiwalay na napiling rate card. Application variable ang mga pangalan ng rate nito, hindi API field. Nagbabalik ito ng null para sa nawawala o hindi tugmang input sa halip na tahimik na ituring na libre ang unknown usage. Token lamang ang sakop ng resulta, hindi tool, tax, o ibang bill item.

function estimateTokenCost(usage, rates) {
  const I = usage?.input_tokens
  const C = usage?.input_tokens_details?.cached_tokens
  const W = usage?.input_tokens_details?.cache_write_tokens
  const O = usage?.output_tokens
  const tokens = [I, C, W, O]
  const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
  if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
  if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
  if (C > I || W > I - C) return null
  const subtotal = ((I - C - W) * rates.input
    + C * rates.cached + W * rates.write
    + O * rates.output) / 1_000_000
  return Number.isFinite(subtotal) ? subtotal : null
}

Lutasin ang context at service-tier rule sa bawat request

Pinaghihiwalay ng opisyal na pricing ng Astra ang ordinary input, cached input, cache write, at output, kasama ang magkakaibang context band at service tier. Lutasin ang mga rule na iyon para sa bawat request bago magbigay ng rate sa formula. Huwag muling maglapat ng multiplier kung nakapili ka na ng rate-card row na kasama na ito.

Itabi sa response ang service-tier at processing metadata at ihambing sa hiningi. Huwag gamitin muli ang Codex speed o credit multiplier para sa direct API calculation: kabilang ang mga iyon sa ibang product price schedule. Para sa hindi pangkaraniwang processing arrangement, i-reconcile laban sa naaangkop na provider term. Mali pa rin ang cost estimate kapag tama ang token formula ngunit mali ang rate basis.

Ihiwalay ang token estimate sa kumpletong task cost

Maaaring mangailangan ang isang task ng maraming model request, tool call, at revision. Idagdag ang token subtotal ng bawat naitalang request, saka idagdag nang hiwalay ang provider tool o service na sinisingil ayon sa aktuwal nitong usage at pricing. Hindi nangangahulugang kasama nang walang dagdag na charge ang tool dahil kaya itong tawagan ng model.

Panatilihing magkahiwalay na category ang infrastructure, asset-generation expense, at oras ng human review. Ikabit ang service receipt at panahong sakop nito, at pare-parehong i-allocate ang shared cost sa mga task. Para sa game, localization batch, o research task, sabihin kung aling component ang kasama sa total. Ihiwalay ang tax at currency conversion sa token rate upang ma-reconcile ang usage subtotal at huling halagang binayaran.

Mga OpenAI token at tool pricing category, kasama ang hiwalay na category para sa ibang delivery cost.
Bahagi ng gastosEbidensyang panatilihinRule sa pagsasama
Model tokenResponses usage at naaangkop na API ratePagsamahin ang request subtotal
Provider tool o serviceTool usage at opisyal na pricing categoryIdagdag ang hiwalay na sinisingil na item
Ibang runtime o assetService receipt at attributionIulat sa magkakahiwalay na category
Pagsusuri ng taoNaitalang oras at idineklarang valuation methodIhiwalay sa API spend

Gawing nakikita ang retry, hindi kumpletong work, at nawawalang usage

Nagbababala ang reasoning guide ng OpenAI na maaaring kumonsumo ng input at reasoning token ang incomplete generation nang walang nakikitang text. Bilangin ang usage na aktuwal na ibinalik kahit bumagsak ang resulta sa acceptance check mo. Huwag limitahan ang ledger sa matagumpay na final answer o tantiyahin ang gastos mula sa haba ng sagot lamang.

Para sa bawat attempt, panatilihin ang response identity, model, status, usage, at task na kinabibilangan nito. I-reconcile ang duplicate bago mag-total. Kung nabigo ang connection at walang dumating na usage, markahan ang attempt bilang hindi pa nalulutas hanggang linawin ng provider record; hindi napapatunayan ang zero cost o ganap na tagumpay. Limitahan ang retry upang hindi lumikha ang pansamantalang fault ng serye ng billable attempt na walang review.

Mag-budget sa paligid ng tinanggap na resulta at limitadong work

Tukuyin ang unit ng tinanggap na work bago ito sukatin: tested code change, aprubadong product-locale record, o source-linked research note. Ang cost bawat tinanggap na unit ay attributable task cost na hinati sa bilang ng accepted unit, at gawin lamang kapag hindi zero ang bilang. Iulat ang sample at hindi pa nalulutas na usage kasama ng ratio.

Pagsabayin ang request ceiling, limitadong retry, at task stop condition. Nililimitahan ng documented max_output_tokens field ang generation, kasama ang reasoning, ngunit hindi ito kumpletong currency budget para sa multi-request task. Magtakda rin ng account control at subaybayan ang naipong spend. Dapat suriin ang mas maliit na context o ibang reasoning setting laban sa parehong acceptance criteria, hindi i-advertise bilang garantisadong savings.

Availability at ebidensya ng provider: September 5, 2026

Mula sa opisyal na OpenAI documentation ang usage field at formula sa guide na ito. Walang Astra task cost o runtime na sinukat para sa article. Noong September 5, 2026, nagbalik ang public APIsRouter pricing endpoint ng HTTP 200, success: true, at 34 model na walang Astra o GPT-6, kaya walang APIsRouter Astra quote dito.

Gamitin ang kasalukuyang OpenAI pricing para sa direct Astra request at ang live APIsRouter catalog para sa sarili nitong offering. Kailangan ng provider comparison ng magkatugmang task, aktuwal na model identity, tinanggap na output, kumpletong usage, at naaangkop na rate. Itabi ang mga record na iyon sa calculation upang maiba ng reader ang estimate sa reconciled task bill.

Mga madalas itanong

Ano ang kasalukuyang Astra API price?

Gamitin ang opisyal na OpenAI API pricing page para sa gpt-6-astra. Piliin ang service tier at context band na naaangkop sa request mo, kasama ang magkahiwalay na cache-read at cache-write rate.

Sinisingil ba ang reasoning token bukod sa output_tokens?

Kasama ang reasoning token sa output usage. Ilapat nang isang beses ang output rate sa output_tokens; panatilihin ang output_tokens_details.reasoning_tokens para sa diagnosis sa halip na idagdag muli.

Paano naaapektuhan ng cache write ang formula?

Ibawas ang cached_tokens at cache_write_tokens sa total input upang makuha ang ordinary input. Hiwalay na presyuhan ang ordinary input, cache read, at cache write gamit ang naaangkop na opisyal na rate.

Libre ba ang timeout o incomplete answer?

Hindi palagi. Maaaring kumonsumo ng token ang incomplete generation, at maaaring iwan ng timeout na hindi pa nalulutas ang billing evidence. Panatilihin ang ibinalik na usage at i-reconcile ang nawawalang record sa halip na magtalaga ng zero cost.

Magkano ang Astra task sa APIsRouter?

Walang quote mula sa check noong September 5, 2026 dahil wala ang Astra sa catalog. Suriin ang kasalukuyang offering; gamitin ang OpenAI pricing para sa direct Astra estimate.