Usage থেকে accepted work পর্যন্ত Astra API cost
Updated 2026-09-05
Ordinary input, cache read, cache write ও output আলাদাভাবে account করুন। Current official rate card এবং complete request ledger দিয়ে task estimate করুন।
Rate বেছে নেওয়ার আগে billing system বেছে নিন
Direct Astra API request OpenAI Platform billing ব্যবহার করে। ChatGPT-authenticated Codex work subscription বা workspace allowance ও credit ব্যবহার করে। OpenAI এগুলো আলাদাভাবে publish করে, তাই Codex credit rate API token প্রতি dollar price নয় এবং included subscription turn API receipt নয়।
Direct request-এর জন্য official API pricing page খুলে service tier, context band ও processing arrangement অনুযায়ী প্রযোজ্য gpt-6-astra rate বেছে নিন। Estimate-এর সঙ্গে rate-card URL ও observation date রাখুন। Request-level usage থেকে calculation তৈরি করুন, তারপর Platform usage record ও bill-এর সঙ্গে total তুলনা করুন। এতে rate selection বা missing request-এর পার্থক্য locate করা সহজ হয়।

Exact Responses usage field capture করুন
Official prompt-caching guide input_tokens, input_tokens_details.cached_tokens ও input_tokens_details.cache_write_tokens document করে। Cached read ও cache write input-এর আলাদা category, তাই ordinary input calculate করার আগে দুটোই বাদ দিন। প্রতিটি uncached token ordinary input rate-এ পড়ে ধরে নিলে cache write করা request-এর cost কম দেখাতে পারে।
Reasoning guide output_tokens ও output_tokens_details.reasoning_tokens document করে। Reasoning token output usage-এর মধ্যে অন্তর্ভুক্ত; আবার billed token category হিসেবে যোগ করবেন না। total_tokens-কে usage total রাখুন, এক blended rate দিয়ে গুণ করার সংখ্যা নয়। Full usage object record করুন, যাতে পরে reconciliation অসম্পূর্ণ text-only log-এর ওপর নির্ভর না করে।
| Responses field | Meaning | Accounting treatment |
|---|---|---|
| usage.input_tokens | মোট input token | Ordinary input, cache read ও write আলাদা করুন |
| usage.input_tokens_details.cached_tokens | Cached input token | Cached-input rate প্রয়োগ করুন |
| usage.input_tokens_details.cache_write_tokens | Cache-এ লেখা input token | Cache-write rate প্রয়োগ করুন |
| usage.output_tokens | Reasoning-সহ output token | Output rate একবার প্রয়োগ করুন |
| usage.output_tokens_details.reasoning_tokens | Output-এর মধ্যে reasoning | Diagnostic subset হিসেবে রাখুন |
| usage.total_tokens | মোট input ও output usage | Reconciliation-এর জন্য রাখুন |
Double counting ছাড়া token subtotal calculate করুন
I হলো input token, C cached input, W cache-write input এবং O output token ধরুন। Ordinary input হলো I - C - W। একই currency প্রতি million token-এ R_input, R_cached, R_write ও R_output rate quote করা হলে token subtotal হলো ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000।
নিচের offline function observed usage ও আলাদাভাবে selected rate card গ্রহণ করে। এর rate name application variable, API field নয়। Unknown usage-কে নীরবে free না ধরে missing বা inconsistent input-এ এটি null ফেরত দেয়। Result কেবল token কভার করে, tool, tax বা অন্য bill item নয়।
function estimateTokenCost(usage, rates) {
const I = usage?.input_tokens
const C = usage?.input_tokens_details?.cached_tokens
const W = usage?.input_tokens_details?.cache_write_tokens
const O = usage?.output_tokens
const tokens = [I, C, W, O]
const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
if (C > I || W > I - C) return null
const subtotal = ((I - C - W) * rates.input
+ C * rates.cached + W * rates.write
+ O * rates.output) / 1_000_000
return Number.isFinite(subtotal) ? subtotal : null
}প্রতিটি request-এ context ও service-tier rule resolve করুন
Astra official pricing ordinary input, cached input, cache write ও output-কে আলাদা করে, সঙ্গে আলাদা context band ও service tier। Formula-এ rate supply করার আগে প্রতিটি request-এর জন্য এই rule resolve করুন। Multiplier-সহ rate-card row বেছে নিলে multiplier আবার প্রয়োগ করবেন না।
Response-এর সঙ্গে service-tier ও processing metadata রাখুন এবং যা request করা হয়েছিল তার সঙ্গে তুলনা করুন। Direct API calculation-এ Codex speed বা credit multiplier reuse করবেন না: এগুলো অন্য product price schedule-এর। Unusual processing arrangement হলে applicable provider term-এর সঙ্গে reconcile করুন। সঠিক token formula-ও ভুল rate basis-এ হলে cost estimate ভুল।
Token estimate ও complete task cost আলাদা করুন
একটি task-এ বহু model request, tool call ও revision লাগতে পারে। প্রতিটি recorded request-এর token subtotal যোগ করুন, তারপর actual usage ও pricing অনুযায়ী separately billed provider tool বা service আলাদাভাবে যোগ করুন। Model tool call করতে পারে বলেই tool no-additional-charge অন্তর্ভুক্ত এমন নয়।
Infrastructure, asset-generation expense ও human review time পৃথক category-তে রাখুন। Service receipt ও কোন সময়কাল cover করে তা attach করুন, shared cost task-এ consistentভাবে allocate করুন। Game, localization batch বা research task-এর ক্ষেত্রে total কোন component অন্তর্ভুক্ত করে বলুন। Token rate থেকে tax ও currency conversion আলাদা রাখুন, যাতে usage subtotal ও final paid amount দুটোই reconcile করতে পারেন।
| Cost component | যে evidence রাখতে হবে | Combination rule |
|---|---|---|
| Model token | Responses usage plus applicable API rate | Request subtotal যোগ করুন |
| Provider tool বা service | Tool usage ও official pricing category | Separately billed item যোগ করুন |
| Other runtime বা asset | Service receipt ও attribution | আলাদা category-তে report করুন |
| Human review | Recorded time ও stated valuation method | API spend থেকে আলাদা রাখুন |
Retry, incomplete work ও missing usage দৃশ্যমান রাখুন
OpenAI reasoning guide সতর্ক করে যে incomplete generation visible text তৈরি না করেও input ও reasoning token consume করতে পারে। Result acceptance check fail করলেও বাস্তবে returned usage count করুন। Ledger-কে কেবল successful final answer-এ সীমিত করবেন না বা answer length দেখে spend estimate করবেন না।
প্রতিটি attempt-এ response identity, model, status, usage ও কোন task-এর তা রাখুন। যোগ করার আগে duplicate reconcile করুন। Connection fail হয়ে usage না এলে provider record পরিষ্কার না হওয়া পর্যন্ত attempt unresolved mark করুন; zero cost বা full success কোনোটিই established নয়। Temporary fault যেন unreviewed billable attempt series তৈরি না করে, retry bound করুন।
Accepted result ও bounded work ঘিরে budget করুন
Measure করার আগে accepted work-এর unit define করুন: tested code change, approved product-locale record অথবা source-linked research note। Count nonzero হলেই cost per accepted unit হলো attributable task cost ভাগ accepted-unit count। Ratio-র সঙ্গে sample ও unresolved usage report করুন।
Request ceiling, bounded retry ও task stop condition একসঙ্গে ব্যবহার করুন। Documented max_output_tokens reasoning-সহ generation constrain করে, কিন্তু multi-request task-এর complete currency budget নয়। Account control set করুন এবং accumulated spend-ও track করুন। Smaller context বা অন্য reasoning setting একই acceptance criteria-তে evaluate করুন, guaranteed saving হিসেবে advertise নয়।
Provider availability ও evidence: September 5, 2026
এই guide-এর usage field ও formula official OpenAI documentation থেকে এসেছে। Article-এর জন্য কোনো Astra task cost বা runtime measure করা হয়নি। September 5, 2026-এ public APIsRouter pricing endpoint HTTP 200, success: true ও Astra বা GPT-6 ছাড়া 34 model ফেরত দিয়েছে, তাই এখানে APIsRouter Astra quote নেই।
Direct Astra request-এর জন্য OpenAI current pricing এবং নিজের offering-এর জন্য live APIsRouter catalog ব্যবহার করুন। Provider comparison-এ matching task, actual model identity, accepted output, complete usage ও applicable rate দরকার। Estimate ও reconciled task bill আলাদা বোঝাতে calculation-এর সঙ্গে record রাখুন।
সাধারণ প্রশ্ন
বর্তমান Astra API price কত?
gpt-6-astra-এর জন্য official OpenAI API pricing page ব্যবহার করুন। আপনার request-এর service tier ও context band বেছে নিন, আলাদা cache-read ও cache-write rate-সহ।
Reasoning token কি output_tokens-এর অতিরিক্ত charge হয়?
Reasoning token output usage-এর মধ্যে অন্তর্ভুক্ত। output_tokens-এ একবার output rate প্রয়োগ করুন; output_tokens_details.reasoning_tokens diagnosis-এর জন্য রাখুন, আবার যোগ করবেন না।
Cache write formula-কে কীভাবে প্রভাবিত করে?
Total input থেকে cached_tokens ও cache_write_tokens বাদ দিয়ে ordinary input পান। Applicable official rate দিয়ে ordinary input, cache read ও cache write আলাদা price করুন।
Timeout বা incomplete answer কি free?
অবশ্যই নয়। Incomplete generation token consume করতে পারে এবং timeout billing evidence unresolved রাখতে পারে। Returned usage রাখুন এবং missing record reconcile করুন; zero cost assign করবেন না।
APIsRouter দিয়ে Astra task-এর cost কত?
September 5, 2026 check-এ Astra catalog-এ না থাকায় কোনো quote নেই। Current offering দেখুন; direct Astra estimate-এর জন্য OpenAI pricing ব্যবহার করুন।