هزینه API Astra: از مصرف تا کار پذیرفتهشده
Updated 2026-09-05
ورودی عادی، خواندن کش، نوشتن کش و خروجی را جداگانه حساب کنید. برای برآورد یک کار از کارت نرخ رسمی جاری و دفتر کامل درخواستها استفاده کنید.
پیش از انتخاب نرخ، سیستم صورتحساب را انتخاب کنید
درخواستهای مستقیم API Astra از صورتحساب OpenAI Platform استفاده میکنند. کار Codex با احراز هویت ChatGPT از سهمیهها و اعتبارهای اشتراک یا فضای کاری استفاده میکند. OpenAI این موارد را جداگانه منتشر میکند؛ بنابراین نرخ اعتبار Codex قیمت دلاری هر توکن API نیست و یک نوبت شاملشده اشتراک، رسید API محسوب نمیشود.
برای درخواستهای مستقیم، صفحه رسمی قیمتگذاری API را باز کنید و نرخهای مربوط به gpt-6-astra را بر اساس سطح سرویس، بازه زمینه و روش پردازش انتخاب کنید. URL کارت نرخ و تاریخ مشاهده را کنار برآورد نگه دارید. محاسبه را از مصرف سطح درخواست بسازید و سپس مجموع را با سوابق مصرف و صورتحساب Platform مقایسه کنید. این کار پیدا کردن تفاوت در انتخاب نرخ یا درخواستهای مفقود را آسانتر میکند.

فیلدهای دقیق مصرف Responses را ثبت کنید
راهنمای رسمی prompt caching، فیلدهای input_tokens، input_tokens_details.cached_tokens و input_tokens_details.cache_write_tokens را مستند میکند. خواندنهای کش و نوشتنهای کش، دستههای جداگانهای در ورودی هستند؛ بنابراین پیش از محاسبه ورودی عادی، هر دو را کم کنید. فرض اینکه هر توکن بدون کش نرخ ورودی عادی دارد، میتواند هزینه درخواستی را که در کش مینویسد کمتر از واقع نشان دهد.
راهنمای استدلال، output_tokens و output_tokens_details.reasoning_tokens را مستند میکند. توکنهای استدلال در مصرف خروجی قرار دارند؛ آنها را دوباره بهعنوان دستهای دیگر از توکنهای قابلپرداخت جمع نکنید. total_tokens را بهعنوان مجموع مصرف نگه دارید، نه تعدادی برای ضرب در یک نرخ ترکیبی. شیء کامل مصرف را ثبت کنید تا تطبیق بعدی به یک گزارش ناقص و فقط متنی وابسته نباشد.
| فیلد Responses | معنا | نحوه حسابداری |
|---|---|---|
| فیلد usage.input_tokens | مجموع توکنهای ورودی | ورودی عادی، خواندن کش و نوشتن کش را جدا کنید |
| فیلد usage.input_tokens_details.cached_tokens | توکنهای ورودی کششده | نرخ ورودی کششده را اعمال کنید |
| فیلد usage.input_tokens_details.cache_write_tokens | توکنهای ورودی نوشتهشده در کش | نرخ نوشتن در کش را اعمال کنید |
| فیلد usage.output_tokens | توکنهای خروجی شامل استدلال | نرخ خروجی را فقط یکبار اعمال کنید |
| فیلد usage.output_tokens_details.reasoning_tokens | استدلال درون خروجی | بهعنوان زیرمجموعه تشخیصی نگه دارید |
| فیلد usage.total_tokens | کل مصرف ورودی و خروجی | برای تطبیق نگه دارید |
جمع توکن را بدون دوبارهشماری محاسبه کنید
فرض کنید I توکنهای ورودی، C ورودی کششده، W ورودی نوشتهشده در کش و O توکنهای خروجی هستند. ورودی عادی برابر I - C - W است. اگر نرخهای R_input، R_cached، R_write و R_output با یک ارز یکسان بهازای یک میلیون توکن اعلام شده باشند، جمع توکن برابر است با ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000.
تابع offline زیر مصرف مشاهدهشده و یک کارت نرخ انتخابشده جداگانه را میپذیرد. نام نرخها متغیرهای برنامه هستند، نه فیلدهای API. برای ورودیهای مفقود یا ناسازگار null برمیگرداند و مصرف ناشناخته را بیصدا رایگان فرض نمیکند. نتیجه فقط توکنها را پوشش میدهد، نه ابزارها، مالیات یا موارد دیگر صورتحساب.
function estimateTokenCost(usage, rates) {
const I = usage?.input_tokens
const C = usage?.input_tokens_details?.cached_tokens
const W = usage?.input_tokens_details?.cache_write_tokens
const O = usage?.output_tokens
const tokens = [I, C, W, O]
const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
if (C > I || W > I - C) return null
const subtotal = ((I - C - W) * rates.input
+ C * rates.cached + W * rates.write
+ O * rates.output) / 1_000_000
return Number.isFinite(subtotal) ? subtotal : null
}قواعد زمینه و سطح سرویس را برای هر درخواست تعیین کنید
قیمتگذاری رسمی Astra ورودی عادی، ورودی کششده، نوشتن در کش و خروجی را با بازههای زمینه و سطحهای سرویس متفاوت جدا میکند. پیش از وارد کردن نرخها به فرمول، این قواعد را برای هر درخواست مشخص کنید. اگر ردیف کارت نرخ انتخابی از قبل ضریب را دارد، آن را دوباره اعمال نکنید.
فراداده سطح سرویس و پردازش را همراه پاسخ نگه دارید و با چیزی که درخواست شده مقایسه کنید. ضریب سرعت یا اعتبار Codex را در محاسبه مستقیم API دوباره استفاده نکنید؛ آنها به برنامه قیمتگذاری محصول دیگری تعلق دارند. برای روشهای پردازش غیرمعمول، با شرایط ارائهدهنده مربوط تطبیق دهید. فرمول درست توکن با مبنای نرخ نادرست همچنان برآورد هزینه نادرستی است.
برآورد توکن را از هزینه کامل کار جدا کنید
یک کار ممکن است به چند درخواست مدل، فراخوانی ابزار و بازبینی نیاز داشته باشد. جمع توکن هر درخواست ثبتشده را اضافه کنید و سپس ابزارها یا سرویسهای جداگانهصورتحسابشده ارائهدهنده را بر اساس مصرف و قیمت واقعی آنها اضافه کنید. توانایی مدل برای فراخوانی ابزار به این معنا نیست که ابزار بدون هزینه اضافی شامل شده است.
زیرساخت، هزینه تولید دارایی و زمان بازبینی انسانی را در دستههای جدا نگه دارید. رسید سرویس و بازهای را که پوشش میدهد پیوست کنید و هزینههای مشترک را در میان کارها بهصورت یکسان تخصیص دهید. برای بازی، بسته بومیسازی یا کار پژوهشی مشخص کنید مجموع شامل چه اجزایی است. مالیات و تبدیل ارز را از نرخ توکن جدا کنید تا هم جمع مصرف و هم مبلغ نهایی پرداختشده قابل تطبیق باشد.
| جزء هزینه | شواهد برای نگهداری | قاعده ترکیب |
|---|---|---|
| توکنهای مدل | مصرف Responses بهعلاوه نرخهای مربوط API | جمع زیرمجموعههای درخواست |
| ابزارها یا سرویسهای ارائهدهنده | مصرف ابزار و دسته قیمت رسمی | موارد جداگانهصورتحسابشده را اضافه کنید |
| سایر منابع اجرا یا داراییها | رسید سرویس و نسبتدهی | در دستههای جدا گزارش کنید |
| بازبینی انسانی | زمان ثبتشده و روش ارزشگذاری اعلامشده | از هزینه API جدا نگه دارید |
تلاشهای مجدد، کار ناقص و مصرف مفقود را قابل مشاهده نگه دارید
راهنمای استدلال OpenAI هشدار میدهد که تولید ناقص میتواند توکنهای ورودی و استدلال را مصرف کند، بدون اینکه متن قابل مشاهدهای تولید شود. مصرفی را که واقعاً برگردانده شده حساب کنید، حتی اگر نتیجه آزمون پذیرش شما را رد کند. دفتر را فقط به پاسخهای نهایی موفق محدود نکنید و هزینه را فقط از طول پاسخ برآورد نکنید.
برای هر تلاش، هویت پاسخ، مدل، وضعیت، مصرف و کار مربوط را نگه دارید. پیش از جمعزدن، موارد تکراری را تطبیق دهید. اگر اتصال شکست خورد و مصرفی نرسید، تا روشن شدن سوابق ارائهدهنده آن تلاش را حلنشده علامت بزنید؛ نه هزینه صفر و نه موفقیت کامل ثابت شده است. تلاشهای مجدد را محدود کنید تا خطای موقت رشتهای بررسینشده از تلاشهای قابلپرداخت ایجاد نکند.
بودجه را بر اساس نتایج پذیرفتهشده و کار محدود تنظیم کنید
پیش از اندازهگیری، واحد کار پذیرفتهشده را تعریف کنید: تغییر کد آزمودهشده، رکورد محصول-locale تأییدشده یا یادداشت پژوهشی متصل به منبع. هزینه هر واحد پذیرفتهشده، هزینه قابلانتساب کار تقسیم بر تعداد واحدهای پذیرفتهشده است، فقط وقتی این تعداد صفر نباشد. نمونه و مصرف حلنشده را کنار نسبت گزارش کنید.
سقف درخواست، تلاشهای مجدد محدود و شرط توقف کار را با هم بهکار ببرید. فیلد مستند max_output_tokens تولید، از جمله استدلال، را محدود میکند؛ اما بودجه کامل ارزی برای کاری با چند درخواست نیست. کنترلهای حساب را تنظیم و هزینه انباشته را هم پیگیری کنید. زمینه کوچکتر یا تنظیمات استدلال متفاوت باید با معیارهای پذیرش یکسان ارزیابی شود، نه اینکه صرفهجویی تضمینشده معرفی شود.
دسترسی ارائهدهنده و شواهد: 5 سپتامبر 2026
فیلدهای مصرف و فرمول این راهنما از مستندات رسمی OpenAI آمدهاند. برای مقاله هیچ هزینه یا زمان اجرای کار Astra اندازهگیری نشده است. در 5 سپتامبر 2026، نقطه پایانی عمومی قیمتگذاری APIsRouter، HTTP 200، success: true و 34 مدل را بدون Astra یا GPT-6 برگرداند؛ بنابراین اینجا قیمت Astra در APIsRouter وجود ندارد.
برای درخواستهای مستقیم Astra از قیمت جاری OpenAI و برای پیشنهادهای خود APIsRouter از کاتالوگ زنده استفاده کنید. مقایسه ارائهدهندگان به کارهای مشابه، هویت واقعی مدل، خروجی پذیرفتهشده، مصرف کامل و نرخهای مربوط نیاز دارد. این سوابق را کنار محاسبه نگه دارید تا برآورد از صورتحساب تطبیقیافته کار قابل تشخیص باشد.
پرسشهای پرتکرار
قیمت فعلی API Astra چقدر است؟
برای gpt-6-astra از صفحه رسمی قیمتگذاری OpenAI API استفاده کنید. سطح سرویس و بازه زمینه مربوط به درخواست را، همراه با نرخهای جداگانه خواندن و نوشتن کش، انتخاب کنید.
آیا توکنهای استدلال علاوه بر output_tokens هزینه دارند؟
توکنهای استدلال در مصرف خروجی قرار دارند. نرخ خروجی را یکبار روی output_tokens اعمال کنید و output_tokens_details.reasoning_tokens را برای تشخیص نگه دارید، نه اینکه دوباره اضافه کنید.
نوشتن در کش چه اثری بر فرمول دارد؟
cached_tokens و cache_write_tokens را از ورودی کل کم کنید تا ورودی عادی به دست آید. ورودی عادی، خواندن کش و نوشتن کش را با نرخهای رسمی مربوط جداگانه قیمتگذاری کنید.
آیا timeout یا پاسخ ناقص رایگان است؟
لزوماً نه. تولید ناقص میتواند توکن مصرف کند و timeout ممکن است شواهد صورتحساب را حلنشده بگذارد. مصرف برگشتی را نگه دارید و سوابق مفقود را تطبیق دهید، نه اینکه هزینه صفر تعیین کنید.
هزینه یک کار Astra از طریق APIsRouter چقدر است؟
در بررسی 5 سپتامبر 2026 قیمتگذاریای وجود ندارد، زیرا Astra در کاتالوگ نبود. پیشنهادهای فعلی را بررسی کنید و برای برآورد مستقیم Astra از قیمت OpenAI استفاده کنید.