هزینه API Astra: از مصرف تا کار پذیرفته‌شده

Updated 2026-09-05

ورودی عادی، خواندن کش، نوشتن کش و خروجی را جداگانه حساب کنید. برای برآورد یک کار از کارت نرخ رسمی جاری و دفتر کامل درخواست‌ها استفاده کنید.

پیش از انتخاب نرخ، سیستم صورت‌حساب را انتخاب کنید

درخواست‌های مستقیم API Astra از صورت‌حساب OpenAI Platform استفاده می‌کنند. کار Codex با احراز هویت ChatGPT از سهمیه‌ها و اعتبارهای اشتراک یا فضای کاری استفاده می‌کند. OpenAI این موارد را جداگانه منتشر می‌کند؛ بنابراین نرخ اعتبار Codex قیمت دلاری هر توکن API نیست و یک نوبت شامل‌شده اشتراک، رسید API محسوب نمی‌شود.

برای درخواست‌های مستقیم، صفحه رسمی قیمت‌گذاری API را باز کنید و نرخ‌های مربوط به gpt-6-astra را بر اساس سطح سرویس، بازه زمینه و روش پردازش انتخاب کنید. URL کارت نرخ و تاریخ مشاهده را کنار برآورد نگه دارید. محاسبه را از مصرف سطح درخواست بسازید و سپس مجموع را با سوابق مصرف و صورتحساب Platform مقایسه کنید. این کار پیدا کردن تفاوت در انتخاب نرخ یا درخواست‌های مفقود را آسان‌تر می‌کند.

مقایسه دسترسی از طریق اشتراک Codex، دسترسی مستقیم به API OpenAI Platform و کاتالوگ مدل و صورتحساب یک تجمیع‌کننده.
تصویر دسترسی و صورتحساب. حساب و ارائه‌دهنده انتخاب‌شده را به‌طور مستقل بررسی کنید.

فیلدهای دقیق مصرف Responses را ثبت کنید

راهنمای رسمی prompt caching، فیلدهای input_tokens، input_tokens_details.cached_tokens و input_tokens_details.cache_write_tokens را مستند می‌کند. خواندن‌های کش و نوشتن‌های کش، دسته‌های جداگانه‌ای در ورودی هستند؛ بنابراین پیش از محاسبه ورودی عادی، هر دو را کم کنید. فرض اینکه هر توکن بدون کش نرخ ورودی عادی دارد، می‌تواند هزینه درخواستی را که در کش می‌نویسد کمتر از واقع نشان دهد.

راهنمای استدلال، output_tokens و output_tokens_details.reasoning_tokens را مستند می‌کند. توکن‌های استدلال در مصرف خروجی قرار دارند؛ آن‌ها را دوباره به‌عنوان دسته‌ای دیگر از توکن‌های قابل‌پرداخت جمع نکنید. total_tokens را به‌عنوان مجموع مصرف نگه دارید، نه تعدادی برای ضرب در یک نرخ ترکیبی. شیء کامل مصرف را ثبت کنید تا تطبیق بعدی به یک گزارش ناقص و فقط متنی وابسته نباشد.

منابع: راهنماهای OpenAI درباره prompt caching و استدلال، دریافت‌شده در 5 سپتامبر 2026. این مسیرهای فیلد برای Responses هستند.
فیلد Responsesمعنانحوه حسابداری
فیلد usage.input_tokensمجموع توکن‌های ورودیورودی عادی، خواندن کش و نوشتن کش را جدا کنید
فیلد usage.input_tokens_details.cached_tokensتوکن‌های ورودی کش‌شدهنرخ ورودی کش‌شده را اعمال کنید
فیلد usage.input_tokens_details.cache_write_tokensتوکن‌های ورودی نوشته‌شده در کشنرخ نوشتن در کش را اعمال کنید
فیلد usage.output_tokensتوکن‌های خروجی شامل استدلالنرخ خروجی را فقط یک‌بار اعمال کنید
فیلد usage.output_tokens_details.reasoning_tokensاستدلال درون خروجیبه‌عنوان زیرمجموعه تشخیصی نگه دارید
فیلد usage.total_tokensکل مصرف ورودی و خروجیبرای تطبیق نگه دارید

جمع توکن را بدون دوباره‌شماری محاسبه کنید

فرض کنید I توکن‌های ورودی، C ورودی کش‌شده، W ورودی نوشته‌شده در کش و O توکن‌های خروجی هستند. ورودی عادی برابر I - C - W است. اگر نرخ‌های R_input، R_cached، R_write و R_output با یک ارز یکسان به‌ازای یک میلیون توکن اعلام شده باشند، جمع توکن برابر است با ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000.

تابع offline زیر مصرف مشاهده‌شده و یک کارت نرخ انتخاب‌شده جداگانه را می‌پذیرد. نام نرخ‌ها متغیرهای برنامه هستند، نه فیلدهای API. برای ورودی‌های مفقود یا ناسازگار null برمی‌گرداند و مصرف ناشناخته را بی‌صدا رایگان فرض نمی‌کند. نتیجه فقط توکن‌ها را پوشش می‌دهد، نه ابزارها، مالیات یا موارد دیگر صورتحساب.

function estimateTokenCost(usage, rates) {
  const I = usage?.input_tokens
  const C = usage?.input_tokens_details?.cached_tokens
  const W = usage?.input_tokens_details?.cache_write_tokens
  const O = usage?.output_tokens
  const tokens = [I, C, W, O]
  const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
  if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
  if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
  if (C > I || W > I - C) return null
  const subtotal = ((I - C - W) * rates.input
    + C * rates.cached + W * rates.write
    + O * rates.output) / 1_000_000
  return Number.isFinite(subtotal) ? subtotal : null
}

قواعد زمینه و سطح سرویس را برای هر درخواست تعیین کنید

قیمت‌گذاری رسمی Astra ورودی عادی، ورودی کش‌شده، نوشتن در کش و خروجی را با بازه‌های زمینه و سطح‌های سرویس متفاوت جدا می‌کند. پیش از وارد کردن نرخ‌ها به فرمول، این قواعد را برای هر درخواست مشخص کنید. اگر ردیف کارت نرخ انتخابی از قبل ضریب را دارد، آن را دوباره اعمال نکنید.

فراداده سطح سرویس و پردازش را همراه پاسخ نگه دارید و با چیزی که درخواست شده مقایسه کنید. ضریب سرعت یا اعتبار Codex را در محاسبه مستقیم API دوباره استفاده نکنید؛ آن‌ها به برنامه قیمت‌گذاری محصول دیگری تعلق دارند. برای روش‌های پردازش غیرمعمول، با شرایط ارائه‌دهنده مربوط تطبیق دهید. فرمول درست توکن با مبنای نرخ نادرست همچنان برآورد هزینه نادرستی است.

برآورد توکن را از هزینه کامل کار جدا کنید

یک کار ممکن است به چند درخواست مدل، فراخوانی ابزار و بازبینی نیاز داشته باشد. جمع توکن هر درخواست ثبت‌شده را اضافه کنید و سپس ابزارها یا سرویس‌های جداگانه‌صورتحساب‌شده ارائه‌دهنده را بر اساس مصرف و قیمت واقعی آن‌ها اضافه کنید. توانایی مدل برای فراخوانی ابزار به این معنا نیست که ابزار بدون هزینه اضافی شامل شده است.

زیرساخت، هزینه تولید دارایی و زمان بازبینی انسانی را در دسته‌های جدا نگه دارید. رسید سرویس و بازه‌ای را که پوشش می‌دهد پیوست کنید و هزینه‌های مشترک را در میان کارها به‌صورت یکسان تخصیص دهید. برای بازی، بسته بومی‌سازی یا کار پژوهشی مشخص کنید مجموع شامل چه اجزایی است. مالیات و تبدیل ارز را از نرخ توکن جدا کنید تا هم جمع مصرف و هم مبلغ نهایی پرداخت‌شده قابل تطبیق باشد.

دسته‌های قیمت توکن و ابزار OpenAI، همراه با دسته‌های جداگانه برای سایر هزینه‌های تحویل.
جزء هزینهشواهد برای نگهداریقاعده ترکیب
توکن‌های مدلمصرف Responses به‌علاوه نرخ‌های مربوط APIجمع زیرمجموعه‌های درخواست
ابزارها یا سرویس‌های ارائه‌دهندهمصرف ابزار و دسته قیمت رسمیموارد جداگانه‌صورتحساب‌شده را اضافه کنید
سایر منابع اجرا یا دارایی‌هارسید سرویس و نسبت‌دهیدر دسته‌های جدا گزارش کنید
بازبینی انسانیزمان ثبت‌شده و روش ارزش‌گذاری اعلام‌شدهاز هزینه API جدا نگه دارید

تلاش‌های مجدد، کار ناقص و مصرف مفقود را قابل مشاهده نگه دارید

راهنمای استدلال OpenAI هشدار می‌دهد که تولید ناقص می‌تواند توکن‌های ورودی و استدلال را مصرف کند، بدون اینکه متن قابل مشاهده‌ای تولید شود. مصرفی را که واقعاً برگردانده شده حساب کنید، حتی اگر نتیجه آزمون پذیرش شما را رد کند. دفتر را فقط به پاسخ‌های نهایی موفق محدود نکنید و هزینه را فقط از طول پاسخ برآورد نکنید.

برای هر تلاش، هویت پاسخ، مدل، وضعیت، مصرف و کار مربوط را نگه دارید. پیش از جمع‌زدن، موارد تکراری را تطبیق دهید. اگر اتصال شکست خورد و مصرفی نرسید، تا روشن شدن سوابق ارائه‌دهنده آن تلاش را حل‌نشده علامت بزنید؛ نه هزینه صفر و نه موفقیت کامل ثابت شده است. تلاش‌های مجدد را محدود کنید تا خطای موقت رشته‌ای بررسی‌نشده از تلاش‌های قابل‌پرداخت ایجاد نکند.

بودجه را بر اساس نتایج پذیرفته‌شده و کار محدود تنظیم کنید

پیش از اندازه‌گیری، واحد کار پذیرفته‌شده را تعریف کنید: تغییر کد آزموده‌شده، رکورد محصول-locale تأییدشده یا یادداشت پژوهشی متصل به منبع. هزینه هر واحد پذیرفته‌شده، هزینه قابل‌انتساب کار تقسیم بر تعداد واحدهای پذیرفته‌شده است، فقط وقتی این تعداد صفر نباشد. نمونه و مصرف حل‌نشده را کنار نسبت گزارش کنید.

سقف درخواست، تلاش‌های مجدد محدود و شرط توقف کار را با هم به‌کار ببرید. فیلد مستند max_output_tokens تولید، از جمله استدلال، را محدود می‌کند؛ اما بودجه کامل ارزی برای کاری با چند درخواست نیست. کنترل‌های حساب را تنظیم و هزینه انباشته را هم پیگیری کنید. زمینه کوچک‌تر یا تنظیمات استدلال متفاوت باید با معیارهای پذیرش یکسان ارزیابی شود، نه اینکه صرفه‌جویی تضمین‌شده معرفی شود.

دسترسی ارائه‌دهنده و شواهد: 5 سپتامبر 2026

فیلدهای مصرف و فرمول این راهنما از مستندات رسمی OpenAI آمده‌اند. برای مقاله هیچ هزینه یا زمان اجرای کار Astra اندازه‌گیری نشده است. در 5 سپتامبر 2026، نقطه پایانی عمومی قیمت‌گذاری APIsRouter، HTTP 200، success: true و 34 مدل را بدون Astra یا GPT-6 برگرداند؛ بنابراین اینجا قیمت Astra در APIsRouter وجود ندارد.

برای درخواست‌های مستقیم Astra از قیمت جاری OpenAI و برای پیشنهادهای خود APIsRouter از کاتالوگ زنده استفاده کنید. مقایسه ارائه‌دهندگان به کارهای مشابه، هویت واقعی مدل، خروجی پذیرفته‌شده، مصرف کامل و نرخ‌های مربوط نیاز دارد. این سوابق را کنار محاسبه نگه دارید تا برآورد از صورتحساب تطبیق‌یافته کار قابل تشخیص باشد.

پرسش‌های پرتکرار

قیمت فعلی API Astra چقدر است؟

برای gpt-6-astra از صفحه رسمی قیمت‌گذاری OpenAI API استفاده کنید. سطح سرویس و بازه زمینه مربوط به درخواست را، همراه با نرخ‌های جداگانه خواندن و نوشتن کش، انتخاب کنید.

آیا توکن‌های استدلال علاوه بر output_tokens هزینه دارند؟

توکن‌های استدلال در مصرف خروجی قرار دارند. نرخ خروجی را یک‌بار روی output_tokens اعمال کنید و output_tokens_details.reasoning_tokens را برای تشخیص نگه دارید، نه اینکه دوباره اضافه کنید.

نوشتن در کش چه اثری بر فرمول دارد؟

cached_tokens و cache_write_tokens را از ورودی کل کم کنید تا ورودی عادی به دست آید. ورودی عادی، خواندن کش و نوشتن کش را با نرخ‌های رسمی مربوط جداگانه قیمت‌گذاری کنید.

آیا timeout یا پاسخ ناقص رایگان است؟

لزوماً نه. تولید ناقص می‌تواند توکن مصرف کند و timeout ممکن است شواهد صورت‌حساب را حل‌نشده بگذارد. مصرف برگشتی را نگه دارید و سوابق مفقود را تطبیق دهید، نه اینکه هزینه صفر تعیین کنید.

هزینه یک کار Astra از طریق APIsRouter چقدر است؟

در بررسی 5 سپتامبر 2026 قیمت‌گذاری‌ای وجود ندارد، زیرا Astra در کاتالوگ نبود. پیشنهادهای فعلی را بررسی کنید و برای برآورد مستقیم Astra از قیمت OpenAI استفاده کنید.