Вартість API Astra: від використання до прийнятої роботи

Updated 2026-09-05

Окремо враховуйте звичайний вхід, читання кешу, записи кешу та вихід. Для оцінки завдання використовуйте актуальну офіційну карту тарифів і повний журнал запитів.

Виберіть систему оплати перед тарифом

Прямі запити API Astra використовують оплату OpenAI Platform. Робота Codex з автентифікацією ChatGPT використовує ліміти та кредити підписки або робочого простору. OpenAI публікує їх окремо, тому тариф кредиту Codex не є ціною в доларах за токен API, а включений хід підписки не є рахунком API.

Для прямих запитів відкрийте офіційну сторінку цін API та виберіть відповідні тарифи gpt-6-astra для рівня сервісу, діапазону контексту й способу обробки. Збережіть URL карти тарифів і дату спостереження разом з оцінкою. Побудуйте розрахунок із використання на рівні запиту, а потім порівняйте підсумок із записами використання та рахунком Platform. Так буде легше знайти помилки вибору тарифу або відсутні запити.

Порівняння доступу через підписку Codex, прямого доступу до API OpenAI Platform, а також каталогу моделей і виставлення рахунків агрегатора.
Ілюстрація доступу та виставлення рахунків. Окремо перевірте вибраний обліковий запис і постачальника.

Зафіксуйте точні поля використання Responses

Офіційний посібник із prompt caching документує input_tokens, input_tokens_details.cached_tokens та input_tokens_details.cache_write_tokens. Читання кешу та записи кешу — окремі категорії входу, тому відніміть обидві перед обчисленням звичайного входу. Припущення, що кожен некешований токен має звичайний тариф входу, може занизити вартість запиту, який записує кеш.

Посібник із міркувань документує output_tokens і output_tokens_details.reasoning_tokens. Токени міркувань уже включені у використання виходу; не додавайте їх повторно як іншу категорію платних токенів. Зберігайте total_tokens як підсумок використання, а не як кількість, яку слід помножити на одну змішану ставку. Записуйте повний об’єкт використання, щоб подальше узгодження не залежало від неповного текстового журналу.

Джерела: посібники OpenAI з prompt caching і міркувань, отримані 5 вересня 2026 року. Ці шляхи полів призначені для Responses.
Поле ResponsesЗначенняОблік
Поле usage.input_tokensЗагальна кількість вхідних токенівРозділити звичайний вхід, читання і записи кешу
Поле usage.input_tokens_details.cached_tokensКешовані вхідні токениЗастосувати тариф кешованого входу
Поле usage.input_tokens_details.cache_write_tokensВхідні токени, записані в кешЗастосувати тариф запису в кеш
Поле usage.output_tokensВихідні токени разом із міркуваннямиЗастосувати тариф виходу один раз
Поле usage.output_tokens_details.reasoning_tokensМіркування всередині виходуЗберігати як діагностичну підмножину
Поле usage.total_tokensЗагальне використання входу та виходуЗберегти для узгодження

Обчисліть підсумок токенів без подвійного рахунку

Нехай I — вхідні токени, C — кешований вхід, W — вхід, записаний у кеш, а O — вихідні токени. Звичайний вхід дорівнює I - C - W. За ставок R_input, R_cached, R_write і R_output в одній валюті на мільйон токенів підсумок токенів дорівнює ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000.

Наведена offline-функція приймає спостережене використання та окремо вибрану карту тарифів. Її назви ставок — змінні застосунку, а не поля API. Вона повертає null для відсутніх або суперечливих даних замість того, щоб мовчки вважати невідоме використання безкоштовним. Результат охоплює лише токени, а не інструменти, податки чи інші позиції рахунку.

function estimateTokenCost(usage, rates) {
  const I = usage?.input_tokens
  const C = usage?.input_tokens_details?.cached_tokens
  const W = usage?.input_tokens_details?.cache_write_tokens
  const O = usage?.output_tokens
  const tokens = [I, C, W, O]
  const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
  if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
  if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
  if (C > I || W > I - C) return null
  const subtotal = ((I - C - W) * rates.input
    + C * rates.cached + W * rates.write
    + O * rates.output) / 1_000_000
  return Number.isFinite(subtotal) ? subtotal : null
}

Визначайте правила контексту й рівня сервісу для кожного запиту

Офіційне ціноутворення Astra розрізняє звичайний вхід, кешований вхід, записи кешу та вихід, а також різні діапазони контексту й рівні сервісу. Визначте ці правила для кожного запиту до передачі тарифів у формулу. Не застосовуйте множник повторно, якщо вибраний рядок карти тарифів уже його містить.

Зберігайте метадані рівня сервісу та обробки разом із відповіддю й порівнюйте їх із запитаними. Не використовуйте множники швидкості або кредитів Codex для прямого розрахунку API: вони належать іншому графіку цін продукту. Для незвичних способів обробки узгодьте дані з умовами відповідного провайдера. Правильна формула токенів із неправильною основою тарифу все одно дає неправильну оцінку вартості.

Відокремте оцінки токенів від повної вартості завдання

Завдання може потребувати кількох запитів до моделі, викликів інструментів і правок. Додайте підсумок токенів для кожного записаного запиту, а потім окремо додайте інструменти або послуги провайдера, що оплачуються за фактичним використанням і ціною. Здатність моделі викликати інструмент не означає, що інструмент включено без додаткової оплати.

Інфраструктуру, витрати на створення ресурсів і час людської перевірки тримайте в окремих категоріях. Додавайте рахунки сервісів і період, якого вони стосуються, та послідовно розподіляйте спільні витрати між завданнями. Для гри, пакета локалізації або дослідницького завдання вкажіть, які компоненти входять до підсумку. Відокремлюйте податки та конвертацію валют від тарифів токенів, щоб узгодити і підсумок використання, і остаточно сплачену суму.

Категорії цін токенів та інструментів OpenAI з окремими категоріями інших витрат доставки.
Компонент вартостіДоказ для збереженняПравило об’єднання
Токени моделіВикористання Responses і відповідні тарифи APIПідсумувати проміжні суми запитів
Інструменти або послуги провайдераВикористання інструмента та офіційна категорія ціниДодати окремо оплачувані позиції
Інші ресурси виконання або ресурсиРахунки сервісів і атрибуціяЗвітувати в окремих категоріях
Людська перевіркаЗафіксований час і зазначений метод оцінкиТримати окремо від витрат API

Зробіть видимими повтори, незавершену роботу та відсутнє використання

Посібник OpenAI з міркувань попереджає, що неповна генерація може витратити вхідні токени й токени міркувань без видимого тексту. Рахуйте фактично повернене використання, навіть якщо результат не проходить перевірку прийняття. Не обмежуйте журнал лише успішними фінальними відповідями й не оцінюйте витрати тільки за довжиною відповіді.

Для кожної спроби зберігайте ідентичність відповіді, модель, статус, використання та завдання, якому вона належить. Перед підсумовуванням узгоджуйте дублікати. Якщо з’єднання втрачено й використання не надійшло, позначте спробу нерозв’язаною, доки записи провайдера не прояснять ситуацію; ні нульова вартість, ні повний успіх не встановлені. Обмежуйте повтори, щоб тимчасова помилка не створила неперевірену серію платних спроб.

Бюджетуйте навколо прийнятих результатів і обмеженої роботи

До вимірювання визначте одиницю прийнятої роботи: протестовану зміну коду, схвалений запис продукту-locale або дослідницьку нотатку з посиланням на джерело. Вартість прийнятої одиниці — це віднесена вартість завдання, поділена на кількість прийнятих одиниць, лише коли кількість не дорівнює нулю. Разом із показником повідомляйте вибірку та нерозв’язане використання.

Одночасно використовуйте ліміт запитів, обмежені повтори та умову зупинки завдання. Задокументоване поле max_output_tokens обмежує генерацію, включно з міркуваннями, але не є повним грошовим бюджетом для завдання з кількома запитами. Встановіть також контроль облікового запису та відстежуйте накопичені витрати. Менший контекст або інші налаштування міркувань слід оцінювати за тими самими критеріями прийняття, а не рекламувати як гарантовану економію.

Доступність провайдера та докази: 5 вересня 2026 року

Поля використання та формула цього посібника походять з офіційної документації OpenAI. Для статті не вимірювали вартість або час виконання завдання Astra. 5 вересня 2026 року публічна кінцева точка цін APIsRouter повернула HTTP 200, success: true і 34 моделі без Astra або GPT-6, тому тут немає ціни Astra від APIsRouter.

Використовуйте поточні ціни OpenAI для прямих запитів Astra та живий каталог APIsRouter для його пропозицій. Порівняння провайдерів потребує однакових завдань, фактичної ідентичності моделі, прийнятих результатів, повного використання й відповідних тарифів. Зберігайте ці записи разом із розрахунком, щоб відрізняти оцінку від узгодженого рахунку за завдання.

Поширені запитання

Яка поточна ціна API Astra?

Скористайтеся офіційною сторінкою цін OpenAI API для gpt-6-astra. Виберіть рівень сервісу й діапазон контексту для вашого запиту, включно з окремими тарифами читання та запису кешу.

Чи стягуються токени міркувань додатково до output_tokens?

Токени міркувань включено у використання виходу. Застосуйте тариф виходу до output_tokens один раз, а output_tokens_details.reasoning_tokens збережіть для діагностики, не додаючи повторно.

Як записи кешу впливають на формулу?

Відніміть cached_tokens і cache_write_tokens від загального входу, щоб отримати звичайний вхід. Окремо оцініть звичайний вхід, читання кешу та записи кешу за відповідними офіційними тарифами.

Чи безкоштовні timeout або неповна відповідь?

Не обов’язково. Неповна генерація може витратити токени, а timeout може залишити докази оплати нерозв’язаними. Збережіть повернене використання та узгодьте відсутні записи, не призначаючи нульову вартість.

Скільки коштує завдання Astra через APIsRouter?

У перевірці 5 вересня 2026 року ціни не було, оскільки Astra була відсутня в каталозі. Перевірте актуальні пропозиції, а для прямих оцінок Astra використовуйте ціни OpenAI.