Вартість API Astra: від використання до прийнятої роботи
Updated 2026-09-05
Окремо враховуйте звичайний вхід, читання кешу, записи кешу та вихід. Для оцінки завдання використовуйте актуальну офіційну карту тарифів і повний журнал запитів.
Виберіть систему оплати перед тарифом
Прямі запити API Astra використовують оплату OpenAI Platform. Робота Codex з автентифікацією ChatGPT використовує ліміти та кредити підписки або робочого простору. OpenAI публікує їх окремо, тому тариф кредиту Codex не є ціною в доларах за токен API, а включений хід підписки не є рахунком API.
Для прямих запитів відкрийте офіційну сторінку цін API та виберіть відповідні тарифи gpt-6-astra для рівня сервісу, діапазону контексту й способу обробки. Збережіть URL карти тарифів і дату спостереження разом з оцінкою. Побудуйте розрахунок із використання на рівні запиту, а потім порівняйте підсумок із записами використання та рахунком Platform. Так буде легше знайти помилки вибору тарифу або відсутні запити.

Зафіксуйте точні поля використання Responses
Офіційний посібник із prompt caching документує input_tokens, input_tokens_details.cached_tokens та input_tokens_details.cache_write_tokens. Читання кешу та записи кешу — окремі категорії входу, тому відніміть обидві перед обчисленням звичайного входу. Припущення, що кожен некешований токен має звичайний тариф входу, може занизити вартість запиту, який записує кеш.
Посібник із міркувань документує output_tokens і output_tokens_details.reasoning_tokens. Токени міркувань уже включені у використання виходу; не додавайте їх повторно як іншу категорію платних токенів. Зберігайте total_tokens як підсумок використання, а не як кількість, яку слід помножити на одну змішану ставку. Записуйте повний об’єкт використання, щоб подальше узгодження не залежало від неповного текстового журналу.
| Поле Responses | Значення | Облік |
|---|---|---|
| Поле usage.input_tokens | Загальна кількість вхідних токенів | Розділити звичайний вхід, читання і записи кешу |
| Поле usage.input_tokens_details.cached_tokens | Кешовані вхідні токени | Застосувати тариф кешованого входу |
| Поле usage.input_tokens_details.cache_write_tokens | Вхідні токени, записані в кеш | Застосувати тариф запису в кеш |
| Поле usage.output_tokens | Вихідні токени разом із міркуваннями | Застосувати тариф виходу один раз |
| Поле usage.output_tokens_details.reasoning_tokens | Міркування всередині виходу | Зберігати як діагностичну підмножину |
| Поле usage.total_tokens | Загальне використання входу та виходу | Зберегти для узгодження |
Обчисліть підсумок токенів без подвійного рахунку
Нехай I — вхідні токени, C — кешований вхід, W — вхід, записаний у кеш, а O — вихідні токени. Звичайний вхід дорівнює I - C - W. За ставок R_input, R_cached, R_write і R_output в одній валюті на мільйон токенів підсумок токенів дорівнює ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000.
Наведена offline-функція приймає спостережене використання та окремо вибрану карту тарифів. Її назви ставок — змінні застосунку, а не поля API. Вона повертає null для відсутніх або суперечливих даних замість того, щоб мовчки вважати невідоме використання безкоштовним. Результат охоплює лише токени, а не інструменти, податки чи інші позиції рахунку.
function estimateTokenCost(usage, rates) {
const I = usage?.input_tokens
const C = usage?.input_tokens_details?.cached_tokens
const W = usage?.input_tokens_details?.cache_write_tokens
const O = usage?.output_tokens
const tokens = [I, C, W, O]
const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
if (C > I || W > I - C) return null
const subtotal = ((I - C - W) * rates.input
+ C * rates.cached + W * rates.write
+ O * rates.output) / 1_000_000
return Number.isFinite(subtotal) ? subtotal : null
}Визначайте правила контексту й рівня сервісу для кожного запиту
Офіційне ціноутворення Astra розрізняє звичайний вхід, кешований вхід, записи кешу та вихід, а також різні діапазони контексту й рівні сервісу. Визначте ці правила для кожного запиту до передачі тарифів у формулу. Не застосовуйте множник повторно, якщо вибраний рядок карти тарифів уже його містить.
Зберігайте метадані рівня сервісу та обробки разом із відповіддю й порівнюйте їх із запитаними. Не використовуйте множники швидкості або кредитів Codex для прямого розрахунку API: вони належать іншому графіку цін продукту. Для незвичних способів обробки узгодьте дані з умовами відповідного провайдера. Правильна формула токенів із неправильною основою тарифу все одно дає неправильну оцінку вартості.
Відокремте оцінки токенів від повної вартості завдання
Завдання може потребувати кількох запитів до моделі, викликів інструментів і правок. Додайте підсумок токенів для кожного записаного запиту, а потім окремо додайте інструменти або послуги провайдера, що оплачуються за фактичним використанням і ціною. Здатність моделі викликати інструмент не означає, що інструмент включено без додаткової оплати.
Інфраструктуру, витрати на створення ресурсів і час людської перевірки тримайте в окремих категоріях. Додавайте рахунки сервісів і період, якого вони стосуються, та послідовно розподіляйте спільні витрати між завданнями. Для гри, пакета локалізації або дослідницького завдання вкажіть, які компоненти входять до підсумку. Відокремлюйте податки та конвертацію валют від тарифів токенів, щоб узгодити і підсумок використання, і остаточно сплачену суму.
| Компонент вартості | Доказ для збереження | Правило об’єднання |
|---|---|---|
| Токени моделі | Використання Responses і відповідні тарифи API | Підсумувати проміжні суми запитів |
| Інструменти або послуги провайдера | Використання інструмента та офіційна категорія ціни | Додати окремо оплачувані позиції |
| Інші ресурси виконання або ресурси | Рахунки сервісів і атрибуція | Звітувати в окремих категоріях |
| Людська перевірка | Зафіксований час і зазначений метод оцінки | Тримати окремо від витрат API |
Зробіть видимими повтори, незавершену роботу та відсутнє використання
Посібник OpenAI з міркувань попереджає, що неповна генерація може витратити вхідні токени й токени міркувань без видимого тексту. Рахуйте фактично повернене використання, навіть якщо результат не проходить перевірку прийняття. Не обмежуйте журнал лише успішними фінальними відповідями й не оцінюйте витрати тільки за довжиною відповіді.
Для кожної спроби зберігайте ідентичність відповіді, модель, статус, використання та завдання, якому вона належить. Перед підсумовуванням узгоджуйте дублікати. Якщо з’єднання втрачено й використання не надійшло, позначте спробу нерозв’язаною, доки записи провайдера не прояснять ситуацію; ні нульова вартість, ні повний успіх не встановлені. Обмежуйте повтори, щоб тимчасова помилка не створила неперевірену серію платних спроб.
Бюджетуйте навколо прийнятих результатів і обмеженої роботи
До вимірювання визначте одиницю прийнятої роботи: протестовану зміну коду, схвалений запис продукту-locale або дослідницьку нотатку з посиланням на джерело. Вартість прийнятої одиниці — це віднесена вартість завдання, поділена на кількість прийнятих одиниць, лише коли кількість не дорівнює нулю. Разом із показником повідомляйте вибірку та нерозв’язане використання.
Одночасно використовуйте ліміт запитів, обмежені повтори та умову зупинки завдання. Задокументоване поле max_output_tokens обмежує генерацію, включно з міркуваннями, але не є повним грошовим бюджетом для завдання з кількома запитами. Встановіть також контроль облікового запису та відстежуйте накопичені витрати. Менший контекст або інші налаштування міркувань слід оцінювати за тими самими критеріями прийняття, а не рекламувати як гарантовану економію.
Доступність провайдера та докази: 5 вересня 2026 року
Поля використання та формула цього посібника походять з офіційної документації OpenAI. Для статті не вимірювали вартість або час виконання завдання Astra. 5 вересня 2026 року публічна кінцева точка цін APIsRouter повернула HTTP 200, success: true і 34 моделі без Astra або GPT-6, тому тут немає ціни Astra від APIsRouter.
Використовуйте поточні ціни OpenAI для прямих запитів Astra та живий каталог APIsRouter для його пропозицій. Порівняння провайдерів потребує однакових завдань, фактичної ідентичності моделі, прийнятих результатів, повного використання й відповідних тарифів. Зберігайте ці записи разом із розрахунком, щоб відрізняти оцінку від узгодженого рахунку за завдання.
Поширені запитання
Яка поточна ціна API Astra?
Скористайтеся офіційною сторінкою цін OpenAI API для gpt-6-astra. Виберіть рівень сервісу й діапазон контексту для вашого запиту, включно з окремими тарифами читання та запису кешу.
Чи стягуються токени міркувань додатково до output_tokens?
Токени міркувань включено у використання виходу. Застосуйте тариф виходу до output_tokens один раз, а output_tokens_details.reasoning_tokens збережіть для діагностики, не додаючи повторно.
Як записи кешу впливають на формулу?
Відніміть cached_tokens і cache_write_tokens від загального входу, щоб отримати звичайний вхід. Окремо оцініть звичайний вхід, читання кешу та записи кешу за відповідними офіційними тарифами.
Чи безкоштовні timeout або неповна відповідь?
Не обов’язково. Неповна генерація може витратити токени, а timeout може залишити докази оплати нерозв’язаними. Збережіть повернене використання та узгодьте відсутні записи, не призначаючи нульову вартість.
Скільки коштує завдання Astra через APIsRouter?
У перевірці 5 вересня 2026 року ціни не було, оскільки Astra була відсутня в каталозі. Перевірте актуальні пропозиції, а для прямих оцінок Astra використовуйте ціни OpenAI.