Biaya API Astra dari penggunaan ke pekerjaan yang diterima
Updated 2026-09-05
Akui input biasa, cache reads, cache writes, dan output secara terpisah. Gunakan kartu tarif resmi terkini serta ledger permintaan lengkap untuk memperkirakan tugas.
Pilih sistem penagihan sebelum memilih tarif
Permintaan API Astra langsung menggunakan penagihan OpenAI Platform. Pekerjaan Codex yang diautentikasi ChatGPT menggunakan allowance dan kredit langganan atau workspace. OpenAI menerbitkannya secara terpisah, jadi tarif kredit Codex bukan harga dolar per token API dan satu turn langganan yang termasuk bukan tanda terima API.
Untuk permintaan langsung, buka halaman harga API resmi dan pilih tarif gpt-6-astra yang sesuai dengan tingkat layanan, pita konteks, dan pengaturan pemrosesan. Simpan URL kartu tarif serta tanggal observasi bersama perkiraan. Bangun perhitungan dari penggunaan tingkat permintaan, lalu bandingkan total dengan catatan penggunaan Platform dan tagihan. Ini memudahkan pelacakan perbedaan pilihan tarif atau permintaan yang hilang.

Tangkap kolom penggunaan Responses yang tepat
Panduan prompt caching resmi mendokumentasikan input_tokens, input_tokens_details.cached_tokens, dan input_tokens_details.cache_write_tokens. Cache reads dan cache writes adalah kategori terpisah dalam input, jadi kurangi keduanya sebelum menghitung input biasa. Menganggap setiap token yang tidak di-cache memakai tarif input biasa dapat mengecilkan biaya permintaan yang menulis cache.
Panduan reasoning mendokumentasikan output_tokens dan output_tokens_details.reasoning_tokens. Token reasoning sudah termasuk dalam penggunaan output; jangan menambahkannya lagi sebagai kategori token tertagih lain. Pertahankan total_tokens sebagai total penggunaan, bukan jumlah yang dikalikan satu tarif campuran. Catat objek usage lengkap agar rekonsiliasi berikutnya tidak bergantung pada log teks saja.
| Kolom Responses | Makna | Perlakuan akuntansi |
|---|---|---|
| usage.input_tokens | Total token input | Pisahkan input biasa, cache reads, dan writes |
| usage.input_tokens_details.cached_tokens | Token input yang di-cache | Terapkan tarif cached-input |
| usage.input_tokens_details.cache_write_tokens | Token input yang ditulis ke cache | Terapkan tarif cache-write |
| usage.output_tokens | Token output termasuk reasoning | Terapkan tarif output sekali |
| usage.output_tokens_details.reasoning_tokens | Reasoning di dalam output | Pertahankan sebagai subset diagnostik |
| usage.total_tokens | Total penggunaan input dan output | Pertahankan untuk rekonsiliasi |
Hitung subtotal token tanpa penghitungan ganda
Misalkan I adalah token input, C input cache, W input cache-write, dan O token output. Input biasa adalah I - C - W. Dengan tarif R_input, R_cached, R_write, dan R_output yang dikutip dalam mata uang sama per satu juta token, subtotal token adalah ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000.
Fungsi offline di bawah menerima penggunaan yang diamati dan kartu tarif yang dipilih secara terpisah. Nama tarifnya adalah variabel aplikasi, bukan kolom API. Fungsi mengembalikan null untuk input yang hilang atau tidak konsisten, bukan diam-diam memperlakukan penggunaan yang tidak diketahui sebagai gratis. Hasilnya hanya mencakup token, bukan tools, pajak, atau item tagihan lain.
function estimateTokenCost(usage, rates) {
const I = usage?.input_tokens
const C = usage?.input_tokens_details?.cached_tokens
const W = usage?.input_tokens_details?.cache_write_tokens
const O = usage?.output_tokens
const tokens = [I, C, W, O]
const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
if (C > I || W > I - C) return null
const subtotal = ((I - C - W) * rates.input
+ C * rates.cached + W * rates.write
+ O * rates.output) / 1_000_000
return Number.isFinite(subtotal) ? subtotal : null
}Selesaikan aturan konteks dan tingkat layanan per permintaan
Harga resmi Astra membedakan input biasa, input cache, cache writes, dan output, dengan pita konteks serta tingkat layanan berbeda. Selesaikan aturan tersebut untuk setiap permintaan sebelum memasukkan tarif ke formula. Jangan menerapkan multiplier lagi jika sudah memilih baris kartu tarif yang menyertakannya.
Simpan metadata tingkat layanan dan pemrosesan bersama response, lalu bandingkan dengan yang diminta. Jangan menggunakan multiplier kecepatan atau kredit Codex untuk perhitungan API langsung: keduanya termasuk jadwal harga produk lain. Untuk pengaturan pemrosesan yang tidak biasa, rekonsiliasikan dengan persyaratan penyedia yang berlaku. Formula token yang benar dengan dasar tarif yang salah tetap merupakan perkiraan biaya yang salah.
Pisahkan perkiraan token dari biaya tugas lengkap
Sebuah tugas dapat memerlukan beberapa permintaan model, panggilan alat, dan revisi. Tambahkan subtotal token untuk setiap permintaan tercatat, lalu tambahkan alat atau layanan penyedia yang ditagih secara terpisah berdasarkan penggunaan dan harga aktual. Kemampuan model memanggil alat tidak berarti alat itu termasuk tanpa biaya tambahan.
Simpan infrastruktur, biaya pembuatan aset, dan waktu peninjauan manusia dalam kategori terpisah. Lampirkan tanda terima layanan dan periode yang dicakup, lalu alokasikan biaya bersama secara konsisten antar tugas. Untuk game, batch lokalisasi, atau tugas riset, nyatakan komponen yang termasuk total. Pisahkan pajak dan konversi mata uang dari tarif token agar subtotal penggunaan maupun jumlah akhir yang dibayar dapat direkonsiliasi.
| Komponen biaya | Bukti yang dipertahankan | Aturan penggabungan |
|---|---|---|
| Token model | Penggunaan Responses plus tarif API yang berlaku | Jumlahkan subtotal permintaan |
| Alat atau layanan penyedia | Penggunaan alat dan kategori harga resmi | Tambahkan item yang ditagih terpisah |
| Runtime atau aset lain | Tanda terima layanan dan atribusi | Laporkan dalam kategori terpisah |
| Peninjauan manusia | Waktu tercatat dan metode valuasi yang dinyatakan | Pisahkan dari pengeluaran API |
Buat percobaan ulang, pekerjaan tidak lengkap, dan penggunaan yang hilang tetap terlihat
Panduan reasoning OpenAI memperingatkan bahwa generasi yang tidak lengkap dapat mengonsumsi token input dan reasoning tanpa menghasilkan teks yang terlihat. Hitung penggunaan yang benar-benar dikembalikan meskipun hasilnya gagal dalam pemeriksaan penerimaan. Jangan membatasi ledger pada jawaban akhir yang berhasil atau memperkirakan pengeluaran hanya dari panjang jawaban.
Untuk setiap percobaan, simpan identitas response, model, status, penggunaan, dan tugasnya. Rekonsiliasikan duplikat sebelum menjumlahkan. Jika koneksi gagal dan penggunaan tidak tiba, tandai percobaan belum terselesaikan sampai catatan penyedia menjelaskannya; biaya nol maupun sukses penuh belum terbukti. Batasi percobaan ulang agar kesalahan sementara tidak membuat rangkaian percobaan tertagih tanpa peninjauan.
Anggarkan hasil yang diterima dan pekerjaan yang dibatasi
Definisikan unit pekerjaan yang diterima sebelum mengukurnya: perubahan kode yang diuji, catatan produk-locale yang disetujui, atau catatan riset berpaut-sumber. Biaya per unit diterima adalah biaya tugas yang dapat diatribusikan dibagi jumlah unit diterima, hanya saat jumlahnya bukan nol. Laporkan sampel dan penggunaan yang belum terselesaikan bersama rasio.
Gunakan batas permintaan, percobaan ulang terbatas, dan kondisi penghentian tugas secara bersama. Kolom max_output_tokens yang terdokumentasi membatasi generasi termasuk reasoning, tetapi bukan anggaran mata uang lengkap untuk tugas multi-permintaan. Tetapkan kontrol akun dan lacak pengeluaran terakumulasi juga. Nilai konteks lebih kecil atau pengaturan reasoning berbeda terhadap kriteria penerimaan yang sama, bukan mengiklankannya sebagai penghematan terjamin.
Ketersediaan penyedia dan bukti: 5 September 2026
Kolom penggunaan dan formula dalam panduan ini berasal dari dokumentasi resmi OpenAI. Tidak ada biaya tugas atau runtime Astra yang diukur untuk artikel ini. Pada 5 September 2026, endpoint harga publik APIsRouter mengembalikan HTTP 200, success: true, dan 34 model tanpa Astra atau GPT-6, sehingga tidak ada kuotasi Astra APIsRouter di sini.
Gunakan harga OpenAI saat ini untuk permintaan Astra langsung dan katalog APIsRouter live untuk penawarannya sendiri. Perbandingan penyedia memerlukan tugas yang sepadan, identitas model aktual, output yang diterima, penggunaan lengkap, dan tarif yang berlaku. Simpan catatan tersebut bersama perhitungan agar pembaca dapat membedakan perkiraan dari tagihan tugas yang telah direkonsiliasi.
Pertanyaan umum
Berapa harga API Astra saat ini?
Gunakan halaman harga API resmi OpenAI untuk gpt-6-astra. Pilih tingkat layanan dan pita konteks yang berlaku, termasuk tarif cache-read dan cache-write terpisah.
Apakah token reasoning ditagih selain output_tokens?
Token reasoning termasuk dalam penggunaan output. Terapkan tarif output pada output_tokens sekali; pertahankan output_tokens_details.reasoning_tokens untuk diagnosis, bukan menambahkannya lagi.
Bagaimana cache writes memengaruhi formula?
Kurangi cached_tokens dan cache_write_tokens dari total input untuk memperoleh input biasa. Hargai input biasa, cache reads, dan cache writes secara terpisah menggunakan tarif resmi yang berlaku.
Apakah timeout atau jawaban tidak lengkap gratis?
Belum tentu. Generasi tidak lengkap dapat mengonsumsi token, dan timeout dapat meninggalkan bukti penagihan yang belum terselesaikan. Simpan penggunaan yang dikembalikan dan rekonsiliasikan catatan yang hilang, bukan menetapkan biaya nol.
Berapa biaya tugas Astra melalui APIsRouter?
Tidak ada kuotasi dari pemeriksaan 5 September 2026 karena Astra tidak ada dalam katalog. Periksa penawaran saat ini; gunakan harga OpenAI untuk perkiraan Astra langsung.