Chi phí API Astra từ mức sử dụng tới công việc đã chấp nhận

Updated 2026-09-05

Hạch toán riêng input thông thường, đọc cache, ghi cache và output. Dùng biểu giá chính thức hiện tại cùng sổ cái yêu cầu hoàn chỉnh để ước tính một tác vụ.

Chọn hệ thống thanh toán trước khi chọn mức giá

Yêu cầu API Astra trực tiếp dùng thanh toán OpenAI Platform. Công việc Codex đã xác thực ChatGPT dùng hạn mức và credit của gói thuê bao hoặc workspace. OpenAI công bố hai thứ riêng biệt, vì vậy mức credit Codex không phải giá đô la trên token API và một lượt dùng trong thuê bao không phải biên nhận API.

Với yêu cầu trực tiếp, mở trang giá API chính thức và chọn mức gpt-6-astra áp dụng cho tầng dịch vụ, dải ngữ cảnh và cách xử lý. Giữ URL biểu giá và ngày quan sát cùng ước tính. Xây phép tính từ mức sử dụng cấp yêu cầu, sau đó so sánh tổng với bản ghi sử dụng Platform và hóa đơn. Nhờ vậy khác biệt do chọn mức giá hay yêu cầu thiếu dễ định vị hơn.

So sánh quyền truy cập qua gói đăng ký Codex, quyền truy cập trực tiếp vào API OpenAI Platform và danh mục mô hình cùng hoạt động thanh toán của một bộ tổng hợp.
Minh họa quyền truy cập và thanh toán. Hãy xác minh độc lập tài khoản và nhà cung cấp đã chọn.

Ghi lại chính xác các trường sử dụng Responses

Hướng dẫn caching prompt chính thức ghi nhận input_tokens, input_tokens_details.cached_tokens và input_tokens_details.cache_write_tokens. Đọc cache và ghi cache là các danh mục riêng trong input, nên hãy trừ cả hai trước khi tính input thông thường. Giả định mọi token không cache đều theo giá input thường có thể đánh giá thấp yêu cầu ghi cache.

Hướng dẫn suy luận ghi nhận output_tokens và output_tokens_details.reasoning_tokens. Token suy luận đã nằm trong mức sử dụng output; đừng cộng lại như danh mục token tính phí khác. Giữ total_tokens là tổng sử dụng, không phải số để nhân với một mức giá trộn. Ghi toàn bộ object usage để đối soát sau này không phụ thuộc log chỉ có văn bản.

Nguồn: hướng dẫn caching prompt và suy luận của OpenAI, lấy ngày 5 tháng 9 năm 2026. Các đường dẫn trường này dành cho Responses.
Trường ResponsesÝ nghĩaCách hạch toán
usage.input_tokensTổng token inputTách input thường, đọc cache và ghi cache
usage.input_tokens_details.cached_tokensToken input đã cacheÁp dụng giá input đã cache
usage.input_tokens_details.cache_write_tokensToken input được ghi vào cacheÁp dụng giá ghi cache
usage.output_tokensToken output gồm suy luậnÁp dụng giá output một lần
usage.output_tokens_details.reasoning_tokensSuy luận nằm trong outputGiữ như tập con chẩn đoán
usage.total_tokensTổng mức sử dụng input và outputGiữ để đối soát

Tính tổng token mà không đếm hai lần

Gọi I là token input, C là input đã cache, W là input ghi cache và O là token output. Input thường là I - C - W. Với các mức R_input, R_cached, R_write và R_output cùng đơn vị tiền tệ trên một triệu token, tổng token là ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000.

Hàm ngoại tuyến bên dưới nhận mức sử dụng quan sát được và biểu giá được chọn riêng. Tên rate là biến ứng dụng, không phải trường API. Hàm trả null khi đầu vào thiếu hoặc không nhất quán thay vì âm thầm coi mức sử dụng chưa biết là miễn phí. Kết quả chỉ bao phủ token, không bao gồm công cụ, thuế hay mục hóa đơn khác.

function estimateTokenCost(usage, rates) {
  const I = usage?.input_tokens
  const C = usage?.input_tokens_details?.cached_tokens
  const W = usage?.input_tokens_details?.cache_write_tokens
  const O = usage?.output_tokens
  const tokens = [I, C, W, O]
  const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
  if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
  if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
  if (C > I || W > I - C) return null
  const subtotal = ((I - C - W) * rates.input
    + C * rates.cached + W * rates.write
    + O * rates.output) / 1_000_000
  return Number.isFinite(subtotal) ? subtotal : null
}

Giải quyết quy tắc ngữ cảnh và tầng dịch vụ cho từng yêu cầu

Giá chính thức của Astra phân biệt input thường, input cache, ghi cache và output, cùng các dải ngữ cảnh và tầng dịch vụ khác nhau. Giải quyết quy tắc đó cho từng yêu cầu trước khi đưa rate vào công thức. Đừng áp dụng multiplier lần nữa nếu đã chọn đúng hàng biểu giá có chứa nó.

Giữ metadata tầng dịch vụ và xử lý cùng response, rồi đối chiếu với những gì đã yêu cầu. Đừng dùng lại multiplier tốc độ hoặc credit Codex cho phép tính API trực tiếp: đó là lịch giá sản phẩm khác. Với cách xử lý bất thường, đối soát theo điều khoản nhà cung cấp áp dụng. Công thức token đúng nhưng sai cơ sở giá vẫn là ước tính chi phí sai.

Tách ước tính token khỏi tổng chi phí tác vụ

Một tác vụ có thể cần nhiều yêu cầu mô hình, lần gọi công cụ và sửa đổi. Cộng tổng token của từng yêu cầu đã ghi, sau đó cộng riêng công cụ hoặc dịch vụ nhà cung cấp được tính phí theo mức sử dụng và giá thực. Mô hình gọi được công cụ không có nghĩa công cụ đó được bao gồm mà không tính thêm.

Giữ hạ tầng, chi phí tạo tài nguyên và thời gian rà soát con người ở danh mục riêng. Đính biên nhận dịch vụ cùng kỳ bao phủ và phân bổ chi phí dùng chung nhất quán giữa các tác vụ. Với game, lô bản địa hóa hoặc tác vụ nghiên cứu, nêu rõ tổng gồm thành phần nào. Tách thuế và chuyển đổi tiền tệ khỏi rate token để có thể đối soát cả tổng sử dụng lẫn số tiền trả cuối.

Danh mục giá token và công cụ OpenAI, cùng danh mục riêng cho các chi phí bàn giao khác.
Thành phần chi phíBằng chứng cần giữQuy tắc kết hợp
Token mô hìnhMức sử dụng Responses cùng giá API áp dụngCộng tổng của từng yêu cầu
Công cụ hoặc dịch vụ nhà cung cấpMức sử dụng công cụ và danh mục giá chính thứcCộng các mục tính phí riêng
Runtime hoặc tài nguyên khácBiên nhận dịch vụ và quy kếtBáo cáo trong danh mục riêng
Rà soát con ngườiThời gian ghi nhận và phương pháp định giá nêu rõGiữ riêng với chi tiêu API

Hiển thị lần thử lại, công việc chưa hoàn chỉnh và mức sử dụng thiếu

Hướng dẫn suy luận của OpenAI cảnh báo rằng tạo không hoàn chỉnh có thể tiêu thụ token input và suy luận mà không tạo văn bản hiển thị. Đếm mức sử dụng thực sự trả về ngay cả khi kết quả không đạt kiểm tra chấp nhận. Đừng giới hạn sổ cái ở câu trả lời cuối thành công hoặc ước tính chi tiêu chỉ từ độ dài câu trả lời.

Với mỗi lần thử, giữ danh tính response, mô hình, trạng thái, usage và tác vụ liên quan. Đối soát bản trùng trước khi cộng. Nếu kết nối thất bại và không có usage, đánh dấu lần thử chưa giải quyết cho tới khi hồ sơ nhà cung cấp làm rõ; không xác lập được chi phí bằng không hay thành công hoàn toàn. Giới hạn thử lại để lỗi tạm thời không tạo chuỗi lần thử tính phí chưa rà soát.

Lập ngân sách quanh kết quả đã chấp nhận và công việc có giới hạn

Định nghĩa đơn vị công việc được chấp nhận trước khi đo: thay đổi mã đã kiểm thử, bản ghi sản phẩm-locale đã duyệt hoặc ghi chú nghiên cứu liên kết nguồn. Chi phí trên đơn vị được chấp nhận là chi phí tác vụ có thể quy kết chia số đơn vị đã chấp nhận, chỉ khi số đó khác không. Báo cáo mẫu và mức sử dụng chưa giải quyết cùng tỷ lệ.

Dùng cùng lúc trần yêu cầu, thử lại có giới hạn và điều kiện dừng tác vụ. Trường max_output_tokens được ghi nhận giới hạn tạo, gồm suy luận, nhưng không phải ngân sách tiền tệ hoàn chỉnh cho tác vụ nhiều yêu cầu. Đặt kiểm soát tài khoản và theo dõi chi tiêu tích lũy. Đánh giá ngữ cảnh nhỏ hơn hoặc cài đặt suy luận khác theo cùng tiêu chí chấp nhận, không quảng bá là tiết kiệm chắc chắn.

Khả dụng nhà cung cấp và bằng chứng: ngày 5 tháng 9 năm 2026

Các trường sử dụng và công thức trong hướng dẫn này lấy từ tài liệu OpenAI chính thức. Không có chi phí tác vụ hoặc runtime Astra nào được đo cho bài viết. Ngày 5 tháng 9 năm 2026, endpoint giá APIsRouter công khai trả về HTTP 200, success: true và 34 mô hình không có Astra hoặc GPT-6, nên ở đây không có báo giá Astra của APIsRouter.

Dùng giá hiện tại của OpenAI cho yêu cầu Astra trực tiếp và danh mục APIsRouter trực tiếp cho các sản phẩm của nó. So sánh nhà cung cấp cần tác vụ tương ứng, danh tính mô hình thực tế, đầu ra được chấp nhận, usage đầy đủ và rate áp dụng. Giữ các bản ghi với phép tính để người đọc phân biệt ước tính với hóa đơn đã đối soát.

Câu hỏi thường gặp

Giá API Astra hiện tại là bao nhiêu?

Dùng trang giá API OpenAI chính thức cho gpt-6-astra. Chọn tầng dịch vụ và dải ngữ cảnh áp dụng cho yêu cầu, gồm rate đọc cache và ghi cache riêng.

Token suy luận có tính thêm ngoài output_tokens không?

Token suy luận nằm trong mức sử dụng output. Áp dụng giá output cho output_tokens một lần; giữ output_tokens_details.reasoning_tokens để chẩn đoán thay vì cộng lại.

Ghi cache ảnh hưởng công thức thế nào?

Trừ cached_tokens và cache_write_tokens khỏi tổng input để có input thường. Định giá input thường, đọc cache và ghi cache riêng theo rate chính thức áp dụng.

Timeout hoặc câu trả lời chưa hoàn chỉnh có miễn phí không?

Không nhất thiết. Tạo chưa hoàn chỉnh có thể tiêu thụ token và timeout có thể để lại bằng chứng thanh toán chưa giải quyết. Giữ usage trả về và đối soát bản ghi thiếu thay vì gán chi phí bằng không.

Một tác vụ Astra qua APIsRouter tốn bao nhiêu?

Không có báo giá từ lần kiểm tra ngày 5 tháng 9 năm 2026 vì Astra vắng trong danh mục. Kiểm tra sản phẩm hiện tại; dùng giá OpenAI cho ước tính Astra trực tiếp.