사용량에서 승인된 작업까지 Astra API 비용 계산

Updated 2026-09-05

일반 입력, 캐시 읽기, 캐시 쓰기, 출력을 각각 집계하세요. 현재 공식 가격표와 완전한 요청 원장을 사용해 작업 비용을 추정합니다.

요금을 선택하기 전에 결제 시스템을 정하세요

Astra API 직접 요청은 OpenAI Platform 결제를 사용합니다. ChatGPT 인증 Codex 작업은 구독 또는 워크스페이스 허용량과 크레딧을 사용합니다. OpenAI는 이를 별도로 공개하므로 Codex 크레딧 요율은 API 토큰당 달러 가격이 아니며 포함된 구독 턴은 API 영수증이 아닙니다.

직접 요청의 경우 공식 API 가격 페이지를 열고 서비스 등급, 컨텍스트 구간, 처리 방식에 적용되는 gpt-6-astra 요율을 선택하세요. 요율표 URL과 관찰 날짜를 추정치와 함께 보존하세요. 요청 단위 사용량으로 계산한 뒤 합계를 Platform 사용량 기록 및 청구서와 비교합니다. 이렇게 하면 요율 선택 오류나 누락된 요청을 더 쉽게 찾을 수 있습니다.

Codex 구독 액세스, OpenAI Platform API에 대한 직접 액세스, 애그리게이터의 모델 카탈로그 및 청구를 비교합니다.
액세스 및 청구 일러스트레이션. 선택한 계정과 제공업체를 각각 확인하세요.

정확한 Responses 사용량 필드를 수집하세요

공식 프롬프트 캐싱 가이드는 input_tokens, input_tokens_details.cached_tokens, input_tokens_details.cache_write_tokens를 문서화합니다. 캐시된 읽기와 캐시 쓰기는 입력 내부의 별도 범주이므로 일반 입력을 계산하기 전에 둘 다 차감하세요. 캐시에 쓰는 요청을 일반 입력 토큰으로만 가정하면 비용이 실제보다 낮아질 수 있습니다.

추론 가이드는 output_tokens와 output_tokens_details.reasoning_tokens를 문서화합니다. 추론 토큰은 출력 사용량에 포함되므로 별도의 청구 토큰 범주로 다시 더하지 마세요. total_tokens는 하나의 혼합 요율을 곱할 개수가 아니라 사용량 합계로 취급하세요. 나중에 대조할 때 불완전한 텍스트 전용 로그에 의존하지 않도록 전체 usage 객체를 기록하세요.

출처: OpenAI 프롬프트 캐싱 및 추론 가이드, 2026년 9월 5일 가져옴. 이 필드 경로는 Responses용입니다.
Responses 필드의미집계 처리
usage.input_tokens전체 입력 토큰일반 입력, 캐시 읽기, 쓰기로 분리
usage.input_tokens_details.cached_tokens캐시된 입력 토큰캐시 입력 요율 적용
usage.input_tokens_details.cache_write_tokens캐시에 기록된 입력 토큰캐시 쓰기 요율 적용
usage.output_tokens추론을 포함한 출력 토큰출력 요율을 한 번 적용
usage.output_tokens_details.reasoning_tokens출력에 포함된 추론진단용 하위 집합으로 보존
usage.total_tokens전체 입력 및 출력 사용량대조를 위해 보존

토큰 소계를 중복 집계 없이 계산하세요

I를 입력 토큰, C를 캐시된 입력, W를 캐시 쓰기 입력, O를 출력 토큰이라고 하겠습니다. 일반 입력은 I - C - W입니다. 동일 통화의 백만 토큰당 요율 R_input, R_cached, R_write, R_output을 사용하면 토큰 소계는 ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000입니다.

아래 오프라인 함수는 관찰된 사용량과 별도로 선택한 요율표를 받습니다. 함수의 요율 이름은 애플리케이션 변수이며 API 필드가 아닙니다. 결과는 알 수 없는 사용량을 조용히 무료로 처리하지 않고 입력 누락 또는 불일치 시 null을 반환합니다. 이 결과에는 토큰만 포함되며 도구, 세금, 기타 청구 항목은 포함되지 않습니다.

function estimateTokenCost(usage, rates) {
  const I = usage?.input_tokens
  const C = usage?.input_tokens_details?.cached_tokens
  const W = usage?.input_tokens_details?.cache_write_tokens
  const O = usage?.output_tokens
  const tokens = [I, C, W, O]
  const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
  if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
  if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
  if (C > I || W > I - C) return null
  const subtotal = ((I - C - W) * rates.input
    + C * rates.cached + W * rates.write
    + O * rates.output) / 1_000_000
  return Number.isFinite(subtotal) ? subtotal : null
}

요청별 컨텍스트와 서비스 등급 규칙을 확인하세요

Astra의 공식 가격은 일반 입력, 캐시 입력, 캐시 쓰기, 출력을 서로 다른 컨텍스트 구간 및 서비스 등급과 함께 구분합니다. 요율을 공식에 넣기 전에 각 요청에 해당하는 규칙을 확인하세요. 배수가 포함된 요율표 행을 이미 선택했다면 배수를 다시 적용하지 마세요.

응답과 함께 서비스 등급 및 처리 메타데이터를 보존하고 요청한 내용과 비교하세요. Codex 속도 또는 크레딧 배수를 직접 API 계산에 재사용하지 마세요. 이는 다른 제품 가격 체계에 속합니다. 특수한 처리 방식이라면 해당 제공업체 조건과 대조하세요. 토큰 공식이 정확해도 잘못된 요율 기준을 사용하면 비용 추정은 여전히 틀립니다.

토큰 추정과 전체 작업 비용을 분리하세요

하나의 작업에 여러 모델 요청, 도구 호출, 수정이 필요할 수 있습니다. 기록된 각 요청의 토큰 소계를 더한 뒤, 실제 사용량과 가격에 따라 별도로 청구되는 제공업체 도구 또는 서비스를 추가하세요. 모델이 도구를 호출할 수 있다고 해서 그 도구가 추가 비용 없이 포함된다는 뜻은 아닙니다.

인프라, 에셋 생성 비용, 사람의 검토 시간을 별도 범주로 관리하세요. 서비스 영수증과 적용 기간을 첨부하고 공유 비용은 작업별로 일관되게 배분하세요. 게임, 현지화 배치, 리서치 작업이라면 총액에 어떤 구성요소가 포함되는지 밝히세요. 세금과 환율 변환은 토큰 요율과 분리해 토큰 소계와 실제 납부액을 모두 대조할 수 있도록 하세요.

OpenAI 토큰 및 도구 가격 범주와 기타 제공 비용을 위한 별도 범주.
비용 구성요소보존할 근거결합 규칙
모델 토큰Responses 사용량과 적용 API 요율요청별 소계를 합산
제공업체 도구 또는 서비스도구 사용량과 공식 가격 범주별도 청구 항목을 추가
기타 런타임 또는 에셋서비스 영수증과 귀속 정보별도 범주로 보고
사람의 검토기록된 시간과 명시된 평가 방식API 지출과 별도로 유지

재시도, 불완전한 작업, 누락된 사용량을 드러내세요

OpenAI 추론 가이드는 불완전한 생성이 눈에 보이는 텍스트를 만들지 않고도 입력 및 추론 토큰을 소비할 수 있다고 경고합니다. 결과가 승인 기준을 통과하지 못하더라도 실제 반환된 사용량은 집계하세요. 성공한 최종 답변만 원장에 넣거나 답변 길이만으로 지출을 추정하지 마세요.

각 시도에 대해 응답 식별자, 모델, 상태, 사용량, 소속 작업을 보존하세요. 합산하기 전에 중복을 대조하세요. 연결이 끊기고 사용량이 도착하지 않았다면 제공업체 기록으로 확인될 때까지 미해결 상태로 표시하세요. 비용이 0이거나 완전히 성공했다고 확정할 수 없습니다. 임시 오류가 검토되지 않은 청구 시도를 연속으로 만들지 않도록 재시도 횟수에 상한을 두세요.

승인된 결과와 제한된 작업량을 기준으로 예산을 정하세요

측정하기 전에 승인된 작업의 단위를 정의하세요. 테스트된 코드 변경, 승인된 제품 현지화 레코드, 출처가 연결된 리서치 노트처럼 정할 수 있습니다. 승인 단위 수가 0이 아닌 경우에만 승인 단위당 비용을 귀속 가능한 작업 비용을 승인 단위 수로 나눈 값으로 계산하세요. 표본과 미해결 사용량을 비율과 함께 보고하세요.

요청 상한, 제한된 재시도, 작업 중지 조건을 함께 사용하세요. 문서화된 max_output_tokens 필드는 추론을 포함한 생성을 제한하지만 여러 요청으로 이루어진 작업의 전체 통화 예산은 아닙니다. 계정 제어도 설정하고 누적 지출을 추적하세요. 더 작은 컨텍스트나 다른 추론 설정은 보장된 절약으로 홍보하지 말고 같은 승인 기준으로 평가해야 합니다.

제공업체 제공 여부와 근거: 2026년 9월 5일

이 가이드의 사용량 필드와 공식은 OpenAI 공식 문서에서 가져왔습니다. 글을 위해 Astra 작업 비용이나 런타임을 측정하지 않았습니다. 2026년 9월 5일 공개 APIsRouter 가격 엔드포인트는 Astra 또는 GPT-6 없이 HTTP 200, success: true, 34개 모델을 반환했으므로 여기에는 APIsRouter Astra 견적이 없습니다.

직접 Astra 요청에는 OpenAI의 현재 가격을 사용하고, APIsRouter 자체 제공 항목은 실시간 카탈로그에서 확인하세요. 제공업체 비교에는 동일한 작업, 실제 모델 식별자, 승인된 출력, 완전한 사용량, 적용 요율이 필요합니다. 추정치와 대조된 작업 청구서를 구분할 수 있도록 이러한 기록을 계산과 함께 보존하세요.

자주 묻는 질문

현재 Astra API 가격은 얼마인가요?

gpt-6-astra의 가격은 OpenAI 공식 API 가격 페이지에서 확인하세요. 캐시 읽기와 캐시 쓰기 요율을 포함해 요청에 적용되는 서비스 등급과 컨텍스트 구간을 선택합니다.

추론 토큰은 output_tokens에 더해 별도로 청구되나요?

추론 토큰은 출력 사용량에 포함됩니다. output_tokens에 출력 요율을 한 번 적용하고, output_tokens_details.reasoning_tokens는 진단용으로 보존하되 다시 더하지 마세요.

캐시 쓰기는 공식에 어떤 영향을 주나요?

전체 입력에서 cached_tokens와 cache_write_tokens를 차감해 일반 입력을 구하세요. 적용되는 공식 요율을 사용해 일반 입력, 캐시 읽기, 캐시 쓰기를 별도로 가격 책정합니다.

타임아웃이나 불완전한 답변은 무료인가요?

반드시 그렇지는 않습니다. 불완전한 생성은 토큰을 소비할 수 있고 타임아웃은 결제 근거를 미해결 상태로 남길 수 있습니다. 비용을 0으로 지정하지 말고 반환된 사용량을 보존하고 누락된 기록을 대조하세요.

APIsRouter를 통한 Astra 작업 비용은 얼마인가요?

2026년 9월 5일 확인에서 Astra가 카탈로그에 없었으므로 견적은 없습니다. 현재 제공 항목을 확인하고 직접 Astra 추정에는 OpenAI 가격을 사용하세요.