עלויות API של Astra: משימוש לעבודה שאושרה
Updated 2026-09-05
חשבו קלט רגיל, קריאות מטמון, כתיבות מטמון ופלט בנפרד. השתמשו בכרטיס התעריפים הרשמי הנוכחי וביומן בקשות מלא כדי להעריך משימה.
בחרו מערכת חיוב לפני בחירת תעריף
בקשות ישירות ל-Astra API משתמשות בחיוב OpenAI Platform. עבודה ב-Codex המאומתת באמצעות ChatGPT משתמשת במכסות ובקרדיטים של מנוי או סביבת עבודה. OpenAI מפרסמת אותם בנפרד, ולכן תעריף קרדיט Codex אינו מחיר דולרי לטוקן API וסבב כלול במנוי אינו חשבון API.
עבור בקשות ישירות, פתחו את דף תמחור ה-API הרשמי ובחרו את תעריפי gpt-6-astra המתאימים לפי רמת השירות, טווח ההקשר והסדר העיבוד. שמרו את כתובת ה-URL של כרטיס התעריפים ואת תאריך התצפית לצד ההערכה. בנו את החישוב משימוש ברמת הבקשה, ואז השוו את הסכום לרשומות השימוש ולחשבון Platform. כך קל יותר לאתר בחירת תעריף שגויה או בקשות חסרות.

לכדו את שדות השימוש המדויקים של Responses
המדריך הרשמי ל-prompt caching מתעד את input_tokens, input_tokens_details.cached_tokens ואת input_tokens_details.cache_write_tokens. קריאות מטמון וכתיבות מטמון הן קטגוריות נפרדות בתוך הקלט, לכן הפחיתו את שתיהן לפני חישוב הקלט הרגיל. ההנחה שכל טוקן שאינו במטמון מחויב בתעריף הקלט הרגיל עלולה להמעיט בעלות של בקשה שכותבת למטמון.
מדריך ההסקה מתעד את output_tokens ואת output_tokens_details.reasoning_tokens. טוקני הסקה כלולים בשימוש הפלט; אל תוסיפו אותם שוב כקטגוריית טוקנים מחויבת נוספת. שמרו את total_tokens כסכום שימוש, לא כמספר שמכפילים בתעריף משולב אחד. תעדו את אובייקט השימוש המלא כדי שההתאמה העתידית לא תהיה תלויה בלוג טקסט חלקי בלבד.
| שדה Responses | משמעות | טיפול חשבונאי |
|---|---|---|
| שדה usage.input_tokens | סך טוקני הקלט | הפרידו קלט רגיל, קריאות מטמון וכתיבות מטמון |
| שדה usage.input_tokens_details.cached_tokens | טוקני קלט במטמון | החילו את תעריף הקלט שבמטמון |
| שדה usage.input_tokens_details.cache_write_tokens | טוקני קלט שנכתבו למטמון | החילו את תעריף הכתיבה למטמון |
| שדה usage.output_tokens | טוקני פלט כולל הסקה | החילו את תעריף הפלט פעם אחת |
| שדה usage.output_tokens_details.reasoning_tokens | הסקה בתוך הפלט | שמרו כתת-קבוצה אבחונית |
| שדה usage.total_tokens | שימוש כולל בקלט ובפלט | שמרו לצורך התאמה |
חשבו את סיכום הטוקנים בלי לספור פעמיים
נסמן ב-I את טוקני הקלט, ב-C את הקלט שבמטמון, ב-W את קלט הכתיבה למטמון וב-O את טוקני הפלט. הקלט הרגיל הוא I - C - W. כאשר התעריפים R_input, R_cached, R_write ו-R_output מצוטטים באותו מטבע למיליון טוקנים, סיכום הטוקנים הוא ((I - C - W) * R_input + C * R_cached + W * R_write + O * R_output) / 1,000,000.
הפונקציה הלא-מקוונת שלמטה מקבלת שימוש שנצפה וכרטיס תעריפים שנבחר בנפרד. שמות התעריפים שלה הם משתני יישום, לא שדות API. היא מחזירה null כאשר קלט חסר או אינו עקבי, במקום להתייחס בשקט לשימוש לא ידוע כחינמי. התוצאה מכסה טוקנים בלבד, לא כלים, מסים או פריטי חיוב אחרים.
function estimateTokenCost(usage, rates) {
const I = usage?.input_tokens
const C = usage?.input_tokens_details?.cached_tokens
const W = usage?.input_tokens_details?.cache_write_tokens
const O = usage?.output_tokens
const tokens = [I, C, W, O]
const prices = [rates?.input, rates?.cached, rates?.write, rates?.output]
if (!tokens.every(n => Number.isSafeInteger(n) && n >= 0)) return null
if (!prices.every(n => Number.isFinite(n) && n >= 0)) return null
if (C > I || W > I - C) return null
const subtotal = ((I - C - W) * rates.input
+ C * rates.cached + W * rates.write
+ O * rates.output) / 1_000_000
return Number.isFinite(subtotal) ? subtotal : null
}פתרו את כללי ההקשר ורמת השירות עבור כל בקשה
התמחור הרשמי של Astra מבחין בין קלט רגיל, קלט במטמון, כתיבות מטמון ופלט, עם טווחי הקשר ורמות שירות שונות. פתרו את הכללים האלה עבור כל בקשה לפני העברת תעריפים לנוסחה. אל תחילו מכפיל שוב אם שורת כרטיס התעריפים שבחרתם כבר כוללת אותו.
שמרו את מטא-נתוני רמת השירות והעיבוד עם התשובה והשוו אותם למה שהתבקש. אל תשתמשו במכפילי מהירות או קרדיטים של Codex בחישוב API ישיר: הם שייכים ללוח תמחור של מוצר אחר. עבור הסדרי עיבוד חריגים, בצעו התאמה מול תנאי הספק הרלוונטיים. נוסחת טוקנים נכונה עם בסיס תעריף שגוי עדיין מפיקה הערכת עלות שגויה.
הפרידו הערכות טוקנים מעלויות משימה מלאות
משימה יכולה לדרוש כמה בקשות מודל, קריאות לכלים ותיקונים. הוסיפו את סיכום הטוקנים לכל בקשה מתועדת, ואז הוסיפו בנפרד כלים או שירותים של הספק שחויבו לפי השימוש והמחיר בפועל. היכולת של מודל לקרוא לכלי אינה אומרת שהכלי כלול ללא חיוב נוסף.
שמרו תשתית, הוצאות יצירת נכסים וזמן בדיקה אנושית בקטגוריות נפרדות. צרפו קבלות שירות ואת התקופה שהן מכסות, והקצו עלויות משותפות בעקביות בין משימות. עבור משחק, אצווה של לוקליזציה או משימת מחקר, ציינו אילו רכיבים כלולים בסך הכול. הפרידו מסים והמרות מטבע מתעריפי טוקנים כדי שתוכלו להתאים גם את סיכום השימוש וגם את הסכום ששולם בפועל.
| רכיב עלות | ראיות לשמירה | כלל שילוב |
|---|---|---|
| טוקני מודל | שימוש Responses בתוספת תעריפי API מתאימים | סכמו תתי-סכומים של בקשות |
| כלים או שירותים של הספק | שימוש בכלי וקטגוריית התמחור הרשמית | הוסיפו פריטים שחויבו בנפרד |
| זמן ריצה או נכסים אחרים | קבלות שירות וייחוס | דווחו בקטגוריות נפרדות |
| בדיקה אנושית | זמן מתועד ושיטת הערכה מצוינת | שמרו בנפרד מהוצאות API |
השאירו ניסיונות חוזרים, עבודה חלקית ושימוש חסר גלויים
מדריך ההסקה של OpenAI מזהיר שיצירה חלקית יכולה לצרוך טוקני קלט והסקה בלי להפיק טקסט נראה. ספרו שימוש שהוחזר בפועל גם כאשר התוצאה נכשלת בבדיקת הקבלה שלכם. אל תגביל את היומן לתשובות סופיות מוצלחות ואל תעריך הוצאה רק לפי אורך התשובה.
לכל ניסיון, שמרו זהות תשובה, מודל, סטטוס, שימוש ואת המשימה שאליה הוא שייך. התאימו כפילויות לפני הסיכום. אם חיבור נכשל ולא התקבל שימוש, סמנו את הניסיון כלא פתור עד שרשומות הספק יבהירו אותו; לא נקבעו עלות אפס או הצלחה מלאה. הגבילו ניסיונות חוזרים כדי שתקלה זמנית לא תיצור סדרה לא-נבדקת של ניסיונות מחויבים.
בנו תקציב סביב תוצאות מאושרות ועבודה מוגבלת
הגדירו את יחידת העבודה המאושרת לפני המדידה: שינוי קוד שנבדק, רשומת מוצר-locale שאושרה או הערת מחקר המקושרת למקור. העלות ליחידה מאושרת היא עלות המשימה שניתן לייחס לה חלקי מספר היחידות המאושרות, ורק כאשר המספר אינו אפס. דווחו על המדגם ועל השימוש הלא-פתור לצד היחס.
השתמשו יחד בתקרת בקשות, ניסיונות חוזרים מוגבלים ותנאי עצירת משימה. השדה המתועד max_output_tokens מגביל יצירה, כולל הסקה, אך אינו תקציב מטבע מלא למשימה מרובת בקשות. הגדירו גם בקרות חשבון ועקבו אחר הוצאה מצטברת. יש להעריך הקשר קטן יותר או הגדרות הסקה שונות מול אותם קריטריוני קבלה, לא לפרסם אותם כחיסכון מובטח.
זמינות הספק והראיות: 5 בספטמבר 2026
שדות השימוש והנוסחה במדריך זה מגיעים מתיעוד OpenAI הרשמי. עבור המאמר לא נמדדו עלות או זמן ריצה של משימת Astra. ב-5 בספטמבר 2026 נקודת הקצה הציבורית של תמחור APIsRouter החזירה HTTP 200, success: true ו-34 מודלים ללא Astra או GPT-6, ולכן אין כאן הצעת מחיר ל-Astra דרך APIsRouter.
השתמשו בתמחור העדכני של OpenAI לבקשות Astra ישירות ובקטלוג החי של APIsRouter להצעות שלו. השוואת ספקים דורשת משימות תואמות, זהות מודל בפועל, פלטים מאושרים, שימוש מלא ותעריפים מתאימים. שמרו את הרשומות האלה עם החישוב כדי שהקוראים יוכלו להבדיל בין הערכה לחשבון משימה שהתואם בפועל.
שאלות נפוצות
מה המחיר הנוכחי של Astra API?
השתמשו בדף התמחור הרשמי של OpenAI API עבור gpt-6-astra. בחרו את רמת השירות ואת טווח ההקשר המתאימים לבקשה, כולל תעריפי קריאה וכתיבה נפרדים של מטמון.
האם טוקני הסקה מחויבים בנוסף ל-output_tokens?
טוקני הסקה כלולים בשימוש הפלט. החילו את תעריף הפלט על output_tokens פעם אחת ושמרו את output_tokens_details.reasoning_tokens לאבחון במקום להוסיף אותו שוב.
כיצד כתיבות מטמון משפיעות על הנוסחה?
הפחיתו cached_tokens ו-cache_write_tokens מסך הקלט כדי לקבל קלט רגיל. תמחור קלט רגיל, קריאות מטמון וכתיבות מטמון צריך להיעשות בנפרד לפי התעריפים הרשמיים המתאימים.
האם timeout או תשובה חלקית הם בחינם?
לא בהכרח. יצירה חלקית יכולה לצרוך טוקנים, ו-timeout עלול להשאיר ראיות חיוב לא פתורות. שמרו את השימוש שהוחזר והתאימו רשומות חסרות במקום להקצות עלות אפס.
כמה עולה משימת Astra דרך APIsRouter?
אין הצעת מחיר מבדיקת 5 בספטמבר 2026, כי Astra לא הופיעה בקטלוג. בדקו הצעות נוכחיות והשתמשו בתמחור OpenAI להערכות ישירות של Astra.