Claude Opus 5.5 כבר זמין ב-SeedRouter
LogoSeedRouter

חיפוש מודלים לפי שם, למשל 'nano banana'

חיפוש מודלים לפי שם, למשל 'nano banana'

מחירי Grok 4.7: קלט מהמטמון, חשיבה ועלות הבקשה

הבן את מחירי Grok 4.7, הקלט מהמטמון וצריכת החשיבה. הערך את עלות הבקשה לפי תעריפי הטוקנים העדכניים, בלי לספור טוקנים מהמטמון פעמיים.

קריאה כ-Markdown

מחירי Grok 4.7 תלויים בטוקני הקלט, בקלט מהמטמון ובצריכת הפלט. תעריפי הפתיחה הרשמיים הם 2 דולר אמריקאי למיליון טוקני קלט ו-6 דולר אמריקאי למיליון טוקני פלט. תעריפי הבסיס האלה מתארים את מחיר המחירון של המודל; כדי להעריך בקשת SeedRouter, השתמש בטבלת המחירים העדכנית של SeedRouter שלהלן.[1]

האורך הגלוי של התשובה הוא רק חלק מהחישוב. תשובה קצרה עשויה לכלול טוקני חשיבה נוספים, ופרומפט ארוך עשוי להכיל קלט מהמטמון. דף המודל Grok 4.7 מרכז את ה-Playground ואת המחירים העדכניים.

כמה עולה Grok 4.7?

ההודעה הרשמית מציגה את תעריפי הקלט והפלט שלעיל כמחירי הפתיחה של Grok 4.7. היא מתארת גם גרסת fast נפרדת במחיר שונה. המדריך הזה עוסק במודל grok-4.7; מחיר של גרסה בעלת שם דומה אינו תחליף למחיר שלו.[2]

לבקשה דרך SeedRouter, השתמש בתעריפי הטוקנים העדכניים האלה:

התמחור אינו זמין כרגע. נסה שוב בקרוב.

קרא את התעריפים של המדרגה המתאימה לאורך הקלט של הבקשה. ב-SeedRouter, קלט קצר מ-200,000 טוקנים משתמש במדרגה הרגילה; קלט של 200,000 טוקנים ומעלה משתמש במדרגת ההקשר הארוך לכל הבקשה. קלט, קלט מהמטמון ופלט משתמשים כל אחד במדרגה המתאימה. הסף הוא גבול תמחור, לא שמירה מראש של מספר הטוקנים הזה.

עם service_tier: "priority" או "fast", הכפל את תעריפי הטוקנים במדרגת אורך הקלט שנבחרה. המכפיל חל על חיובי הטוקנים; חיובי הכלים מחושבים בנפרד.

סקירת ה-API הרשמית מציינת חלון הקשר של 500,000 טוקנים. מגבלת היכולת הזו אינה אומרת שכל בקשה מחויבת על החלון כולו.[1]

אילו שדות שימוש נכללים בחישוב?

ב-Responses API, שמור שלושה ערכים מתוך usage שהוחזר:

שדה שימושאיך להשתמש בו
input_tokensסך הקלט, כולל החלק מהמטמון
input_tokens_details.cached_tokensחלק הקלט שמחויב בתעריף הקלט מהמטמון
output_tokensסך הפלט המשמש לחישוב הטוקנים

הפחת את הטוקנים מהמטמון מסך הקלט לפני החלת תעריף הקלט הרגיל. אחרת, אותם טוקנים מהמטמון ייספרו בהערכה פעם אחת כקלט רגיל ופעם נוספת כקלט מהמטמון.

כאשר התעריפים נקובים למיליון טוקנים:

uncached input = input_tokens - cached_tokens

token cost = (
  uncached input × input rate
  + cached_tokens × cached-input rate
  + output_tokens × output rate
) / 1,000,000

השתמש בתעריפים שבטבלה העדכנית לכל איבר. בחר את מדרגת אורך הקלט לפי סך הקלט לפני הפחתת הטוקנים מהמטמון. אומדן טוקנים אינו כולל אוטומטית חיובי כלים נפרדים; בבקשה שמשתמשת בכלי חיפוש בתשלום צריך להביא בחשבון גם את השימוש הזה.

למה תשובה קצרה עשויה להשתמש ביותר טוקני פלט?

החשיבה תורמת לצריכת הפלט גם כשהתשובה הסופית קצרה. לדוגמה, בקשת Responses אחת ל-Grok 4.7 שהושלמה ואומתה ב-10 באוקטובר 2026 החזירה:

{
  "input_tokens": 3340,
  "input_tokens_details": { "cached_tokens": 1152 },
  "output_tokens": 22,
  "output_tokens_details": { "reasoning_tokens": 21 },
  "total_tokens": 3362
}

הבקשה הזו כוללת 2,188 טוקני קלט שאינם מהמטמון, 1,152 טוקני קלט מהמטמון ו-22 טוקני פלט. 21 טוקני החשיבה שלה הם פירוט של סך הפלט. הוספתם שוב תהפוך 22 ל-43 ותגדיל את אומדן עלות הפלט מעבר לנדרש.

המספרים האלה מתארים בקשה אחת שהושלמה, לא ממוצע או תחזית לפרומפטים אחרים. כדי לתכנן תקציב לאפליקציה שלך, תעד את השימוש המדווח במשימות מייצגות ובדוק אם כל תוצאה עומדת בדרישות המשימה.

האם הזרמה משנה את מחיר הטוקנים?

הזרמה משנה את הדרך שבה התשובה מגיעה. האומדן עדיין משתמש בקלט, בקלט מהמטמון ובפלט של הבקשה שהושלמה. שמור את נתוני השימוש הסופיים במקום להתייחס לכל מקטע טקסט כבקשה נפרדת לחיוב.

באימות Grok 4.7 של SeedRouter, בקשות Chat ו-Responses עם הזרמה ובלעדיה הושלמו תוך התחשבות בקלט מהמטמון. זה מאמת את חישוב השימוש; אין פירוש הדבר ששתי תשובות שנוצרו בנפרד צורכות בדיוק אותו מספר טוקנים.

איך להשוות את העלות של שני פרומפטים?

שמור על אותה משימה ועל אותם קריטריוני קבלה. תעד בכל ניסיון את סך הקלט, הקלט מהמטמון, הפלט והאם התשובה הייתה שימושית. השווה את ההוצאה הכוללת לקבלת תוצאה מספקת, כולל יצירות שהושלמו בהצלחה אך נדרש לחזור עליהן מפני שהתשובות לא היו מספקות.

בשיחה ארוכה, הסר היסטוריה לא רלוונטית רק אחרי שבדקת שהגרסה הקצרה עדיין עונה נכון. בהקשר חוזר, בדוק את מספר הטוקנים מהמטמון; חזרה על טקסט לבדה אינה הוכחה שהקלט נמצא במטמון. במשימות שדורשות חשיבה רבה, השווה את צריכת הפלט בפועל במקום לספור רק את המילים המוצגות בתשובה.

שאלות על מחירים

האם תעריף הבסיס הרשמי הוא המחיר שאני משלם ב-SeedRouter?

עבור SeedRouter, השתמש בטבלה החיה שלמעלה. מחיר הפתיחה הרשמי מספק הקשר מועיל, ואילו מדרגות אורך הקלט ותעריפי הטוקנים העדכניים של השירות קובעים את האומדן.

האם צריך להוסיף reasoning_tokens ל-output_tokens?

לא. בנתוני השימוש של Responses שהוצגו לעיל, החשיבה כבר כלולה בסך הפלט. השתמש בפירוט החשיבה כדי להבין את העבודה שבוצעה, לא כחיוב פלט נוסף.

האם חזרה על פרומפט מבטיחה הנחה על קלט מהמטמון?

לא. השתמש במספר הטוקנים מהמטמון שמדווח בתגובה. החל את תעריף הקלט מהמטמון רק על החלק הזה, ואת תעריף הקלט הרגיל על היתר.

איפה אפשר לבדוק את החיוב הסופי?

רישומי השימוש מציגים את החיוב של הבקשה שהושלמה. לאומדן חדש, רענן את מקטע המחירים של Grok 4.7 והשתמש בנתוני השימוש המדווחים של אותה בקשה. בקשות שמחזירות שגיאה אינן מחויבות.

מקורות

  1. SpaceXAI API: מודלי Grok ומחירים, נבדק ב-10 באוקטובר 2026.
  2. הצגת Grok 4.7, 21 בספטמבר 2026.

מדריכים קשורים