Claude Opus 5.5 כבר זמין ב-SeedRouter
SeedRouter Docs

GPT-6 Astra

קריאה ל-GPT-6 Astra עם ה-API הרשמי של OpenAI בפורמט Responses או Chat Completions: חלון הקשר של 1.05M טוקנים, עד 128K טוקני פלט ורמת הסקה לבחירתך.

View Markdown

GPT-6 Astra הוא המודל החזק ביותר של OpenAI, שנבנה לעבודה הקשה ביותר מקצה לקצה: הסקה מורכבת, תכנות, מחקר ויצירת מסמכים. שלח את בקשת OpenAI Responses או Chat Completions הרשמית ל-SeedRouter: שנה את כתובת הבסיס ואת מפתח ה-API, שמור את גוף הבקשה.

מזהה המודל

מזהה המודלחלון הקשרפלט מקסימלירמת הסקהרמת הסקה ברירת מחדל
gpt-6-astra1.05M טוקנים (922K קלט)128K טוקניםlow, medium, high, xhigh, maxלא מתועד

קלט: טקסט ותמונות. פלט: טקסט. תאריך סיום הידע: 30 באפריל 2026. ראה את דף המודל לקבלת המחירים הנוכחיים.

דוגמה מהירה

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

נקודות קצה

פורמטשיטה וכתובתאימות
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> או Authorization: Bearer <key>, בתוספת anthropic-version

נקודות הקצה של OpenAI מעבירות את גוף הבקשה שלך כפי שנשלח ומחזירות את התשובה הרשמית. שמור את מפתח ה-API בקוד שרץ בצד השרת.

פרמטרים

שדות Responses API:

שםסוגחובהברירת מחדלהערות
modelstringכן—gpt-6-astra.
inputstring or object[]כן—פרומפט, או פריטי קלט: הודעות שה-content שלהן מכיל חלקי input_text ו-input_image.
instructionsstringלא—הנחיות מערכת (מפתח).
max_output_tokensintegerלאהמקסימום של המודל16–128000. כולל טוקני הסקה.
reasoning.effortenumלאלא מתועדlow, medium, high, xhigh, max.
reasoning.summaryenumלא—auto, concise או detailed: מחזיר סיכום של ההסקה.
reasoning.modeenumלאstandardstandard או pro.
reasoning.contextenumלאautoauto, current_turn או all_turns: איזו הסקה קודמת מוצגת למודל.
text.verbosityenumלאmediumlow, medium או high.
text.formatobjectלא—פלט מובנה, לדוגמה {"type": "json_schema", "name": "...", "schema": {...}}.
temperaturenumberלא—0–2. לא מתקבל: GPT-6 Astra תמיד מבצע הסקה. השמט אותו.
top_pnumberלא—0–1. לא מתקבל: GPT-6 Astra תמיד מבצע הסקה. השמט אותו.
top_logprobsintegerלא—0–20. לא מתקבל: GPT-6 Astra תמיד מבצע הסקה. השמט אותו.
streambooleanלאfalseהזרמת התשובה כאירועים שנשלחים מהשרת.
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—לא—מועברים כפי שנשלחו.

לא זמינים: background, service_tier (כולל Batch, Flex ומצב מהיר) ו-safety_identifier.

הסקה ורמת הסקה

GPT-6 Astra תמיד מבצע הסקה: none אינו נתמך ומחזיר שגיאת 400. OpenAI אינה מתעדת רמת הסקה ברירת מחדל עבור GPT-6 Astra; השמט את reasoning.effort כדי להשתמש בברירת המחדל של המודל עצמו. רמת הסקה גבוהה יותר בדרך כלל פירושה יותר טוקני פלט, המתנה ארוכה יותר ועלות גבוהה יותר. טוקני הסקה מחויבים כטוקני פלט ונספרים במסגרת max_output_tokens.

קלט תמונות

תמונות נכנסות ל-content של הודעת משתמש כחלקי input_image עם image_url:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

החלף את כתובת הדוגמה בתמונה ציבורית משלך.

מימדי חיוב

ראה את התעריפים הנוכחיים בדף המודל. בקשה מחויבת לפי הטוקנים בהם היא משתמשת:

  • טוקני קלט,
  • טוקני פלט, כולל הסקה,
  • טוקני קלט מהמטמון (usage.input_tokens_details.cached_tokens), ו-
  • טוקני כתיבה למטמון (usage.input_tokens_details.cache_write_tokens).

כאשר פרומפט מכיל יותר מ-272K טוקני קלט, הבקשה כולה מחויבת בתעריפי הקשר ארוך. הסכום נלקח מה-usage המדווח עם התשובה שהסתיימה. בקשה שנכשלת אינה מחויבת. רשומות השימוש של החשבון שלך מציגות את החיוב המדויק לכל בקשה.

פלט

בקשה שאינה בהזרמה מחזירה את אובייקט התשובה הרשמי:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-astra",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

עם "stream": true התשובה היא זרם של האירועים הרשמיים, כולל response.created, response.output_text.delta ו-response.completed; אירוע response.completed הסופי מכיל את נתוני השימוש.

Chat Completions

קוד Chat Completions קיים צריך רק כתובת בסיס חדשה ומזהה מודל:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-astra",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

הגדר את מגבלת הפלט עם max_completion_tokens ואת רמת ההסקה עם reasoning_effort. Chat Completions אינו תומך בקריאה לפונקציות עם GPT-6 Astra; השתמש ב-Responses API עבור כלים.

פורמט Anthropic Messages

גם קוד שנכתב עבור Anthropic Messages API יכול לקרוא ל-GPT-6 Astra: שלח את גוף ה-Messages אל /v1/messages עם "model": "gpt-6-astra". הבקשה מומרת ל-Chat Completions, כך שלשדה ללא מקביל ב-Chat Completions אין השפעה. התשובה מכילה את שדות Messages הרשמיים וייתכן שתכלול כמה שדות שימוש נוספים; קרא את usage.input_tokens, usage.output_tokens ואת השדות הרשמיים.

שגיאות

שגיאות משתמשות בצורה {"error": {"code": ..., "message": "..."}}. ה-code הוא קוד מ-קטלוג השגיאות המשותף. בקשות שנכשלו אינן מחויבות.

טיפים

  • התחל עם medium והעלה את רמת ההסקה רק למשימות שדורשות הסקה עמוקה יותר; רמת ההסקה משנה גם את האיכות וגם את העלות.
  • הגדר max_output_tokens גבוה מספיק גם להסקה וגם לתשובה: זה תקציב אחד לשתיהן.
  • שים הקשר ארוך שחוזר על עצמו בתחילת הפרומפט כדי שבקשות מאוחרות יותר יקראו אותו מהמטמון בתעריף הנמוך יותר.

קשור