Claude Opus 5.5 כבר זמין ב-SeedRouter
SeedRouter Docs

GPT-6 Luna

קריאה ל-GPT-6 Luna עם ה-API הרשמי של OpenAI בפורמט Responses או Chat Completions: חלון הקשר של 1.05M טוקנים, עד 128K טוקני פלט ורמת הסקה לבחירתך.

View Markdown

GPT-6 Luna הוא מודל GPT-6 היעיל ביותר של OpenAI, שנבנה למשימות ממוקדות בנפח גבוה, והמודל הזול ביותר במשפחת GPT-6. שלח את בקשת OpenAI Responses או Chat Completions הרשמית ל-SeedRouter: שנה את כתובת הבסיס ואת מפתח ה-API, שמור את גוף הבקשה.

מזהה המודל

מזהה המודלחלון הקשרפלט מקסימלירמת הסקהרמת הסקה ברירת מחדל
gpt-6-luna1.05M טוקנים (922K קלט)128K טוקניםnone, low, medium, high, xhigh, maxmedium

קלט: טקסט ותמונות. פלט: טקסט. תאריך סיום הידע: 18 במאי 2026. ראה את דף המודל לקבלת המחירים הנוכחיים.

דוגמה מהירה

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-luna",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

נקודות קצה

פורמטשיטה וכתובתאימות
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> או Authorization: Bearer <key>, בתוספת anthropic-version

נקודות הקצה של OpenAI מעבירות את גוף הבקשה שלך כפי שנשלח ומחזירות את התשובה הרשמית. שמור את מפתח ה-API בקוד שרץ בצד השרת.

פרמטרים

שדות Responses API:

שםסוגחובהברירת מחדלהערות
modelstringכן—gpt-6-luna.
inputstring or object[]כן—פרומפט, או פריטי קלט: הודעות שה-content שלהן מכיל חלקי input_text ו-input_image.
instructionsstringלא—הנחיות מערכת (מפתח).
max_output_tokensintegerלאהמקסימום של המודל16–128000. כולל טוקני הסקה.
reasoning.effortenumלאmediumnone, low, medium, high, xhigh, max.
reasoning.summaryenumלא—auto, concise או detailed: מחזיר סיכום של ההסקה.
reasoning.modeenumלאstandardstandard או pro.
reasoning.contextenumלאautoauto, current_turn או all_turns: איזו הסקה קודמת מוצגת למודל.
text.verbosityenumלאmediumlow, medium או high.
text.formatobjectלא—פלט מובנה, לדוגמה {"type": "json_schema", "name": "...", "schema": {...}}.
temperaturenumberלא—0–2. מתקבל רק כאשר reasoning.effort מוגדר ל-none.
top_pnumberלא—0–1. מתקבל רק כאשר reasoning.effort מוגדר ל-none.
top_logprobsintegerלא—0–20. מתקבל רק כאשר reasoning.effort מוגדר ל-none.
streambooleanלאfalseהזרמת התשובה כאירועים שנשלחים מהשרת.
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—לא—מועברים כפי שנשלחו.

לא זמינים: background, service_tier (כולל Batch, Flex ומצב מהיר) ו-safety_identifier.

הסקה ורמת הסקה

ברירת המחדל של GPT-6 Luna היא medium. ב-none המודל עונה ללא הסקה, ורק אז מתקבלים temperature, top_p ו-top_logprobs. רמת הסקה גבוהה יותר בדרך כלל פירושה יותר טוקני פלט, המתנה ארוכה יותר ועלות גבוהה יותר. טוקני הסקה מחויבים כטוקני פלט ונספרים במסגרת max_output_tokens.

קלט תמונות

תמונות נכנסות ל-content של הודעת משתמש כחלקי input_image עם image_url:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

החלף את כתובת הדוגמה בתמונה ציבורית משלך.

מימדי חיוב

ראה את התעריפים הנוכחיים בדף המודל. בקשה מחויבת לפי הטוקנים בהם היא משתמשת:

  • טוקני קלט,
  • טוקני פלט, כולל הסקה,
  • טוקני קלט מהמטמון (usage.input_tokens_details.cached_tokens), ו-
  • טוקני כתיבה למטמון (usage.input_tokens_details.cache_write_tokens).

כאשר פרומפט מכיל יותר מ-272K טוקני קלט, הבקשה כולה מחויבת בתעריפי הקשר ארוך. הסכום נלקח מה-usage המדווח עם התשובה שהסתיימה. בקשה שנכשלת אינה מחויבת. רשומות השימוש של החשבון שלך מציגות את החיוב המדויק לכל בקשה.

פלט

בקשה שאינה בהזרמה מחזירה את אובייקט התשובה הרשמי:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-luna",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

עם "stream": true התשובה היא זרם של האירועים הרשמיים, כולל response.created, response.output_text.delta ו-response.completed; אירוע response.completed הסופי מכיל את נתוני השימוש.

Chat Completions

קוד Chat Completions קיים צריך רק כתובת בסיס חדשה ומזהה מודל:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-luna",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

הגדר את מגבלת הפלט עם max_completion_tokens ואת רמת ההסקה עם reasoning_effort. ב-Chat Completions, GPT-6 Luna תומך בקריאה לפונקציות רק כאשר reasoning_effort מוגדר ל-none; השתמש ב-Responses API להסקה עם כלים.

פורמט Anthropic Messages

גם קוד שנכתב עבור Anthropic Messages API יכול לקרוא ל-GPT-6 Luna: שלח את גוף ה-Messages אל /v1/messages עם "model": "gpt-6-luna". הבקשה מומרת ל-Chat Completions, כך שלשדה ללא מקביל ב-Chat Completions אין השפעה. התשובה מכילה את שדות Messages הרשמיים וייתכן שתכלול כמה שדות שימוש נוספים; קרא את usage.input_tokens, usage.output_tokens ואת השדות הרשמיים.

שגיאות

שגיאות משתמשות בצורה {"error": {"code": ..., "message": "..."}}. ה-code הוא קוד מ-קטלוג השגיאות המשותף. בקשות שנכשלו אינן מחויבות.

טיפים

  • לסיווג ולחילוץ, נסה קודם את none: זו ההגדרה המהירה והזולה ביותר.
  • הגדר max_output_tokens גבוה מספיק גם להסקה וגם לתשובה: זה תקציב אחד לשתיהן.
  • שים הקשר ארוך שחוזר על עצמו בתחילת הפרומפט כדי שבקשות מאוחרות יותר יקראו אותו מהמטמון בתעריף הנמוך יותר.

קשור