GPT-6 Luna
קריאה ל-GPT-6 Luna עם ה-API הרשמי של OpenAI בפורמט Responses או Chat Completions: חלון הקשר של 1.05M טוקנים, עד 128K טוקני פלט ורמת הסקה לבחירתך.
GPT-6 Luna הוא מודל GPT-6 היעיל ביותר של OpenAI, שנבנה למשימות ממוקדות בנפח גבוה, והמודל הזול ביותר במשפחת GPT-6. שלח את בקשת OpenAI Responses או Chat Completions הרשמית ל-SeedRouter: שנה את כתובת הבסיס ואת מפתח ה-API, שמור את גוף הבקשה.
מזהה המודל
| מזהה המודל | חלון הקשר | פלט מקסימלי | רמת הסקה | רמת הסקה ברירת מחדל |
|---|---|---|---|---|
gpt-6-luna | 1.05M טוקנים (922K קלט) | 128K טוקנים | none, low, medium, high, xhigh, max | medium |
קלט: טקסט ותמונות. פלט: טקסט. תאריך סיום הידע: 18 במאי 2026. ראה את דף המודל לקבלת המחירים הנוכחיים.
דוגמה מהירה
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-luna",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'נקודות קצה
| פורמט | שיטה וכתובת | אימות |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> או Authorization: Bearer <key>, בתוספת anthropic-version |
נקודות הקצה של OpenAI מעבירות את גוף הבקשה שלך כפי שנשלח ומחזירות את התשובה הרשמית. שמור את מפתח ה-API בקוד שרץ בצד השרת.
פרמטרים
שדות Responses API:
| שם | סוג | חובה | ברירת מחדל | הערות |
|---|---|---|---|---|
model | string | כן | — | gpt-6-luna. |
input | string or object[] | כן | — | פרומפט, או פריטי קלט: הודעות שה-content שלהן מכיל חלקי input_text ו-input_image. |
instructions | string | לא | — | הנחיות מערכת (מפתח). |
max_output_tokens | integer | לא | המקסימום של המודל | 16–128000. כולל טוקני הסקה. |
reasoning.effort | enum | לא | medium | none, low, medium, high, xhigh, max. |
reasoning.summary | enum | לא | — | auto, concise או detailed: מחזיר סיכום של ההסקה. |
reasoning.mode | enum | לא | standard | standard או pro. |
reasoning.context | enum | לא | auto | auto, current_turn או all_turns: איזו הסקה קודמת מוצגת למודל. |
text.verbosity | enum | לא | medium | low, medium או high. |
text.format | object | לא | — | פלט מובנה, לדוגמה {"type": "json_schema", "name": "...", "schema": {...}}. |
temperature | number | לא | — | 0–2. מתקבל רק כאשר reasoning.effort מוגדר ל-none. |
top_p | number | לא | — | 0–1. מתקבל רק כאשר reasoning.effort מוגדר ל-none. |
top_logprobs | integer | לא | — | 0–20. מתקבל רק כאשר reasoning.effort מוגדר ל-none. |
stream | boolean | לא | false | הזרמת התשובה כאירועים שנשלחים מהשרת. |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | לא | — | מועברים כפי שנשלחו. |
לא זמינים: background, service_tier (כולל Batch, Flex ומצב מהיר) ו-safety_identifier.
הסקה ורמת הסקה
ברירת המחדל של GPT-6 Luna היא medium. ב-none המודל עונה ללא הסקה, ורק אז מתקבלים temperature, top_p ו-top_logprobs. רמת הסקה גבוהה יותר בדרך כלל פירושה יותר טוקני פלט, המתנה ארוכה יותר ועלות גבוהה יותר. טוקני הסקה מחויבים כטוקני פלט ונספרים במסגרת max_output_tokens.
קלט תמונות
תמונות נכנסות ל-content של הודעת משתמש כחלקי input_image עם image_url:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}החלף את כתובת הדוגמה בתמונה ציבורית משלך.
מימדי חיוב
ראה את התעריפים הנוכחיים בדף המודל. בקשה מחויבת לפי הטוקנים בהם היא משתמשת:
- טוקני קלט,
- טוקני פלט, כולל הסקה,
- טוקני קלט מהמטמון (
usage.input_tokens_details.cached_tokens), ו- - טוקני כתיבה למטמון (
usage.input_tokens_details.cache_write_tokens).
כאשר פרומפט מכיל יותר מ-272K טוקני קלט, הבקשה כולה מחויבת בתעריפי הקשר ארוך. הסכום נלקח מה-usage המדווח עם התשובה שהסתיימה. בקשה שנכשלת אינה מחויבת. רשומות השימוש של החשבון שלך מציגות את החיוב המדויק לכל בקשה.
פלט
בקשה שאינה בהזרמה מחזירה את אובייקט התשובה הרשמי:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6-luna",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}עם "stream": true התשובה היא זרם של האירועים הרשמיים, כולל response.created, response.output_text.delta ו-response.completed; אירוע response.completed הסופי מכיל את נתוני השימוש.
Chat Completions
קוד Chat Completions קיים צריך רק כתובת בסיס חדשה ומזהה מודל:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6-luna",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)הגדר את מגבלת הפלט עם max_completion_tokens ואת רמת ההסקה עם reasoning_effort. ב-Chat Completions, GPT-6 Luna תומך בקריאה לפונקציות רק כאשר reasoning_effort מוגדר ל-none; השתמש ב-Responses API להסקה עם כלים.
פורמט Anthropic Messages
גם קוד שנכתב עבור Anthropic Messages API יכול לקרוא ל-GPT-6 Luna: שלח את גוף ה-Messages אל /v1/messages עם "model": "gpt-6-luna". הבקשה מומרת ל-Chat Completions, כך שלשדה ללא מקביל ב-Chat Completions אין השפעה. התשובה מכילה את שדות Messages הרשמיים וייתכן שתכלול כמה שדות שימוש נוספים; קרא את usage.input_tokens, usage.output_tokens ואת השדות הרשמיים.
שגיאות
שגיאות משתמשות בצורה {"error": {"code": ..., "message": "..."}}. ה-code הוא קוד מ-קטלוג השגיאות המשותף. בקשות שנכשלו אינן מחויבות.
טיפים
- לסיווג ולחילוץ, נסה קודם את
none: זו ההגדרה המהירה והזולה ביותר. - הגדר
max_output_tokensגבוה מספיק גם להסקה וגם לתשובה: זה תקציב אחד לשתיהן. - שים הקשר ארוך שחוזר על עצמו בתחילת הפרומפט כדי שבקשות מאוחרות יותר יקראו אותו מהמטמון בתעריף הנמוך יותר.
