Claude Opus 5.5 כבר זמין ב-SeedRouter
SeedRouter Docs

GPT-6.1 Sol

קריאה ל-GPT-6.1 Sol עם ה-API הרשמי של OpenAI בפורמט Responses או Chat Completions: קוד ועבודת סוכנים ברמה קרובה ל-Astra, חלון הקשר של 1.05M טוקנים ועד 128K טוקני פלט.

View Markdown

GPT-6.1 Sol הוא השדרוג של OpenAI ל-GPT-6 Sol לתכנות מורכב, לשימוש במחשב ולעבודה מקצועית, עם ביצועים קרובים ל-GPT-6 Astra בעלות נמוכה יותר. שלח את בקשת OpenAI Responses או Chat Completions הרשמית ל-SeedRouter: שנה את כתובת הבסיס ואת מפתח ה-API, שמור את גוף הבקשה.

מזהה המודל

מזהה המודלחלון הקשרפלט מקסימלירמת הסקהרמת הסקה ברירת מחדל
gpt-6.1-sol1.05M טוקנים (922K קלט)128K טוקניםlow, medium, high, xhigh, maxmedium

קלט: טקסט ותמונות. פלט: טקסט. תאריך סיום הידע: 30 באפריל 2026. ראה את דף המודל לקבלת המחירים הנוכחיים.

דוגמה מהירה

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

נקודות קצה

פורמטשיטה וכתובתאימות
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responses⁦Authorization: Bearer <key>⁩
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completions⁦Authorization: Bearer <key>⁩
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messages⁦x-api-key: <key>⁩ או ⁦Authorization: Bearer <key>⁩, בתוספת anthropic-version

נקודות הקצה של OpenAI מעבירות את גוף הבקשה שלך כפי שנשלח ומחזירות את התשובה הרשמית. שמור את מפתח ה-API בקוד שרץ בצד השרת.

פרמטרים

שדות Responses API:

שםסוגחובהברירת מחדלהערות
modelstringכן—gpt-6.1-sol.
inputstring or object[]כן—פרומפט, או פריטי קלט: הודעות שה-content שלהן מכיל חלקי input_text ו-input_image.
instructionsstringלא—הנחיות מערכת (מפתח).
max_output_tokensintegerלאהמקסימום של המודל16–128000. כולל טוקני הסקה.
reasoning.effortenumלאmediumlow, medium, high, xhigh, max. אין תמיכה ב-none וב-minimal.
reasoning.summaryenumלא—auto, concise או detailed: מחזיר סיכום של ההסקה.
reasoning.modeenumלאstandardstandard או pro.
reasoning.contextenumלאautoauto, current_turn או all_turns: איזו הסקה קודמת מוצגת למודל.
text.verbosityenumלאmediumlow, medium או high.
text.formatobjectלא—פלט מובנה, לדוגמה ⁦{"type": "json_schema", "name": "...", "schema": {...}}⁩.
temperature, top_p, top_logprobs—לא—GPT-6.1 Sol לא משתמש בהם, כי הוא תמיד מסיק. המערכת מתעלמת מהם אם נשלחו.
streambooleanלאfalseהזרמת התשובה כאירועים שנשלחים מהשרת.
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—לא—מועברים כפי שנשלחו.

לא זמינים: background, service_tier (כולל Batch, Flex ומצב מהיר) ו-safety_identifier.

הסקה ורמת הסקה

ברירת המחדל של GPT-6.1 Sol היא medium, והוא תמיד מסיק: אין תמיכה ב-none וב-minimal, ו-temperature, top_p ו-top_logprobs אינם בשימוש. רמת הסקה גבוהה יותר בדרך כלל פירושה יותר טוקני פלט, המתנה ארוכה יותר ועלות גבוהה יותר. טוקני הסקה מחויבים כטוקני פלט ונספרים במסגרת max_output_tokens.

קלט תמונות

תמונות נכנסות ל-content של הודעת משתמש כחלקי input_image עם image_url:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

החלף את כתובת הדוגמה בתמונה ציבורית משלך.

מימדי חיוב

ראה את התעריפים הנוכחיים בדף המודל. בקשה מחויבת לפי הטוקנים בהם היא משתמשת:

  • טוקני קלט,
  • טוקני פלט, כולל הסקה,
  • טוקני קלט מהמטמון (usage.input_tokens_details.cached_tokens), ו-
  • טוקני כתיבה למטמון (usage.input_tokens_details.cache_write_tokens).

כאשר פרומפט מכיל יותר מ-272K טוקני קלט, הבקשה כולה מחויבת בתעריפי הקשר ארוך. הסכום נלקח מה-usage המדווח עם התשובה שהסתיימה. בקשה שנכשלת אינה מחויבת. רשומות השימוש של החשבון שלך מציגות את החיוב המדויק לכל בקשה.

פלט

בקשה שאינה בהזרמה מחזירה את אובייקט התשובה הרשמי:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6.1-sol",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

עם ⁦"stream": true⁩ התשובה היא זרם של האירועים הרשמיים, כולל response.created, response.output_text.delta ו-response.completed; אירוע response.completed הסופי מכיל את נתוני השימוש.

Chat Completions

קוד Chat Completions קיים צריך רק כתובת בסיס חדשה ומזהה מודל:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6.1-sol",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

הגדר את מגבלת הפלט עם max_completion_tokens ואת רמת ההסקה עם reasoning_effort. לקריאה לכלים השתמש ב-Responses API.

פורמט Anthropic Messages

גם קוד שנכתב עבור Anthropic Messages API יכול לקרוא ל-GPT-6.1 Sol: שלח את גוף ה-Messages אל ⁦/v1/messages⁩ עם ⁦"model": "gpt-6.1-sol"⁩. הבקשה מומרת ל-Chat Completions, כך שלשדה ללא מקביל ב-Chat Completions אין השפעה. התשובה מכילה את שדות Messages הרשמיים וייתכן שתכלול כמה שדות שימוש נוספים; קרא את usage.input_tokens, usage.output_tokens ואת השדות הרשמיים.

שגיאות

שגיאות משתמשות בצורה ⁦{"error": {"code": ..., "message": "..."}}⁩. ה-code הוא קוד מ-קטלוג השגיאות המשותף. בקשות שנכשלו אינן מחויבות.

טיפים

  • התחל עם רמת ההסקה ברירת המחדל medium, השתמש ב-low לצעדים מהירים ופשוטים והעלה את רמת ההסקה רק למשימות קשות.
  • הגדר max_output_tokens גבוה מספיק גם להסקה וגם לתשובה: זה תקציב אחד לשתיהן.
  • שים הקשר ארוך שחוזר על עצמו בתחילת הפרומפט כדי שבקשות מאוחרות יותר יקראו אותו מהמטמון בתעריף הנמוך יותר.

קשור