GPT-6.1 Sol
استدعِ GPT-6.1 Sol عبر واجهة API الرسمية من OpenAI بصيغتي Responses و Chat Completions: برمجة وعمل وكلاء بمستوى يقارب Astra، ونافذة سياق بـ 1.05M توكن، وحتى 128K توكن إخراج.
GPT-6.1 Sol هو الإصدار المطوَّر من GPT-6 Sol لدى OpenAI للبرمجة المعقّدة واستخدام الحاسوب والعمل المهني، بأداء يقارب GPT-6 Astra وبتكلفة أقل. أرسل طلب OpenAI Responses أو Chat Completions الرسمي إلى SeedRouter: عدّل الرابط الأساسي ومفتاح API، واحفظ جسم الطلب.
معرّف النموذج
| معرّف النموذج | نافذة السياق | الحد الأقصى للإخراج | مستوى الاستدلال | مستوى الاستدلال الافتراضي |
|---|---|---|---|---|
gpt-6.1-sol | 1.05M توكن (922K إدخال) | 128K توكن | low, medium, high, xhigh, max | medium |
الإدخال: نص وصور. الإخراج: نص. تاريخ انتهاء المعرفة: 30 أبريل 2026. راجع صفحة النموذج للاطلاع على الأسعار الحالية.
مثال سريع
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'نقاط النهاية
| الصيغة | الطريقة والمسار | المصادقة |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> أو Authorization: Bearer <key>، بالإضافة إلى anthropic-version |
تُمرّر نقطتا نهاية OpenAI جسم طلبك كما أرسلته وتعيدان الاستجابة الرسمية. احفظ مفتاح API في شيفرة تعمل على الخادم.
المعاملات
حقول Responses API:
| الاسم | النوع | مطلوب | القيمة الافتراضية | ملاحظات |
|---|---|---|---|---|
model | string | نعم | — | gpt-6.1-sol. |
input | string or object[] | نعم | — | موجّه، أو عناصر إدخال: رسائل يحتوي content فيها على أجزاء input_text وinput_image. |
instructions | string | لا | — | تعليمات النظام (المطوّر). |
max_output_tokens | integer | لا | الحد الأقصى للنموذج | 16–128000. يشمل توكنات الاستدلال. |
reasoning.effort | enum | لا | medium | low, medium, high, xhigh, max. القيمتان none وminimal غير مدعومتين. |
reasoning.summary | enum | لا | — | auto أو concise أو detailed: يعيد ملخصًا للاستدلال. |
reasoning.mode | enum | لا | standard | standard أو pro. |
reasoning.context | enum | لا | auto | auto أو current_turn أو all_turns: أي استدلال سابق يُعرض على النموذج. |
text.verbosity | enum | لا | medium | low أو medium أو high. |
text.format | object | لا | — | إخراج مهيكل، مثلًا {"type": "json_schema", "name": "...", "schema": {...}}. |
temperature, top_p, top_logprobs | — | لا | — | لا يستخدمها GPT-6.1 Sol لأنه يستدل دائمًا. تُتجاهل إذا أُرسلت. |
stream | boolean | لا | false | بثّ الاستجابة كأحداث مرسلة من الخادم. |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | لا | — | تُمرَّر كما أُرسلت. |
غير متاح: background وservice_tier (بما في ذلك Batch و Flex والوضع السريع) وsafety_identifier.
الاستدلال ومستوى الاستدلال
يستخدم GPT-6.1 Sol افتراضيًا المستوى medium ويستدل دائمًا: القيمتان none وminimal غير مدعومتين، ولا تُستخدم temperature وtop_p وtop_logprobs. عادةً ما يعني مستوى الاستدلال الأعلى مزيدًا من توكنات الإخراج وانتظارًا أطول وتكلفة أعلى. تُفوتَر توكنات الاستدلال كتوكنات إخراج وتُحتسب ضمن max_output_tokens.
إدخال الصور
تُدرج الصور في content لرسالة المستخدم كأجزاء input_image مع image_url:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}استبدل رابط المثال بصورة خاصة بك يمكن الوصول إليها علنًا.
أبعاد الفواتير
راجع الأسعار الحالية في صفحة النموذج. يُفوتَر الطلب بالتوكنات التي يستخدمها:
- توكنات الإدخال،
- توكنات الإخراج، بما فيها الاستدلال،
- توكنات الإدخال المخزّنة مؤقتًا (
usage.input_tokens_details.cached_tokens)، و - توكنات الكتابة في ذاكرة التخزين المؤقت (
usage.input_tokens_details.cache_write_tokens).
عندما يتجاوز الموجّه 272K توكن إدخال، يُفوتَر الطلب كله بأسعار السياق الطويل. يُؤخذ المبلغ من usage المبلّغ عنه مع الاستجابة المكتملة. لا يُفوتَر الطلب الفاشل. يُظهر سجل استخدام حسابك المبلغ الدقيق لكل طلب.
الإخراج
الطلب غير المُبثّ يعيد كائن الاستجابة الرسمي:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6.1-sol",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}مع "stream": true تكون الاستجابة تدفقًا من الأحداث الرسمية، بما فيها response.created وresponse.output_text.delta وresponse.completed؛ ويحمل حدث response.completed الأخير بيانات الاستخدام.
Chat Completions
لا تحتاج شيفرة Chat Completions الموجودة سوى رابط أساسي جديد ومعرّف نموذج:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6.1-sol",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)اضبط حد الإخراج بـ max_completion_tokens ومستوى الاستدلال بـ reasoning_effort. استخدم Responses API لاستدعاء الأدوات.
صيغة Anthropic Messages
يمكن للشيفرة المكتوبة لـ Anthropic Messages API استدعاء GPT-6.1 Sol أيضًا: أرسل جسم Messages إلى /v1/messages مع "model": "gpt-6.1-sol". يُحوَّل الطلب إلى Chat Completions، لذا لا يكون لأي حقل بلا نظير في Chat Completions أي أثر. تحمل الاستجابة حقول Messages الرسمية وقد تتضمن بعض حقول الاستخدام الإضافية؛ اقرأ usage.input_tokens وusage.output_tokens والحقول الرسمية.
الأخطاء
تستخدم الأخطاء الشكل {"error": {"code": ..., "message": "..."}}. code هو رمز من كتالوج الأخطاء المشترك. لا تُفوتَر الطلبات الفاشلة.
نصائح
- ابدأ بمستوى الاستدلال الافتراضي
medium، واستخدمlowللخطوات السريعة والبسيطة، وارفع مستوى الاستدلال فقط للمهام الصعبة. - اضبط
max_output_tokensعاليًا بما يكفي للاستدلال والإجابة معًا: إنها ميزانية واحدة لكليهما. - ضع السياق الطويل المُعاد استخدامه في بداية الموجّه حتى تقرأه الطلبات اللاحقة من الذاكرة المؤقتة بالسعر الأقل.
