GPT-6 Astra
استدعِ GPT-6 Astra عبر واجهة API الرسمية من OpenAI بصيغتي Responses و Chat Completions: نافذة سياق بـ 1.05M توكن، وحتى 128K توكن إخراج، ومستوى الاستدلال الذي تختاره.
GPT-6 Astra هو أقوى نماذج OpenAI، مصمّم لأصعب الأعمال من البداية إلى النهاية: الاستدلال المعقّد والبرمجة والبحث وإنشاء المستندات. أرسل طلب OpenAI Responses أو Chat Completions الرسمي إلى SeedRouter: عدّل الرابط الأساسي ومفتاح API، واحفظ جسم الطلب.
معرّف النموذج
| معرّف النموذج | نافذة السياق | الحد الأقصى للإخراج | مستوى الاستدلال | مستوى الاستدلال الافتراضي |
|---|---|---|---|---|
gpt-6-astra | 1.05M توكن (922K إدخال) | 128K توكن | low, medium, high, xhigh, max | غير موثّق |
الإدخال: نص وصور. الإخراج: نص. تاريخ انتهاء المعرفة: 30 أبريل 2026. راجع صفحة النموذج للاطلاع على الأسعار الحالية.
مثال سريع
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'نقاط النهاية
| الصيغة | الطريقة والمسار | المصادقة |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> أو Authorization: Bearer <key>، بالإضافة إلى anthropic-version |
تُمرّر نقطتا نهاية OpenAI جسم طلبك كما أرسلته وتعيدان الاستجابة الرسمية. احفظ مفتاح API في شيفرة تعمل على الخادم.
المعاملات
حقول Responses API:
| الاسم | النوع | مطلوب | القيمة الافتراضية | ملاحظات |
|---|---|---|---|---|
model | string | نعم | — | gpt-6-astra. |
input | string or object[] | نعم | — | موجّه، أو عناصر إدخال: رسائل يحتوي content فيها على أجزاء input_text وinput_image. |
instructions | string | لا | — | تعليمات النظام (المطوّر). |
max_output_tokens | integer | لا | الحد الأقصى للنموذج | 16–128000. يشمل توكنات الاستدلال. |
reasoning.effort | enum | لا | غير موثّق | low, medium, high, xhigh, max. |
reasoning.summary | enum | لا | — | auto أو concise أو detailed: يعيد ملخصًا للاستدلال. |
reasoning.mode | enum | لا | standard | standard أو pro. |
reasoning.context | enum | لا | auto | auto أو current_turn أو all_turns: أي استدلال سابق يُعرض على النموذج. |
text.verbosity | enum | لا | medium | low أو medium أو high. |
text.format | object | لا | — | إخراج مهيكل، مثلًا {"type": "json_schema", "name": "...", "schema": {...}}. |
temperature | number | لا | — | 0–2. غير مقبول: GPT-6 Astra يستدل دائمًا. أزِله. |
top_p | number | لا | — | 0–1. غير مقبول: GPT-6 Astra يستدل دائمًا. أزِله. |
top_logprobs | integer | لا | — | 0–20. غير مقبول: GPT-6 Astra يستدل دائمًا. أزِله. |
stream | boolean | لا | false | بثّ الاستجابة كأحداث مرسلة من الخادم. |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | لا | — | تُمرَّر كما أُرسلت. |
غير متاح: background وservice_tier (بما في ذلك Batch و Flex والوضع السريع) وsafety_identifier.
الاستدلال ومستوى الاستدلال
يستدل GPT-6 Astra دائمًا: القيمة none غير مدعومة وتعيد خطأ 400. لا توثّق OpenAI مستوى استدلال افتراضيًا لـ GPT-6 Astra؛ اترك reasoning.effort لاستخدام القيمة الافتراضية للنموذج نفسه. عادةً ما يعني مستوى الاستدلال الأعلى مزيدًا من توكنات الإخراج وانتظارًا أطول وتكلفة أعلى. تُفوتَر توكنات الاستدلال كتوكنات إخراج وتُحتسب ضمن max_output_tokens.
إدخال الصور
تُدرج الصور في content لرسالة المستخدم كأجزاء input_image مع image_url:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}استبدل رابط المثال بصورة خاصة بك يمكن الوصول إليها علنًا.
أبعاد الفواتير
راجع الأسعار الحالية في صفحة النموذج. يُفوتَر الطلب بالتوكنات التي يستخدمها:
- توكنات الإدخال،
- توكنات الإخراج، بما فيها الاستدلال،
- توكنات الإدخال المخزّنة مؤقتًا (
usage.input_tokens_details.cached_tokens)، و - توكنات الكتابة في ذاكرة التخزين المؤقت (
usage.input_tokens_details.cache_write_tokens).
عندما يتجاوز الموجّه 272K توكن إدخال، يُفوتَر الطلب كله بأسعار السياق الطويل. يُؤخذ المبلغ من usage المبلّغ عنه مع الاستجابة المكتملة. لا يُفوتَر الطلب الفاشل. يُظهر سجل استخدام حسابك المبلغ الدقيق لكل طلب.
الإخراج
الطلب غير المُبثّ يعيد كائن الاستجابة الرسمي:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6-astra",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}مع "stream": true تكون الاستجابة تدفقًا من الأحداث الرسمية، بما فيها response.created وresponse.output_text.delta وresponse.completed؛ ويحمل حدث response.completed الأخير بيانات الاستخدام.
Chat Completions
لا تحتاج شيفرة Chat Completions الموجودة سوى رابط أساسي جديد ومعرّف نموذج:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6-astra",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)اضبط حد الإخراج بـ max_completion_tokens ومستوى الاستدلال بـ reasoning_effort. لا يدعم Chat Completions استدعاء الدوال مع GPT-6 Astra؛ استخدم Responses API للأدوات.
صيغة Anthropic Messages
يمكن للشيفرة المكتوبة لـ Anthropic Messages API استدعاء GPT-6 Astra أيضًا: أرسل جسم Messages إلى /v1/messages مع "model": "gpt-6-astra". يُحوَّل الطلب إلى Chat Completions، لذا لا يكون لأي حقل بلا نظير في Chat Completions أي أثر. تحمل الاستجابة حقول Messages الرسمية وقد تتضمن بعض حقول الاستخدام الإضافية؛ اقرأ usage.input_tokens وusage.output_tokens والحقول الرسمية.
الأخطاء
تستخدم الأخطاء الشكل {"error": {"code": ..., "message": "..."}}. code هو رمز من كتالوج الأخطاء المشترك. لا تُفوتَر الطلبات الفاشلة.
نصائح
- ابدأ بـ
mediumوارفع مستوى الاستدلال فقط للمهام التي تحتاج استدلالًا أعمق؛ مستوى الاستدلال يُغيّر الجودة والتكلفة معًا. - اضبط
max_output_tokensعاليًا بما يكفي للاستدلال والإجابة معًا: إنها ميزانية واحدة لكليهما. - ضع السياق الطويل المُعاد استخدامه في بداية الموجّه حتى تقرأه الطلبات اللاحقة من الذاكرة المؤقتة بالسعر الأقل.
