GPT-6 Astra
Используйте GPT-6 Astra через официальный API OpenAI Responses или Chat Completions: контекстное окно 1.05M токенов, до 128K выходных токенов и уровень рассуждения на ваш выбор.
GPT-6 Astra — самая мощная модель OpenAI, созданная для самой сложной сквозной работы: сложных рассуждений, программирования, исследований и создания документов. Отправьте официальный запрос OpenAI Responses или Chat Completions в SeedRouter: измените базовый URL и API-ключ, тело оставьте прежним.
ID модели
| ID модели | Контекстное окно | Максимальный вывод | Уровень рассуждения | Уровень рассуждения по умолчанию |
|---|---|---|---|---|
gpt-6-astra | 1.05M токенов (922K на вход) | 128K токенов | low, medium, high, xhigh, max | Не задокументирован |
Вход: текст и изображения. Выход: текст. Дата отсечения знаний: 30 апреля 2026 г.. Актуальные цены смотрите на странице модели.
Краткий пример
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'Конечные точки
| Формат | Метод и путь | Аутентификация |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> или Authorization: Bearer <key>, плюс anthropic-version |
Конечные точки OpenAI пересылают тело вашего запроса без изменений и возвращают официальный ответ. Храните API-ключ в коде на серверной стороне.
Параметры
Поля Responses API:
| Имя | Тип | Обязательный | По умолчанию | Примечания |
|---|---|---|---|---|
model | string | Да | — | gpt-6-astra. |
input | string or object[] | Да | — | Промпт или входные элементы: сообщения, в content которых находятся части input_text и input_image. |
instructions | string | Нет | — | Системные инструкции (инструкции разработчика). |
max_output_tokens | integer | Нет | Максимум модели | 16–128000. Включает токены рассуждения. |
reasoning.effort | enum | Нет | Не задокументирован | low, medium, high, xhigh, max. |
reasoning.summary | enum | Нет | — | auto, concise или detailed: вернуть краткое изложение рассуждения. |
reasoning.mode | enum | Нет | standard | standard или pro. |
reasoning.context | enum | Нет | auto | auto, current_turn или all_turns: какие предыдущие рассуждения показываются модели. |
text.verbosity | enum | Нет | medium | low, medium или high. |
text.format | object | Нет | — | Структурированный вывод, например {"type": "json_schema", "name": "...", "schema": {...}}. |
temperature | number | Нет | — | 0–2. Не принимается: GPT-6 Astra всегда рассуждает. Опустите этот параметр. |
top_p | number | Нет | — | 0–1. Не принимается: GPT-6 Astra всегда рассуждает. Опустите этот параметр. |
top_logprobs | integer | Нет | — | 0–20. Не принимается: GPT-6 Astra всегда рассуждает. Опустите этот параметр. |
stream | boolean | Нет | false | Транслировать ответ как серверные события. |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | Нет | — | Пересылаются как отправлены. |
Недоступны: background, service_tier (включая Batch, Flex и быстрый режим) и safety_identifier.
Рассуждение и уровень рассуждения
GPT-6 Astra всегда рассуждает: none не поддерживается и возвращает ошибку 400. OpenAI не документирует уровень рассуждения по умолчанию для GPT-6 Astra; опустите reasoning.effort, чтобы использовать собственное значение модели по умолчанию. Более высокий уровень рассуждения обычно означает больше выходных токенов, более долгое ожидание и более высокую стоимость. Токены рассуждения тарифицируются как выходные токены и учитываются в max_output_tokens.
Входные изображения
Изображения передаются в content пользовательского сообщения как части input_image с image_url:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}Замените пример URL собственным общедоступным изображением.
Измерения стоимости
Смотрите актуальные тарифы на странице модели. Запрос тарифицируется по используемым токенам:
- входные токены,
- выходные токены, включая рассуждение,
- кэшированные входные токены (
usage.input_tokens_details.cached_tokens), и - токены записи в кэш (
usage.input_tokens_details.cache_write_tokens).
Если промпт содержит более 272K входных токенов, весь запрос тарифицируется по тарифам длинного контекста. Сумма берётся из usage, возвращённого с завершённым ответом. Неудачный запрос не тарифицируется. Записи использования вашей учётной записи показывают точную сумму для каждого запроса.
Вывод
Нестриминговый запрос возвращает официальный объект ответа:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6-astra",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}При "stream": true ответ — это поток официальных событий, включая response.created, response.output_text.delta и response.completed; финальное событие response.completed содержит данные об использовании.
Chat Completions
Существующему коду Chat Completions нужны только новый базовый URL и ID модели:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6-astra",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)Лимит вывода задаётся через max_completion_tokens, уровень рассуждения — через reasoning_effort. Chat Completions не поддерживает вызов функций с GPT-6 Astra; для инструментов используйте Responses API.
Формат Anthropic Messages
Код, написанный для Anthropic Messages API, тоже может вызывать GPT-6 Astra: отправьте тело Messages на /v1/messages с "model": "gpt-6-astra". Запрос преобразуется в Chat Completions, поэтому поле без аналога в Chat Completions не имеет эффекта. Ответ содержит официальные поля Messages и может включать несколько дополнительных полей использования; читайте usage.input_tokens, usage.output_tokens и официальные поля.
Ошибки
Ошибки используют форму {"error": {"code": ..., "message": "..."}}. Поле code — это код из общего каталога ошибок. Неудачные запросы не тарифицируются.
Советы
- Начните с
mediumи повышайте уровень рассуждения только для задач, требующих более глубокого анализа; уровень рассуждения влияет и на качество, и на стоимость. - Установите
max_output_tokensдостаточно высоким и для рассуждения, и для ответа: это один бюджет для обоих. - Помещайте длинный, повторно используемый контекст в начало промпта, чтобы последующие запросы читали его из кэша по более низкому тарифу.
