GPT-6 Astra
GPT-6 Astra API를 공식 OpenAI Responses 또는 Chat Completions 형식으로 호출하세요: 105만 토큰 컨텍스트 윈도우, 최대 128K 출력 토큰, 직접 선택하는 추론 강도.
GPT-6 Astra는 가장 어려운 엔드투엔드 작업, 즉 복잡한 추론, 코딩, 리서치, 문서 작성을 위해 만든 OpenAI의 가장 강력한 모델입니다. 공식 OpenAI Responses 또는 Chat Completions 요청을 SeedRouter로 보냅니다: 기본 URL과 API 키만 바꾸고 본문은 그대로 유지합니다.
모델 ID
| 모델 ID | 컨텍스트 윈도우 | 최대 출력 | 추론 강도 | 기본 추론 강도 |
|---|---|---|---|---|
gpt-6-astra | 105만 토큰(입력 92만 2,000) | 128,000 토큰 | low, medium, high, xhigh, max | 문서화되지 않음 |
입력: 텍스트와 이미지. 출력: 텍스트. 지식 컷오프: 2026년 4월 30일. 모델 페이지에서 현재 요금을 확인하세요.
빠른 예제
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'엔드포인트
| 형식 | 메서드 및 경로 | 인증 |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> 또는 Authorization: Bearer <key>, 그리고 anthropic-version |
OpenAI 엔드포인트는 요청 본문을 보낸 그대로 전달하고 공식 응답을 반환합니다. API 키는 서버 측 코드에 보관하세요.
파라미터
Responses API 필드:
| 이름 | 타입 | 필수 | 기본값 | 설명 |
|---|---|---|---|---|
model | string | 예 | — | gpt-6-astra. |
input | string or object[] | 예 | — | 프롬프트 또는 입력 항목: content에 input_text와 input_image 파트를 담은 메시지. |
instructions | string | 아니요 | — | 시스템(developer) 지침. |
max_output_tokens | integer | 아니요 | 모델 최대값 | 16–128000. 추론 토큰을 포함합니다. |
reasoning.effort | enum | 아니요 | 문서화되지 않음 | low, medium, high, xhigh, max. |
reasoning.summary | enum | 아니요 | — | auto, concise 또는 detailed: 추론 요약을 반환합니다. |
reasoning.mode | enum | 아니요 | standard | standard 또는 pro. |
reasoning.context | enum | 아니요 | auto | auto, current_turn 또는 all_turns: 이전 추론 중 어떤 부분을 모델에 보여줄지 정합니다. |
text.verbosity | enum | 아니요 | medium | low, medium 또는 high. |
text.format | object | 아니요 | — | 구조화된 출력. 예: {"type": "json_schema", "name": "...", "schema": {...}}. |
temperature | number | 아니요 | — | 0–2. 허용되지 않음: GPT-6 Astra는 항상 추론합니다. 이를 생략하세요. |
top_p | number | 아니요 | — | 0–1. 허용되지 않음: GPT-6 Astra는 항상 추론합니다. 이를 생략하세요. |
top_logprobs | integer | 아니요 | — | 0–20. 허용되지 않음: GPT-6 Astra는 항상 추론합니다. 이를 생략하세요. |
stream | boolean | 아니요 | false | 응답을 서버 전송 이벤트로 스트리밍합니다. |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | 아니요 | — | 그대로 전달됩니다. |
사용할 수 없음: background, service_tier(Batch, Flex, fast 모드 포함), safety_identifier.
추론과 추론 강도
GPT-6 Astra는 항상 추론합니다: none은 지원되지 않으며 400 오류를 반환합니다. OpenAI는 GPT-6 Astra의 기본 추론 강도를 문서화하지 않았습니다. 모델 자체의 기본값을 사용하려면 reasoning.effort를 생략하세요. 더 높은 추론 강도는 보통 더 많은 출력 토큰, 더 긴 대기 시간, 더 높은 비용을 의미합니다. 추론 토큰은 출력 토큰으로 청구되며 max_output_tokens에 포함됩니다.
이미지 입력
이미지는 사용자 메시지의 content에 image_url을 가진 input_image 파트로 들어갑니다:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}예제 URL을 본인의 공개 액세스 가능 이미지로 바꾸세요.
청구 규모
모델 페이지의 현재 요금을 참조하세요. 요청은 사용한 토큰으로 청구됩니다:
- 입력 토큰,
- 추론을 포함한 출력 토큰,
- 캐시된 입력 토큰(
usage.input_tokens_details.cached_tokens), 그리고 - 캐시 쓰기 토큰(
usage.input_tokens_details.cache_write_tokens).
프롬프트의 입력 토큰이 27만 2,000개를 넘으면 요청 전체가 장문 컨텍스트 요금으로 청구됩니다. 청구는 완성된 응답과 함께 보고된 usage에서 가져옵니다. 실패한 요청은 청구되지 않습니다. 계정의 사용 기록에 모든 요청의 정확한 청구 금액이 표시됩니다.
출력
비스트리밍 요청은 공식 응답 객체를 반환합니다:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6-astra",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}"stream": true일 때 응답은 response.created, response.output_text.delta, response.completed를 포함한 공식 이벤트 스트림입니다. 마지막 response.completed 이벤트가 사용량을 포함합니다.
Chat Completions
기존 Chat Completions 코드는 새 기본 URL과 모델 ID만 필요합니다:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6-astra",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)출력 한도는 max_completion_tokens로, 추론 강도는 reasoning_effort로 설정합니다. Chat Completions에서는 GPT-6 Astra로 함수 호출을 지원하지 않습니다. 도구를 사용하려면 Responses API를 사용하세요.
Anthropic Messages 형식
Anthropic Messages API용으로 작성한 코드도 GPT-6 Astra를 호출할 수 있습니다: Messages 본문을 "model": "gpt-6-astra"와 함께 /v1/messages로 보내세요. 이 요청은 Chat Completions로 변환되므로, Chat Completions 대응물이 없는 필드는 영향을 미치지 않습니다. 응답은 공식 Messages 필드를 포함하며 몇 가지 추가 사용 필드가 포함될 수 있습니다. usage.input_tokens, usage.output_tokens와 공식 필드를 읽으세요.
오류
오류는 {"error": {"code": ..., "message": "..."}}를 사용합니다. code는 공통 오류 카탈로그의 코드입니다. 실패한 요청은 청구되지 않습니다.
팁
medium부터 시작하고 더 깊은 추론이 필요한 작업에서만 추론 강도를 높이세요. 추론 강도는 품질과 비용 모두를 바꿉니다.max_output_tokens를 답변뿐 아니라 추론까지 충분하게 설정하세요: 이는 둘 다의 단일 예산입니다.- 길고 재사용되는 컨텍스트를 프롬프트 앞부분에 두어 이후 요청이 더 낮은 요금으로 캐시에서 읽도록 하세요.
