Text
Grok 4.7
Wywołuj Grok 4.7 w natywnym formacie Chat Completions, Responses lub Messages. Parametry, strumieniowanie, zużycie i aktualne ograniczenia.
Używaj grok-4.7 w jednym z trzech poniższych formatów. Do uwierzytelniania służy twój klucz API SeedRouter. Strona modelu zawiera Playground i aktualne ceny tokenów, a przewodnik po cenach wyjaśnia wejście z pamięci podręcznej i rozumowanie.
Szybki start
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'Odpowiedź JSON zawiera elementy output i usage. Tworząc historię rozmowy, zachowaj wszystkie elementy wyjściowe, w tym rozumowanie i elementy narzędzi.
Formaty żądań
| Format | Endpoint | Wymagane pola |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
Użyj Content-Type: application/json i Authorization: Bearer $SEEDROUTER_API_KEY. Klienci Messages mogą też wysyłać anthropic-version: 2023-06-01.
Parametry i ograniczenia
Specyfikacja OpenAPI zawiera pełne, zagnieżdżone schematy żądań i odpowiedzi. Poniższe tabele wymieniają wszystkie obsługiwane pola żądania najwyższego poziomu. Nieznane pola oraz parametry oficjalnie ignorowane przez ten model są odrzucane. Obsługiwany parametr z nieprawidłową wartością nadal pozostaje nieprawidłowy.
Opcjonalne pola dopuszczające null przyjmują jawne null; pominięcie pola powoduje użycie jego wartości domyślnej w API. Playground ukrywa user i ustawia model na stałe na grok-4.7. Klienci API nadal mogą wysyłać user.
- Kontekst: 500 000 tokenów, łącznie z rozmową i wyjściem.
- Poziom rozumowania:
low,medium,high,xhigh; domyślniehigh. - Domyślna wartość
max_completion_tokensimax_output_tokenswynosi 128 000 widocznych tokenów wyjściowych. Tokeny rozumowania i wywołań funkcji nie wchodzą do tego limitu widocznego wyjścia. To wartość domyślna, a nie deklaracja maksymalnej zdolności generowania wyjścia. - Limity wyjścia muszą być dodatnimi liczbami całkowitymi. API stosuje też istniejący bezpieczny pułap dla liczb całkowitych: 1 073 741 823; limit pojemności kontekstu nadal obowiązuje.
temperature: od 0 do 2, domyślnie 1.top_p: większe od 0 i nie większe niż 1, domyślnie 1. W Responsesmin_p: od 0 do 1;top_k: liczba całkowita co najmniej 1.- Maksymalnie 350 definicji narzędzi.
stream_optionswymagastream: true. instructionsiprevious_response_idnie można łączyć. Podsumowania rozumowania są zawsze szczegółowe.
Parametry Responses
| Pole | Typ | Reguła |
|---|---|---|
include | tablica lub null | Tablica dodatkowych pól do uwzględnienia w odpowiedzi. |
input (wymagane) | obiekt lub inna obsługiwana forma | Ciąg tekstowy lub pełna tablica elementów wejściowych. |
instructions | ciąg znaków lub null | Instrukcje systemowe; nie można łączyć z previous_response_id. |
max_output_tokens | liczba całkowita lub null | Limit widocznego wyjścia; domyślnie 128 000. |
max_turns | liczba całkowita lub null | Maksymalna liczba tur agenta jako liczba całkowita. |
min_p | liczba lub null | Liczba od 0 do 1. |
model (wymagane) | ciąg znaków | Stała wartość grok-4.7. |
parallel_tool_calls | wartość logiczna lub null | Wartość logiczna; domyślnie true. |
previous_response_id | ciąg znaków lub null | Identyfikator odpowiedzi jako ciąg znaków; kontynuacja według ID jest obecnie niedostępna. |
prompt_cache_key | ciąg znaków lub null | Klucz pamięci podręcznej jako ciąg znaków. |
reasoning | obiekt | Konfiguracja rozumowania; domyślny poziom to high. |
reasoning_effort | ciąg znaków lub null | low, medium, high, xhigh; domyślnie high. |
safety_identifier | ciąg znaków lub null | Opcjonalny identyfikator bezpieczeństwa dostarczony przez wywołującego. |
search_parameters | obiekt | Konfiguracja wyszukiwania. |
service_tier | ciąg znaków | auto, default, priority, fast; priority i fast podwajają stawki za tokeny. |
store | wartość logiczna lub null | Wartość logiczna; domyślnie true. Operacje na zapisanych odpowiedziach są obecnie niedostępne. |
stream | wartość logiczna lub null | Wartość logiczna; domyślnie false. |
temperature | liczba lub null | Liczba od 0 do 2; domyślnie 1. |
text | obiekt | Konfiguracja odpowiedzi tekstowej, w tym format. |
tool_choice | obiekt lub inna obsługiwana forma | Automatyczny wybór, wyłączenie, wymagane wywołanie lub wskazane narzędzie; składnia zależy od formatu. |
tools | tablica lub null | Definicje narzędzi; maksymalnie 350. |
top_k | liczba całkowita lub null | Liczba całkowita; Responses wymaga co najmniej 1. |
top_p | liczba lub null | Liczba większa od 0 i nie większa niż 1; domyślnie 1. |
user | ciąg znaków lub null | Opcjonalny identyfikator wywołującego; ukryty w Playground. |
Parametry Chat Completions
| Pole | Typ | Reguła |
|---|---|---|
deferred | wartość logiczna lub null | Wartość logiczna; domyślnie false. Odroczone zakończenie jest obecnie niedostępne. |
max_completion_tokens | liczba całkowita lub null | Limit widocznego wyjścia; domyślnie 128 000. |
max_tokens | liczba całkowita lub null | Dodatni limit widocznego wyjścia. Wymagany w Messages. |
messages (wymagane) | tablica | Wiadomości rozmowy w tym formacie. |
model (wymagane) | ciąg znaków | Stała wartość grok-4.7. |
n | liczba całkowita lub null | Liczba całkowita co najmniej 1; domyślnie 1. |
parallel_tool_calls | wartość logiczna lub null | Wartość logiczna; domyślnie true. |
prompt_cache_key | ciąg znaków lub null | Klucz pamięci podręcznej jako ciąg znaków. |
reasoning_effort | ciąg znaków lub null | low, medium, high, xhigh; domyślnie high. |
response_format | obiekt lub inna obsługiwana forma | Tekst, obiekt JSON lub wyjście zgodne ze schematem JSON. |
safety_identifier | ciąg znaków lub null | Opcjonalny identyfikator bezpieczeństwa dostarczony przez wywołującego. |
search_parameters | obiekt | Konfiguracja wyszukiwania. |
seed | liczba całkowita lub null | Całkowitoliczbowe ziarno próbkowania. |
service_tier | ciąg znaków | auto, default, priority, fast; priority i fast podwajają stawki za tokeny. |
stream | wartość logiczna lub null | Wartość logiczna; domyślnie false. |
stream_options | obiekt | Opcje strumieniowania; wymaga stream: true. |
temperature | liczba lub null | Liczba od 0 do 2; domyślnie 1. |
tool_choice | obiekt lub inna obsługiwana forma | Automatyczny wybór, wyłączenie, wymagane wywołanie lub wskazane narzędzie; składnia zależy od formatu. |
tools | tablica lub null | Definicje narzędzi; maksymalnie 350. |
top_p | liczba lub null | Liczba większa od 0 i nie większa niż 1; domyślnie 1. |
user | ciąg znaków lub null | Opcjonalny identyfikator wywołującego; ukryty w Playground. |
web_search_options | obiekt | Opcje wyszukiwania dla zgodności. |
Parametry Messages
| Pole | Typ | Reguła |
|---|---|---|
max_tokens (wymagane) | liczba całkowita | Dodatni limit widocznego wyjścia. Wymagany w Messages. |
messages (wymagane) | tablica | Wiadomości rozmowy w tym formacie. |
metadata | obiekt | Obiekt metadanych Messages. |
model (wymagane) | ciąg znaków | Stała wartość grok-4.7. |
stop_sequences | tablica lub null | Tablica ciągów zatrzymujących. |
stream | wartość logiczna lub null | Wartość logiczna; domyślnie false. |
system | obiekt lub inna obsługiwana forma | Ciąg systemowy lub bloki treści. |
temperature | liczba lub null | Liczba od 0 do 2; domyślnie 1. |
tool_choice | obiekt lub inna obsługiwana forma | Automatyczny wybór, wyłączenie, wymagane wywołanie lub wskazane narzędzie; składnia zależy od formatu. |
tools | tablica lub null | Definicje narzędzi; maksymalnie 350. |
top_k | liczba całkowita lub null | Liczba całkowita; Responses wymaga co najmniej 1. |
top_p | liczba lub null | Liczba większa od 0 i nie większa niż 1; domyślnie 1. |
Strumieniowanie
Ustaw stream na true. Chat wysyła fragmenty odpowiedzi; Responses wysyła nazwane zdarzenia odpowiedzi; Messages wysyła zdarzenia wiadomości i bloków treści. Odczytuj końcowe zdarzenie użycia, a nie tylko przyrosty tekstu. Wywołania narzędzi i rozumowanie mogą stanowić osobne elementy wyjściowe; zachowując historię, nie ograniczaj strumienia do widocznego tekstu.
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}Narzędzia i ustrukturyzowane wyjście
Użyj definicji narzędzia dla wybranego formatu. Chat używa response_format, a Responses — text.format. Funkcje, wyszukiwanie w sieci, wyszukiwanie w X, interpreter kodu i wywołania MCP zostały przetestowane z tym modelem. Shell zwraca wywołanie do wykonania przez klienta; nie uruchamia automatycznie polecenia na twoim komputerze. Pełny schemat opisuje też inne typy narzędzi; sam wpis w schemacie nie dowodzi, że określona usługa zewnętrzna jest skonfigurowana.
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}Użycie narzędzi jest rozliczane niezależnie od tokenów. Wyszukiwanie w sieci i interpreter kodu rozliczane są według liczby wywołań. Wyszukiwanie w X wykorzystuje liczbę pobranych postów i profili, także elementów pobranych wielokrotnie; liczba wywołań wyszukiwania w X nie jest jednostką rozliczeniową. Sprawdź usage.server_side_tool_usage_details oraz rejestry użycia na swoim koncie.
Zużycie i ceny
Ceny zależą od całkowitej długości wejścia. Poniżej 200 000 tokenów wejściowych stosuj standardowy próg cenowy. Od 200 000 tokenów próg dla długiego kontekstu obejmuje całe żądanie; wejście z pamięci podręcznej wlicza się przy wyborze progu. service_tier: "priority" i "fast" podwajają stawki za tokeny w obu progach. auto i default wybierają usługę standardową. Opłaty za narzędzia są obliczane osobno i nie są podwajane przez ten mnożnik tokenów.
| Format | Rozliczanie wejścia | Rozliczanie wyjścia |
|---|---|---|
| Responses | input_tokens zawiera input_tokens_details.cached_tokens | output_tokens zawiera rozumowanie; nie dodawaj ponownie jego szczegółowego zużycia |
| Chat | prompt_tokens zawiera prompt_tokens_details.cached_tokens | xAI raportuje widoczne completion_tokens osobno; całe płatne wyjście to total_tokens - prompt_tokens, łącznie z rozumowaniem |
| Messages | input_tokens nie zawiera cache_read_input_tokens; dodaj pola pamięci podręcznej, aby uzyskać całkowite wejście | output_tokens to całkowite wyjście |
Publiczne odpowiedzi zawierają liczniki użycia, nie kwoty pieniężne. Ostateczna opłata jest widoczna w rejestrach użycia. Nieudane żądania nie są rozliczane.
Historia rozmowy i aktualne ograniczenia
Aby kontynuować bez przechowywania stanu, wyślij poprzednie wejście, wszystkie zwrócone elementy wyjścia i następną wiadomość użytkownika jako nowe input. W Chat lub Messages wyślij pełną historię wiadomości w odpowiednim formacie. Zachowaj bez zmian zwrócone elementy zaszyfrowanego rozumowania i narzędzi.
Obecna usługa nie pozwala kontynuować przez previous_response_id, pobierać ani usuwać zapisanej odpowiedzi, wyświetlać listy zapisanych elementów wejściowych ani zwracać odroczonych odpowiedzi Chat. store: true może zostać przyjęte podczas tworzenia, ale nie potwierdza to obsługi zapisywania lub pobierania odpowiedzi. Pola te pozostają w oficjalnym kontrakcie i Playground; to ograniczenie nie zastępuje definicji ich docelowego zachowania.
Załączniki nie działały z testowanymi danymi wejściowymi w postaci tekstu inline i adresów URL plików PDF. Żądania generowania obrazów zwracały tekst bez obrazów, a wyszukiwanie narzędzi nie ukończyło wykrywania po stronie serwera. Te możliwości nie zostały potwierdzone jako dostępne. Wyszukiwanie Collections wymaga też prawidłowego zasobu collection i nie zostało zweryfikowane.
Chat ignoruje frequency_penalty, presence_penalty, logit_bias, stop, logprobs i top_logprobs. Responses ignoruje background, context_management, metadata, truncation, logprobs i top_logprobs. Nie są one przekazywane ani oferowane jako aktywne elementy sterujące.
Błędy
Nieprawidłowe żądanie zwraca błąd zamiast ukończonej odpowiedzi. Sprawdź wartości pól i publiczny opis błędów. Żądania zwracające błąd nie są rozliczane.
