Claude Opus 5.5 jest już dostępny w SeedRouter
LogoSeedRouter

Szukaj modeli po nazwie, np. „nano banana”

Szukaj modeli po nazwie, np. „nano banana”

Text

Grok 4.7

View Markdown

Wywołuj Grok 4.7 w natywnym formacie Chat Completions, Responses lub Messages. Parametry, strumieniowanie, zużycie i aktualne ograniczenia.

Używaj grok-4.7 w jednym z trzech poniższych formatów. Do uwierzytelniania służy twój klucz API SeedRouter. Strona modelu zawiera Playground i aktualne ceny tokenów, a przewodnik po cenach wyjaśnia wejście z pamięci podręcznej i rozumowanie.

Szybki start

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'

Odpowiedź JSON zawiera elementy output i usage. Tworząc historię rozmowy, zachowaj wszystkie elementy wyjściowe, w tym rozumowanie i elementy narzędzi.

Formaty żądań

FormatEndpointWymagane pola
ResponsesPOST /v1/responsesmodel, input
Chat CompletionsPOST /v1/chat/completionsmodel, messages
MessagesPOST /v1/messagesmodel, messages, max_tokens

Użyj Content-Type: application/json i Authorization: Bearer $SEEDROUTER_API_KEY. Klienci Messages mogą też wysyłać anthropic-version: 2023-06-01.

Parametry i ograniczenia

Specyfikacja OpenAPI zawiera pełne, zagnieżdżone schematy żądań i odpowiedzi. Poniższe tabele wymieniają wszystkie obsługiwane pola żądania najwyższego poziomu. Nieznane pola oraz parametry oficjalnie ignorowane przez ten model są odrzucane. Obsługiwany parametr z nieprawidłową wartością nadal pozostaje nieprawidłowy.

Opcjonalne pola dopuszczające null przyjmują jawne null; pominięcie pola powoduje użycie jego wartości domyślnej w API. Playground ukrywa user i ustawia model na stałe na grok-4.7. Klienci API nadal mogą wysyłać user.

  • Kontekst: 500 000 tokenów, łącznie z rozmową i wyjściem.
  • Poziom rozumowania: low, medium, high, xhigh; domyślnie high.
  • Domyślna wartość max_completion_tokens i max_output_tokens wynosi 128 000 widocznych tokenów wyjściowych. Tokeny rozumowania i wywołań funkcji nie wchodzą do tego limitu widocznego wyjścia. To wartość domyślna, a nie deklaracja maksymalnej zdolności generowania wyjścia.
  • Limity wyjścia muszą być dodatnimi liczbami całkowitymi. API stosuje też istniejący bezpieczny pułap dla liczb całkowitych: 1 073 741 823; limit pojemności kontekstu nadal obowiązuje.
  • temperature: od 0 do 2, domyślnie 1. top_p: większe od 0 i nie większe niż 1, domyślnie 1. W Responses min_p: od 0 do 1; top_k: liczba całkowita co najmniej 1.
  • Maksymalnie 350 definicji narzędzi. stream_options wymaga stream: true.
  • instructions i previous_response_id nie można łączyć. Podsumowania rozumowania są zawsze szczegółowe.

Parametry Responses

PoleTypReguła
includetablica lub nullTablica dodatkowych pól do uwzględnienia w odpowiedzi.
input (wymagane)obiekt lub inna obsługiwana formaCiąg tekstowy lub pełna tablica elementów wejściowych.
instructionsciąg znaków lub nullInstrukcje systemowe; nie można łączyć z previous_response_id.
max_output_tokensliczba całkowita lub nullLimit widocznego wyjścia; domyślnie 128 000.
max_turnsliczba całkowita lub nullMaksymalna liczba tur agenta jako liczba całkowita.
min_pliczba lub nullLiczba od 0 do 1.
model (wymagane)ciąg znakówStała wartość grok-4.7.
parallel_tool_callswartość logiczna lub nullWartość logiczna; domyślnie true.
previous_response_idciąg znaków lub nullIdentyfikator odpowiedzi jako ciąg znaków; kontynuacja według ID jest obecnie niedostępna.
prompt_cache_keyciąg znaków lub nullKlucz pamięci podręcznej jako ciąg znaków.
reasoningobiektKonfiguracja rozumowania; domyślny poziom to high.
reasoning_effortciąg znaków lub nulllow, medium, high, xhigh; domyślnie high.
safety_identifierciąg znaków lub nullOpcjonalny identyfikator bezpieczeństwa dostarczony przez wywołującego.
search_parametersobiektKonfiguracja wyszukiwania.
service_tierciąg znakówauto, default, priority, fast; priority i fast podwajają stawki za tokeny.
storewartość logiczna lub nullWartość logiczna; domyślnie true. Operacje na zapisanych odpowiedziach są obecnie niedostępne.
streamwartość logiczna lub nullWartość logiczna; domyślnie false.
temperatureliczba lub nullLiczba od 0 do 2; domyślnie 1.
textobiektKonfiguracja odpowiedzi tekstowej, w tym format.
tool_choiceobiekt lub inna obsługiwana formaAutomatyczny wybór, wyłączenie, wymagane wywołanie lub wskazane narzędzie; składnia zależy od formatu.
toolstablica lub nullDefinicje narzędzi; maksymalnie 350.
top_kliczba całkowita lub nullLiczba całkowita; Responses wymaga co najmniej 1.
top_pliczba lub nullLiczba większa od 0 i nie większa niż 1; domyślnie 1.
userciąg znaków lub nullOpcjonalny identyfikator wywołującego; ukryty w Playground.

Parametry Chat Completions

PoleTypReguła
deferredwartość logiczna lub nullWartość logiczna; domyślnie false. Odroczone zakończenie jest obecnie niedostępne.
max_completion_tokensliczba całkowita lub nullLimit widocznego wyjścia; domyślnie 128 000.
max_tokensliczba całkowita lub nullDodatni limit widocznego wyjścia. Wymagany w Messages.
messages (wymagane)tablicaWiadomości rozmowy w tym formacie.
model (wymagane)ciąg znakówStała wartość grok-4.7.
nliczba całkowita lub nullLiczba całkowita co najmniej 1; domyślnie 1.
parallel_tool_callswartość logiczna lub nullWartość logiczna; domyślnie true.
prompt_cache_keyciąg znaków lub nullKlucz pamięci podręcznej jako ciąg znaków.
reasoning_effortciąg znaków lub nulllow, medium, high, xhigh; domyślnie high.
response_formatobiekt lub inna obsługiwana formaTekst, obiekt JSON lub wyjście zgodne ze schematem JSON.
safety_identifierciąg znaków lub nullOpcjonalny identyfikator bezpieczeństwa dostarczony przez wywołującego.
search_parametersobiektKonfiguracja wyszukiwania.
seedliczba całkowita lub nullCałkowitoliczbowe ziarno próbkowania.
service_tierciąg znakówauto, default, priority, fast; priority i fast podwajają stawki za tokeny.
streamwartość logiczna lub nullWartość logiczna; domyślnie false.
stream_optionsobiektOpcje strumieniowania; wymaga stream: true.
temperatureliczba lub nullLiczba od 0 do 2; domyślnie 1.
tool_choiceobiekt lub inna obsługiwana formaAutomatyczny wybór, wyłączenie, wymagane wywołanie lub wskazane narzędzie; składnia zależy od formatu.
toolstablica lub nullDefinicje narzędzi; maksymalnie 350.
top_pliczba lub nullLiczba większa od 0 i nie większa niż 1; domyślnie 1.
userciąg znaków lub nullOpcjonalny identyfikator wywołującego; ukryty w Playground.
web_search_optionsobiektOpcje wyszukiwania dla zgodności.

Parametry Messages

PoleTypReguła
max_tokens (wymagane)liczba całkowitaDodatni limit widocznego wyjścia. Wymagany w Messages.
messages (wymagane)tablicaWiadomości rozmowy w tym formacie.
metadataobiektObiekt metadanych Messages.
model (wymagane)ciąg znakówStała wartość grok-4.7.
stop_sequencestablica lub nullTablica ciągów zatrzymujących.
streamwartość logiczna lub nullWartość logiczna; domyślnie false.
systemobiekt lub inna obsługiwana formaCiąg systemowy lub bloki treści.
temperatureliczba lub nullLiczba od 0 do 2; domyślnie 1.
tool_choiceobiekt lub inna obsługiwana formaAutomatyczny wybór, wyłączenie, wymagane wywołanie lub wskazane narzędzie; składnia zależy od formatu.
toolstablica lub nullDefinicje narzędzi; maksymalnie 350.
top_kliczba całkowita lub nullLiczba całkowita; Responses wymaga co najmniej 1.
top_pliczba lub nullLiczba większa od 0 i nie większa niż 1; domyślnie 1.

Strumieniowanie

Ustaw stream na true. Chat wysyła fragmenty odpowiedzi; Responses wysyła nazwane zdarzenia odpowiedzi; Messages wysyła zdarzenia wiadomości i bloków treści. Odczytuj końcowe zdarzenie użycia, a nie tylko przyrosty tekstu. Wywołania narzędzi i rozumowanie mogą stanowić osobne elementy wyjściowe; zachowując historię, nie ograniczaj strumienia do widocznego tekstu.

{
  "model": "grok-4.7",
  "input": "Explain a mutex in one sentence.",
  "reasoning": { "effort": "low" },
  "max_output_tokens": 128,
  "store": false,
  "stream": true
}

Narzędzia i ustrukturyzowane wyjście

Użyj definicji narzędzia dla wybranego formatu. Chat używa response_format, a Responses — text.format. Funkcje, wyszukiwanie w sieci, wyszukiwanie w X, interpreter kodu i wywołania MCP zostały przetestowane z tym modelem. Shell zwraca wywołanie do wykonania przez klienta; nie uruchamia automatycznie polecenia na twoim komputerze. Pełny schemat opisuje też inne typy narzędzi; sam wpis w schemacie nie dowodzi, że określona usługa zewnętrzna jest skonfigurowana.

{
  "model": "grok-4.7",
  "input": "Use the code interpreter once to compute 13*17. Return the number.",
  "tools": [{ "type": "code_interpreter" }],
  "tool_choice": "required",
  "max_turns": 1,
  "reasoning": { "effort": "low" },
  "max_output_tokens": 32,
  "store": false
}

Użycie narzędzi jest rozliczane niezależnie od tokenów. Wyszukiwanie w sieci i interpreter kodu rozliczane są według liczby wywołań. Wyszukiwanie w X wykorzystuje liczbę pobranych postów i profili, także elementów pobranych wielokrotnie; liczba wywołań wyszukiwania w X nie jest jednostką rozliczeniową. Sprawdź usage.server_side_tool_usage_details oraz rejestry użycia na swoim koncie.

Zużycie i ceny

Ceny zależą od całkowitej długości wejścia. Poniżej 200 000 tokenów wejściowych stosuj standardowy próg cenowy. Od 200 000 tokenów próg dla długiego kontekstu obejmuje całe żądanie; wejście z pamięci podręcznej wlicza się przy wyborze progu. service_tier: "priority" i "fast" podwajają stawki za tokeny w obu progach. auto i default wybierają usługę standardową. Opłaty za narzędzia są obliczane osobno i nie są podwajane przez ten mnożnik tokenów.

FormatRozliczanie wejściaRozliczanie wyjścia
Responsesinput_tokens zawiera input_tokens_details.cached_tokensoutput_tokens zawiera rozumowanie; nie dodawaj ponownie jego szczegółowego zużycia
Chatprompt_tokens zawiera prompt_tokens_details.cached_tokensxAI raportuje widoczne completion_tokens osobno; całe płatne wyjście to total_tokens - prompt_tokens, łącznie z rozumowaniem
Messagesinput_tokens nie zawiera cache_read_input_tokens; dodaj pola pamięci podręcznej, aby uzyskać całkowite wejścieoutput_tokens to całkowite wyjście

Publiczne odpowiedzi zawierają liczniki użycia, nie kwoty pieniężne. Ostateczna opłata jest widoczna w rejestrach użycia. Nieudane żądania nie są rozliczane.

Historia rozmowy i aktualne ograniczenia

Aby kontynuować bez przechowywania stanu, wyślij poprzednie wejście, wszystkie zwrócone elementy wyjścia i następną wiadomość użytkownika jako nowe input. W Chat lub Messages wyślij pełną historię wiadomości w odpowiednim formacie. Zachowaj bez zmian zwrócone elementy zaszyfrowanego rozumowania i narzędzi.

Obecna usługa nie pozwala kontynuować przez previous_response_id, pobierać ani usuwać zapisanej odpowiedzi, wyświetlać listy zapisanych elementów wejściowych ani zwracać odroczonych odpowiedzi Chat. store: true może zostać przyjęte podczas tworzenia, ale nie potwierdza to obsługi zapisywania lub pobierania odpowiedzi. Pola te pozostają w oficjalnym kontrakcie i Playground; to ograniczenie nie zastępuje definicji ich docelowego zachowania.

Załączniki nie działały z testowanymi danymi wejściowymi w postaci tekstu inline i adresów URL plików PDF. Żądania generowania obrazów zwracały tekst bez obrazów, a wyszukiwanie narzędzi nie ukończyło wykrywania po stronie serwera. Te możliwości nie zostały potwierdzone jako dostępne. Wyszukiwanie Collections wymaga też prawidłowego zasobu collection i nie zostało zweryfikowane.

Chat ignoruje frequency_penalty, presence_penalty, logit_bias, stop, logprobs i top_logprobs. Responses ignoruje background, context_management, metadata, truncation, logprobs i top_logprobs. Nie są one przekazywane ani oferowane jako aktywne elementy sterujące.

Błędy

Nieprawidłowe żądanie zwraca błąd zamiast ukończonej odpowiedzi. Sprawdź wartości pól i publiczny opis błędów. Żądania zwracające błąd nie są rozliczane.