Claude Opus 5.5 已在 SeedRouter 上线
LogoSeedRouter

按名称搜索模型,例如 nano banana

按名称搜索模型,例如 nano banana

Text

Grok 4.7

View Markdown

使用原生 Chat Completions、Responses 或 Messages 请求调用 Grok 4.7,了解参数、流式输出、用量及当前能力限制。

通过以下三种格式之一使用 grok-4.7,并使用你的 SeedRouter API key 进行身份验证。模型页面提供 Playground 和当前 Token 价格;价格指南说明缓存输入与推理的计费方式。

快速开始

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'

JSON 响应包含 output 项和 usage。构建对话历史时,请保留全部输出项,包括推理项和工具项。

请求格式

格式端点必填字段
ResponsesPOST /v1/responsesmodel, input
Chat CompletionsPOST /v1/chat/completionsmodel, messages
MessagesPOST /v1/messagesmodel, messages, max_tokens

使用 Content-Type: application/json 和 Authorization: Bearer $SEEDROUTER_API_KEY。Messages 客户端还可发送 anthropic-version: 2023-06-01。

参数与约束

OpenAPI 规范包含完整的嵌套请求和响应 schema。下表列出所有支持的顶层请求字段。未知字段以及官方明确由该模型忽略的参数会被丢弃。支持的参数若取值无效,仍属于无效请求。

可选且允许为空的字段接受显式 null;省略字段时采用其 API 默认值。Playground 隐藏 user,并将 model 固定为 grok-4.7。API 客户端仍可发送 user。

  • 上下文:50 万个 Token,包括对话与输出。
  • 推理强度:low、medium、high、xhigh;默认 high。
  • max_completion_tokens 和 max_output_tokens 默认限制为 128,000 个可见输出 Token。推理和函数调用 Token 不计入这一可见输出限制。这是默认值,不代表最大输出能力。
  • 输出限制必须为正整数。API 同时执行现有的整数安全上限 1,073,741,823;上下文容量限制仍然适用。
  • temperature:0 至 2,默认 1。top_p:大于 0 且不超过 1,默认 1。Responses 的 min_p:0 至 1;top_k:不小于 1 的整数。
  • 最多 350 个工具定义。stream_options 要求 stream: true。
  • instructions 与 previous_response_id 不能同时使用。推理摘要始终为详细模式。

Responses 参数

字段类型规则
include数组或 null需要额外包含在响应中的字段数组。
input(必填)对象或其他支持的类型文本字符串或完整的输入项数组。
instructions字符串或 null系统指令;不能与 previous_response_id 同时使用。
max_output_tokens整数或 null可见输出限制;默认 128,000。
max_turns整数或 null智能体最大轮数,以整数表示。
min_p数值或 null0 至 1 的数值。
model(必填)字符串固定为 grok-4.7。
parallel_tool_calls布尔值或 null布尔值;默认 true。
previous_response_id字符串或 null字符串类型的响应 ID;当前无法按 ID 续接。
prompt_cache_key字符串或 null字符串类型的缓存键。
reasoning对象推理配置;推理强度默认 high。
reasoning_effort字符串或 nulllow、medium、high、xhigh;默认 high。
safety_identifier字符串或 null可选的调用方安全标识符。
search_parameters对象搜索配置。
service_tier字符串auto、default、priority、fast;priority 和 fast 的 Token 费率加倍。
store布尔值或 null布尔值;默认 true。当前无法执行已存储响应的相关操作。
stream布尔值或 null布尔值;默认 false。
temperature数值或 null0 至 2 的数值;默认 1。
text对象文本响应配置,包含 format。
tool_choice对象或其他支持的类型自动、禁用、必须调用或指定工具;语法取决于所选格式。
tools数组或 null工具定义;最多 350 个。
top_k整数或 null整数;Responses 要求不小于 1。
top_p数值或 null大于 0 且不超过 1 的数值;默认 1。
user字符串或 null可选的调用方标识符;在 Playground 中隐藏。

Chat Completions 参数

字段类型规则
deferred布尔值或 null布尔值;默认 false。当前无法返回延迟完成的响应。
max_completion_tokens整数或 null可见输出限制;默认 128,000。
max_tokens整数或 null正整数可见输出限制。Messages 必填。
messages(必填)数组使用该格式的对话消息。
model(必填)字符串固定为 grok-4.7。
n整数或 null不小于 1 的整数;默认 1。
parallel_tool_calls布尔值或 null布尔值;默认 true。
prompt_cache_key字符串或 null字符串类型的缓存键。
reasoning_effort字符串或 nulllow、medium、high、xhigh;默认 high。
response_format对象或其他支持的类型文本、JSON 对象或 JSON schema 输出。
safety_identifier字符串或 null可选的调用方安全标识符。
search_parameters对象搜索配置。
seed整数或 null整数类型的采样种子。
service_tier字符串auto、default、priority、fast;priority 和 fast 的 Token 费率加倍。
stream布尔值或 null布尔值;默认 false。
stream_options对象流式输出选项;要求 stream: true。
temperature数值或 null0 至 2 的数值;默认 1。
tool_choice对象或其他支持的类型自动、禁用、必须调用或指定工具;语法取决于所选格式。
tools数组或 null工具定义;最多 350 个。
top_p数值或 null大于 0 且不超过 1 的数值;默认 1。
user字符串或 null可选的调用方标识符;在 Playground 中隐藏。
web_search_options对象兼容格式的搜索选项。

Messages 参数

字段类型规则
max_tokens(必填)整数正整数可见输出限制。Messages 必填。
messages(必填)数组使用该格式的对话消息。
metadata对象Messages 元数据对象。
model(必填)字符串固定为 grok-4.7。
stop_sequences数组或 null停止字符串数组。
stream布尔值或 null布尔值;默认 false。
system对象或其他支持的类型系统字符串或内容块。
temperature数值或 null0 至 2 的数值;默认 1。
tool_choice对象或其他支持的类型自动、禁用、必须调用或指定工具;语法取决于所选格式。
tools数组或 null工具定义;最多 350 个。
top_k整数或 null整数;Responses 要求不小于 1。
top_p数值或 null大于 0 且不超过 1 的数值;默认 1。

流式输出

将 stream 设为 true。Chat 发送 completion 数据块;Responses 发送具名响应事件;Messages 发送消息事件和内容块事件。除文本增量外,还需读取最终用量事件。工具调用和推理可能以独立输出项返回;保留历史时,不要只保留流中的可见文本。

{
  "model": "grok-4.7",
  "input": "Explain a mutex in one sentence.",
  "reasoning": { "effort": "low" },
  "max_output_tokens": 128,
  "store": false,
  "stream": true
}

工具与结构化输出

使用所选格式对应的工具定义。Chat 使用 response_format;Responses 使用 text.format。函数、网页搜索、X 搜索、代码解释器和 MCP 调用均已使用该模型实测。Shell 返回由客户端执行的调用,不会自动在你的电脑上运行命令。完整 schema 还描述了其他工具类型;仅有 schema 条目不能证明某项外部服务已配置。

{
  "model": "grok-4.7",
  "input": "Use the code interpreter once to compute 13*17. Return the number.",
  "tools": [{ "type": "code_interpreter" }],
  "tool_choice": "required",
  "max_turns": 1,
  "reasoning": { "effort": "low" },
  "max_output_tokens": 32,
  "store": false
}

工具用量与 Token 分开计费。网页搜索和代码解释器按调用次数计费。X 搜索按获取的帖子和个人资料数量计费,包括重复获取的项目;X 搜索的调用次数不是其计费单位。请查看 usage.server_side_tool_usage_details 及账号用量记录。

用量与价格

价格取决于输入总长度。输入少于 20 万个 Token 时采用标准档;输入达到或超过 20 万个 Token 时,整个请求采用长上下文档;选择档位时计入缓存输入。service_tier: "priority" 和 "fast" 会使两档的 Token 费率均加倍。auto 和 default 选择标准服务。工具费单独计算,不随此 Token 倍率加倍。

格式输入计量输出计量
Responsesinput_tokens 包含 input_tokens_details.cached_tokensoutput_tokens 包含推理;不要再次加上推理明细
Chatprompt_tokens 包含 prompt_tokens_details.cached_tokensxAI 单独报告可见的 completion_tokens;计费输出总量为 total_tokens - prompt_tokens,包含推理
Messagesinput_tokens 不包含 cache_read_input_tokens;加上缓存字段可得输入总量output_tokens 为输出总量

公开响应包含用量计数,不包含金额字段。用量记录显示最终费用。失败的请求不收费。

对话历史与当前限制

进行无状态续接时,将先前输入、所有返回的输出项和下一条用户消息作为新的 input 发送。使用 Chat 或 Messages 时,发送对应格式的完整消息历史。返回的加密推理项和工具项应原样保留。

当前服务无法使用 previous_response_id 续接、获取或删除已存储的响应、列出已存储的输入项,也无法返回延迟完成的 Chat 响应。创建时可能接受 store: true,但这不能证明支持响应存储或读取。这些字段仍保留在官方契约和 Playground 中;当前限制不会重新定义它们应有的行为。

文件附件在已测试的内联文本和 PDF URL 输入中均未成功使用。图像生成请求返回了文本而非图片,工具搜索未完成服务端发现。这些能力尚未验证为可用。Collections 搜索还需要有效的 collection 资源,目前尚未验证。

Chat 忽略 frequency_penalty、presence_penalty、logit_bias、stop、logprobs 和 top_logprobs。Responses 忽略 background、context_management、metadata、truncation、logprobs 和 top_logprobs。这些字段不会转发,也不作为有效控件提供。

错误

无效请求会返回错误,而不是已完成的回答。请检查字段值并参阅公开错误说明。返回错误的请求不收费。