Text
Grok 4.7
使用原生 Chat Completions、Responses 或 Messages 请求调用 Grok 4.7,了解参数、流式输出、用量及当前能力限制。
通过以下三种格式之一使用 grok-4.7,并使用你的 SeedRouter API key 进行身份验证。模型页面提供 Playground 和当前 Token 价格;价格指南说明缓存输入与推理的计费方式。
快速开始
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'JSON 响应包含 output 项和 usage。构建对话历史时,请保留全部输出项,包括推理项和工具项。
请求格式
| 格式 | 端点 | 必填字段 |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
使用 Content-Type: application/json 和 Authorization: Bearer $SEEDROUTER_API_KEY。Messages 客户端还可发送 anthropic-version: 2023-06-01。
参数与约束
OpenAPI 规范包含完整的嵌套请求和响应 schema。下表列出所有支持的顶层请求字段。未知字段以及官方明确由该模型忽略的参数会被丢弃。支持的参数若取值无效,仍属于无效请求。
可选且允许为空的字段接受显式 null;省略字段时采用其 API 默认值。Playground 隐藏 user,并将 model 固定为 grok-4.7。API 客户端仍可发送 user。
- 上下文:50 万个 Token,包括对话与输出。
- 推理强度:
low、medium、high、xhigh;默认high。 max_completion_tokens和max_output_tokens默认限制为 128,000 个可见输出 Token。推理和函数调用 Token 不计入这一可见输出限制。这是默认值,不代表最大输出能力。- 输出限制必须为正整数。API 同时执行现有的整数安全上限 1,073,741,823;上下文容量限制仍然适用。
temperature:0 至 2,默认 1。top_p:大于 0 且不超过 1,默认 1。Responses 的min_p:0 至 1;top_k:不小于 1 的整数。- 最多 350 个工具定义。
stream_options要求stream: true。 instructions与previous_response_id不能同时使用。推理摘要始终为详细模式。
Responses 参数
| 字段 | 类型 | 规则 |
|---|---|---|
include | 数组或 null | 需要额外包含在响应中的字段数组。 |
input(必填) | 对象或其他支持的类型 | 文本字符串或完整的输入项数组。 |
instructions | 字符串或 null | 系统指令;不能与 previous_response_id 同时使用。 |
max_output_tokens | 整数或 null | 可见输出限制;默认 128,000。 |
max_turns | 整数或 null | 智能体最大轮数,以整数表示。 |
min_p | 数值或 null | 0 至 1 的数值。 |
model(必填) | 字符串 | 固定为 grok-4.7。 |
parallel_tool_calls | 布尔值或 null | 布尔值;默认 true。 |
previous_response_id | 字符串或 null | 字符串类型的响应 ID;当前无法按 ID 续接。 |
prompt_cache_key | 字符串或 null | 字符串类型的缓存键。 |
reasoning | 对象 | 推理配置;推理强度默认 high。 |
reasoning_effort | 字符串或 null | low、medium、high、xhigh;默认 high。 |
safety_identifier | 字符串或 null | 可选的调用方安全标识符。 |
search_parameters | 对象 | 搜索配置。 |
service_tier | 字符串 | auto、default、priority、fast;priority 和 fast 的 Token 费率加倍。 |
store | 布尔值或 null | 布尔值;默认 true。当前无法执行已存储响应的相关操作。 |
stream | 布尔值或 null | 布尔值;默认 false。 |
temperature | 数值或 null | 0 至 2 的数值;默认 1。 |
text | 对象 | 文本响应配置,包含 format。 |
tool_choice | 对象或其他支持的类型 | 自动、禁用、必须调用或指定工具;语法取决于所选格式。 |
tools | 数组或 null | 工具定义;最多 350 个。 |
top_k | 整数或 null | 整数;Responses 要求不小于 1。 |
top_p | 数值或 null | 大于 0 且不超过 1 的数值;默认 1。 |
user | 字符串或 null | 可选的调用方标识符;在 Playground 中隐藏。 |
Chat Completions 参数
| 字段 | 类型 | 规则 |
|---|---|---|
deferred | 布尔值或 null | 布尔值;默认 false。当前无法返回延迟完成的响应。 |
max_completion_tokens | 整数或 null | 可见输出限制;默认 128,000。 |
max_tokens | 整数或 null | 正整数可见输出限制。Messages 必填。 |
messages(必填) | 数组 | 使用该格式的对话消息。 |
model(必填) | 字符串 | 固定为 grok-4.7。 |
n | 整数或 null | 不小于 1 的整数;默认 1。 |
parallel_tool_calls | 布尔值或 null | 布尔值;默认 true。 |
prompt_cache_key | 字符串或 null | 字符串类型的缓存键。 |
reasoning_effort | 字符串或 null | low、medium、high、xhigh;默认 high。 |
response_format | 对象或其他支持的类型 | 文本、JSON 对象或 JSON schema 输出。 |
safety_identifier | 字符串或 null | 可选的调用方安全标识符。 |
search_parameters | 对象 | 搜索配置。 |
seed | 整数或 null | 整数类型的采样种子。 |
service_tier | 字符串 | auto、default、priority、fast;priority 和 fast 的 Token 费率加倍。 |
stream | 布尔值或 null | 布尔值;默认 false。 |
stream_options | 对象 | 流式输出选项;要求 stream: true。 |
temperature | 数值或 null | 0 至 2 的数值;默认 1。 |
tool_choice | 对象或其他支持的类型 | 自动、禁用、必须调用或指定工具;语法取决于所选格式。 |
tools | 数组或 null | 工具定义;最多 350 个。 |
top_p | 数值或 null | 大于 0 且不超过 1 的数值;默认 1。 |
user | 字符串或 null | 可选的调用方标识符;在 Playground 中隐藏。 |
web_search_options | 对象 | 兼容格式的搜索选项。 |
Messages 参数
| 字段 | 类型 | 规则 |
|---|---|---|
max_tokens(必填) | 整数 | 正整数可见输出限制。Messages 必填。 |
messages(必填) | 数组 | 使用该格式的对话消息。 |
metadata | 对象 | Messages 元数据对象。 |
model(必填) | 字符串 | 固定为 grok-4.7。 |
stop_sequences | 数组或 null | 停止字符串数组。 |
stream | 布尔值或 null | 布尔值;默认 false。 |
system | 对象或其他支持的类型 | 系统字符串或内容块。 |
temperature | 数值或 null | 0 至 2 的数值;默认 1。 |
tool_choice | 对象或其他支持的类型 | 自动、禁用、必须调用或指定工具;语法取决于所选格式。 |
tools | 数组或 null | 工具定义;最多 350 个。 |
top_k | 整数或 null | 整数;Responses 要求不小于 1。 |
top_p | 数值或 null | 大于 0 且不超过 1 的数值;默认 1。 |
流式输出
将 stream 设为 true。Chat 发送 completion 数据块;Responses 发送具名响应事件;Messages 发送消息事件和内容块事件。除文本增量外,还需读取最终用量事件。工具调用和推理可能以独立输出项返回;保留历史时,不要只保留流中的可见文本。
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}工具与结构化输出
使用所选格式对应的工具定义。Chat 使用 response_format;Responses 使用 text.format。函数、网页搜索、X 搜索、代码解释器和 MCP 调用均已使用该模型实测。Shell 返回由客户端执行的调用,不会自动在你的电脑上运行命令。完整 schema 还描述了其他工具类型;仅有 schema 条目不能证明某项外部服务已配置。
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}工具用量与 Token 分开计费。网页搜索和代码解释器按调用次数计费。X 搜索按获取的帖子和个人资料数量计费,包括重复获取的项目;X 搜索的调用次数不是其计费单位。请查看 usage.server_side_tool_usage_details 及账号用量记录。
用量与价格
价格取决于输入总长度。输入少于 20 万个 Token 时采用标准档;输入达到或超过 20 万个 Token 时,整个请求采用长上下文档;选择档位时计入缓存输入。service_tier: "priority" 和 "fast" 会使两档的 Token 费率均加倍。auto 和 default 选择标准服务。工具费单独计算,不随此 Token 倍率加倍。
| 格式 | 输入计量 | 输出计量 |
|---|---|---|
| Responses | input_tokens 包含 input_tokens_details.cached_tokens | output_tokens 包含推理;不要再次加上推理明细 |
| Chat | prompt_tokens 包含 prompt_tokens_details.cached_tokens | xAI 单独报告可见的 completion_tokens;计费输出总量为 total_tokens - prompt_tokens,包含推理 |
| Messages | input_tokens 不包含 cache_read_input_tokens;加上缓存字段可得输入总量 | output_tokens 为输出总量 |
公开响应包含用量计数,不包含金额字段。用量记录显示最终费用。失败的请求不收费。
对话历史与当前限制
进行无状态续接时,将先前输入、所有返回的输出项和下一条用户消息作为新的 input 发送。使用 Chat 或 Messages 时,发送对应格式的完整消息历史。返回的加密推理项和工具项应原样保留。
当前服务无法使用 previous_response_id 续接、获取或删除已存储的响应、列出已存储的输入项,也无法返回延迟完成的 Chat 响应。创建时可能接受 store: true,但这不能证明支持响应存储或读取。这些字段仍保留在官方契约和 Playground 中;当前限制不会重新定义它们应有的行为。
文件附件在已测试的内联文本和 PDF URL 输入中均未成功使用。图像生成请求返回了文本而非图片,工具搜索未完成服务端发现。这些能力尚未验证为可用。Collections 搜索还需要有效的 collection 资源,目前尚未验证。
Chat 忽略 frequency_penalty、presence_penalty、logit_bias、stop、logprobs 和 top_logprobs。Responses 忽略 background、context_management、metadata、truncation、logprobs 和 top_logprobs。这些字段不会转发,也不作为有效控件提供。
错误
无效请求会返回错误,而不是已完成的回答。请检查字段值并参阅公开错误说明。返回错误的请求不收费。
