Claude Opus 5.5 已在 SeedRouter 上线
Moonshot AI文本生成

Kimi K3 — 面向长时编码与 Agent 任务的开放前沿模型

Kimi K3 是 Moonshot AI 的旗舰模型,面向长周期编码和知识工作,支持 100 万 token 上下文。每百万 token 价格:$2.40 / 1M 输入、$12.00 / 1M 输出。

可用$2.40 / 1M 输入 · $12.00 / 1M 输出$3.00 / 1M 输入 · $15.00 / 1M 输出-20%
  • 推理始终开启
  • 百万 token 上下文
  • 图片输入
  • 提示缓存
  • 流式输出
上下文窗口
100 万 token
最大输出
100 万 token
推理强度等级
low、high、max
推理
始终开启

试试 Kimi K3

和 Kimi K3 聊天、附加图片,实时查看每个回答的 token 数和费用。

参数

kimi-k3$2.40 输入 · $12.00 输出,每百万 token

Reasoning effort
Log probabilities

参数会被接受,但不会返回对数概率。

Cache TTL
对话总计$0.000000
就绪

试试下面这几条提示词

每条消息会从你的余额中扣费,费率如下所示,和调用 API 一样。失败的请求不收费。

Kimi K3 的真实输出

一个提示词,以 low 推理强度发送给 Kimi K3。未经编辑。

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.

生成于 2026-09-28。每次运行的回答都可能不同。

Kimi K3 价格

Kimi K3 按 token 计费,从你的余额中扣除。下方费率为实时价格,与你的账户实际扣费费率相同。

一次典型的请求2000 个输入 token、1000 个输出 token
$0.0168每次请求
Kimi K3 始终进行推理,推理 token 计入输出。
$20.00 能买多少按当前费率计算输出 token
1,666,666输出 token 数
输入 token 和缓存 token 的单价都低于输出 token。

示例用量仅供说明。实际账单以每个请求报告的 token 数为准。

项目计为价格计费方式
输入未从缓存读取、也未写入缓存的提示 token$2.40 / 1M每百万 token
输出回答 token 与推理 token$12.00 / 1M每百万 token
缓存输入从缓存读取的提示 token$0.24 / 1M每百万 token
缓存写入,5 分钟以默认 5 分钟 TTL 写入缓存的提示 token$2.40 / 1M每百万 token
缓存写入,1 小时以 1 小时 TTL 写入缓存的提示 token$4.80 / 1M每百万 token
失败的请求任何返回错误的请求免费不收费

Kimi K3 是什么?

Kimi K3 是 Moonshot AI 面向长周期编码、代理和知识工作的旗舰模型。它是一个开放权重模型,拥有 2.8 万亿参数,Kimi K3 单次请求最多可读取 100 万 token 的上下文。

Kimi K3 总是先推理再作答。推理的深度由推理强度决定:low 适合快速步骤,high 适合大多数工作,默认的 max 用于最难的问题。

模型 ID:kimi-k3 · 输入:文本、图片 · 输出:文本 · 接口格式:Chat Completions、Responses、Anthropic Messages。

模型 ID
kimi-k3
上下文窗口
100 万 token
最大输出
100 万 token
推理强度等级
low、high、max
输入
文本、图片

使用 Kimi K3 的两种方式

从你的代码调用它,或让你的编码助手来做。

API

从后端调用

适合应用和服务

把 OpenAI SDK 指向 SeedRouter,代码无需改动。Kimi K3 支持 Chat Completions、Responses 和 Anthropic Messages 三种格式。

  1. 1创建 API Key
  2. 2把 base URL 设为 https://api.seedrouter.ai/v1
  3. 3将 model 设为 kimi-k3
代理

交给你的编码助手

适合 Codex、Claude Code 和其他代理

复制一个现成的提示词。你的助手会在执行任何操作前显示请求和费用。

  1. 1复制提示词
  2. 2粘贴到你的助手
  3. 3批准请求

Kimi K3 擅长什么

Kimi K3 专为需要大量上下文、步骤繁多的长任务打造。

长期编码任务

Kimi K3 能把大型代码库放在视野内,逐步完成多步骤的改动。

代理工作流

工具调用加上 100 万 token 上下文,让代理长时间运行也不会丢失上下文。

知识工作

把报告、合同或日志交给 Kimi K3,得到结构化的解读。

提示中带图片

Kimi K3 能结合你的文字读懂截图和图表。

推理强度由你掌控

简单问题用 low 快速作答,难题用 max。Kimi K3 的每个请求都会推理。

便宜的重复上下文

Kimi K3 的缓存输入只需输入费率的十分之一。

团队用 Kimi K3 构建什么

编码代理

在 Codex 或你自己的代理循环中运行 Kimi K3,完成跨多个文件的改动。

代码审查机器人

把整个代码仓库放进上下文,检查每个 pull request。

结构化提取

用 json_schema 响应格式把工单和文档转换成 JSON。

四步开始使用 Kimi K3

  1. 01

    创建 Key

    登录并创建 API Key。随时添加余额;没有订阅。

  2. 02

    更改基础 URL

    代码保持不变,只需把 OpenAI SDK 的 base_url 指向 https://api.seedrouter.ai/v1。

  3. 03

    选择 Kimi K3

    将 model 设为 kimi-k3。通过推理强度在思考深度与速度、费用之间取舍。

  4. 04

    检查账单

    每个请求在你的使用记录中显示其 token 数和费用。

获取 API Key

SeedRouter 上的 Kimi K3 一览

你现在可以使用的功能。

功能Kimi K3
Chat Completions支持,官方格式
Responses支持,可用于 Codex
Anthropic Messages是
图片输入支持,以 base64 传入
流式输出是
提示缓存支持,TTL 为 5 分钟或 1 小时
结构化输出支持,json_object 和 json_schema
失败的请求不收费

不提供视频输入、文件上传、联网搜索、批处理任务和对数概率。

Kimi K3 的使用限制

百万 token 上下文

在 Kimi K3 上,提示、图片和历史记录共用一个 1,048,576 token 的窗口。

推理占用输出额度

Kimi K3 默认最多输出 131,072 token(含推理);需要更多时调高 max_completion_tokens。

固定采样参数

Kimi K3 将 temperature 固定为 1.0、top_p 固定为 0.95。传入其他值会返回错误。

图片以 base64 传入

Kimi K3 接收以 data URI 形式传入的图片,不接收公开 URL。

为什么通过 SeedRouter 调用 Kimi K3

一把 key,三种格式

用同一个 Key,即可通过 Chat Completions、Responses 或 Anthropic Messages 调用 Kimi K3。

按 token 付费

一次充值,任意模型都能用。无套餐,无月费。

失败请求不收费

返回错误的请求不会被扣费。

实时价格

本页显示的费率就是你的账户支付的费率。

提示缓存

重复的提示前缀会从缓存读取,按更低的 Kimi K3 费率计费。

回复中返回推理内容

Kimi K3 会在回答旁边的 reasoning_content 中返回推理内容。

流式输出

设置 stream: true,即可边生成边接收 Kimi K3 的 token。

相关模型

使用同一把 key 可以调用的其他模型。

DeepSeek V4.1 Flash
deepseek-v4.1-flash

用 OpenAI 或 Anthropic SDK 调用 DeepSeek V4.1 Flash:100 万 token 上下文,思考可开可关,支持图片输入,高峰与非高峰时段实时计价,Playground 在线试用。

查看价格
claude-fable-5
claude-fable-5

Anthropic

查看价格
claude-fable-5-1
claude-fable-5-1

Anthropic

查看价格
claude-opus-5-5
claude-opus-5-5

Anthropic

查看价格
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

查看价格
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

查看价格

Kimi K3 常见问题

Kimi K3 是什么?+

Kimi K3 是 Moonshot AI 面向长周期编码、代理和知识工作的旗舰模型。它是一个开放权重模型,拥有 2.8 万亿参数、100 万 token 的上下文窗口,每个请求都会进行推理。

Kimi K3 适合做什么?+

Kimi K3 适合长时间的编码会话、需要多步调用工具的代理,以及处理大型文档或代码库的工作——100 万 token 的上下文能把所有内容都放在视野内。

Kimi K3 多少钱?+

Kimi K3 按每百万 token $2.40 / 1M 输入、$12.00 / 1M 输出计费。缓存输入只需输入费率的十分之一,缓存写入按其 TTL 计费。价格不随提示长度变化。

Kimi K3 可以免费用吗?+

每个新注册的 SeedRouter 账户都自带 $0.10 免费余额,足够用几次请求试用 Kimi K3。之后从预付余额中按 token 付费,没有订阅,失败的请求不收费。

Kimi K3 开源吗?能本地部署吗?+

Kimi K3 的权重已由 Moonshot AI 公开发布。它拥有 2.8 万亿参数,需要数据中心级硬件才能运行,所以大多数团队会通过 API 调用 Kimi K3。

Kimi K3 是哪家公司开发的?+

Kimi K3 由 Moonshot AI(月之暗面)开发,这家中国公司也是 Kimi 助手的开发者。

Kimi K3 的推理可以关闭吗?+

不能。Kimi K3 始终进行推理。你可以把推理强度设为 low、high 或 max;默认为 max,强度越低,回答越快,输出 token 越少。

Kimi K3 能识别图片吗?+

能。Kimi K3 可以同时接收文本和图片,图片以 base64 data URI 形式传入。它不接收公开的图片 URL,只返回文本。

Kimi K3 的模型 ID 是什么?怎么调用?+

模型 ID 是 kimi-k3。创建一个 SeedRouter API Key,把 OpenAI SDK 指向 https://api.seedrouter.ai/v1,然后通过 Chat Completions 或 Responses 将 model 设为 kimi-k3 发送请求。

Kimi K3 请求失败会收费吗?+

不会。返回错误的 Kimi K3 请求不收费。你只需为成功完成的请求所报告的 token 付费。

立即试用 Kimi K3

几分钟内,就能在 Playground 或你自己的代码里发出第一个 Kimi K3 请求。