Kimi K3 — 面向长时编码与 Agent 任务的开放前沿模型
Kimi K3 是 Moonshot AI 的旗舰模型,面向长周期编码和知识工作,支持 100 万 token 上下文。每百万 token 价格:$2.40 / 1M 输入、$12.00 / 1M 输出。
- 推理始终开启
- 百万 token 上下文
- 图片输入
- 提示缓存
- 流式输出
试试 Kimi K3
和 Kimi K3 聊天、附加图片,实时查看每个回答的 token 数和费用。
kimi-k3$2.40 输入 · $12.00 输出,每百万 token
参数会被接受,但不会返回对数概率。
Kimi K3 的真实输出
一个提示词,以 low 推理强度发送给 Kimi K3。未经编辑。
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.
生成于 2026-09-28。每次运行的回答都可能不同。
Kimi K3 价格
Kimi K3 按 token 计费,从你的余额中扣除。下方费率为实时价格,与你的账户实际扣费费率相同。
示例用量仅供说明。实际账单以每个请求报告的 token 数为准。
| 项目 | 计为 | 价格 | 计费方式 |
|---|---|---|---|
| 输入 | 未从缓存读取、也未写入缓存的提示 token | $2.40 / 1M | 每百万 token |
| 输出 | 回答 token 与推理 token | $12.00 / 1M | 每百万 token |
| 缓存输入 | 从缓存读取的提示 token | $0.24 / 1M | 每百万 token |
| 缓存写入,5 分钟 | 以默认 5 分钟 TTL 写入缓存的提示 token | $2.40 / 1M | 每百万 token |
| 缓存写入,1 小时 | 以 1 小时 TTL 写入缓存的提示 token | $4.80 / 1M | 每百万 token |
| 失败的请求 | 任何返回错误的请求 | 免费 | 不收费 |
Kimi K3 是什么?
Kimi K3 是 Moonshot AI 面向长周期编码、代理和知识工作的旗舰模型。它是一个开放权重模型,拥有 2.8 万亿参数,Kimi K3 单次请求最多可读取 100 万 token 的上下文。
Kimi K3 总是先推理再作答。推理的深度由推理强度决定:low 适合快速步骤,high 适合大多数工作,默认的 max 用于最难的问题。
模型 ID:kimi-k3 · 输入:文本、图片 · 输出:文本 · 接口格式:Chat Completions、Responses、Anthropic Messages。
使用 Kimi K3 的两种方式
从你的代码调用它,或让你的编码助手来做。
从后端调用
把 OpenAI SDK 指向 SeedRouter,代码无需改动。Kimi K3 支持 Chat Completions、Responses 和 Anthropic Messages 三种格式。
- 1创建 API Key
- 2把 base URL 设为 https://api.seedrouter.ai/v1
- 3将 model 设为 kimi-k3
交给你的编码助手
复制一个现成的提示词。你的助手会在执行任何操作前显示请求和费用。
- 1复制提示词
- 2粘贴到你的助手
- 3批准请求
Kimi K3 擅长什么
Kimi K3 专为需要大量上下文、步骤繁多的长任务打造。
长期编码任务
Kimi K3 能把大型代码库放在视野内,逐步完成多步骤的改动。
代理工作流
工具调用加上 100 万 token 上下文,让代理长时间运行也不会丢失上下文。
知识工作
把报告、合同或日志交给 Kimi K3,得到结构化的解读。
提示中带图片
Kimi K3 能结合你的文字读懂截图和图表。
推理强度由你掌控
简单问题用 low 快速作答,难题用 max。Kimi K3 的每个请求都会推理。
便宜的重复上下文
Kimi K3 的缓存输入只需输入费率的十分之一。
团队用 Kimi K3 构建什么
编码代理
在 Codex 或你自己的代理循环中运行 Kimi K3,完成跨多个文件的改动。
代码审查机器人
把整个代码仓库放进上下文,检查每个 pull request。
结构化提取
用 json_schema 响应格式把工单和文档转换成 JSON。
四步开始使用 Kimi K3
- 01
创建 Key
登录并创建 API Key。随时添加余额;没有订阅。
- 02
更改基础 URL
代码保持不变,只需把 OpenAI SDK 的 base_url 指向 https://api.seedrouter.ai/v1。
- 03
选择 Kimi K3
将 model 设为 kimi-k3。通过推理强度在思考深度与速度、费用之间取舍。
- 04
检查账单
每个请求在你的使用记录中显示其 token 数和费用。
SeedRouter 上的 Kimi K3 一览
你现在可以使用的功能。
| 功能 | Kimi K3 |
|---|---|
| Chat Completions | 支持,官方格式 |
| Responses | 支持,可用于 Codex |
| Anthropic Messages | 是 |
| 图片输入 | 支持,以 base64 传入 |
| 流式输出 | 是 |
| 提示缓存 | 支持,TTL 为 5 分钟或 1 小时 |
| 结构化输出 | 支持,json_object 和 json_schema |
| 失败的请求 | 不收费 |
不提供视频输入、文件上传、联网搜索、批处理任务和对数概率。
Kimi K3 的使用限制
百万 token 上下文
在 Kimi K3 上,提示、图片和历史记录共用一个 1,048,576 token 的窗口。
推理占用输出额度
Kimi K3 默认最多输出 131,072 token(含推理);需要更多时调高 max_completion_tokens。
固定采样参数
Kimi K3 将 temperature 固定为 1.0、top_p 固定为 0.95。传入其他值会返回错误。
图片以 base64 传入
Kimi K3 接收以 data URI 形式传入的图片,不接收公开 URL。
为什么通过 SeedRouter 调用 Kimi K3
一把 key,三种格式
用同一个 Key,即可通过 Chat Completions、Responses 或 Anthropic Messages 调用 Kimi K3。
按 token 付费
一次充值,任意模型都能用。无套餐,无月费。
失败请求不收费
返回错误的请求不会被扣费。
实时价格
本页显示的费率就是你的账户支付的费率。
提示缓存
重复的提示前缀会从缓存读取,按更低的 Kimi K3 费率计费。
回复中返回推理内容
Kimi K3 会在回答旁边的 reasoning_content 中返回推理内容。
流式输出
设置 stream: true,即可边生成边接收 Kimi K3 的 token。
相关模型
使用同一把 key 可以调用的其他模型。
用 OpenAI 或 Anthropic SDK 调用 DeepSeek V4.1 Flash:100 万 token 上下文,思考可开可关,支持图片输入,高峰与非高峰时段实时计价,Playground 在线试用。
查看价格Kimi K3 使用指南
该模型的教程和对比。
Kimi K3 能免费用吗?权重可以免费下载,但运行需要数据中心级硬件,API 则按 token 付费。这里说明哪些可以免费试用。
Kimi K3 API 接入教程:获取 API key,用 OpenAI SDK 调用 kimi-k3,设置推理强度、流式输出、发送图片,并解决新手最先遇到的报错。
Kimi K3 API 每百万 token 价格:输入、输出、缓存输入,以及 5 分钟或 1 小时缓存写入费率,附计费公式和一次任务的成本。
如何通过 SeedRouter 在 Claude Code 和 OpenAI Codex CLI 中把 Kimi K3 设为模型:环境变量、config.toml 配置以及实测结果。
Kimi K3 与 Claude Fable 5、Claude Opus 5.5 的对比:官方标价、上下文、输出上限、推理控制、开放权重和 API 格式,并给出选择建议。
Kimi K3 常见问题
Kimi K3 是什么?+
Kimi K3 是 Moonshot AI 面向长周期编码、代理和知识工作的旗舰模型。它是一个开放权重模型,拥有 2.8 万亿参数、100 万 token 的上下文窗口,每个请求都会进行推理。
Kimi K3 适合做什么?+
Kimi K3 适合长时间的编码会话、需要多步调用工具的代理,以及处理大型文档或代码库的工作——100 万 token 的上下文能把所有内容都放在视野内。
Kimi K3 多少钱?+
Kimi K3 按每百万 token $2.40 / 1M 输入、$12.00 / 1M 输出计费。缓存输入只需输入费率的十分之一,缓存写入按其 TTL 计费。价格不随提示长度变化。
Kimi K3 可以免费用吗?+
每个新注册的 SeedRouter 账户都自带 $0.10 免费余额,足够用几次请求试用 Kimi K3。之后从预付余额中按 token 付费,没有订阅,失败的请求不收费。
Kimi K3 开源吗?能本地部署吗?+
Kimi K3 的权重已由 Moonshot AI 公开发布。它拥有 2.8 万亿参数,需要数据中心级硬件才能运行,所以大多数团队会通过 API 调用 Kimi K3。
Kimi K3 是哪家公司开发的?+
Kimi K3 由 Moonshot AI(月之暗面)开发,这家中国公司也是 Kimi 助手的开发者。
Kimi K3 的推理可以关闭吗?+
不能。Kimi K3 始终进行推理。你可以把推理强度设为 low、high 或 max;默认为 max,强度越低,回答越快,输出 token 越少。
Kimi K3 能识别图片吗?+
能。Kimi K3 可以同时接收文本和图片,图片以 base64 data URI 形式传入。它不接收公开的图片 URL,只返回文本。
Kimi K3 的模型 ID 是什么?怎么调用?+
模型 ID 是 kimi-k3。创建一个 SeedRouter API Key,把 OpenAI SDK 指向 https://api.seedrouter.ai/v1,然后通过 Chat Completions 或 Responses 将 model 设为 kimi-k3 发送请求。
Kimi K3 请求失败会收费吗?+
不会。返回错误的 Kimi K3 请求不收费。你只需为成功完成的请求所报告的 token 付费。
