Kimi K3 — modelo aberto de fronteira para programação longa e agentes
O Kimi K3 é o modelo principal da Moonshot AI para programação de longo prazo e trabalho de conhecimento, com contexto de 1M de tokens. $2.40 / 1M entrada, $12.00 / 1M saída por 1M de tokens.
- Raciocínio sempre ativo
- Contexto de 1M de tokens
- Entrada de imagem
- Cache de prompt
- Streaming
Experimente o Kimi K3
Converse com o Kimi K3, anexe imagens e veja os tokens e o custo de cada resposta.
kimi-k3$2.40 entrada · $12.00 saída por milhão de tokens
Aceito, mas nenhuma probabilidade logarítmica é retornada.
Experimente um destes prompts
As mensagens são cobradas do seu saldo conforme as tarifas abaixo, como uma chamada de API. Requisições que falham não custam nada.
Saída real do Kimi K3
Um prompt, enviado ao Kimi K3 com nível de raciocínio low. Sem edição.
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.
Gerado em 28 de setembro de 2026. As respostas variam de execução para execução.
Preços do Kimi K3
O Kimi K3 é cobrado por token do seu saldo. As tarifas abaixo são em tempo real, as mesmas cobradas na sua conta.
Os tamanhos de exemplo são ilustrativos. Sua cobrança se baseia nos tokens informados por cada requisição.
| Item | Contado como | Tarifa | Cobrança |
|---|---|---|---|
| Entrada | Tokens de prompt não lidos do cache nem gravados nele | $2.40 / 1M | Por 1M de tokens |
| Saída | Tokens de resposta e de raciocínio | $12.00 / 1M | Por 1M de tokens |
| Entrada em cache | Tokens de prompt servidos pelo cache | $0.24 / 1M | Por 1M de tokens |
| Escrita no cache, 5 min | Tokens de prompt gravados no cache com o TTL padrão de 5 minutos | $2.40 / 1M | Por 1M de tokens |
| Escrita no cache, 1 hora | Tokens de prompt gravados no cache com um TTL de 1 hora | $4.80 / 1M | Por 1M de tokens |
| Requisição que falhou | Qualquer requisição que retorna um erro | Grátis | Não cobrada |
O que é o Kimi K3?
O Kimi K3 é o modelo principal da Moonshot AI para programação de longo prazo, agentes e trabalho de conhecimento. É um modelo de pesos abertos com 2,8 trilhões de parâmetros, e o Kimi K3 lê até 1M de tokens de contexto em uma única requisição.
O Kimi K3 sempre raciocina antes de responder. Você escolhe a intensidade com o nível de raciocínio: low para etapas rápidas, high para a maior parte do trabalho e max, o padrão, para os problemas mais difíceis.
ID do modelo: kimi-k3 · Entrada: texto, imagens · Saída: texto · Formatos: Chat Completions, Responses, Anthropic Messages.
Duas formas de usar o Kimi K3
Chame do seu código, ou deixe seu agente programador fazer.
Chame do seu backend
Aponte o SDK da OpenAI para o SeedRouter e mantenha seu código. O Kimi K3 responde a Chat Completions, Responses e Anthropic Messages.
- 1Crie uma chave de API
- 2Defina a URL base como https://api.seedrouter.ai/v1
- 3Envie kimi-k3 como modelo
Deixe seu agente programador fazer
Copie um prompt pronto. Seu agente mostra a requisição e o custo antes de gastar.
- 1Copie o prompt
- 2Cole no seu agente
- 3Aprove a requisição
No que o Kimi K3 se destaca
O Kimi K3 foi feito para tarefas longas que exigem muito contexto e muitas etapas.
Sessões longas de código
O Kimi K3 mantém uma base de código grande à vista e executa mudanças em várias etapas.
Fluxos de trabalho com agentes
Chamadas de ferramentas e um contexto de 1M de tokens deixam um agente trabalhar por muito tempo sem perder o fio.
Trabalho de conhecimento
Entregue ao Kimi K3 relatórios, contratos ou logs e receba uma leitura estruturada.
Imagens no prompt
O Kimi K3 lê capturas de tela e gráficos junto com o seu texto.
Raciocínio que você controla
Low para respostas rápidas, max para problemas difíceis. O Kimi K3 raciocina em toda requisição.
Contexto repetido mais barato
A entrada em cache no Kimi K3 custa um décimo da tarifa de entrada.
O que as equipes criam com o Kimi K3
Agentes de programação
Rode o Kimi K3 no Codex ou no seu próprio loop de agente para mudanças em vários arquivos.
Bots de revisão de código
Revise cada pull request com o repositório inteiro no contexto.
Extração estruturada
Transforme tickets e documentos em JSON com um response_format json_schema.
Comece a usar o Kimi K3 em quatro passos
- 01
Crie uma chave
Entre e crie uma chave de API. Adicione crédito sempre que precisar; não há assinatura.
- 02
Mude a URL base
Aponte o SDK da OpenAI para https://api.seedrouter.ai/v1. Seu código continua o mesmo.
- 03
Escolha o Kimi K3
Envie kimi-k3 como modelo. Defina o nível de raciocínio para equilibrar profundidade, velocidade e custo.
- 04
Verifique a conta
Cada requisição mostra seus tokens e cobrança em seus registros de uso.
Kimi K3 no SeedRouter em resumo
O que você pode usar hoje.
| Recurso | Kimi K3 |
|---|---|
| Chat Completions | Sim, formato oficial |
| Responses | Sim, funciona com o Codex |
| Anthropic Messages | Sim |
| Entrada de imagem | Sim, em base64 |
| Streaming | Sim |
| Cache de prompt | Sim, TTL de 5 minutos ou 1 hora |
| Saída estruturada | Sim, json_object e json_schema |
| Requisições com falha | Não cobrada |
Entrada de vídeo, upload de arquivos, busca na web, jobs em lote e probabilidades logarítmicas não são oferecidos.
Limites do Kimi K3
Contexto de 1M de tokens
No Kimi K3, prompt, imagens e histórico compartilham uma única janela de 1.048.576 tokens.
O raciocínio usa o orçamento de saída
O Kimi K3 escreve até 131.072 tokens por padrão, incluindo o raciocínio; aumente max_completion_tokens para mais.
Amostragem fixa
O Kimi K3 fixa temperature em 1.0 e top_p em 0.95. Qualquer outro valor retorna um erro.
Imagens em base64
O Kimi K3 recebe imagens como data URIs, não como URLs públicas.
Por que chamar o Kimi K3 pelo SeedRouter
Uma chave, três formatos
Chame o Kimi K3 com Chat Completions, Responses ou Anthropic Messages, usando a mesma chave.
Pague por token
Recarregue uma vez e gaste em qualquer modelo. Sem plano, sem taxa mensal.
Falhas são grátis
Uma requisição que gera erro não é cobrada.
Preços em tempo real
As tarifas nesta página são as que sua conta paga.
Cache de prompt
Prefixos de prompt repetidos são lidos do cache a uma tarifa menor do Kimi K3.
Raciocínio de volta na resposta
O Kimi K3 retorna o raciocínio em reasoning_content, ao lado da resposta.
Streaming
Receba os tokens do Kimi K3 em streaming à medida que chegam com stream: true.
Modelos relacionados
Outros modelos que você pode chamar com a mesma chave.
Use o DeepSeek V4.1 Flash com o SDK da OpenAI ou da Anthropic: contexto de 1M de tokens, raciocínio ligado ou desligado, entrada de imagens, preços de horário de pico e fora de pico em tempo real e um Playground.
Ver preçosGuias do Kimi K3
Passo a passo e comparações para este modelo.
O Kimi K3 é grátis? Os pesos são gratuitos para baixar, mas rodá-los exige hardware de data center, e a API é paga por token. Veja o que dá para testar grátis.
Como acessar a API do Kimi K3: obtenha a chave, chame kimi-k3 com o SDK da OpenAI, esforço de raciocínio, streaming, imagens e os erros mais comuns no início.
Preço da API do Kimi K3 por milhão de tokens: entrada, saída, entrada em cache e escritas no cache de 5 minutos ou 1 hora, com a fórmula e o custo por tarefa.
Como usar o Kimi K3 como modelo no Claude Code e no OpenAI Codex CLI pela SeedRouter: as variáveis de ambiente, o config.toml e os resultados dos testes.
Kimi K3 vs Claude Fable 5 e Claude Opus 5.5 comparados em preço de tabela, contexto, limite de saída, controle de raciocínio, pesos abertos e formatos de API.
Perguntas frequentes sobre o Kimi K3
O que é o Kimi K3?+
O Kimi K3 é o modelo principal da Moonshot AI para programação de longo prazo, agentes e trabalho de conhecimento. É um modelo de pesos abertos com 2,8 trilhões de parâmetros, janela de contexto de 1M de tokens e raciocínio em toda requisição.
Para que serve o Kimi K3?+
O Kimi K3 é indicado para sessões longas de programação, agentes que chamam ferramentas ao longo de muitas etapas e trabalho com documentos ou bases de código grandes, em que o contexto de 1M de tokens mantém tudo à vista.
Quanto custa o Kimi K3?+
O Kimi K3 custa $2.40 / 1M de entrada e $12.00 / 1M de saída por 1M de tokens. A entrada em cache custa um décimo da tarifa de entrada, e as escritas no cache são cobradas conforme o TTL. O preço não muda com o tamanho do prompt.
Posso usar o Kimi K3 de graça?+
Toda conta nova do SeedRouter começa com $0.10 de saldo gratuito, o suficiente para testar o Kimi K3 com algumas requisições. Depois disso, você paga por token de um saldo pré-pago, sem assinatura, e uma requisição que falha não é cobrada.
O Kimi K3 é open source? Posso rodá-lo localmente?+
Os pesos do Kimi K3 são publicados pela Moonshot AI. Com 2,8 trilhões de parâmetros, ele exige hardware de data center, por isso a maioria das equipes chama o Kimi K3 por uma API.
Quem criou o Kimi K3?+
O Kimi K3 é feito pela Moonshot AI, a empresa chinesa por trás do assistente Kimi.
Posso desligar o raciocínio do Kimi K3?+
Não. O Kimi K3 sempre raciocina. Você pode definir o nível de raciocínio como low, high ou max; o padrão é max, e um nível menor responde mais rápido com menos tokens de saída.
O Kimi K3 consegue ler imagens?+
Sim. O Kimi K3 aceita imagens junto com texto como data URIs em base64. Ele não aceita URLs públicas de imagens e retorna apenas texto.
Qual é o ID do modelo Kimi K3 e como faço para chamá-lo?+
O ID do modelo é kimi-k3. Crie uma chave de API do SeedRouter, aponte o SDK da OpenAI para https://api.seedrouter.ai/v1 e envie kimi-k3 como modelo com Chat Completions ou Responses.
Sou cobrado se uma requisição ao Kimi K3 falhar?+
Não. Uma requisição ao Kimi K3 que retorna um erro não é cobrada. Você paga apenas pelos tokens que uma requisição concluída informa.
Experimente o Kimi K3 agora
Envie sua primeira requisição ao Kimi K3 pelo Playground ou pelo seu próprio código em minutos.
