Claude Opus 5.5 já está disponível no SeedRouter
Moonshot AIGeração de texto

Kimi K3 — modelo aberto de fronteira para programação longa e agentes

O Kimi K3 é o modelo principal da Moonshot AI para programação de longo prazo e trabalho de conhecimento, com contexto de 1M de tokens. $2.40 / 1M entrada, $12.00 / 1M saída por 1M de tokens.

Disponível$2.40 / 1M entrada · $12.00 / 1M saída$3.00 / 1M entrada · $15.00 / 1M saída-20%
  • Raciocínio sempre ativo
  • Contexto de 1M de tokens
  • Entrada de imagem
  • Cache de prompt
  • Streaming
Janela de contexto
1M de tokens
Saída máxima
1M de tokens
Níveis de raciocínio
low, high, max
Raciocínio
Sempre ativo

Experimente o Kimi K3

Converse com o Kimi K3, anexe imagens e veja os tokens e o custo de cada resposta.

Parâmetros

kimi-k3$2.40 entrada · $12.00 saída por milhão de tokens

Reasoning effort
Probabilidades logarítmicas

Aceito, mas nenhuma probabilidade logarítmica é retornada.

TTL do cache
Total da conversa$0.000000
Pronto

Experimente um destes prompts

As mensagens são cobradas do seu saldo conforme as tarifas abaixo, como uma chamada de API. Requisições que falham não custam nada.

Saída real do Kimi K3

Um prompt, enviado ao Kimi K3 com nível de raciocínio low. Sem edição.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.

Gerado em 28 de setembro de 2026. As respostas variam de execução para execução.

Preços do Kimi K3

O Kimi K3 é cobrado por token do seu saldo. As tarifas abaixo são em tempo real, as mesmas cobradas na sua conta.

Uma requisição típica2.000 tokens de entrada, 1.000 tokens de saída
$0.0168por requisição
O Kimi K3 sempre raciocina, e o raciocínio conta como saída.
O que $20.00 compraTokens de saída à tarifa atual
1,666,666tokens de saída
Tokens de entrada e em cache custam menos por token que os de saída.

Os tamanhos de exemplo são ilustrativos. Sua cobrança se baseia nos tokens informados por cada requisição.

ItemContado comoTarifaCobrança
EntradaTokens de prompt não lidos do cache nem gravados nele$2.40 / 1MPor 1M de tokens
SaídaTokens de resposta e de raciocínio$12.00 / 1MPor 1M de tokens
Entrada em cacheTokens de prompt servidos pelo cache$0.24 / 1MPor 1M de tokens
Escrita no cache, 5 minTokens de prompt gravados no cache com o TTL padrão de 5 minutos$2.40 / 1MPor 1M de tokens
Escrita no cache, 1 horaTokens de prompt gravados no cache com um TTL de 1 hora$4.80 / 1MPor 1M de tokens
Requisição que falhouQualquer requisição que retorna um erroGrátisNão cobrada

O que é o Kimi K3?

O Kimi K3 é o modelo principal da Moonshot AI para programação de longo prazo, agentes e trabalho de conhecimento. É um modelo de pesos abertos com 2,8 trilhões de parâmetros, e o Kimi K3 lê até 1M de tokens de contexto em uma única requisição.

O Kimi K3 sempre raciocina antes de responder. Você escolhe a intensidade com o nível de raciocínio: low para etapas rápidas, high para a maior parte do trabalho e max, o padrão, para os problemas mais difíceis.

ID do modelo: kimi-k3 · Entrada: texto, imagens · Saída: texto · Formatos: Chat Completions, Responses, Anthropic Messages.

ID do modelo
kimi-k3
Janela de contexto
1M de tokens
Saída máxima
1M de tokens
Níveis de raciocínio
low, high, max
Entrada
Texto, imagens

Duas formas de usar o Kimi K3

Chame do seu código, ou deixe seu agente programador fazer.

API

Chame do seu backend

Melhor para aplicativos e serviços

Aponte o SDK da OpenAI para o SeedRouter e mantenha seu código. O Kimi K3 responde a Chat Completions, Responses e Anthropic Messages.

  1. 1Crie uma chave de API
  2. 2Defina a URL base como https://api.seedrouter.ai/v1
  3. 3Envie kimi-k3 como modelo
Agente

Deixe seu agente programador fazer

Ideal para Codex, Claude Code e outros agentes

Copie um prompt pronto. Seu agente mostra a requisição e o custo antes de gastar.

  1. 1Copie o prompt
  2. 2Cole no seu agente
  3. 3Aprove a requisição

No que o Kimi K3 se destaca

O Kimi K3 foi feito para tarefas longas que exigem muito contexto e muitas etapas.

Sessões longas de código

O Kimi K3 mantém uma base de código grande à vista e executa mudanças em várias etapas.

Fluxos de trabalho com agentes

Chamadas de ferramentas e um contexto de 1M de tokens deixam um agente trabalhar por muito tempo sem perder o fio.

Trabalho de conhecimento

Entregue ao Kimi K3 relatórios, contratos ou logs e receba uma leitura estruturada.

Imagens no prompt

O Kimi K3 lê capturas de tela e gráficos junto com o seu texto.

Raciocínio que você controla

Low para respostas rápidas, max para problemas difíceis. O Kimi K3 raciocina em toda requisição.

Contexto repetido mais barato

A entrada em cache no Kimi K3 custa um décimo da tarifa de entrada.

O que as equipes criam com o Kimi K3

Agentes de programação

Rode o Kimi K3 no Codex ou no seu próprio loop de agente para mudanças em vários arquivos.

Bots de revisão de código

Revise cada pull request com o repositório inteiro no contexto.

Extração estruturada

Transforme tickets e documentos em JSON com um response_format json_schema.

Comece a usar o Kimi K3 em quatro passos

  1. 01

    Crie uma chave

    Entre e crie uma chave de API. Adicione crédito sempre que precisar; não há assinatura.

  2. 02

    Mude a URL base

    Aponte o SDK da OpenAI para https://api.seedrouter.ai/v1. Seu código continua o mesmo.

  3. 03

    Escolha o Kimi K3

    Envie kimi-k3 como modelo. Defina o nível de raciocínio para equilibrar profundidade, velocidade e custo.

  4. 04

    Verifique a conta

    Cada requisição mostra seus tokens e cobrança em seus registros de uso.

Obtenha uma chave de API

Kimi K3 no SeedRouter em resumo

O que você pode usar hoje.

RecursoKimi K3
Chat CompletionsSim, formato oficial
ResponsesSim, funciona com o Codex
Anthropic MessagesSim
Entrada de imagemSim, em base64
StreamingSim
Cache de promptSim, TTL de 5 minutos ou 1 hora
Saída estruturadaSim, json_object e json_schema
Requisições com falhaNão cobrada

Entrada de vídeo, upload de arquivos, busca na web, jobs em lote e probabilidades logarítmicas não são oferecidos.

Limites do Kimi K3

Contexto de 1M de tokens

No Kimi K3, prompt, imagens e histórico compartilham uma única janela de 1.048.576 tokens.

O raciocínio usa o orçamento de saída

O Kimi K3 escreve até 131.072 tokens por padrão, incluindo o raciocínio; aumente max_completion_tokens para mais.

Amostragem fixa

O Kimi K3 fixa temperature em 1.0 e top_p em 0.95. Qualquer outro valor retorna um erro.

Imagens em base64

O Kimi K3 recebe imagens como data URIs, não como URLs públicas.

Por que chamar o Kimi K3 pelo SeedRouter

Uma chave, três formatos

Chame o Kimi K3 com Chat Completions, Responses ou Anthropic Messages, usando a mesma chave.

Pague por token

Recarregue uma vez e gaste em qualquer modelo. Sem plano, sem taxa mensal.

Falhas são grátis

Uma requisição que gera erro não é cobrada.

Preços em tempo real

As tarifas nesta página são as que sua conta paga.

Cache de prompt

Prefixos de prompt repetidos são lidos do cache a uma tarifa menor do Kimi K3.

Raciocínio de volta na resposta

O Kimi K3 retorna o raciocínio em reasoning_content, ao lado da resposta.

Streaming

Receba os tokens do Kimi K3 em streaming à medida que chegam com stream: true.

Modelos relacionados

Outros modelos que você pode chamar com a mesma chave.

DeepSeek V4.1 Flash
deepseek-v4.1-flash

Use o DeepSeek V4.1 Flash com o SDK da OpenAI ou da Anthropic: contexto de 1M de tokens, raciocínio ligado ou desligado, entrada de imagens, preços de horário de pico e fora de pico em tempo real e um Playground.

Ver preços
claude-fable-5
claude-fable-5

Anthropic

Ver preços
claude-fable-5-1
claude-fable-5-1

Anthropic

Ver preços
claude-opus-5-5
claude-opus-5-5

Anthropic

Ver preços
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Ver preços
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Ver preços

Perguntas frequentes sobre o Kimi K3

O que é o Kimi K3?+

O Kimi K3 é o modelo principal da Moonshot AI para programação de longo prazo, agentes e trabalho de conhecimento. É um modelo de pesos abertos com 2,8 trilhões de parâmetros, janela de contexto de 1M de tokens e raciocínio em toda requisição.

Para que serve o Kimi K3?+

O Kimi K3 é indicado para sessões longas de programação, agentes que chamam ferramentas ao longo de muitas etapas e trabalho com documentos ou bases de código grandes, em que o contexto de 1M de tokens mantém tudo à vista.

Quanto custa o Kimi K3?+

O Kimi K3 custa $2.40 / 1M de entrada e $12.00 / 1M de saída por 1M de tokens. A entrada em cache custa um décimo da tarifa de entrada, e as escritas no cache são cobradas conforme o TTL. O preço não muda com o tamanho do prompt.

Posso usar o Kimi K3 de graça?+

Toda conta nova do SeedRouter começa com $0.10 de saldo gratuito, o suficiente para testar o Kimi K3 com algumas requisições. Depois disso, você paga por token de um saldo pré-pago, sem assinatura, e uma requisição que falha não é cobrada.

O Kimi K3 é open source? Posso rodá-lo localmente?+

Os pesos do Kimi K3 são publicados pela Moonshot AI. Com 2,8 trilhões de parâmetros, ele exige hardware de data center, por isso a maioria das equipes chama o Kimi K3 por uma API.

Quem criou o Kimi K3?+

O Kimi K3 é feito pela Moonshot AI, a empresa chinesa por trás do assistente Kimi.

Posso desligar o raciocínio do Kimi K3?+

Não. O Kimi K3 sempre raciocina. Você pode definir o nível de raciocínio como low, high ou max; o padrão é max, e um nível menor responde mais rápido com menos tokens de saída.

O Kimi K3 consegue ler imagens?+

Sim. O Kimi K3 aceita imagens junto com texto como data URIs em base64. Ele não aceita URLs públicas de imagens e retorna apenas texto.

Qual é o ID do modelo Kimi K3 e como faço para chamá-lo?+

O ID do modelo é kimi-k3. Crie uma chave de API do SeedRouter, aponte o SDK da OpenAI para https://api.seedrouter.ai/v1 e envie kimi-k3 como modelo com Chat Completions ou Responses.

Sou cobrado se uma requisição ao Kimi K3 falhar?+

Não. Uma requisição ao Kimi K3 que retorna um erro não é cobrada. Você paga apenas pelos tokens que uma requisição concluída informa.

Experimente o Kimi K3 agora

Envie sua primeira requisição ao Kimi K3 pelo Playground ou pelo seu próprio código em minutos.