Claude Opus 5.5 ya está disponible en SeedRouter
Moonshot AIGeneración de texto

Kimi K3 — modelo abierto de frontera para programación extensa y agentes

Kimi K3 es el modelo insignia de Moonshot AI para programación de largo alcance y trabajo de conocimiento, con una ventana de contexto de 1M de tokens. $2.40 / 1M entrada, $12.00 / 1M salida por 1M de tokens.

Disponible$2.40 / 1M entrada · $12.00 / 1M salida$3.00 / 1M entrada · $15.00 / 1M salida-20%
  • Razonamiento siempre activo
  • Ventana de contexto de 1M de tokens
  • Entrada de imágenes
  • Almacenamiento en caché de prompts
  • Streaming
Ventana de contexto
1M de tokens
Salida máxima
1M de tokens
Niveles de razonamiento
low, high, max
Razonamiento
Siempre activo

Prueba Kimi K3

Chatea con Kimi K3, adjunta imágenes y ve los tokens y el costo de cada respuesta.

Parámetros

kimi-k3$2.40 entrada · $12.00 salida por millón de tokens

Reasoning effort
Log probabilities

Se acepta, pero no se devuelven probabilidades logarítmicas.

Cache TTL
Total de la conversación$0.000000
Listo

Prueba uno de estos prompts

Los mensajes se facturan a partir de tu saldo a las tarifas de abajo, como una llamada a la API. Las solicitudes fallidas son gratis.

Salida real de Kimi K3

Un prompt, enviado a Kimi K3 con esfuerzo de razonamiento bajo. Sin editar.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.

Generado 2026-09-28. Las respuestas varían de una ejecución a otra.

Precios de Kimi K3

Kimi K3 se factura por token a partir de tu saldo. Las tarifas de abajo son en vivo, las mismas que se cobran a tu cuenta.

Una solicitud típica2.000 tokens de entrada, 1.000 tokens de salida
$0.0168por solicitud
Kimi K3 siempre razona, y el razonamiento cuenta como salida.
Qué compra $20.00Tokens de salida a la tarifa actual
1,666,666tokens de salida
Los tokens de entrada y en caché cuestan menos por token que la salida.

Los tamaños de ejemplo son ilustrativos. Tu factura se basa en los tokens que informa cada solicitud.

ElementoContado comoTarifaFacturación
EntradaTokens del prompt no leídos ni escritos en la caché$2.40 / 1MPor 1M de tokens
SalidaTokens de respuesta y de razonamiento$12.00 / 1MPor 1M de tokens
Entrada en cachéTokens del prompt servidos desde la caché$0.24 / 1MPor 1M de tokens
Escritura en caché, 5 minTokens del prompt escritos en la caché con el TTL predeterminado de 5 minutos$2.40 / 1MPor 1M de tokens
Escritura en caché, 1 horaTokens del prompt escritos en la caché con un TTL de 1 hora$4.80 / 1MPor 1M de tokens
Solicitud fallidaCualquier solicitud que devuelva un errorGratisNo se factura

¿Qué es Kimi K3?

Kimi K3 es el modelo insignia de Moonshot AI para programación de largo alcance, agentes y trabajo de conocimiento. Es un modelo de pesos abiertos con 2,8 billones de parámetros, y Kimi K3 lee hasta 1M de tokens de contexto en una sola solicitud.

Kimi K3 siempre razona antes de responder. Tú eliges cuánto con el esfuerzo de razonamiento: low para pasos rápidos, high para la mayor parte del trabajo y max, el predeterminado, para los problemas más difíciles.

ID de modelo: kimi-k3 · Entrada: texto, imágenes · Salida: texto · Formatos: Chat Completions, Responses, Anthropic Messages.

ID de modelo
kimi-k3
Ventana de contexto
1M de tokens
Salida máxima
1M de tokens
Niveles de razonamiento
low, high, max
Entrada
Texto, imágenes

Dos formas de usar Kimi K3

Llámalo desde tu código, o deja que tu agente de codificación lo haga.

API

Llámalo desde tu backend

Mejor para aplicaciones y servicios

Apunta el SDK de OpenAI a SeedRouter y mantén tu código. Kimi K3 responde en los formatos Chat Completions, Responses y Anthropic Messages.

  1. 1Crea una clave API
  2. 2Establece la URL base en https://api.seedrouter.ai/v1
  3. 3Envía kimi-k3 como el modelo
Agente

Entrégalo a tu agente de codificación

Mejor para Codex, Claude Code y otros agentes

Copia un prompt listo. Tu agente muestra la solicitud y el costo antes de gastar nada.

  1. 1Copia el prompt
  2. 2Pégala en tu agente
  3. 3Aprueba la solicitud

En qué es bueno Kimi K3

Kimi K3 está hecho para tareas largas que necesitan mucho contexto y muchos pasos.

Sesiones de código largas

Kimi K3 mantiene a la vista una base de código grande y avanza por cambios de varios pasos.

Flujos de trabajo de agentes

Las llamadas a herramientas y una ventana de contexto de 1M de tokens permiten que un agente trabaje durante mucho tiempo sin perder el hilo.

Trabajo de conocimiento

Dale a Kimi K3 informes, contratos o logs y obtén una lectura estructurada de ellos.

Imágenes en el prompt

Kimi K3 lee capturas de pantalla y gráficos junto con tu texto.

Esfuerzo de razonamiento que controlas

Low para respuestas rápidas, max para problemas difíciles. Kimi K3 razona en cada solicitud.

Contexto repetido más económico

La entrada en caché de Kimi K3 cuesta una décima parte de la tarifa de entrada.

Lo que los equipos construyen con Kimi K3

Agentes de programación

Ejecuta Kimi K3 en Codex o en tu propio bucle de agente para cambios en varios archivos.

Bots de revisión de código

Revisa cada pull request con todo el repositorio en contexto.

Extracción estructurada

Convierte tickets y documentos en JSON con un formato de respuesta json_schema.

Empieza a usar Kimi K3 en cuatro pasos

  1. 01

    Crea una clave

    Inicia sesión y crea una clave API. Añade crédito cuando lo necesites; no hay suscripción.

  2. 02

    Cambia la URL base

    Apunta el SDK de OpenAI a https://api.seedrouter.ai/v1. Tu código sigue siendo el mismo.

  3. 03

    Elige Kimi K3

    Envía kimi-k3 como el modelo. Ajusta el esfuerzo de razonamiento para equilibrar profundidad, velocidad y costo.

  4. 04

    Revisa la factura

    Cada solicitud muestra sus tokens y costo en tus registros de uso.

Obtén una clave API

Kimi K3 en SeedRouter de un vistazo

Lo que puedes usar hoy.

CaracterísticaKimi K3
Chat CompletionsSí, formato oficial
ResponsesSí, compatible con Codex
Anthropic MessagesSí
Entrada de imágenesSí, en base64
StreamingSí
Almacenamiento en caché de promptsSí, TTL de 5 minutos o de 1 hora
Salida estructuradaSí, json_object y json_schema
Solicitudes fallidasNo se factura

No se ofrecen la entrada de video, la subida de archivos, la búsqueda web, los trabajos por lotes ni las probabilidades logarítmicas.

Límites de Kimi K3

Ventana de contexto de 1M de tokens

En Kimi K3, el prompt, las imágenes y el historial comparten una ventana de 1.048.576 tokens.

El razonamiento consume el presupuesto de salida

Kimi K3 escribe hasta 131.072 tokens por defecto, razonamiento incluido; sube max_completion_tokens para obtener más.

Muestreo fijo

Kimi K3 fija temperature en 1.0 y top_p en 0.95. Cualquier otro valor devuelve un error.

Imágenes en base64

Kimi K3 recibe las imágenes como data URIs, no como URL públicas.

Por qué llamar a Kimi K3 a través de SeedRouter

Una clave, tres formatos

Llama a Kimi K3 con Chat Completions, Responses o Anthropic Messages, todo con la misma clave.

Pago por token

Recarga una vez y gástalo en cualquier modelo. Sin plan, sin cuota mensual.

Los fallos son gratis

Una solicitud que genera un error no se factura.

Precios en vivo

Las tarifas en esta página son las tarifas que tu cuenta paga.

Almacenamiento en caché de prompts

Los prefijos de prompt repetidos se leen desde la caché a una tarifa de Kimi K3 más baja.

El razonamiento vuelve en la respuesta

Kimi K3 devuelve su razonamiento en reasoning_content junto a la respuesta.

Streaming

Recibe los tokens de Kimi K3 en streaming a medida que llegan con stream: true.

Modelos relacionados

Otros modelos que puedes llamar con la misma clave.

DeepSeek V4.1 Flash
deepseek-v4.1-flash

Usa DeepSeek V4.1 Flash con el SDK de OpenAI o Anthropic: contexto de 1M, pensamiento activable, imágenes, precios en vivo en horas pico y valle y Playground.

Ver precios
claude-fable-5
claude-fable-5

Anthropic

Ver precios
claude-fable-5-1
claude-fable-5-1

Anthropic

Ver precios
claude-opus-5-5
claude-opus-5-5

Anthropic

Ver precios
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Ver precios
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Ver precios

Preguntas frecuentes sobre Kimi K3

¿Qué es Kimi K3?+

Kimi K3 es el modelo insignia de Moonshot AI para programación de largo alcance, agentes y trabajo de conocimiento. Es un modelo de pesos abiertos con 2,8 billones de parámetros, una ventana de contexto de 1M de tokens y razonamiento en cada solicitud.

¿Para qué sirve Kimi K3?+

Kimi K3 es adecuado para sesiones largas de programación, agentes que llaman a herramientas a lo largo de muchos pasos y trabajo con documentos o bases de código grandes, donde la ventana de contexto de 1M de tokens lo mantiene todo a la vista.

¿Cuánto cuesta Kimi K3?+

Kimi K3 se factura a $2.40 / 1M de entrada y $12.00 / 1M de salida por 1M de tokens. La entrada en caché cuesta una décima parte de la tarifa de entrada, y las escrituras en caché se facturan según su TTL. El precio no cambia con la longitud del prompt.

¿Puedo usar Kimi K3 gratis?+

Cada cuenta nueva de SeedRouter empieza con $0.10 de saldo gratis, suficiente para probar Kimi K3 con algunas solicitudes. Después pagas por token con un saldo prepago, sin suscripción, y una solicitud que falla no se factura.

¿Kimi K3 es de código abierto y puedo ejecutarlo en local?+

Moonshot AI publica los pesos de Kimi K3. Con 2,8 billones de parámetros necesita hardware de centro de datos para ejecutarse, así que la mayoría de los equipos llama a Kimi K3 a través de una API.

¿Quién desarrolla Kimi K3?+

Kimi K3 lo desarrolla Moonshot AI, la empresa china detrás del asistente Kimi.

¿Puedo desactivar el razonamiento de Kimi K3?+

No. Kimi K3 siempre razona. Puedes fijar el esfuerzo de razonamiento en low, high o max; el predeterminado es max, y con un esfuerzo de razonamiento menor responde más rápido y con menos tokens de salida.

¿Kimi K3 puede leer imágenes?+

Sí. Kimi K3 acepta imágenes junto con texto como data URIs en base64. No acepta URL públicas de imágenes y solo devuelve texto.

¿Cuál es el ID de modelo de Kimi K3 y cómo lo llamo?+

El ID de modelo es kimi-k3. Crea una clave API de SeedRouter, apunta el SDK de OpenAI a https://api.seedrouter.ai/v1 y envía kimi-k3 como el modelo con Chat Completions o Responses.

¿Se me cobra si una solicitud de Kimi K3 falla?+

No. Una solicitud de Kimi K3 que devuelve un error no se factura. Solo pagas los tokens que informa una solicitud finalizada.

Prueba Kimi K3 ahora

Envía tu primera solicitud a Kimi K3 desde el Playground o desde tu propio código en minutos.