Kimi K3 — modelo abierto de frontera para programación extensa y agentes
Kimi K3 es el modelo insignia de Moonshot AI para programación de largo alcance y trabajo de conocimiento, con una ventana de contexto de 1M de tokens. $2.40 / 1M entrada, $12.00 / 1M salida por 1M de tokens.
- Razonamiento siempre activo
- Ventana de contexto de 1M de tokens
- Entrada de imágenes
- Almacenamiento en caché de prompts
- Streaming
Prueba Kimi K3
Chatea con Kimi K3, adjunta imágenes y ve los tokens y el costo de cada respuesta.
kimi-k3$2.40 entrada · $12.00 salida por millón de tokens
Se acepta, pero no se devuelven probabilidades logarítmicas.
Prueba uno de estos prompts
Los mensajes se facturan a partir de tu saldo a las tarifas de abajo, como una llamada a la API. Las solicitudes fallidas son gratis.
Salida real de Kimi K3
Un prompt, enviado a Kimi K3 con esfuerzo de razonamiento bajo. Sin editar.
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.
Generado 2026-09-28. Las respuestas varían de una ejecución a otra.
Precios de Kimi K3
Kimi K3 se factura por token a partir de tu saldo. Las tarifas de abajo son en vivo, las mismas que se cobran a tu cuenta.
Los tamaños de ejemplo son ilustrativos. Tu factura se basa en los tokens que informa cada solicitud.
| Elemento | Contado como | Tarifa | Facturación |
|---|---|---|---|
| Entrada | Tokens del prompt no leídos ni escritos en la caché | $2.40 / 1M | Por 1M de tokens |
| Salida | Tokens de respuesta y de razonamiento | $12.00 / 1M | Por 1M de tokens |
| Entrada en caché | Tokens del prompt servidos desde la caché | $0.24 / 1M | Por 1M de tokens |
| Escritura en caché, 5 min | Tokens del prompt escritos en la caché con el TTL predeterminado de 5 minutos | $2.40 / 1M | Por 1M de tokens |
| Escritura en caché, 1 hora | Tokens del prompt escritos en la caché con un TTL de 1 hora | $4.80 / 1M | Por 1M de tokens |
| Solicitud fallida | Cualquier solicitud que devuelva un error | Gratis | No se factura |
¿Qué es Kimi K3?
Kimi K3 es el modelo insignia de Moonshot AI para programación de largo alcance, agentes y trabajo de conocimiento. Es un modelo de pesos abiertos con 2,8 billones de parámetros, y Kimi K3 lee hasta 1M de tokens de contexto en una sola solicitud.
Kimi K3 siempre razona antes de responder. Tú eliges cuánto con el esfuerzo de razonamiento: low para pasos rápidos, high para la mayor parte del trabajo y max, el predeterminado, para los problemas más difíciles.
ID de modelo: kimi-k3 · Entrada: texto, imágenes · Salida: texto · Formatos: Chat Completions, Responses, Anthropic Messages.
Dos formas de usar Kimi K3
Llámalo desde tu código, o deja que tu agente de codificación lo haga.
Llámalo desde tu backend
Apunta el SDK de OpenAI a SeedRouter y mantén tu código. Kimi K3 responde en los formatos Chat Completions, Responses y Anthropic Messages.
- 1Crea una clave API
- 2Establece la URL base en https://api.seedrouter.ai/v1
- 3Envía kimi-k3 como el modelo
Entrégalo a tu agente de codificación
Copia un prompt listo. Tu agente muestra la solicitud y el costo antes de gastar nada.
- 1Copia el prompt
- 2Pégala en tu agente
- 3Aprueba la solicitud
En qué es bueno Kimi K3
Kimi K3 está hecho para tareas largas que necesitan mucho contexto y muchos pasos.
Sesiones de código largas
Kimi K3 mantiene a la vista una base de código grande y avanza por cambios de varios pasos.
Flujos de trabajo de agentes
Las llamadas a herramientas y una ventana de contexto de 1M de tokens permiten que un agente trabaje durante mucho tiempo sin perder el hilo.
Trabajo de conocimiento
Dale a Kimi K3 informes, contratos o logs y obtén una lectura estructurada de ellos.
Imágenes en el prompt
Kimi K3 lee capturas de pantalla y gráficos junto con tu texto.
Esfuerzo de razonamiento que controlas
Low para respuestas rápidas, max para problemas difíciles. Kimi K3 razona en cada solicitud.
Contexto repetido más económico
La entrada en caché de Kimi K3 cuesta una décima parte de la tarifa de entrada.
Lo que los equipos construyen con Kimi K3
Agentes de programación
Ejecuta Kimi K3 en Codex o en tu propio bucle de agente para cambios en varios archivos.
Bots de revisión de código
Revisa cada pull request con todo el repositorio en contexto.
Extracción estructurada
Convierte tickets y documentos en JSON con un formato de respuesta json_schema.
Empieza a usar Kimi K3 en cuatro pasos
- 01
Crea una clave
Inicia sesión y crea una clave API. Añade crédito cuando lo necesites; no hay suscripción.
- 02
Cambia la URL base
Apunta el SDK de OpenAI a https://api.seedrouter.ai/v1. Tu código sigue siendo el mismo.
- 03
Elige Kimi K3
Envía kimi-k3 como el modelo. Ajusta el esfuerzo de razonamiento para equilibrar profundidad, velocidad y costo.
- 04
Revisa la factura
Cada solicitud muestra sus tokens y costo en tus registros de uso.
Kimi K3 en SeedRouter de un vistazo
Lo que puedes usar hoy.
| Característica | Kimi K3 |
|---|---|
| Chat Completions | Sí, formato oficial |
| Responses | Sí, compatible con Codex |
| Anthropic Messages | Sí |
| Entrada de imágenes | Sí, en base64 |
| Streaming | Sí |
| Almacenamiento en caché de prompts | Sí, TTL de 5 minutos o de 1 hora |
| Salida estructurada | Sí, json_object y json_schema |
| Solicitudes fallidas | No se factura |
No se ofrecen la entrada de video, la subida de archivos, la búsqueda web, los trabajos por lotes ni las probabilidades logarítmicas.
Límites de Kimi K3
Ventana de contexto de 1M de tokens
En Kimi K3, el prompt, las imágenes y el historial comparten una ventana de 1.048.576 tokens.
El razonamiento consume el presupuesto de salida
Kimi K3 escribe hasta 131.072 tokens por defecto, razonamiento incluido; sube max_completion_tokens para obtener más.
Muestreo fijo
Kimi K3 fija temperature en 1.0 y top_p en 0.95. Cualquier otro valor devuelve un error.
Imágenes en base64
Kimi K3 recibe las imágenes como data URIs, no como URL públicas.
Por qué llamar a Kimi K3 a través de SeedRouter
Una clave, tres formatos
Llama a Kimi K3 con Chat Completions, Responses o Anthropic Messages, todo con la misma clave.
Pago por token
Recarga una vez y gástalo en cualquier modelo. Sin plan, sin cuota mensual.
Los fallos son gratis
Una solicitud que genera un error no se factura.
Precios en vivo
Las tarifas en esta página son las tarifas que tu cuenta paga.
Almacenamiento en caché de prompts
Los prefijos de prompt repetidos se leen desde la caché a una tarifa de Kimi K3 más baja.
El razonamiento vuelve en la respuesta
Kimi K3 devuelve su razonamiento en reasoning_content junto a la respuesta.
Streaming
Recibe los tokens de Kimi K3 en streaming a medida que llegan con stream: true.
Modelos relacionados
Otros modelos que puedes llamar con la misma clave.
Usa DeepSeek V4.1 Flash con el SDK de OpenAI o Anthropic: contexto de 1M, pensamiento activable, imágenes, precios en vivo en horas pico y valle y Playground.
Ver preciosGuías de Kimi K3
Tutoriales y comparaciones para este modelo.
¿Kimi K3 es gratis? Los pesos se descargan gratis, pero ejecutarlos requiere hardware de centro de datos y la API se paga por token. Qué puedes probar gratis.
Cómo usar la API de Kimi K3: consigue una clave, llama a kimi-k3 con el SDK de OpenAI, ajusta el razonamiento, streaming, imágenes y primeros errores.
Precios de la API de Kimi K3 por millón de tokens: entrada, salida, entrada en caché y escrituras en caché de 5 min o 1 h, con la fórmula y el coste por tarea.
Cómo usar Kimi K3 como modelo en Claude Code y OpenAI Codex CLI con SeedRouter: variables de entorno, config.toml y resultados de las pruebas.
Kimi K3 vs Claude Fable 5 y Claude Opus 5.5: precio de lista, contexto, límites de salida, razonamiento, pesos abiertos y formatos de API, con un veredicto.
Preguntas frecuentes sobre Kimi K3
¿Qué es Kimi K3?+
Kimi K3 es el modelo insignia de Moonshot AI para programación de largo alcance, agentes y trabajo de conocimiento. Es un modelo de pesos abiertos con 2,8 billones de parámetros, una ventana de contexto de 1M de tokens y razonamiento en cada solicitud.
¿Para qué sirve Kimi K3?+
Kimi K3 es adecuado para sesiones largas de programación, agentes que llaman a herramientas a lo largo de muchos pasos y trabajo con documentos o bases de código grandes, donde la ventana de contexto de 1M de tokens lo mantiene todo a la vista.
¿Cuánto cuesta Kimi K3?+
Kimi K3 se factura a $2.40 / 1M de entrada y $12.00 / 1M de salida por 1M de tokens. La entrada en caché cuesta una décima parte de la tarifa de entrada, y las escrituras en caché se facturan según su TTL. El precio no cambia con la longitud del prompt.
¿Puedo usar Kimi K3 gratis?+
Cada cuenta nueva de SeedRouter empieza con $0.10 de saldo gratis, suficiente para probar Kimi K3 con algunas solicitudes. Después pagas por token con un saldo prepago, sin suscripción, y una solicitud que falla no se factura.
¿Kimi K3 es de código abierto y puedo ejecutarlo en local?+
Moonshot AI publica los pesos de Kimi K3. Con 2,8 billones de parámetros necesita hardware de centro de datos para ejecutarse, así que la mayoría de los equipos llama a Kimi K3 a través de una API.
¿Quién desarrolla Kimi K3?+
Kimi K3 lo desarrolla Moonshot AI, la empresa china detrás del asistente Kimi.
¿Puedo desactivar el razonamiento de Kimi K3?+
No. Kimi K3 siempre razona. Puedes fijar el esfuerzo de razonamiento en low, high o max; el predeterminado es max, y con un esfuerzo de razonamiento menor responde más rápido y con menos tokens de salida.
¿Kimi K3 puede leer imágenes?+
Sí. Kimi K3 acepta imágenes junto con texto como data URIs en base64. No acepta URL públicas de imágenes y solo devuelve texto.
¿Cuál es el ID de modelo de Kimi K3 y cómo lo llamo?+
El ID de modelo es kimi-k3. Crea una clave API de SeedRouter, apunta el SDK de OpenAI a https://api.seedrouter.ai/v1 y envía kimi-k3 como el modelo con Chat Completions o Responses.
¿Se me cobra si una solicitud de Kimi K3 falla?+
No. Una solicitud de Kimi K3 que devuelve un error no se factura. Solo pagas los tokens que informa una solicitud finalizada.
Prueba Kimi K3 ahora
Envía tu primera solicitud a Kimi K3 desde el Playground o desde tu propio código en minutos.
