Claude Opus 5.5 ya está disponible en SeedRouter

Kimi K3: parámetros, ventana de contexto y tokens máximos de salida

Datos de Kimi K3: 2,8 billones de parámetros, 16 de 896 expertos activos por token, ventana de contexto de 1M tokens y hasta 1.048.576 tokens de salida.

Leer en Markdown

Kimi K3 tiene 2,8 billones de parámetros y activa 16 de sus 896 expertos en cada token. Su ventana de contexto es de 1.048.576 tokens, y una sola respuesta puede llegar a 1.048.576 tokens, aunque el límite por defecto es 131.072. Moonshot AI lo llama "el primer modelo de código abierto del mundo de la clase de 3 billones de parámetros" y ha publicado los pesos completos. Siempre razona, lee texto e imágenes y escribe texto.

Especificaciones de Kimi K3 de un vistazo

EspecificaciónValor
DesarrolladorMoonshot AI
Parámetros totales2,8 billones
Expertos896, con 16 activos por token
ArquitecturaMixture of experts con Kimi Delta Attention y Attention Residuals
Ventana de contexto1.048.576 tokens
Salida máxima1.048.576 tokens, razonamiento incluido
Límite de salida por defecto131.072 tokens
RazonamientoSiempre activado; low, high o max (por defecto max)
EntradaTexto e imágenes (imágenes solo en base64)
SalidaTexto
PesosPublicados por Moonshot AI
ID del modelo en SeedRouterkimi-k3

¿Cuántos parámetros tiene Kimi K3?

2,8 billones. La guía de inicio rápido de Moonshot AI llama a Kimi K3 su "modelo insignia más capaz hasta la fecha, con 2,8 billones de parámetros" y "el primer modelo de código abierto que alcanza los 2,8 billones de parámetros".

¿Cuántos parámetros activos tiene Kimi K3?

La guía de inicio rápido de Moonshot AI no da una cifra de parámetros activos. Lo que sí dice es que el modelo "activa de forma eficiente 16 de 896 expertos" mediante su framework Stable LatentMoE. Así que solo una pequeña parte de los 2,8 billones de parámetros trabaja en cada token, lo que mantiene bajo el cómputo por token. Aun así, todos los pesos tienen que cargarse, y por eso ejecutar Kimi K3 por tu cuenta exige hardware de centro de datos con varias GPU.

¿Qué arquitectura usa Kimi K3?

Un modelo mixture-of-experts construido sobre dos cambios en la atención. En palabras de Moonshot AI, "se basa en Kimi Delta Attention (KDA), un mecanismo híbrido de atención lineal, y en Attention Residuals". Moonshot AI dice que estos cambios, junto con una disposición de expertos más dispersa y nuevos métodos de entrenamiento, dan a Kimi K3 "aproximadamente 2,5 veces la eficiencia de escalado global de K2". Los detalles completos llegarán en el informe técnico de Kimi K3.

¿Cuál es la ventana de contexto de Kimi K3?

1.048.576 tokens, que se suele escribir como 1M. El prompt, las imágenes, el historial de la conversación y la respuesta comparten esta única ventana.

¿Cuál es la salida máxima de Kimi K3?

Hasta 1.048.576 tokens por solicitud, fijados con max_completion_tokens. El valor por defecto es 131.072. La guía de inicio rápido de Moonshot AI: "max_completion_tokens tiene por defecto 131072 y se puede fijar hasta 1048576".

Dos cosas que conviene saber:

  • El razonamiento cuenta para el límite. Kimi K3 siempre razona, y sus tokens de razonamiento usan el mismo presupuesto que la respuesta.
  • max_tokens es el nombre obsoleto del mismo límite. Usa max_completion_tokens.

Si una respuesta se corta, sube max_completion_tokens o baja reasoning_effort para que el razonamiento consuma menos presupuesto. Ventana de contexto vs tokens máximos de salida explica cómo detectar una respuesta truncada en cada formato de API.

¿Se puede desactivar el razonamiento de Kimi K3?

No. Kimi K3 siempre razona. Puedes fijar reasoning_effort en low, high o max; el valor por defecto es max, que es el más lento y el que más tokens de salida usa. high sirve para la mayoría de las tareas y low para pasos rápidos y sencillos. El razonamiento vuelve en reasoning_content, junto a content, y se factura como tokens de salida.

¿Qué ajustes están fijados?

Moonshot AI fija el muestreo de Kimi K3: temperature 1.0, top_p 0.95, n 1, presence_penalty 0 y frequency_penalty 0. Cualquier otro valor devuelve un error, así que deja estos campos fuera de la solicitud.

¿Kimi K3 lee imágenes?

Sí, pero solo como data URI en base64. No se acepta una URL pública de imagen: devuelve 400, igual que en la API de Kimi. La salida siempre es texto.

¿Cómo llamo a Kimi K3?

En SeedRouter, Kimi K3 acepta los formatos OpenAI Chat Completions, OpenAI Responses y Anthropic Messages con la misma clave y el ID de modelo kimi-k3. La guía de la API de Kimi K3 explica la primera solicitud, la configuración para Claude Code y Codex tiene configuraciones probadas y la referencia de la API de Kimi K3 enumera todos los parámetros. Los precios actuales están en la página de Kimi K3.

Preguntas frecuentes

¿Qué tamaño tiene Kimi K3?

2,8 billones de parámetros en total, con 16 de 896 expertos activos por token.

¿Kimi K3 es de código abierto?

Moonshot AI ha publicado los pesos completos del modelo. ¿Kimi K3 es gratis? explica lo que hace falta para ejecutarlos por tu cuenta.

¿Por qué Kimi K3 se detiene en 131.072 tokens?

Es el límite de salida por defecto. Fija max_completion_tokens hasta 1048576 para respuestas más largas.

¿Quién hace Kimi K3?

Moonshot AI, la empresa china detrás del asistente Kimi.

Guías relacionadas