Claude Opus 5.5 est disponible sur SeedRouter
Moonshot AIGénération de texte

Kimi K3 — modèle ouvert de pointe pour le codage au long cours et les agents

Kimi K3 est le modèle phare de Moonshot AI pour le codage au long cours et le travail intellectuel, avec une fenêtre de contexte d'1M tokens. $2.40 / 1M en entrée, $12.00 / 1M en sortie par 1M de tokens.

Disponible$2.40 / 1M en entrée · $12.00 / 1M en sortie$3.00 / 1M en entrée · $15.00 / 1M en sortie-20%
  • Raisonnement toujours actif
  • Fenêtre de contexte d'1M tokens
  • Entrée d'images
  • Mise en cache des prompts
  • Streaming
Fenêtre de contexte
1M tokens
Sortie maximale
1M tokens
Niveaux de raisonnement
low, high, max
Raisonnement
Toujours actif

Essayer Kimi K3

Discutez avec Kimi K3, joignez des images, et voyez les tokens et le coût de chaque réponse.

Paramètres

kimi-k3$2.40 entrée · $12.00 sortie par million de tokens

Reasoning effort
Log probabilities

Accepté, mais aucune log probability n'est renvoyée.

Cache TTL
Total de la conversation$0.000000
Prêt

Essayez l'un de ces prompts

Les messages sont facturés sur votre solde aux tarifs ci-dessous, comme un appel API. Les requêtes en échec sont gratuites.

Sortie réelle de Kimi K3

Un prompt, envoyé à Kimi K3 avec un effort de raisonnement low. Sans modification.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.

Généré le 2026-09-28. Les réponses varient d'une exécution à l'autre.

Tarifs de Kimi K3

Kimi K3 est facturé par token sur votre solde. Les tarifs ci-dessous sont en direct : ce sont ceux que votre compte paie.

Une requête typique2 000 tokens en entrée, 1 000 tokens en sortie
$0.0168par requête
Kimi K3 raisonne toujours, et le raisonnement compte comme sortie.
Ce que $20.00 achèteTokens de sortie au tarif actuel
1,666,666tokens de sortie
Les tokens en entrée et en cache coûtent moins cher par token que la sortie.

Les tailles d'exemple sont données à titre d'illustration. Votre facture se base sur les tokens déclarés par chaque requête.

ÉlémentCompté commeTarifFacturation
EntréeTokens de prompt ni lus ni écrits dans le cache$2.40 / 1MPar million de tokens
SortieTokens de réponse et de raisonnement$12.00 / 1MPar million de tokens
Entrée en cacheTokens de prompt servis depuis le cache$0.24 / 1MPar million de tokens
Écriture en cache, 5 minTokens de prompt écrits dans le cache avec le TTL par défaut de 5 minutes$2.40 / 1MPar million de tokens
Écriture en cache, 1 heureTokens de prompt écrits dans le cache avec un TTL d'1 heure$4.80 / 1MPar million de tokens
Requête en échecN'importe quelle requête qui retourne une erreurGratuitNon facturé

Qu'est-ce que Kimi K3 ?

Kimi K3 est le modèle phare de Moonshot AI pour le codage au long cours, les agents et le travail intellectuel. C'est un modèle à poids ouverts de 2 800 milliards de paramètres, et Kimi K3 lit jusqu'à 1M tokens de contexte en une seule requête.

Kimi K3 raisonne toujours avant de répondre. Vous choisissez l'intensité avec l'effort de raisonnement : low pour les étapes rapides, high pour la plupart des tâches et max, la valeur par défaut, pour les problèmes les plus difficiles.

ID de modèle : kimi-k3 · Entrée : texte, images · Sortie : texte · Formats : Chat Completions, Responses, Anthropic Messages.

ID de modèle
kimi-k3
Fenêtre de contexte
1M tokens
Sortie maximale
1M tokens
Niveaux de raisonnement
low, high, max
Entrée
Texte, images

Deux façons d'utiliser Kimi K3

Appelez-le depuis votre code, ou laissez votre agent de codage le faire.

API

Appelez-le depuis votre serveur d'application

Idéal pour les applications et services

Pointez le SDK OpenAI vers SeedRouter et gardez votre code. Kimi K3 répond aux formats Chat Completions, Responses et Anthropic Messages.

  1. 1Créez une clé API
  2. 2Définissez l'URL de base sur https://api.seedrouter.ai/v1
  3. 3Envoyez kimi-k3 comme modèle
Agent

Confiez-le à votre agent de codage

Idéal pour Codex, Claude Code et autres agents

Copiez un prompt prêt. Votre agent affiche la requête et le coût avant que quoi que ce soit ne soit dépensé.

  1. 1Copiez le prompt
  2. 2Collez-le dans votre agent
  3. 3Approuvez la requête

Ce que Kimi K3 fait bien

Kimi K3 est conçu pour les tâches longues qui demandent beaucoup de contexte et de nombreuses étapes.

Longues sessions de codage

Kimi K3 garde en vue une grande base de code et mène à bien des modifications en plusieurs étapes.

Flux de travail agentique

Les appels d'outils et une fenêtre de contexte d'1M tokens permettent à un agent de travailler longtemps sans perdre le fil.

Travail intellectuel

Confiez à Kimi K3 des rapports, des contrats ou des logs et obtenez-en une lecture structurée.

Images dans le prompt

Kimi K3 lit les captures d'écran et les graphiques en plus de votre texte.

L'effort que vous contrôlez

Low pour les réponses rapides, max pour les problèmes difficiles. Kimi K3 raisonne à chaque requête.

Contexte répété moins cher

L'entrée en cache sur Kimi K3 coûte un dixième du tarif d'entrée.

Ce que les équipes construisent avec Kimi K3

Agents de codage

Exécutez Kimi K3 dans Codex ou dans votre propre boucle d'agent pour des modifications sur plusieurs fichiers.

Bots de revue de code

Vérifiez chaque pull request avec tout le dépôt en contexte.

Extraction structurée

Transformez tickets et documents en JSON avec un response format json_schema.

Commencer à utiliser Kimi K3 en quatre étapes

  1. 01

    Créez une clé

    Connectez-vous et créez une clé API. Ajoutez du crédit chaque fois que vous en avez besoin ; il n'y a pas d'abonnement.

  2. 02

    Changez l'URL de base

    Pointez le SDK OpenAI vers https://api.seedrouter.ai/v1. Votre code reste le même.

  3. 03

    Choisissez Kimi K3

    Envoyez kimi-k3 comme modèle. Réglez l'effort de raisonnement pour arbitrer entre profondeur, vitesse et coût.

  4. 04

    Vérifiez la facture

    Chaque requête affiche ses tokens et son montant facturé dans votre historique d'utilisation.

Obtenir une clé API

Kimi K3 sur SeedRouter en un coup d'œil

Ce que vous pouvez utiliser aujourd'hui.

FonctionnalitéKimi K3
Chat CompletionsOui, format officiel
ResponsesOui, compatible avec Codex
Anthropic MessagesOui
Entrée d'imagesOui, en base64
StreamingOui
Mise en cache des promptsOui, TTL de 5 minutes ou d'1 heure
Sortie structuréeOui, json_object et json_schema
Requêtes en échecNon facturé

L'entrée vidéo, l'envoi de fichiers, la recherche web, les traitements par lots et les log probabilities ne sont pas proposés.

Limites de Kimi K3

Fenêtre de contexte d'1M tokens

Sur Kimi K3, le prompt, les images et l'historique partagent une fenêtre de 1 048 576 tokens.

Le raisonnement consomme le budget de sortie

Kimi K3 écrit jusqu'à 131 072 tokens par défaut, raisonnement inclus ; augmentez max_completion_tokens pour aller au-delà.

Échantillonnage fixe

Kimi K3 fixe temperature à 1.0 et top_p à 0.95. Toute autre valeur renvoie une erreur.

Images en base64

Kimi K3 accepte les images sous forme de data URI, pas d'URL publiques.

Pourquoi appeler Kimi K3 via SeedRouter

Une clé, trois formats

Appelez Kimi K3 avec Chat Completions, Responses ou Anthropic Messages, avec la même clé.

Paiement par token

Rechargez une fois et utilisez votre solde sur n'importe quel modèle. Pas de forfait, pas de frais mensuels.

Les échecs sont gratuits

Une requête qui génère une erreur n'est pas facturée.

Tarifs en direct

Les tarifs sur cette page sont ceux que votre compte paie.

Mise en cache des prompts

Les préfixes de prompt répétés sont lus depuis le cache à un tarif Kimi K3 plus bas.

Le raisonnement renvoyé dans la réponse

Kimi K3 renvoie son raisonnement dans reasoning_content, à côté de la réponse.

Streaming

Recevez les tokens de Kimi K3 au fur et à mesure avec stream: true.

Modèles connexes

Autres modèles que vous pouvez appeler avec la même clé.

DeepSeek V4.1 Flash
deepseek-v4.1-flash

DeepSeek V4.1 Flash via le SDK OpenAI ou Anthropic : contexte d'1M tokens, réflexion activable, images, tarifs heures pleines/creuses en direct, Playground.

Afficher les tarifs
claude-fable-5
claude-fable-5

Anthropic

Afficher les tarifs
claude-fable-5-1
claude-fable-5-1

Anthropic

Afficher les tarifs
claude-opus-5-5
claude-opus-5-5

Anthropic

Afficher les tarifs
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Afficher les tarifs
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Afficher les tarifs

FAQ Kimi K3

Qu'est-ce que Kimi K3 ?+

Kimi K3 est le modèle phare de Moonshot AI pour le codage au long cours, les agents et le travail intellectuel. C'est un modèle à poids ouverts de 2 800 milliards de paramètres, avec une fenêtre de contexte d'1M tokens et un raisonnement à chaque requête.

À quoi sert Kimi K3 ?+

Kimi K3 convient aux longues sessions de codage, aux agents qui appellent des outils sur de nombreuses étapes et au travail sur de gros documents ou de grandes bases de code, où la fenêtre de contexte d'1M tokens garde tout en vue.

Combien coûte Kimi K3 ?+

Kimi K3 est facturé $2.40 / 1M en entrée et $12.00 / 1M en sortie par million de tokens. L'entrée en cache coûte un dixième du tarif d'entrée, et les écritures en cache sont facturées selon leur TTL. Le prix ne varie pas avec la longueur du prompt.

Peut-on utiliser Kimi K3 gratuitement ?+

Chaque nouveau compte SeedRouter démarre avec $0.10 de solde offert, de quoi tester Kimi K3 avec quelques requêtes. Ensuite, vous payez par token sur un solde prépayé, sans abonnement, et une requête qui échoue n'est pas facturée.

Kimi K3 est-il open source, et peut-on l'exécuter en local ?+

Les poids de Kimi K3 sont publiés par Moonshot AI. Avec 2 800 milliards de paramètres, il faut du matériel de data center pour l'exécuter : la plupart des équipes appellent donc plutôt Kimi K3 via une API.

Qui développe Kimi K3 ?+

Kimi K3 est développé par Moonshot AI, l'entreprise chinoise à l'origine de l'assistant Kimi.

Peut-on désactiver le raisonnement de Kimi K3 ?+

Non. Kimi K3 raisonne toujours. Vous pouvez régler l'effort de raisonnement sur low, high ou max ; la valeur par défaut est max, et un effort plus faible répond plus vite avec moins de tokens de sortie.

Kimi K3 peut-il lire des images ?+

Oui. Kimi K3 accepte des images en plus du texte, sous forme de data URI en base64. Il n'accepte pas les URL d'images publiques et ne renvoie que du texte.

Quel est l'ID de modèle de Kimi K3 et comment l'appeler ?+

L'ID de modèle est kimi-k3. Créez une clé API SeedRouter, pointez le SDK OpenAI vers https://api.seedrouter.ai/v1 et envoyez kimi-k3 comme modèle avec Chat Completions ou Responses.

Suis-je facturé si une requête Kimi K3 échoue ?+

Non. Une requête Kimi K3 qui retourne une erreur n'est pas facturée. Vous ne payez que les tokens qu'une requête terminée rapporte.

Essayez Kimi K3 maintenant

Envoyez votre première requête Kimi K3 depuis le Playground ou votre propre code en quelques minutes.