Kimi K3 — modèle ouvert de pointe pour le codage au long cours et les agents
Kimi K3 est le modèle phare de Moonshot AI pour le codage au long cours et le travail intellectuel, avec une fenêtre de contexte d'1M tokens. $2.40 / 1M en entrée, $12.00 / 1M en sortie par 1M de tokens.
- Raisonnement toujours actif
- Fenêtre de contexte d'1M tokens
- Entrée d'images
- Mise en cache des prompts
- Streaming
Essayer Kimi K3
Discutez avec Kimi K3, joignez des images, et voyez les tokens et le coût de chaque réponse.
kimi-k3$2.40 entrée · $12.00 sortie par million de tokens
Accepté, mais aucune log probability n'est renvoyée.
Essayez l'un de ces prompts
Les messages sont facturés sur votre solde aux tarifs ci-dessous, comme un appel API. Les requêtes en échec sont gratuites.
Sortie réelle de Kimi K3
Un prompt, envoyé à Kimi K3 avec un effort de raisonnement low. Sans modification.
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.
Généré le 2026-09-28. Les réponses varient d'une exécution à l'autre.
Tarifs de Kimi K3
Kimi K3 est facturé par token sur votre solde. Les tarifs ci-dessous sont en direct : ce sont ceux que votre compte paie.
Les tailles d'exemple sont données à titre d'illustration. Votre facture se base sur les tokens déclarés par chaque requête.
| Élément | Compté comme | Tarif | Facturation |
|---|---|---|---|
| Entrée | Tokens de prompt ni lus ni écrits dans le cache | $2.40 / 1M | Par million de tokens |
| Sortie | Tokens de réponse et de raisonnement | $12.00 / 1M | Par million de tokens |
| Entrée en cache | Tokens de prompt servis depuis le cache | $0.24 / 1M | Par million de tokens |
| Écriture en cache, 5 min | Tokens de prompt écrits dans le cache avec le TTL par défaut de 5 minutes | $2.40 / 1M | Par million de tokens |
| Écriture en cache, 1 heure | Tokens de prompt écrits dans le cache avec un TTL d'1 heure | $4.80 / 1M | Par million de tokens |
| Requête en échec | N'importe quelle requête qui retourne une erreur | Gratuit | Non facturé |
Qu'est-ce que Kimi K3 ?
Kimi K3 est le modèle phare de Moonshot AI pour le codage au long cours, les agents et le travail intellectuel. C'est un modèle à poids ouverts de 2 800 milliards de paramètres, et Kimi K3 lit jusqu'à 1M tokens de contexte en une seule requête.
Kimi K3 raisonne toujours avant de répondre. Vous choisissez l'intensité avec l'effort de raisonnement : low pour les étapes rapides, high pour la plupart des tâches et max, la valeur par défaut, pour les problèmes les plus difficiles.
ID de modèle : kimi-k3 · Entrée : texte, images · Sortie : texte · Formats : Chat Completions, Responses, Anthropic Messages.
Deux façons d'utiliser Kimi K3
Appelez-le depuis votre code, ou laissez votre agent de codage le faire.
Appelez-le depuis votre serveur d'application
Pointez le SDK OpenAI vers SeedRouter et gardez votre code. Kimi K3 répond aux formats Chat Completions, Responses et Anthropic Messages.
- 1Créez une clé API
- 2Définissez l'URL de base sur https://api.seedrouter.ai/v1
- 3Envoyez kimi-k3 comme modèle
Confiez-le à votre agent de codage
Copiez un prompt prêt. Votre agent affiche la requête et le coût avant que quoi que ce soit ne soit dépensé.
- 1Copiez le prompt
- 2Collez-le dans votre agent
- 3Approuvez la requête
Ce que Kimi K3 fait bien
Kimi K3 est conçu pour les tâches longues qui demandent beaucoup de contexte et de nombreuses étapes.
Longues sessions de codage
Kimi K3 garde en vue une grande base de code et mène à bien des modifications en plusieurs étapes.
Flux de travail agentique
Les appels d'outils et une fenêtre de contexte d'1M tokens permettent à un agent de travailler longtemps sans perdre le fil.
Travail intellectuel
Confiez à Kimi K3 des rapports, des contrats ou des logs et obtenez-en une lecture structurée.
Images dans le prompt
Kimi K3 lit les captures d'écran et les graphiques en plus de votre texte.
L'effort que vous contrôlez
Low pour les réponses rapides, max pour les problèmes difficiles. Kimi K3 raisonne à chaque requête.
Contexte répété moins cher
L'entrée en cache sur Kimi K3 coûte un dixième du tarif d'entrée.
Ce que les équipes construisent avec Kimi K3
Agents de codage
Exécutez Kimi K3 dans Codex ou dans votre propre boucle d'agent pour des modifications sur plusieurs fichiers.
Bots de revue de code
Vérifiez chaque pull request avec tout le dépôt en contexte.
Extraction structurée
Transformez tickets et documents en JSON avec un response format json_schema.
Commencer à utiliser Kimi K3 en quatre étapes
- 01
Créez une clé
Connectez-vous et créez une clé API. Ajoutez du crédit chaque fois que vous en avez besoin ; il n'y a pas d'abonnement.
- 02
Changez l'URL de base
Pointez le SDK OpenAI vers https://api.seedrouter.ai/v1. Votre code reste le même.
- 03
Choisissez Kimi K3
Envoyez kimi-k3 comme modèle. Réglez l'effort de raisonnement pour arbitrer entre profondeur, vitesse et coût.
- 04
Vérifiez la facture
Chaque requête affiche ses tokens et son montant facturé dans votre historique d'utilisation.
Kimi K3 sur SeedRouter en un coup d'œil
Ce que vous pouvez utiliser aujourd'hui.
| Fonctionnalité | Kimi K3 |
|---|---|
| Chat Completions | Oui, format officiel |
| Responses | Oui, compatible avec Codex |
| Anthropic Messages | Oui |
| Entrée d'images | Oui, en base64 |
| Streaming | Oui |
| Mise en cache des prompts | Oui, TTL de 5 minutes ou d'1 heure |
| Sortie structurée | Oui, json_object et json_schema |
| Requêtes en échec | Non facturé |
L'entrée vidéo, l'envoi de fichiers, la recherche web, les traitements par lots et les log probabilities ne sont pas proposés.
Limites de Kimi K3
Fenêtre de contexte d'1M tokens
Sur Kimi K3, le prompt, les images et l'historique partagent une fenêtre de 1 048 576 tokens.
Le raisonnement consomme le budget de sortie
Kimi K3 écrit jusqu'à 131 072 tokens par défaut, raisonnement inclus ; augmentez max_completion_tokens pour aller au-delà.
Échantillonnage fixe
Kimi K3 fixe temperature à 1.0 et top_p à 0.95. Toute autre valeur renvoie une erreur.
Images en base64
Kimi K3 accepte les images sous forme de data URI, pas d'URL publiques.
Pourquoi appeler Kimi K3 via SeedRouter
Une clé, trois formats
Appelez Kimi K3 avec Chat Completions, Responses ou Anthropic Messages, avec la même clé.
Paiement par token
Rechargez une fois et utilisez votre solde sur n'importe quel modèle. Pas de forfait, pas de frais mensuels.
Les échecs sont gratuits
Une requête qui génère une erreur n'est pas facturée.
Tarifs en direct
Les tarifs sur cette page sont ceux que votre compte paie.
Mise en cache des prompts
Les préfixes de prompt répétés sont lus depuis le cache à un tarif Kimi K3 plus bas.
Le raisonnement renvoyé dans la réponse
Kimi K3 renvoie son raisonnement dans reasoning_content, à côté de la réponse.
Streaming
Recevez les tokens de Kimi K3 au fur et à mesure avec stream: true.
Modèles connexes
Autres modèles que vous pouvez appeler avec la même clé.
DeepSeek V4.1 Flash via le SDK OpenAI ou Anthropic : contexte d'1M tokens, réflexion activable, images, tarifs heures pleines/creuses en direct, Playground.
Afficher les tarifsGuides Kimi K3
Procédures pas à pas et comparaisons pour ce modèle.
Kimi K3 est-il gratuit ? Les poids se téléchargent gratuitement, mais les faire tourner exige du matériel de centre de données, et l’API est payante au token.
API Kimi K3 : obtenir une clé, appeler kimi-k3 avec le SDK OpenAI, régler l’effort de raisonnement, streamer, envoyer des images, corriger les erreurs.
Prix de l’API Kimi K3 par million de tokens : entrée, sortie, entrée en cache, écritures en cache de 5 min ou 1 h, formule de facturation et coût d’une tâche.
Utiliser Kimi K3 comme modèle dans Claude Code et OpenAI Codex CLI via SeedRouter : variables d’environnement, config.toml et résultats de nos tests.
Kimi K3 vs Claude Fable 5 et Claude Opus 5.5 : prix catalogue, contexte, limites de sortie, raisonnement, poids ouverts et formats d’API, avec un verdict.
FAQ Kimi K3
Qu'est-ce que Kimi K3 ?+
Kimi K3 est le modèle phare de Moonshot AI pour le codage au long cours, les agents et le travail intellectuel. C'est un modèle à poids ouverts de 2 800 milliards de paramètres, avec une fenêtre de contexte d'1M tokens et un raisonnement à chaque requête.
À quoi sert Kimi K3 ?+
Kimi K3 convient aux longues sessions de codage, aux agents qui appellent des outils sur de nombreuses étapes et au travail sur de gros documents ou de grandes bases de code, où la fenêtre de contexte d'1M tokens garde tout en vue.
Combien coûte Kimi K3 ?+
Kimi K3 est facturé $2.40 / 1M en entrée et $12.00 / 1M en sortie par million de tokens. L'entrée en cache coûte un dixième du tarif d'entrée, et les écritures en cache sont facturées selon leur TTL. Le prix ne varie pas avec la longueur du prompt.
Peut-on utiliser Kimi K3 gratuitement ?+
Chaque nouveau compte SeedRouter démarre avec $0.10 de solde offert, de quoi tester Kimi K3 avec quelques requêtes. Ensuite, vous payez par token sur un solde prépayé, sans abonnement, et une requête qui échoue n'est pas facturée.
Kimi K3 est-il open source, et peut-on l'exécuter en local ?+
Les poids de Kimi K3 sont publiés par Moonshot AI. Avec 2 800 milliards de paramètres, il faut du matériel de data center pour l'exécuter : la plupart des équipes appellent donc plutôt Kimi K3 via une API.
Qui développe Kimi K3 ?+
Kimi K3 est développé par Moonshot AI, l'entreprise chinoise à l'origine de l'assistant Kimi.
Peut-on désactiver le raisonnement de Kimi K3 ?+
Non. Kimi K3 raisonne toujours. Vous pouvez régler l'effort de raisonnement sur low, high ou max ; la valeur par défaut est max, et un effort plus faible répond plus vite avec moins de tokens de sortie.
Kimi K3 peut-il lire des images ?+
Oui. Kimi K3 accepte des images en plus du texte, sous forme de data URI en base64. Il n'accepte pas les URL d'images publiques et ne renvoie que du texte.
Quel est l'ID de modèle de Kimi K3 et comment l'appeler ?+
L'ID de modèle est kimi-k3. Créez une clé API SeedRouter, pointez le SDK OpenAI vers https://api.seedrouter.ai/v1 et envoyez kimi-k3 comme modèle avec Chat Completions ou Responses.
Suis-je facturé si une requête Kimi K3 échoue ?+
Non. Une requête Kimi K3 qui retourne une erreur n'est pas facturée. Vous ne payez que les tokens qu'une requête terminée rapporte.
Essayez Kimi K3 maintenant
Envoyez votre première requête Kimi K3 depuis le Playground ou votre propre code en quelques minutes.
