Kimi K3 — offenes Frontier-Modell für lange Coding- und Agenten-Aufgaben
Kimi K3 ist das Flaggschiff-Modell von Moonshot AI für lange, mehrstufige Coding- und Wissensarbeit, mit einem 1M-Token-Kontextfenster. $2.40 / 1M Eingabe, $12.00 / 1M Ausgabe pro 1M Token.
- Reasoning immer aktiv
- 1M-Token-Kontextfenster
- Bildeingabe
- Prompt Caching
- Streaming
Kimi K3 ausprobieren
Chatte mit Kimi K3, hänge Bilder an und sieh bei jeder Antwort die Token und Kosten.
kimi-k3$2.40 Eingabe · $12.00 Ausgabe pro 1M Tokens
Wird akzeptiert, aber es werden keine Log-Wahrscheinlichkeiten zurückgegeben.
Probier einen dieser Prompts
Nachrichten werden aus deinem Guthaben zu den unten angegebenen Tarifen abgerechnet, wie ein API-Aufruf. Fehlgeschlagene Anfragen sind kostenlos.
Echte Ausgabe von Kimi K3
Ein Prompt, an Kimi K3 mit Reasoning-Aufwand low gesendet. Unbearbeitet.
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.
Generiert am 2026-09-28. Antworten variieren von Durchlauf zu Durchlauf.
Kimi K3 Preise
Kimi K3 wird pro Token von deinem Guthaben abgerechnet. Die Tarife unten sind live – dieselben, die deinem Konto berechnet werden.
Beispielgrößen dienen nur der Veranschaulichung. Deine Abrechnung folgt den Token, die jede Anfrage meldet.
| Posten | Gezählt als | Tarif | Abrechnung |
|---|---|---|---|
| Eingabe | Prompt-Token, die weder aus dem Cache gelesen noch in ihn geschrieben werden | $2.40 / 1M | Pro 1M Token |
| Ausgabe | Antwort- und Reasoning-Token | $12.00 / 1M | Pro 1M Token |
| Gecachte Eingabe | Prompt-Token, die aus dem Cache bereitgestellt werden | $0.24 / 1M | Pro 1M Token |
| Cache-Schreibvorgang, 5 Min. | Prompt-Token, die mit der Standard-TTL von 5 Minuten in den Cache geschrieben werden | $2.40 / 1M | Pro 1M Token |
| Cache-Schreibvorgang, 1 Stunde | Prompt-Token, die mit einer TTL von 1 Stunde in den Cache geschrieben werden | $4.80 / 1M | Pro 1M Token |
| Fehlgeschlagene Anfrage | Jede Anfrage, die einen Fehler zurückgibt | Kostenlos | Nicht berechnet |
Was ist Kimi K3?
Kimi K3 ist das Flaggschiff-Modell von Moonshot AI für lange, mehrstufige Coding-Aufgaben, Agenten und Wissensarbeit. Es ist ein Open-Weight-Modell mit 2,8 Billionen Parametern, und Kimi K3 liest bis zu 1M Token Kontext in einer Anfrage.
Kimi K3 nutzt vor jeder Antwort Reasoning. Wie gründlich, bestimmst du über den Reasoning-Aufwand: low für schnelle Schritte, high für die meiste Arbeit und max, der Standard, für die schwierigsten Probleme.
Modell-ID: kimi-k3 · Eingabe: Text, Bilder · Ausgabe: Text · Formate: Chat Completions, Responses, Anthropic Messages.
Zwei Wege, Kimi K3 zu nutzen
Rufe es aus deinem Code auf, oder lass deinen Coding-Agenten es tun.
Vom Backend aufrufen
Richte das OpenAI SDK auf SeedRouter aus und behalte deinen Code. Kimi K3 antwortet im Chat-Completions-, Responses- und Anthropic-Messages-Format.
- 1API-Schlüssel erstellen
- 2Base URL auf https://api.seedrouter.ai/v1 setzen
- 3kimi-k3 als Modell senden
Überlass es deinem Coding-Agenten
Kopiere einen fertigen Prompt. Dein Agent zeigt die Anfrage und die Kosten, bevor etwas ausgegeben wird.
- 1Prompt kopieren
- 2In deinen Agenten einfügen
- 3Anfrage bestätigen
Wofür Kimi K3 gut ist
Kimi K3 ist für lange Aufgaben gebaut, die viel Kontext und viele Schritte brauchen.
Lange Programmiersitzungen
Kimi K3 behält eine große Codebasis im Blick und arbeitet Änderungen über mehrere Schritte ab.
Agenten-Workflows
Tool-Aufrufe und ein 1M-Token-Kontextfenster lassen einen Agenten lange laufen, ohne den Faden zu verlieren.
Wissensarbeit
Gib Kimi K3 Berichte, Verträge oder Logs und erhalte eine strukturierte Auswertung.
Bilder im Prompt
Kimi K3 liest Screenshots und Diagramme zusammen mit deinem Text.
Reasoning-Aufwand, den du steuerst
Low für schnelle Antworten, max für harte Probleme. Kimi K3 nutzt bei jeder Anfrage Reasoning.
Günstigere wiederholte Kontexte
Gecachte Eingabe kostet bei Kimi K3 ein Zehntel des Input-Tarifs.
Was Teams mit Kimi K3 bauen
Coding-Agenten
Lass Kimi K3 in Codex oder deinem eigenen Agenten-Loop für Änderungen über mehrere Dateien laufen.
Code-Review-Bots
Prüfe jeden Pull Request mit dem ganzen Repository im Kontext.
Strukturierte Extraktion
Wandle Tickets und Dokumente mit einem json_schema-Antwortformat in JSON um.
Kimi K3 in vier Schritten nutzen
- 01
Schlüssel erstellen
Meld dich an und erstelle einen API-Schlüssel. Füge Guthaben hinzu, wann immer du es brauchst; es gibt kein Abo.
- 02
Base URL ändern
Richte das OpenAI SDK auf https://api.seedrouter.ai/v1 aus. Dein Code bleibt gleich.
- 03
Kimi K3 wählen
Sende kimi-k3 als Modell. Über den Reasoning-Aufwand tauschst du Tiefe gegen Geschwindigkeit und Kosten.
- 04
Abrechnung prüfen
Jede Anfrage zeigt ihre Token und Kosten in deinem Nutzungsverlauf.
Kimi K3 auf SeedRouter auf einen Blick
Was du heute nutzen kannst.
| Merkmal | Kimi K3 |
|---|---|
| Chat Completions | Ja, offizielles Format |
| Responses | Ja, funktioniert mit Codex |
| Anthropic Messages | Ja |
| Bildeingabe | Ja, als base64 |
| Streaming | Ja |
| Prompt Caching | Ja, TTL von 5 Minuten oder 1 Stunde |
| Strukturierte Ausgabe | Ja, json_object und json_schema |
| Fehlgeschlagene Anfragen | Nicht berechnet |
Videoeingabe, Datei-Uploads, Websuche, Batch-Jobs und Log-Wahrscheinlichkeiten werden nicht angeboten.
Kimi K3 Limits
1M-Token-Kontextfenster
Bei Kimi K3 teilen sich Prompt, Bilder und Verlauf ein Fenster von 1.048.576 Token.
Reasoning nutzt das Ausgabebudget
Kimi K3 schreibt standardmäßig bis zu 131.072 Token, Reasoning inklusive; für mehr erhöhst du max_completion_tokens.
Festes Sampling
Kimi K3 legt temperature fest auf 1.0 und top_p auf 0.95. Jeder andere Wert gibt einen Fehler zurück.
Bilder als base64
Kimi K3 nimmt Bilder als Data-URIs an, nicht als öffentliche URLs.
Warum Kimi K3 über SeedRouter aufrufen
Ein Schlüssel, drei Formate
Ruf Kimi K3 mit Chat Completions, Responses oder Anthropic Messages auf – mit demselben Schlüssel.
Zahle pro Token
Lade einmal auf und gib es für jedes Modell aus. Kein Plan, keine monatliche Gebühr.
Fehler sind kostenlos
Eine Anfrage, die einen Fehler zurückgibt, wird nicht berechnet.
Live-Preisgestaltung
Die Tarife auf dieser Seite sind die Tarife, die dein Konto zahlt.
Prompt Caching
Wiederholte Prompt-Präfixe werden zu einem günstigeren Kimi K3 Tarif aus dem Cache gelesen.
Reasoning in der Antwort
Kimi K3 gibt sein Reasoning in reasoning_content neben der Antwort zurück.
Streaming
Streame die Token von Kimi K3 mit stream: true, sobald sie ankommen.
Verwandte Modelle
Andere Modelle, die du mit demselben Schlüssel aufrufen kannst.
DeepSeek V4.1 Flash mit dem OpenAI- oder Anthropic-SDK nutzen: 1M-Token-Kontext, Denken an/aus, Bildeingabe, Live-Preise für Haupt- und Nebenzeit, Playground.
Preisgestaltung ansehenKimi K3 Anleitungen
Walkthroughs und Vergleiche für dieses Modell.
Ist Kimi K3 kostenlos? Die Gewichte sind gratis, der Betrieb braucht aber Rechenzentrums-Hardware, und die API kostet pro Token. Was Sie gratis testen können.
Kimi K3 API nutzen: API-Key erhalten, kimi-k3 per OpenAI SDK aufrufen, Reasoning-Aufwand setzen, streamen, Bilder senden und typische erste Fehler beheben.
Kimi K3 API-Preise pro Million Token: Eingabe, Ausgabe, gecachte Eingabe und Cache-Schreiben für 5 Minuten oder 1 Stunde, mit Formel und Kosten pro Aufgabe.
So nutzen Sie Kimi K3 als Modell in Claude Code und der OpenAI Codex CLI über SeedRouter: die Umgebungsvariablen, die config.toml und unsere Testergebnisse.
Kimi K3 vs. Claude Fable 5 und Claude Opus 5.5: Listenpreis, Kontext, Ausgabegrenzen, Reasoning-Steuerung, offene Gewichte und API-Formate, mit Fazit.
Kimi K3 FAQ
Was ist Kimi K3?+
Kimi K3 ist das Flaggschiff-Modell von Moonshot AI für lange, mehrstufige Coding-Aufgaben, Agenten und Wissensarbeit. Es ist ein Open-Weight-Modell mit 2,8 Billionen Parametern, einem Kontextfenster von 1M Token und Reasoning bei jeder Anfrage.
Wofür eignet sich Kimi K3?+
Kimi K3 eignet sich für lange Coding-Sitzungen, für Agenten, die über viele Schritte Tools aufrufen, und für die Arbeit mit großen Dokumenten oder Codebasen, bei der das 1M-Token-Kontextfenster alles im Blick behält.
Was kostet Kimi K3?+
Kimi K3 kostet $2.40 / 1M Eingabe und $12.00 / 1M Ausgabe pro 1M Token. Gecachte Eingabe kostet ein Zehntel des Input-Tarifs, und Cache-Schreibvorgänge werden nach ihrer TTL abgerechnet. Der Preis ändert sich nicht mit der Prompt-Länge.
Kann ich Kimi K3 kostenlos nutzen?+
Jedes neue SeedRouter-Konto startet mit $0.10 Gratis-Guthaben, genug, um Kimi K3 mit ein paar Anfragen auszuprobieren. Danach zahlst du pro Token aus einem vorausbezahlten Guthaben, ohne Abo, und eine fehlgeschlagene Anfrage wird nicht berechnet.
Ist Kimi K3 Open Source, und kann ich es lokal ausführen?+
Die Gewichte von Kimi K3 werden von Moonshot AI veröffentlicht. Mit 2,8 Billionen Parametern braucht es Rechenzentrums-Hardware, deshalb rufen die meisten Teams Kimi K3 stattdessen über eine API auf.
Wer entwickelt Kimi K3?+
Kimi K3 wird von Moonshot AI entwickelt, dem chinesischen Unternehmen hinter dem Kimi-Assistenten.
Kann ich das Reasoning von Kimi K3 abschalten?+
Nein. Kimi K3 nutzt immer Reasoning. Du kannst den Reasoning-Aufwand auf low, high oder max setzen; Standard ist max, und mit niedrigerem Aufwand antwortet das Modell schneller und mit weniger Output-Token.
Kann Kimi K3 Bilder lesen?+
Ja. Kimi K3 akzeptiert Bilder zusammen mit Text als base64-Data-URIs. Öffentliche Bild-URLs nimmt es nicht an, und es gibt nur Text zurück.
Wie lautet die Modell-ID von Kimi K3 und wie rufe ich es auf?+
Die Modell-ID ist kimi-k3. Erstelle einen SeedRouter API-Schlüssel, richte das OpenAI SDK auf https://api.seedrouter.ai/v1 aus und sende kimi-k3 als Modell über Chat Completions oder Responses.
Zahle ich, wenn eine Kimi K3 Anfrage fehlschlägt?+
Nein. Eine Kimi K3 Anfrage, die einen Fehler zurückgibt, wird nicht berechnet. Du zahlst nur für die Token, die eine abgeschlossene Anfrage meldet.
Kimi K3 jetzt testen
Sende deine erste Kimi K3 Anfrage in wenigen Minuten aus dem Playground oder deinem eigenen Code.
