Claude Opus 5.5 ist auf SeedRouter verfügbar
Moonshot AITextgenerierung

Kimi K3 — offenes Frontier-Modell für lange Coding- und Agenten-Aufgaben

Kimi K3 ist das Flaggschiff-Modell von Moonshot AI für lange, mehrstufige Coding- und Wissensarbeit, mit einem 1M-Token-Kontextfenster. $2.40 / 1M Eingabe, $12.00 / 1M Ausgabe pro 1M Token.

Verfügbar$2.40 / 1M Eingabe · $12.00 / 1M Ausgabe$3.00 / 1M Eingabe · $15.00 / 1M Ausgabe-20%
  • Reasoning immer aktiv
  • 1M-Token-Kontextfenster
  • Bildeingabe
  • Prompt Caching
  • Streaming
Kontextfenster
1M Token
Maximale Ausgabe
1M Token
Reasoning-Stufen
low, high, max
Reasoning
Immer aktiv

Kimi K3 ausprobieren

Chatte mit Kimi K3, hänge Bilder an und sieh bei jeder Antwort die Token und Kosten.

Parameter

kimi-k3$2.40 Eingabe · $12.00 Ausgabe pro 1M Tokens

Reasoning effort
Log probabilities

Wird akzeptiert, aber es werden keine Log-Wahrscheinlichkeiten zurückgegeben.

Cache TTL
Gesamtkosten der Unterhaltung$0.000000
Bereit

Probier einen dieser Prompts

Nachrichten werden aus deinem Guthaben zu den unten angegebenen Tarifen abgerechnet, wie ein API-Aufruf. Fehlgeschlagene Anfragen sind kostenlos.

Echte Ausgabe von Kimi K3

Ein Prompt, an Kimi K3 mit Reasoning-Aufwand low gesendet. Unbearbeitet.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.

Generiert am 2026-09-28. Antworten variieren von Durchlauf zu Durchlauf.

Kimi K3 Preise

Kimi K3 wird pro Token von deinem Guthaben abgerechnet. Die Tarife unten sind live – dieselben, die deinem Konto berechnet werden.

Eine typische Anfrage2.000 Input-Token, 1.000 Output-Token
$0.0168pro Anfrage
Kimi K3 nutzt immer Reasoning, und Reasoning zählt als Ausgabe.
Was $20.00 dir bringtOutput-Token zum aktuellen Tarif
1,666,666Output-Token
Input- und gecachte Token kosten pro Token weniger als Output.

Beispielgrößen dienen nur der Veranschaulichung. Deine Abrechnung folgt den Token, die jede Anfrage meldet.

PostenGezählt alsTarifAbrechnung
EingabePrompt-Token, die weder aus dem Cache gelesen noch in ihn geschrieben werden$2.40 / 1MPro 1M Token
AusgabeAntwort- und Reasoning-Token$12.00 / 1MPro 1M Token
Gecachte EingabePrompt-Token, die aus dem Cache bereitgestellt werden$0.24 / 1MPro 1M Token
Cache-Schreibvorgang, 5 Min.Prompt-Token, die mit der Standard-TTL von 5 Minuten in den Cache geschrieben werden$2.40 / 1MPro 1M Token
Cache-Schreibvorgang, 1 StundePrompt-Token, die mit einer TTL von 1 Stunde in den Cache geschrieben werden$4.80 / 1MPro 1M Token
Fehlgeschlagene AnfrageJede Anfrage, die einen Fehler zurückgibtKostenlosNicht berechnet

Was ist Kimi K3?

Kimi K3 ist das Flaggschiff-Modell von Moonshot AI für lange, mehrstufige Coding-Aufgaben, Agenten und Wissensarbeit. Es ist ein Open-Weight-Modell mit 2,8 Billionen Parametern, und Kimi K3 liest bis zu 1M Token Kontext in einer Anfrage.

Kimi K3 nutzt vor jeder Antwort Reasoning. Wie gründlich, bestimmst du über den Reasoning-Aufwand: low für schnelle Schritte, high für die meiste Arbeit und max, der Standard, für die schwierigsten Probleme.

Modell-ID: kimi-k3 · Eingabe: Text, Bilder · Ausgabe: Text · Formate: Chat Completions, Responses, Anthropic Messages.

Modell-ID
kimi-k3
Kontextfenster
1M Token
Maximale Ausgabe
1M Token
Reasoning-Stufen
low, high, max
Eingabe
Text, Bilder

Zwei Wege, Kimi K3 zu nutzen

Rufe es aus deinem Code auf, oder lass deinen Coding-Agenten es tun.

API

Vom Backend aufrufen

Ideal für Apps und Services

Richte das OpenAI SDK auf SeedRouter aus und behalte deinen Code. Kimi K3 antwortet im Chat-Completions-, Responses- und Anthropic-Messages-Format.

  1. 1API-Schlüssel erstellen
  2. 2Base URL auf https://api.seedrouter.ai/v1 setzen
  3. 3kimi-k3 als Modell senden
Agent

Überlass es deinem Coding-Agenten

Ideal für Codex, Claude Code und andere Agenten

Kopiere einen fertigen Prompt. Dein Agent zeigt die Anfrage und die Kosten, bevor etwas ausgegeben wird.

  1. 1Prompt kopieren
  2. 2In deinen Agenten einfügen
  3. 3Anfrage bestätigen

Wofür Kimi K3 gut ist

Kimi K3 ist für lange Aufgaben gebaut, die viel Kontext und viele Schritte brauchen.

Lange Programmiersitzungen

Kimi K3 behält eine große Codebasis im Blick und arbeitet Änderungen über mehrere Schritte ab.

Agenten-Workflows

Tool-Aufrufe und ein 1M-Token-Kontextfenster lassen einen Agenten lange laufen, ohne den Faden zu verlieren.

Wissensarbeit

Gib Kimi K3 Berichte, Verträge oder Logs und erhalte eine strukturierte Auswertung.

Bilder im Prompt

Kimi K3 liest Screenshots und Diagramme zusammen mit deinem Text.

Reasoning-Aufwand, den du steuerst

Low für schnelle Antworten, max für harte Probleme. Kimi K3 nutzt bei jeder Anfrage Reasoning.

Günstigere wiederholte Kontexte

Gecachte Eingabe kostet bei Kimi K3 ein Zehntel des Input-Tarifs.

Was Teams mit Kimi K3 bauen

Coding-Agenten

Lass Kimi K3 in Codex oder deinem eigenen Agenten-Loop für Änderungen über mehrere Dateien laufen.

Code-Review-Bots

Prüfe jeden Pull Request mit dem ganzen Repository im Kontext.

Strukturierte Extraktion

Wandle Tickets und Dokumente mit einem json_schema-Antwortformat in JSON um.

Kimi K3 in vier Schritten nutzen

  1. 01

    Schlüssel erstellen

    Meld dich an und erstelle einen API-Schlüssel. Füge Guthaben hinzu, wann immer du es brauchst; es gibt kein Abo.

  2. 02

    Base URL ändern

    Richte das OpenAI SDK auf https://api.seedrouter.ai/v1 aus. Dein Code bleibt gleich.

  3. 03

    Kimi K3 wählen

    Sende kimi-k3 als Modell. Über den Reasoning-Aufwand tauschst du Tiefe gegen Geschwindigkeit und Kosten.

  4. 04

    Abrechnung prüfen

    Jede Anfrage zeigt ihre Token und Kosten in deinem Nutzungsverlauf.

API-Schlüssel holen

Kimi K3 auf SeedRouter auf einen Blick

Was du heute nutzen kannst.

MerkmalKimi K3
Chat CompletionsJa, offizielles Format
ResponsesJa, funktioniert mit Codex
Anthropic MessagesJa
BildeingabeJa, als base64
StreamingJa
Prompt CachingJa, TTL von 5 Minuten oder 1 Stunde
Strukturierte AusgabeJa, json_object und json_schema
Fehlgeschlagene AnfragenNicht berechnet

Videoeingabe, Datei-Uploads, Websuche, Batch-Jobs und Log-Wahrscheinlichkeiten werden nicht angeboten.

Kimi K3 Limits

1M-Token-Kontextfenster

Bei Kimi K3 teilen sich Prompt, Bilder und Verlauf ein Fenster von 1.048.576 Token.

Reasoning nutzt das Ausgabebudget

Kimi K3 schreibt standardmäßig bis zu 131.072 Token, Reasoning inklusive; für mehr erhöhst du max_completion_tokens.

Festes Sampling

Kimi K3 legt temperature fest auf 1.0 und top_p auf 0.95. Jeder andere Wert gibt einen Fehler zurück.

Bilder als base64

Kimi K3 nimmt Bilder als Data-URIs an, nicht als öffentliche URLs.

Warum Kimi K3 über SeedRouter aufrufen

Ein Schlüssel, drei Formate

Ruf Kimi K3 mit Chat Completions, Responses oder Anthropic Messages auf – mit demselben Schlüssel.

Zahle pro Token

Lade einmal auf und gib es für jedes Modell aus. Kein Plan, keine monatliche Gebühr.

Fehler sind kostenlos

Eine Anfrage, die einen Fehler zurückgibt, wird nicht berechnet.

Live-Preisgestaltung

Die Tarife auf dieser Seite sind die Tarife, die dein Konto zahlt.

Prompt Caching

Wiederholte Prompt-Präfixe werden zu einem günstigeren Kimi K3 Tarif aus dem Cache gelesen.

Reasoning in der Antwort

Kimi K3 gibt sein Reasoning in reasoning_content neben der Antwort zurück.

Streaming

Streame die Token von Kimi K3 mit stream: true, sobald sie ankommen.

Verwandte Modelle

Andere Modelle, die du mit demselben Schlüssel aufrufen kannst.

DeepSeek V4.1 Flash
deepseek-v4.1-flash

DeepSeek V4.1 Flash mit dem OpenAI- oder Anthropic-SDK nutzen: 1M-Token-Kontext, Denken an/aus, Bildeingabe, Live-Preise für Haupt- und Nebenzeit, Playground.

Preisgestaltung ansehen
claude-fable-5
claude-fable-5

Anthropic

Preisgestaltung ansehen
claude-fable-5-1
claude-fable-5-1

Anthropic

Preisgestaltung ansehen
claude-opus-5-5
claude-opus-5-5

Anthropic

Preisgestaltung ansehen
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Preisgestaltung ansehen
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Preisgestaltung ansehen

Kimi K3 FAQ

Was ist Kimi K3?+

Kimi K3 ist das Flaggschiff-Modell von Moonshot AI für lange, mehrstufige Coding-Aufgaben, Agenten und Wissensarbeit. Es ist ein Open-Weight-Modell mit 2,8 Billionen Parametern, einem Kontextfenster von 1M Token und Reasoning bei jeder Anfrage.

Wofür eignet sich Kimi K3?+

Kimi K3 eignet sich für lange Coding-Sitzungen, für Agenten, die über viele Schritte Tools aufrufen, und für die Arbeit mit großen Dokumenten oder Codebasen, bei der das 1M-Token-Kontextfenster alles im Blick behält.

Was kostet Kimi K3?+

Kimi K3 kostet $2.40 / 1M Eingabe und $12.00 / 1M Ausgabe pro 1M Token. Gecachte Eingabe kostet ein Zehntel des Input-Tarifs, und Cache-Schreibvorgänge werden nach ihrer TTL abgerechnet. Der Preis ändert sich nicht mit der Prompt-Länge.

Kann ich Kimi K3 kostenlos nutzen?+

Jedes neue SeedRouter-Konto startet mit $0.10 Gratis-Guthaben, genug, um Kimi K3 mit ein paar Anfragen auszuprobieren. Danach zahlst du pro Token aus einem vorausbezahlten Guthaben, ohne Abo, und eine fehlgeschlagene Anfrage wird nicht berechnet.

Ist Kimi K3 Open Source, und kann ich es lokal ausführen?+

Die Gewichte von Kimi K3 werden von Moonshot AI veröffentlicht. Mit 2,8 Billionen Parametern braucht es Rechenzentrums-Hardware, deshalb rufen die meisten Teams Kimi K3 stattdessen über eine API auf.

Wer entwickelt Kimi K3?+

Kimi K3 wird von Moonshot AI entwickelt, dem chinesischen Unternehmen hinter dem Kimi-Assistenten.

Kann ich das Reasoning von Kimi K3 abschalten?+

Nein. Kimi K3 nutzt immer Reasoning. Du kannst den Reasoning-Aufwand auf low, high oder max setzen; Standard ist max, und mit niedrigerem Aufwand antwortet das Modell schneller und mit weniger Output-Token.

Kann Kimi K3 Bilder lesen?+

Ja. Kimi K3 akzeptiert Bilder zusammen mit Text als base64-Data-URIs. Öffentliche Bild-URLs nimmt es nicht an, und es gibt nur Text zurück.

Wie lautet die Modell-ID von Kimi K3 und wie rufe ich es auf?+

Die Modell-ID ist kimi-k3. Erstelle einen SeedRouter API-Schlüssel, richte das OpenAI SDK auf https://api.seedrouter.ai/v1 aus und sende kimi-k3 als Modell über Chat Completions oder Responses.

Zahle ich, wenn eine Kimi K3 Anfrage fehlschlägt?+

Nein. Eine Kimi K3 Anfrage, die einen Fehler zurückgibt, wird nicht berechnet. Du zahlst nur für die Token, die eine abgeschlossene Anfrage meldet.

Kimi K3 jetzt testen

Sende deine erste Kimi K3 Anfrage in wenigen Minuten aus dem Playground oder deinem eigenen Code.