Claude Opus 5.5 ist auf SeedRouter verfügbar

Kimi K3 Parameter, Kontextfenster und maximale Ausgabe-Token

Kimi K3 Specs: 2,8 Billionen Parameter, 16 von 896 Experten pro Token aktiv, ein Kontextfenster von 1M Token und bis zu 1.048.576 Ausgabe-Token.

Als Markdown lesen

Kimi K3 hat 2,8 Billionen Parameter und aktiviert pro Token 16 seiner 896 Experten. Sein Kontextfenster umfasst 1.048.576 Token, und eine einzelne Antwort kann bis zu 1.048.576 Token lang sein, auch wenn das Standardlimit bei 131.072 liegt. Moonshot AI nennt es „das weltweit erste Open-Source-Modell der 3-Billionen-Parameter-Klasse“ und hat die vollständigen Gewichte veröffentlicht. Es denkt immer nach, liest Text und Bilder und schreibt Text.

Kimi K3 Specs auf einen Blick

SpecWert
EntwicklerMoonshot AI
Parameter gesamt2,8 Billionen
Experten896, davon 16 aktiv pro Token
ArchitekturMixture of Experts mit Kimi Delta Attention und Attention Residuals
Kontextfenster1.048.576 Token
Maximale Ausgabe1.048.576 Token, einschließlich Reasoning
Standard-Ausgabelimit131.072 Token
ReasoningImmer an; low, high oder max (Standard max)
EingabeText und Bilder (Bilder nur als base64)
AusgabeText
GewichteVon Moonshot AI veröffentlicht
Modell-ID bei SeedRouterkimi-k3

Wie viele Parameter hat Kimi K3?

2,8 Billionen. Moonshot AIs Quickstart nennt Kimi K3 sein „bisher leistungsfähigstes Flaggschiffmodell, mit 2,8 Billionen Parametern“ und „das erste Open-Source-Modell, das 2,8 Billionen Parameter erreicht“.

Wie viele aktive Parameter hat Kimi K3?

Moonshot AIs Quickstart nennt keine Zahl aktiver Parameter. Es heißt dort aber, dass das Modell über sein Stable-LatentMoE-Framework „effizient 16 von 896 Experten aktiviert“. Nur ein kleiner Teil der 2,8 Billionen Parameter arbeitet also für jeden Token, was den Rechenaufwand pro Token niedrig hält. Alle Gewichte müssen trotzdem geladen werden, weshalb der Eigenbetrieb von Kimi K3 Multi-GPU-Hardware auf Rechenzentrumsniveau erfordert.

Welche Architektur nutzt Kimi K3?

Ein Mixture-of-Experts-Modell mit zwei Änderungen an der Attention. In Moonshot AIs Worten „basiert es auf Kimi Delta Attention (KDA), einem hybriden linearen Attention-Mechanismus, und Attention Residuals“. Laut Moonshot AI verschaffen diese Änderungen zusammen mit der spärlicheren Experten-Anordnung und neuen Trainingsmethoden Kimi K3 „ungefähr die 2,5-fache Gesamt-Skalierungseffizienz von K2“. Alle Details sollen im technischen Bericht zu Kimi K3 folgen.

Wie groß ist das Kontextfenster von Kimi K3?

1.048.576 Token, meist als 1M geschrieben. Prompt, Bilder, Gesprächsverlauf und Antwort teilen sich dieses eine Fenster.

Wie hoch ist die maximale Ausgabe von Kimi K3?

Bis zu 1.048.576 Token pro Anfrage, gesetzt mit max_completion_tokens. Der Standard liegt bei 131.072. Moonshot AIs Quickstart: „max_completion_tokens ist standardmäßig 131072 und kann auf bis zu 1048576 gesetzt werden.“

Zwei Dinge sollten Sie wissen:

  • Reasoning zählt zum Limit. Kimi K3 denkt immer nach, und seine Reasoning-Token nutzen dasselbe Budget wie die Antwort.
  • max_tokens ist der veraltete Name für dasselbe Limit. Verwenden Sie max_completion_tokens.

Wird eine Antwort abgeschnitten, erhöhen Sie max_completion_tokens oder senken Sie reasoning_effort, damit weniger Budget ins Nachdenken fließt. Kontextfenster vs. maximale Ausgabe-Token erklärt, wie Sie eine gekappte Antwort in jedem API-Format erkennen.

Lässt sich das Reasoning von Kimi K3 abschalten?

Nein. Kimi K3 denkt immer nach. Sie können reasoning_effort auf low, high oder max setzen; Standard ist max, die langsamste Stufe mit den meisten Ausgabe-Token. high passt zu den meisten Aufgaben und low zu schnellen, einfachen Schritten. Das Reasoning kommt in reasoning_content zurück, neben content, und wird als Ausgabe-Token abgerechnet.

Welche Einstellungen sind fest?

Moonshot AI legt das Sampling von Kimi K3 fest: temperature 1,0, top_p 0,95, n 1, presence_penalty 0 und frequency_penalty 0. Jeder andere Wert gibt einen Fehler zurück, lassen Sie diese Felder also in der Anfrage weg.

Liest Kimi K3 Bilder?

Ja, aber nur als base64-Data-URIs. Eine öffentliche Bild-URL wird nicht akzeptiert und gibt 400 zurück, wie in Kimis eigener API. Die Ausgabe ist immer Text.

Wie rufe ich Kimi K3 auf?

Bei SeedRouter nimmt Kimi K3 mit demselben Key und der Modell-ID kimi-k3 die Formate OpenAI Chat Completions, OpenAI Responses und Anthropic Messages an. Der Kimi K3 API Leitfaden führt durch die erste Anfrage, die Einrichtung für Claude Code und Codex enthält getestete Konfigurationen, und die Kimi K3 API-Referenz listet jeden Parameter. Aktuelle Preise stehen auf der Kimi K3 Seite.

Häufig gestellte Fragen

Wie groß ist Kimi K3?

Insgesamt 2,8 Billionen Parameter, davon 16 von 896 Experten aktiv pro Token.

Ist Kimi K3 Open Source?

Moonshot AI hat die vollständigen Modellgewichte veröffentlicht. Ist Kimi K3 kostenlos? erklärt, was der Eigenbetrieb erfordert.

Warum stoppt Kimi K3 bei 131.072 Token?

Das ist das Standard-Ausgabelimit. Setzen Sie max_completion_tokens auf bis zu 1048576 für längere Antworten.

Wer entwickelt Kimi K3?

Moonshot AI, das chinesische Unternehmen hinter dem Assistenten Kimi.

Verwandte Leitfäden