Claude Opus 5.5 è disponibile su SeedRouter
Moonshot AIGenerazione di testo

Kimi K3 — modello open di frontiera per coding lungo e agenti

Kimi K3 è il modello di punta di Moonshot AI per il coding di lungo periodo e il lavoro della conoscenza, con un contesto da 1M di token. $2.40 / 1M di input, $12.00 / 1M di output per 1M di token.

Disponibile$2.40 / 1M input · $12.00 / 1M output$3.00 / 1M input · $15.00 / 1M output-20%
  • Ragionamento sempre attivo
  • Finestra di contesto da 1M di token
  • Input di immagini
  • Prompt caching
  • Streaming
Finestra di contesto
1M di token
Output massimo
1M di token
Livelli di ragionamento
low, high, max
Ragionamento
Sempre attivo

Prova Kimi K3

Chatta con Kimi K3, allega immagini e visualizza i token e il costo di ogni risposta.

Parametri

kimi-k3$2.40 input · $12.00 output per milione di token

Reasoning effort
Probabilità logaritmiche

Accettato, ma non vengono restituite probabilità logaritmiche.

TTL della cache
Totale della conversazione$0.000000
Pronto

Prova uno di questi prompt

I messaggi si addebitano dal tuo credito alle tariffe sottostanti, come una chiamata API. Le richieste non riuscite sono gratuite.

Output reale di Kimi K3

Un prompt, inviato a Kimi K3 con sforzo di ragionamento low. Non modificato.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.

Generato 2026-09-28. Le risposte variano da un'esecuzione all'altra.

Prezzi di Kimi K3

Kimi K3 si addebita per token dal tuo credito. Le tariffe sottostanti sono in tempo reale, le stesse applicate al tuo account.

Una richiesta tipica2.000 token di input, 1.000 token di output
$0.0168per richiesta
Kimi K3 ragiona sempre e il ragionamento conta come output.
Cosa compri con $20.00Token di output alla tariffa attuale
1,666,666token di output
I token di input e di cache costano meno per token rispetto all'output.

Le dimensioni degli esempi sono indicative. Il tuo addebito si basa sui token dichiarati da ogni richiesta.

VoceContato comeTariffaFatturazione
InputToken di prompt non letti dalla cache né scritti in cache$2.40 / 1MPer 1M di token
OutputToken di risposta e ragionamento$12.00 / 1MPer 1M di token
Input in cacheToken di prompt serviti dalla cache$0.24 / 1MPer 1M di token
Scrittura della cache, 5 minToken di prompt scritti in cache con il TTL predefinito di 5 minuti$2.40 / 1MPer 1M di token
Scrittura della cache, 1 oraToken di prompt scritti in cache con un TTL di 1 ora$4.80 / 1MPer 1M di token
Richiesta non riuscitaQualsiasi richiesta che restituisce un erroreGratisNon viene addebitato

Cos'è Kimi K3?

Kimi K3 è il modello di punta di Moonshot AI per il coding di lungo periodo, gli agenti e il lavoro della conoscenza. È un modello open-weight da 2,8 trilioni di parametri, e Kimi K3 legge fino a 1M di token di contesto in una sola richiesta.

Kimi K3 ragiona sempre prima di rispondere. Scegli tu quanto a fondo con lo sforzo di ragionamento: low per i passaggi rapidi, high per la maggior parte del lavoro e max, il predefinito, per i problemi più difficili.

ID del modello: kimi-k3 · Input: testo, immagini · Output: testo · Formati: Chat Completions, Responses, Anthropic Messages.

ID del modello
kimi-k3
Finestra di contesto
1M di token
Output massimo
1M di token
Livelli di ragionamento
low, high, max
Input
Testo, immagini

Due modi per usare Kimi K3

Chiamala dal tuo codice, oppure lascia che il tuo agente di coding lo faccia per te.

API

Chiamala dal tuo backend

Ideale per app e servizi

Punta l'SDK OpenAI a SeedRouter e mantieni il tuo codice. Kimi K3 risponde a Chat Completions, Responses e Anthropic Messages.

  1. 1Crea una chiave API
  2. 2Imposta l'URL di base a https://api.seedrouter.ai/v1
  3. 3Invia kimi-k3 come modello
Agente

Affidala al tuo agente di coding

Ideale per Codex, Claude Code e altri agenti

Copia un prompt pronto. Il tuo agente mostra la richiesta e il costo prima di spendere nulla.

  1. 1Copia il prompt
  2. 2Incollalo nel tuo agente
  3. 3Approva la richiesta

In cosa eccelle Kimi K3

Kimi K3 è fatto per compiti lunghi che richiedono molto contesto e molti passaggi.

Lunghe sessioni di coding

Kimi K3 tiene sotto controllo una grande base di codice e porta a termine modifiche in più passaggi.

Workflow con agenti

Chiamate agli strumenti e un contesto da 1M di token permettono a un agente di lavorare a lungo senza perdere il filo.

Lavoro della conoscenza

Dai a Kimi K3 report, contratti o log e ottieni una lettura strutturata.

Immagini nel prompt

Kimi K3 legge screenshot e grafici insieme al tuo testo.

Ragionamento che controlli tu

Low per risposte rapide, max per problemi difficili. Kimi K3 ragiona a ogni richiesta.

Contesto riusato più economico

L'input in cache su Kimi K3 costa un decimo della tariffa di input.

Cosa costruiscono i team con Kimi K3

Agenti di coding

Esegui Kimi K3 in Codex o nel tuo ciclo di agenti per modifiche su più file.

Bot di revisione del codice

Controlla ogni pull request con l'intero repository nel contesto.

Estrazione strutturata

Trasforma ticket e documenti in JSON con un response_format json_schema.

Inizia a usare Kimi K3 in quattro passaggi

  1. 01

    Crea una chiave

    Accedi e crea una chiave API. Aggiungi credito quando ti serve; non c'è abbonamento.

  2. 02

    Cambia l'URL di base

    Punta l'SDK OpenAI a https://api.seedrouter.ai/v1. Il tuo codice rimane uguale.

  3. 03

    Scegli Kimi K3

    Invia kimi-k3 come modello. Imposta lo sforzo di ragionamento per bilanciare profondità, velocità e costo.

  4. 04

    Controlla il conto

    Ogni richiesta mostra token e addebito nel tuo storico di utilizzo.

Ottieni una chiave API

Kimi K3 su SeedRouter a colpo d'occhio

Quello che puoi usare oggi.

CaratteristicaKimi K3
Chat CompletionsSì, formato ufficiale
ResponsesSì, funziona con Codex
Anthropic MessagesSì
Input di immaginiSì, in base64
StreamingSì
Prompt cachingSì, TTL di 5 minuti o di 1 ora
Output strutturatoSì, json_object e json_schema
Richieste non riusciteNon viene addebitato

Input video, caricamento di file, ricerca web, job batch e probabilità logaritmiche non sono offerti.

Limiti di Kimi K3

Finestra di contesto da 1M di token

Su Kimi K3, prompt, immagini e cronologia condividono un'unica finestra da 1.048.576 token.

Il ragionamento usa il budget di output

Kimi K3 scrive fino a 131.072 token per impostazione predefinita, ragionamento incluso; aumenta max_completion_tokens per averne di più.

Campionamento fisso

Kimi K3 fissa temperature a 1.0 e top_p a 0.95. Qualsiasi altro valore restituisce un errore.

Immagini in base64

Kimi K3 accetta le immagini come data URI, non come URL pubblici.

Perché chiamare Kimi K3 tramite SeedRouter

Una chiave, tre formati

Chiama Kimi K3 con Chat Completions, Responses oppure Anthropic Messages, tutto con la stessa chiave.

Paghi per token

Ricarica una volta e spendilo su qualsiasi modello. Niente piano, niente canone mensile.

I fallimenti sono gratis

Una richiesta che restituisce un errore non viene addebitata.

Prezzi in tempo reale

Le tariffe su questa pagina sono quelle che il tuo account paga.

Prompt caching

I prefissi di prompt ripetuti vengono letti dalla cache a una tariffa più bassa di Kimi K3.

Ragionamento nella risposta

Kimi K3 restituisce il suo ragionamento in reasoning_content accanto alla risposta.

Streaming

Ricevi i token di Kimi K3 in streaming man mano che arrivano con stream: true.

Modelli correlati

Altri modelli che puoi chiamare con la stessa chiave.

DeepSeek V4.1 Flash
deepseek-v4.1-flash

Usa DeepSeek V4.1 Flash con l'SDK OpenAI o Anthropic: contesto da 1M di token, ragionamento attivabile o disattivabile, input di immagini, prezzi in fascia di punta e fuori punta in tempo reale e un Playground.

Visualizza i prezzi
claude-fable-5
claude-fable-5

Anthropic

Visualizza i prezzi
claude-fable-5-1
claude-fable-5-1

Anthropic

Visualizza i prezzi
claude-opus-5-5
claude-opus-5-5

Anthropic

Visualizza i prezzi
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Visualizza i prezzi
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Visualizza i prezzi

FAQ su Kimi K3

Cos'è Kimi K3?+

Kimi K3 è il modello di punta di Moonshot AI per il coding di lungo periodo, gli agenti e il lavoro della conoscenza. È un modello open-weight da 2,8 trilioni di parametri, con una finestra di contesto da 1M di token e ragionamento a ogni richiesta.

A cosa serve Kimi K3?+

Kimi K3 è adatto a lunghe sessioni di coding, ad agenti che chiamano strumenti per molti passaggi e al lavoro su grandi documenti o basi di codice, dove il contesto da 1M di token tiene tutto sotto controllo.

Quanto costa Kimi K3?+

Kimi K3 costa $2.40 / 1M di input e $12.00 / 1M di output per 1M di token. L'input in cache costa un decimo della tariffa di input e le scritture della cache si addebitano in base al loro TTL. Il prezzo non cambia con la lunghezza del prompt.

Posso usare Kimi K3 gratis?+

Ogni nuovo account SeedRouter parte con $0.10 di credito gratuito, abbastanza per provare Kimi K3 con qualche richiesta. Dopo paghi per token da un credito prepagato, senza abbonamento, e una richiesta non riuscita non viene addebitata.

Kimi K3 è open source e posso eseguirlo in locale?+

I pesi di Kimi K3 sono pubblicati da Moonshot AI. Con 2,8 trilioni di parametri richiede hardware da data center, quindi la maggior parte dei team chiama Kimi K3 tramite un'API.

Chi ha creato Kimi K3?+

Kimi K3 è sviluppato da Moonshot AI, l'azienda cinese dietro l'assistente Kimi.

Posso disattivare il ragionamento di Kimi K3?+

No. Kimi K3 ragiona sempre. Puoi impostare lo sforzo di ragionamento su low, high o max; il predefinito è max, e uno sforzo più basso risponde più in fretta con meno token di output.

Kimi K3 può leggere le immagini?+

Sì. Kimi K3 accetta immagini insieme al testo come data URI base64. Non accetta URL pubblici di immagini e restituisce solo testo.

Qual è l'ID del modello Kimi K3 e come lo chiamo?+

L'ID del modello è kimi-k3. Crea una chiave API SeedRouter, punta l'SDK OpenAI a https://api.seedrouter.ai/v1 e invia kimi-k3 come modello con Chat Completions o Responses.

Mi viene addebitato se una richiesta a Kimi K3 non riesce?+

No. Una richiesta a Kimi K3 che restituisce un errore non viene addebitata. Paghi solo i token che una richiesta completata dichiara.

Prova Kimi K3 adesso

Invia la tua prima richiesta a Kimi K3 dal Playground o dal tuo codice in pochi minuti.