Kimi K3 — modello open di frontiera per coding lungo e agenti
Kimi K3 è il modello di punta di Moonshot AI per il coding di lungo periodo e il lavoro della conoscenza, con un contesto da 1M di token. $2.40 / 1M di input, $12.00 / 1M di output per 1M di token.
- Ragionamento sempre attivo
- Finestra di contesto da 1M di token
- Input di immagini
- Prompt caching
- Streaming
Prova Kimi K3
Chatta con Kimi K3, allega immagini e visualizza i token e il costo di ogni risposta.
kimi-k3$2.40 input · $12.00 output per milione di token
Accettato, ma non vengono restituite probabilità logaritmiche.
Prova uno di questi prompt
I messaggi si addebitano dal tuo credito alle tariffe sottostanti, come una chiamata API. Le richieste non riuscite sono gratuite.
Output reale di Kimi K3
Un prompt, inviato a Kimi K3 con sforzo di ragionamento low. Non modificato.
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex (mutual exclusion) is a locking mechanism with ownership: the thread that locks it must be the one to unlock it, and only one thread can hold it at a time. It exists to protect shared resources from concurrent access. A semaphore is a counter with no ownership: one thread can signal (increment) it while another waits (decrements) it. A binary semaphore acts like a mutex, but counting semaphores allow N threads to access a pool of resources simultaneously. When to use each: Use a mutex when you need exclusive access to shared data—like protecting a critical section or data structure from race conditions. Use a semaphore when you're coordinating or signaling between threads—like limiting access to a fixed pool of connections, implementing producer-consumer queues, or notifying one thread that work is available.
Generato 2026-09-28. Le risposte variano da un'esecuzione all'altra.
Prezzi di Kimi K3
Kimi K3 si addebita per token dal tuo credito. Le tariffe sottostanti sono in tempo reale, le stesse applicate al tuo account.
Le dimensioni degli esempi sono indicative. Il tuo addebito si basa sui token dichiarati da ogni richiesta.
| Voce | Contato come | Tariffa | Fatturazione |
|---|---|---|---|
| Input | Token di prompt non letti dalla cache né scritti in cache | $2.40 / 1M | Per 1M di token |
| Output | Token di risposta e ragionamento | $12.00 / 1M | Per 1M di token |
| Input in cache | Token di prompt serviti dalla cache | $0.24 / 1M | Per 1M di token |
| Scrittura della cache, 5 min | Token di prompt scritti in cache con il TTL predefinito di 5 minuti | $2.40 / 1M | Per 1M di token |
| Scrittura della cache, 1 ora | Token di prompt scritti in cache con un TTL di 1 ora | $4.80 / 1M | Per 1M di token |
| Richiesta non riuscita | Qualsiasi richiesta che restituisce un errore | Gratis | Non viene addebitato |
Cos'è Kimi K3?
Kimi K3 è il modello di punta di Moonshot AI per il coding di lungo periodo, gli agenti e il lavoro della conoscenza. È un modello open-weight da 2,8 trilioni di parametri, e Kimi K3 legge fino a 1M di token di contesto in una sola richiesta.
Kimi K3 ragiona sempre prima di rispondere. Scegli tu quanto a fondo con lo sforzo di ragionamento: low per i passaggi rapidi, high per la maggior parte del lavoro e max, il predefinito, per i problemi più difficili.
ID del modello: kimi-k3 · Input: testo, immagini · Output: testo · Formati: Chat Completions, Responses, Anthropic Messages.
Due modi per usare Kimi K3
Chiamala dal tuo codice, oppure lascia che il tuo agente di coding lo faccia per te.
Chiamala dal tuo backend
Punta l'SDK OpenAI a SeedRouter e mantieni il tuo codice. Kimi K3 risponde a Chat Completions, Responses e Anthropic Messages.
- 1Crea una chiave API
- 2Imposta l'URL di base a https://api.seedrouter.ai/v1
- 3Invia kimi-k3 come modello
Affidala al tuo agente di coding
Copia un prompt pronto. Il tuo agente mostra la richiesta e il costo prima di spendere nulla.
- 1Copia il prompt
- 2Incollalo nel tuo agente
- 3Approva la richiesta
In cosa eccelle Kimi K3
Kimi K3 è fatto per compiti lunghi che richiedono molto contesto e molti passaggi.
Lunghe sessioni di coding
Kimi K3 tiene sotto controllo una grande base di codice e porta a termine modifiche in più passaggi.
Workflow con agenti
Chiamate agli strumenti e un contesto da 1M di token permettono a un agente di lavorare a lungo senza perdere il filo.
Lavoro della conoscenza
Dai a Kimi K3 report, contratti o log e ottieni una lettura strutturata.
Immagini nel prompt
Kimi K3 legge screenshot e grafici insieme al tuo testo.
Ragionamento che controlli tu
Low per risposte rapide, max per problemi difficili. Kimi K3 ragiona a ogni richiesta.
Contesto riusato più economico
L'input in cache su Kimi K3 costa un decimo della tariffa di input.
Cosa costruiscono i team con Kimi K3
Agenti di coding
Esegui Kimi K3 in Codex o nel tuo ciclo di agenti per modifiche su più file.
Bot di revisione del codice
Controlla ogni pull request con l'intero repository nel contesto.
Estrazione strutturata
Trasforma ticket e documenti in JSON con un response_format json_schema.
Inizia a usare Kimi K3 in quattro passaggi
- 01
Crea una chiave
Accedi e crea una chiave API. Aggiungi credito quando ti serve; non c'è abbonamento.
- 02
Cambia l'URL di base
Punta l'SDK OpenAI a https://api.seedrouter.ai/v1. Il tuo codice rimane uguale.
- 03
Scegli Kimi K3
Invia kimi-k3 come modello. Imposta lo sforzo di ragionamento per bilanciare profondità, velocità e costo.
- 04
Controlla il conto
Ogni richiesta mostra token e addebito nel tuo storico di utilizzo.
Kimi K3 su SeedRouter a colpo d'occhio
Quello che puoi usare oggi.
| Caratteristica | Kimi K3 |
|---|---|
| Chat Completions | Sì, formato ufficiale |
| Responses | Sì, funziona con Codex |
| Anthropic Messages | Sì |
| Input di immagini | Sì, in base64 |
| Streaming | Sì |
| Prompt caching | Sì, TTL di 5 minuti o di 1 ora |
| Output strutturato | Sì, json_object e json_schema |
| Richieste non riuscite | Non viene addebitato |
Input video, caricamento di file, ricerca web, job batch e probabilità logaritmiche non sono offerti.
Limiti di Kimi K3
Finestra di contesto da 1M di token
Su Kimi K3, prompt, immagini e cronologia condividono un'unica finestra da 1.048.576 token.
Il ragionamento usa il budget di output
Kimi K3 scrive fino a 131.072 token per impostazione predefinita, ragionamento incluso; aumenta max_completion_tokens per averne di più.
Campionamento fisso
Kimi K3 fissa temperature a 1.0 e top_p a 0.95. Qualsiasi altro valore restituisce un errore.
Immagini in base64
Kimi K3 accetta le immagini come data URI, non come URL pubblici.
Perché chiamare Kimi K3 tramite SeedRouter
Una chiave, tre formati
Chiama Kimi K3 con Chat Completions, Responses oppure Anthropic Messages, tutto con la stessa chiave.
Paghi per token
Ricarica una volta e spendilo su qualsiasi modello. Niente piano, niente canone mensile.
I fallimenti sono gratis
Una richiesta che restituisce un errore non viene addebitata.
Prezzi in tempo reale
Le tariffe su questa pagina sono quelle che il tuo account paga.
Prompt caching
I prefissi di prompt ripetuti vengono letti dalla cache a una tariffa più bassa di Kimi K3.
Ragionamento nella risposta
Kimi K3 restituisce il suo ragionamento in reasoning_content accanto alla risposta.
Streaming
Ricevi i token di Kimi K3 in streaming man mano che arrivano con stream: true.
Modelli correlati
Altri modelli che puoi chiamare con la stessa chiave.
Usa DeepSeek V4.1 Flash con l'SDK OpenAI o Anthropic: contesto da 1M di token, ragionamento attivabile o disattivabile, input di immagini, prezzi in fascia di punta e fuori punta in tempo reale e un Playground.
Visualizza i prezziGuide su Kimi K3
Procedure dettagliate e confronti per questo modello.
Kimi K3 è gratis? I pesi si scaricano gratis, ma eseguirli richiede hardware da data center e l'API si paga a token. Ecco cosa puoi provare gratis.
Come accedere all'API di Kimi K3: ottieni una chiave, chiama kimi-k3 con l'SDK OpenAI, imposta lo sforzo di ragionamento, streaming, immagini ed errori comuni.
Prezzi dell'API di Kimi K3 per milione di token: input, output, input in cache e scritture in cache da 5 minuti o 1 ora, con formula e costo di un task.
Come usare Kimi K3 come modello in Claude Code e in OpenAI Codex CLI tramite SeedRouter: le variabili d'ambiente, il config.toml e i risultati dei test.
Kimi K3 vs Claude Fable 5 e Claude Opus 5.5 a confronto su prezzo di listino, contesto, limiti di output, controllo del ragionamento, pesi aperti e formati API.
FAQ su Kimi K3
Cos'è Kimi K3?+
Kimi K3 è il modello di punta di Moonshot AI per il coding di lungo periodo, gli agenti e il lavoro della conoscenza. È un modello open-weight da 2,8 trilioni di parametri, con una finestra di contesto da 1M di token e ragionamento a ogni richiesta.
A cosa serve Kimi K3?+
Kimi K3 è adatto a lunghe sessioni di coding, ad agenti che chiamano strumenti per molti passaggi e al lavoro su grandi documenti o basi di codice, dove il contesto da 1M di token tiene tutto sotto controllo.
Quanto costa Kimi K3?+
Kimi K3 costa $2.40 / 1M di input e $12.00 / 1M di output per 1M di token. L'input in cache costa un decimo della tariffa di input e le scritture della cache si addebitano in base al loro TTL. Il prezzo non cambia con la lunghezza del prompt.
Posso usare Kimi K3 gratis?+
Ogni nuovo account SeedRouter parte con $0.10 di credito gratuito, abbastanza per provare Kimi K3 con qualche richiesta. Dopo paghi per token da un credito prepagato, senza abbonamento, e una richiesta non riuscita non viene addebitata.
Kimi K3 è open source e posso eseguirlo in locale?+
I pesi di Kimi K3 sono pubblicati da Moonshot AI. Con 2,8 trilioni di parametri richiede hardware da data center, quindi la maggior parte dei team chiama Kimi K3 tramite un'API.
Chi ha creato Kimi K3?+
Kimi K3 è sviluppato da Moonshot AI, l'azienda cinese dietro l'assistente Kimi.
Posso disattivare il ragionamento di Kimi K3?+
No. Kimi K3 ragiona sempre. Puoi impostare lo sforzo di ragionamento su low, high o max; il predefinito è max, e uno sforzo più basso risponde più in fretta con meno token di output.
Kimi K3 può leggere le immagini?+
Sì. Kimi K3 accetta immagini insieme al testo come data URI base64. Non accetta URL pubblici di immagini e restituisce solo testo.
Qual è l'ID del modello Kimi K3 e come lo chiamo?+
L'ID del modello è kimi-k3. Crea una chiave API SeedRouter, punta l'SDK OpenAI a https://api.seedrouter.ai/v1 e invia kimi-k3 come modello con Chat Completions o Responses.
Mi viene addebitato se una richiesta a Kimi K3 non riesce?+
No. Una richiesta a Kimi K3 che restituisce un errore non viene addebitata. Paghi solo i token che una richiesta completata dichiara.
Prova Kimi K3 adesso
Invia la tua prima richiesta a Kimi K3 dal Playground o dal tuo codice in pochi minuti.
