Prezzi di Kimi K3 spiegati: piani e costi API

8 min di lettura2026-07-25
Prezzi di Kimi K3

Kimi K3 è il primo modello open al mondo di classe 3T, un modello di punta da 2,8T parametri progettato per un'intelligenza all'avanguardia in coding a lungo termine, lavoro basato sulla conoscenza e ragionamento, con visione nativa e una finestra di contesto da 1M di token. È disponibile su Kimi.com, Kimi Work, Kimi Code e Kimi API. Di seguito una panoramica dei piani di abbonamento Kimi e dei prezzi dell'API di Kimi K3 per aiutarti a scegliere il modo giusto per accedervi.

Piani di abbonamento e livelli di utilizzo di Kimi K3

Il modo più semplice per usare Kimi K3 è tramite un abbonamento Kimi. Kimi offre piani a livelli che si adattano alle tue esigenze, dall'uso quotidiano occasionale ai flussi di lavoro agentivi intensivi. I livelli superiori sbloccano più crediti agent, maggiore concorrenza e la capacità di chat extra-lunga fino a 1M di token, alimentata da Kimi K3.

AdagioModeratoAllegrettoAllegroVivace
Fatturazione annuale (equivalente mensile)0 $ / mese15 $ / mese31 $ / mese79 $ / mese159 $ / mese
Attività simultanee dell'agent1 attività2 attività2 attività4 attività4 attività
Coda prioritaria dell'agent×Velocità 4×Velocità 4×Velocità 4×Velocità 4×
Capacità di chat estesa K3 (fino a 1M di token)×××
Dashboard personalizzabile
Attività pianificate2 attività10 attività15 attività20 attività25 attività
Attività widget2 attività10 attività15 attività20 attività25 attività
PluginOltre 15 tipi supportatiOltre 15 tipi supportatiOltre 15 tipi supportatiOltre 15 tipi supportatiOltre 15 tipi supportati
Swarm×
Sottoattività eseguite dallo swarm×2 subagent4 subagent8 subagent8 subagent
Dream Memory×
Self-evolving Skill×
Obiettivo××
Kimi Claw (Web, Android, PC)××
Chat di gruppo con Claw××10 chat di gruppo10 chat di gruppo10 chat di gruppo
Distribuisci un sito web con un database×

Tutti i prezzi sopra indicati si riferiscono alla fatturazione annuale. È disponibile anche la fatturazione mensile a $19, $39, $99 e $199 al mese rispettivamente. Allegro e Vivace sbloccano la capacità di chat extra-lunga di K3, supportando fino a 1M di token di contesto per conversazioni ultra-lunghe, codebase di grandi dimensioni e ricerche ricche di documenti. Per i dettagli aggiornati dei piani, consulta la pagina ufficiale degli abbonamenti.

Prezzi dell'API di Kimi K3

I prezzi dell'API di Kimi K3 seguono un modello basato sui token, con l'utilizzo fatturato per 1M di token (1.000.000 di token) sia per l'elaborazione dell'input che dell'output, consentendo un controllo dei costi chiaro e prevedibile.

ModelloUnitàPrezzo di input (cache hit)Prezzo di input (cache miss)Prezzo di outputFinestra di contesto
kimi-k31M di token$0.30$3.00$15.001.048.576 token

Kimi K3 è il modello di punta di Kimi per il coding a lungo termine e per il lavoro basato sulla conoscenza end-to-end. Ragiona sempre, con lo sforzo di ragionamento impostato tramite il campo di primo livello reasoning_effort. Il modello supporta la memorizzazione automatica del contesto (context caching), le chiamate agli strumenti, la modalità JSON, output strutturati e una finestra di contesto completa da 1M di token in un'unica richiesta.

Come funziona la fatturazione dell'API di Kimi K3

L'API di Kimi K3 utilizza un modello di prezzo basato sui token per ogni richiesta, in cui ogni interazione con il modello consuma token che vengono fatturati in base al loro tipo. In questo modello, i token sono generalmente suddivisi in tre categorie: token di input, token di input memorizzati nella cache e token di output.

Token di input

I token di input rappresentano tutto ciò che viene inviato al modello, tra cui:

  • I prompt dell'utente

  • Le istruzioni di sistema

  • La cronologia della conversazione o il contesto Questi token determinano quanto contesto il modello deve elaborare prima di generare una risposta. Con una finestra di contesto da 1M di token, Kimi K3 può acquisire interi codebase, documenti lunghi e cronologie estese multi-turno in un'unica richiesta.

Token di input memorizzati nella cache

I token di input memorizzati nella cache si verificano quando un contesto già elaborato viene riutilizzato.

  • Se lo stesso contesto o un contesto simile viene riutilizzato, viene fatturato a $0,30 per 1M di token invece di $3,00, con una riduzione del 90%

  • Questo migliora notevolmente l'efficienza per i flussi di lavoro ripetitivi

  • È particolarmente utile nelle applicazioni a contesto lungo e nelle interazioni multi-turno, dove un ampio contesto condiviso viene inviato ripetutamente

Token di output

I token di output vengono generati dal modello in risposta a una richiesta. Rappresentano il contenuto effettivo generato dall'IA, come:

  • Risposte testuali

  • Generazione di codice

  • Output strutturati Poiché la generazione dell'output richiede ulteriore calcolo, il suo prezzo è in genere più alto rispetto ai token di input.

Conclusione

Kimi K3 offre prezzi flessibili sia per gli utenti comuni che per gli sviluppatori: piani di abbonamento per l'esperienza Kimi completa e un'API basata sui token con memorizzazione automatica del contesto che riduce i costi di input del 90%. Scegli il percorso più adatto al tuo flusso di lavoro e inizia oggi con Kimi K3.

Domande frequenti

Come viene calcolato il prezzo dell'API di Kimi K3?
Il prezzo dell'API di Kimi K3 viene calcolato in base all'utilizzo dei token, con addebito ogni 1M di token (1.000.000 di token). I token di input vengono addebitati a 3,00 $ per 1M di token in caso di cache miss, oppure 0,30 $ per 1M di token in caso di cache hit. I token di output vengono addebitati a 15,00 $ per 1M di token. Tutti i prezzi non includono le imposte applicabili, calcolate al momento del pagamento in base alla tua area di fatturazione.
Quanto posso risparmiare con la memorizzazione nella cache del contesto?
Quando il contesto elaborato in precedenza viene riutilizzato, i token di input memorizzati nella cache vengono addebitati a 0,30 $ per 1M di token invece di 3,00 $, con una riduzione del 90% dei costi di input. Questo è particolarmente utile nelle applicazioni con contesto lungo e nelle interazioni a più turni in cui lo stesso contesto viene inviato ripetutamente.
Dovrei usare l'API o un piano di abbonamento Kimi?
Utilizza un piano di abbonamento Kimi se vuoi accedere a Kimi K3 direttamente nello spazio di lavoro Kimi, con funzionalità agent e capacità di chat estesa incluse. Utilizza l'API se stai costruendo strumenti personalizzati, agent o applicazioni di produzione che richiedono accesso programmatico e un controllo granulare sul consumo di token.
Quanti token supporta Kimi K3 per ogni richiesta?
Kimi K3 supporta una finestra di contesto di 1M di token (1.048.576 token), che gli consente di gestire interi codebase, documenti lunghi e attività agentiche complesse a più fasi all'interno di un'unica richiesta.
Quali piani di abbonamento includono la capacità di chat extra-lunga di K3?
I piani Allegro e Vivace sbloccano la capacità di chat extra-lunga di K3, con conversazioni fino a 1M di token di contesto. Tutte le altre funzionalità del piano di abbonamento, come i task agentivi e Swarm, aumentano in base al livello, come mostrato nella tabella di confronto dei piani.
Potrebbe interessarti anche
Kimi Work Dashboard: dashboard e widget AI personalizzati
Kimi Work Dashboard: dashboard e widget AI personalizzati
2026-07-23
Kimi Code: l'AI Code Agent di nuova generazione per terminale e IDE
Kimi Code: l'AI Code Agent di nuova generazione per terminale e IDE
2026-07-22
Kimi Claw: deployment cloud di OpenClaw con 1 clic e Agent AI 24/7
Kimi Claw: deployment cloud di OpenClaw con 1 clic e Agent AI 24/7
2026-07-22
Sistema multi-Agent spiegato: che cos'è, vantaggi e usi
Sistema multi-Agent spiegato: che cos'è, vantaggi e usi
2026-07-22
Agenti paralleli spiegati: architettura, pattern e utilizzi
Agenti paralleli spiegati: architettura, pattern e utilizzi
2026-07-22