Kimi K3 è il primo modello open al mondo di classe 3T, un modello di punta da 2,8T parametri progettato per un'intelligenza all'avanguardia in coding a lungo termine, lavoro basato sulla conoscenza e ragionamento, con visione nativa e una finestra di contesto da 1M di token. È disponibile su Kimi.com, Kimi Work, Kimi Code e Kimi API. Di seguito una panoramica dei piani di abbonamento Kimi e dei prezzi dell'API di Kimi K3 per aiutarti a scegliere il modo giusto per accedervi.
Piani di abbonamento e livelli di utilizzo di Kimi K3
Il modo più semplice per usare Kimi K3 è tramite un abbonamento Kimi. Kimi offre piani a livelli che si adattano alle tue esigenze, dall'uso quotidiano occasionale ai flussi di lavoro agentivi intensivi. I livelli superiori sbloccano più crediti agent, maggiore concorrenza e la capacità di chat extra-lunga fino a 1M di token, alimentata da Kimi K3.
| Adagio | Moderato | Allegretto | Allegro | Vivace | |
|---|---|---|---|---|---|
| Fatturazione annuale (equivalente mensile) | 0 $ / mese | 15 $ / mese | 31 $ / mese | 79 $ / mese | 159 $ / mese |
| Attività simultanee dell'agent | 1 attività | 2 attività | 2 attività | 4 attività | 4 attività |
| Coda prioritaria dell'agent | × | Velocità 4× | Velocità 4× | Velocità 4× | Velocità 4× |
| Capacità di chat estesa K3 (fino a 1M di token) | × | × | × | ✓ | ✓ |
| Dashboard personalizzabile | ✓ | ✓ | ✓ | ✓ | ✓ |
| Attività pianificate | 2 attività | 10 attività | 15 attività | 20 attività | 25 attività |
| Attività widget | 2 attività | 10 attività | 15 attività | 20 attività | 25 attività |
| Plugin | Oltre 15 tipi supportati | Oltre 15 tipi supportati | Oltre 15 tipi supportati | Oltre 15 tipi supportati | Oltre 15 tipi supportati |
| Swarm | × | ✓ | ✓ | ✓ | ✓ |
| Sottoattività eseguite dallo swarm | × | 2 subagent | 4 subagent | 8 subagent | 8 subagent |
| Dream Memory | × | ✓ | ✓ | ✓ | ✓ |
| Self-evolving Skill | × | ✓ | ✓ | ✓ | ✓ |
| Obiettivo | × | × | ✓ | ✓ | ✓ |
| Kimi Claw (Web, Android, PC) | × | × | ✓ | ✓ | ✓ |
| Chat di gruppo con Claw | × | × | 10 chat di gruppo | 10 chat di gruppo | 10 chat di gruppo |
| Distribuisci un sito web con un database | × | ✓ | ✓ | ✓ | ✓ |
Tutti i prezzi sopra indicati si riferiscono alla fatturazione annuale. È disponibile anche la fatturazione mensile a $19, $39, $99 e $199 al mese rispettivamente. Allegro e Vivace sbloccano la capacità di chat extra-lunga di K3, supportando fino a 1M di token di contesto per conversazioni ultra-lunghe, codebase di grandi dimensioni e ricerche ricche di documenti. Per i dettagli aggiornati dei piani, consulta la pagina ufficiale degli abbonamenti.
Prezzi dell'API di Kimi K3
I prezzi dell'API di Kimi K3 seguono un modello basato sui token, con l'utilizzo fatturato per 1M di token (1.000.000 di token) sia per l'elaborazione dell'input che dell'output, consentendo un controllo dei costi chiaro e prevedibile.
| Modello | Unità | Prezzo di input (cache hit) | Prezzo di input (cache miss) | Prezzo di output | Finestra di contesto |
|---|---|---|---|---|---|
| kimi-k3 | 1M di token | $0.30 | $3.00 | $15.00 | 1.048.576 token |
Kimi K3 è il modello di punta di Kimi per il coding a lungo termine e per il lavoro basato sulla conoscenza end-to-end. Ragiona sempre, con lo sforzo di ragionamento impostato tramite il campo di primo livello reasoning_effort. Il modello supporta la memorizzazione automatica del contesto (context caching), le chiamate agli strumenti, la modalità JSON, output strutturati e una finestra di contesto completa da 1M di token in un'unica richiesta.
Come funziona la fatturazione dell'API di Kimi K3
L'API di Kimi K3 utilizza un modello di prezzo basato sui token per ogni richiesta, in cui ogni interazione con il modello consuma token che vengono fatturati in base al loro tipo. In questo modello, i token sono generalmente suddivisi in tre categorie: token di input, token di input memorizzati nella cache e token di output.
Token di input
I token di input rappresentano tutto ciò che viene inviato al modello, tra cui:
I prompt dell'utente
Le istruzioni di sistema
La cronologia della conversazione o il contesto Questi token determinano quanto contesto il modello deve elaborare prima di generare una risposta. Con una finestra di contesto da 1M di token, Kimi K3 può acquisire interi codebase, documenti lunghi e cronologie estese multi-turno in un'unica richiesta.
Token di input memorizzati nella cache
I token di input memorizzati nella cache si verificano quando un contesto già elaborato viene riutilizzato.
Se lo stesso contesto o un contesto simile viene riutilizzato, viene fatturato a $0,30 per 1M di token invece di $3,00, con una riduzione del 90%
Questo migliora notevolmente l'efficienza per i flussi di lavoro ripetitivi
È particolarmente utile nelle applicazioni a contesto lungo e nelle interazioni multi-turno, dove un ampio contesto condiviso viene inviato ripetutamente
Token di output
I token di output vengono generati dal modello in risposta a una richiesta. Rappresentano il contenuto effettivo generato dall'IA, come:
Risposte testuali
Generazione di codice
Output strutturati Poiché la generazione dell'output richiede ulteriore calcolo, il suo prezzo è in genere più alto rispetto ai token di input.
Conclusione
Kimi K3 offre prezzi flessibili sia per gli utenti comuni che per gli sviluppatori: piani di abbonamento per l'esperienza Kimi completa e un'API basata sui token con memorizzazione automatica del contesto che riduce i costi di input del 90%. Scegli il percorso più adatto al tuo flusso di lavoro e inizia oggi con Kimi K3.