Kimi K3 adalah model kelas 3T pertama di dunia yang bersifat terbuka, model unggulan dengan 2,8 triliun parameter yang dibangun untuk kecerdasan mutakhir dalam pengkodean jangka panjang, pekerjaan berbasis pengetahuan, dan penalaran, dengan visi native dan jendela konteks 1 juta token. Model ini tersedia di Kimi.com, Kimi Work, Kimi Code, dan Kimi API. Berikut adalah gambaran paket keanggotaan Kimi dan harga API Kimi K3 untuk membantu Anda memilih cara yang tepat untuk mengaksesnya.
Paket keanggotaan & tier penggunaan Kimi K3
Cara termudah untuk menggunakan Kimi K3 adalah melalui keanggotaan Kimi. Kimi menawarkan paket bertingkat yang menyesuaikan dengan kebutuhan Anda, mulai dari penggunaan harian biasa hingga alur kerja agentik yang intensif. Tier yang lebih tinggi membuka lebih banyak kredit agent, konkurensi yang lebih tinggi, dan kapasitas obrolan ekstra panjang hingga 1 juta token yang didukung oleh Kimi K3.
| Adagio | Moderato | Allegretto | Allegro | Vivace | |
|---|---|---|---|---|---|
| Penagihan Tahunan (Setara Bulanan) | $0 / bulan | $15 / bulan | $31 / bulan | $79 / bulan | $159 / bulan |
| Tugas Bersamaan Agent | 1 tugas | 2 tugas | 2 tugas | 4 tugas | 4 tugas |
| Antrean Prioritas Agent | × | kecepatan 4× | kecepatan 4× | kecepatan 4× | kecepatan 4× |
| Kapasitas Chat Ekstra Panjang K3 (Hingga 1 Juta Token) | × | × | × | ✓ | ✓ |
| Dasbor yang Dapat Disesuaikan | ✓ | ✓ | ✓ | ✓ | ✓ |
| Tugas Terjadwal | 2 tugas | 10 tugas | 15 tugas | 20 tugas | 25 tugas |
| Tugas Widget | 2 tugas | 10 tugas | 15 tugas | 20 tugas | 25 tugas |
| Plugin | Mendukung 15+ jenis | Mendukung 15+ jenis | Mendukung 15+ jenis | Mendukung 15+ jenis | Mendukung 15+ jenis |
| Swarm | × | ✓ | ✓ | ✓ | ✓ |
| Subtugas yang Dijalankan Swarm | × | 2 subagen | 4 subagen | 8 subagen | 8 subagen |
| Dream Memory | × | ✓ | ✓ | ✓ | ✓ |
| Self-evolving Skill | × | ✓ | ✓ | ✓ | ✓ |
| Tujuan | × | × | ✓ | ✓ | ✓ |
| Kimi Claw (Web, Android, PC) | × | × | ✓ | ✓ | ✓ |
| Obrolan Grup dengan Claw | × | × | 10 obrolan grup | 10 obrolan grup | 10 obrolan grup |
| Deploy Situs Web dengan Database | × | ✓ | ✓ | ✓ | ✓ |
Semua harga di atas berlaku untuk penagihan tahunan. Penagihan bulanan juga tersedia masing-masing seharga $19, $39, $99, dan $199 per bulan. Allegro dan Vivace membuka kapasitas obrolan ekstra panjang K3, yang mendukung konteks hingga 1 juta token untuk percakapan yang sangat panjang, basis kode besar, dan riset yang banyak melibatkan dokumen. Untuk detail paket terbaru, lihat halaman keanggotaan resmi.
Harga API Kimi K3
Harga API Kimi K3 menggunakan model berbasis token, dengan penggunaan ditagih per 1 juta token (1.000.000 token) untuk pemrosesan input maupun output, sehingga kontrol biaya menjadi jelas dan dapat diprediksi.
| Model | Satuan | Harga Input (Cache Hit) | Harga Input (Cache Miss) | Harga Output | Jendela Konteks |
|---|---|---|---|---|---|
| kimi-k3 | 1 juta token | $0.30 | $3.00 | $15.00 | 1.048.576 token |
Kimi K3 adalah model unggulan Kimi untuk pengkodean jangka panjang dan pekerjaan berbasis pengetahuan dari awal hingga akhir. Model ini selalu bernalar, dengan tingkat upaya penalaran diatur melalui field reasoning_effort tingkat atas. Model ini mendukung caching konteks otomatis, pemanggilan tool, mode JSON, output terstruktur, dan jendela konteks penuh 1 juta token dalam satu permintaan.
Cara kerja penagihan API Kimi K3
API Kimi K3 menggunakan model harga berbasis token untuk setiap permintaan, di mana setiap interaksi dengan model mengonsumsi token yang ditagih sesuai jenisnya. Dalam model ini, token umumnya dikategorikan menjadi tiga jenis: token input, token input yang di-cache, dan token output.
Token input
Token input mewakili semua yang dikirim ke model, termasuk:
Prompt pengguna
Instruksi sistem
Riwayat percakapan atau konteks Token-token ini menentukan seberapa banyak konteks yang perlu diproses model sebelum menghasilkan respons. Dengan jendela konteks 1 juta token, Kimi K3 dapat menerima seluruh basis kode, dokumen panjang, dan riwayat multi-giliran yang panjang dalam satu permintaan.
Token input yang di-cache
Token input yang di-cache terjadi ketika konteks yang telah diproses sebelumnya digunakan kembali.
Jika konteks yang sama atau serupa digunakan kembali, biayanya adalah $0,30 per 1 juta token, bukan $3,00, penurunan sebesar 90%
Hal ini secara signifikan meningkatkan efisiensi untuk alur kerja yang berulang
Ini sangat berguna dalam aplikasi konteks panjang dan interaksi multi-giliran, di mana konteks bersama yang besar dikirim berulang kali
Token output
Token output dihasilkan oleh model sebagai respons terhadap permintaan. Token-token ini mewakili konten yang benar-benar dihasilkan oleh AI, seperti:
Respons teks
Pembuatan kode
Output terstruktur Karena pembuatan output memerlukan komputasi tambahan, harganya biasanya lebih tinggi daripada token input.
Kesimpulan
Kimi K3 menawarkan harga yang fleksibel bagi pengguna sehari-hari maupun developer: paket keanggotaan untuk pengalaman Kimi secara penuh, dan API berbasis token dengan caching konteks otomatis yang memangkas biaya input hingga 90%. Pilih jalur yang sesuai dengan alur kerja Anda, dan mulai gunakan Kimi K3 hari ini.