Giải thích giá Kimi K3: Các gói và chi phí API

8 phút đọc2026-07-25
Giá Kimi K3

Kimi K3 là model mã nguồn mở đầu tiên trên thế giới thuộc lớp 3T, một flagship với 2,8T tham số được xây dựng để đạt trí tuệ hàng đầu trong lập trình dài hạn, công việc tri thức và suy luận, với khả năng nhìn (vision) gốc và cửa sổ ngữ cảnh 1M token. Model này có sẵn trên Kimi.com, Kimi Work, Kimi Code và Kimi API. Dưới đây là tổng quan về các gói thành viên Kimi và giá API của Kimi K3 để giúp bạn chọn cách truy cập phù hợp.

Gói thành viên Kimi K3 & các cấp sử dụng

Cách dễ nhất để sử dụng Kimi K3 là thông qua một gói thành viên Kimi. Kimi cung cấp các gói theo cấp bậc phù hợp với nhu cầu của bạn, từ sử dụng hàng ngày thông thường đến các quy trình làm việc agentic chuyên sâu. Các cấp cao hơn sẽ mở khóa thêm agent credit, khả năng xử lý đồng thời cao hơn và dung lượng chat siêu dài lên tới 1M token, được vận hành bởi Kimi K3.

AdagioModeratoAllegrettoAllegroVivace
Thanh toán hàng năm (quy đổi theo tháng)0 $/tháng15 $/tháng31 $/tháng79 $/tháng159 $/tháng
Tác vụ đồng thời của Agent1 tác vụ2 tác vụ2 tác vụ4 tác vụ4 tác vụ
Hàng đợi ưu tiên Agent×Tốc độ 4×Tốc độ 4×Tốc độ 4×Tốc độ 4×
Dung lượng trò chuyện siêu dài K3 (Lên đến 1M Token)×××
Bảng điều khiển tùy chỉnh
Tác vụ theo lịch2 tác vụ10 tác vụ15 tác vụ20 tác vụ25 tác vụ
Tác vụ Widget2 tác vụ10 tác vụ15 tác vụ20 tác vụ25 tác vụ
PluginHỗ trợ hơn 15 loạiHỗ trợ hơn 15 loạiHỗ trợ hơn 15 loạiHỗ trợ hơn 15 loạiHỗ trợ hơn 15 loại
Swarm×
Swarm chạy tác vụ con×2 subagent4 subagent8 subagent8 subagent
Bộ nhớ Dream×
Kỹ năng tự tiến hóa×
Mục tiêu××
Kimi Claw (Web, Android, PC)××
Trò chuyện nhóm với Claw××10 nhóm chat10 nhóm chat10 nhóm chat
Triển khai một trang web có cơ sở dữ liệu×

Tất cả mức giá trên áp dụng cho hình thức thanh toán theo năm. Thanh toán theo tháng cũng có sẵn với mức $19, $39, $99 và $199 mỗi tháng tương ứng. Allegro và Vivace mở khóa dung lượng chat siêu dài của K3, hỗ trợ ngữ cảnh lên tới 1M token cho các cuộc trò chuyện siêu dài, codebase lớn và nghiên cứu nhiều tài liệu. Để biết thông tin chi tiết mới nhất về các gói, xem trang thành viên chính thức.

Giá API của Kimi K3

Giá API của Kimi K3 sử dụng mô hình tính phí theo token, với mức sử dụng được tính phí trên mỗi 1M token (1.000.000 token) cho cả xử lý đầu vào và đầu ra, giúp kiểm soát chi phí rõ ràng và dễ dự đoán.

ModelĐơn vịGiá đầu vào (Cache Hit)Giá đầu vào (Cache Miss)Giá đầu raCửa sổ ngữ cảnh
kimi-k31M token$0.30$3.00$15.001.048.576 token

Kimi K3 là model flagship của Kimi dành cho lập trình dài hạn và công việc tri thức toàn diện. Model này luôn thực hiện suy luận, với mức độ suy luận được thiết lập thông qua trường reasoning_effort ở cấp cao nhất. Model hỗ trợ cache ngữ cảnh tự động, gọi công cụ (tool calls), chế độ JSON, đầu ra có cấu trúc và cửa sổ ngữ cảnh đầy đủ 1M token trong một yêu cầu duy nhất.

Cách tính phí API của Kimi K3

Kimi K3 API sử dụng mô hình định giá theo token cho mỗi yêu cầu, trong đó mọi tương tác với model sẽ tiêu hao token và được tính phí theo từng loại. Trong mô hình này, token thường được chia thành ba loại: token đầu vào, token đầu vào được lưu cache, và token đầu ra.

Token đầu vào

Token đầu vào đại diện cho mọi thứ được gửi đến model, bao gồm:

  • Prompt của người dùng

  • Chỉ dẫn hệ thống

  • Lịch sử hội thoại hoặc ngữ cảnh Những token này quyết định lượng ngữ cảnh mà model cần xử lý trước khi tạo ra phản hồi. Với cửa sổ ngữ cảnh 1 triệu token, Kimi K3 có thể tiếp nhận toàn bộ codebase, tài liệu dài và lịch sử hội thoại nhiều lượt trong một yêu cầu duy nhất.

Token đầu vào được lưu cache

Token đầu vào được lưu cache xuất hiện khi ngữ cảnh đã xử lý trước đó được sử dụng lại.

  • Nếu ngữ cảnh giống hoặc tương tự được dùng lại, mức phí sẽ là 0,30 USD cho mỗi 1 triệu token thay vì 3,00 USD, giảm 90%

  • Điều này giúp cải thiện đáng kể hiệu quả cho các quy trình làm việc lặp lại

  • Cách này đặc biệt hữu ích trong các ứng dụng ngữ cảnh dài và tương tác nhiều lượt, nơi ngữ cảnh chung có dung lượng lớn được gửi lại nhiều lần

Token đầu ra

Token đầu ra được model tạo ra để phản hồi một yêu cầu. Chúng đại diện cho nội dung do AI tạo ra trên thực tế, chẳng hạn như:

  • Phản hồi văn bản

  • Tạo mã

  • Đầu ra có cấu trúc Vì việc tạo đầu ra đòi hỏi thêm tính toán, nên loại token này thường được định giá cao hơn token đầu vào.

Kết luận

Kimi K3 mang đến mức giá linh hoạt cho cả người dùng thông thường và nhà phát triển: các gói thành viên cho trải nghiệm Kimi đầy đủ, và API tính phí theo token với cơ chế lưu cache ngữ cảnh tự động giúp giảm 90% chi phí đầu vào. Hãy chọn phương án phù hợp với quy trình làm việc của bạn và bắt đầu với Kimi K3 ngay hôm nay.

Câu hỏi thường gặp

Giá API của Kimi K3 được tính như thế nào?
Giá API của Kimi K3 được tính dựa trên lượng token sử dụng, tính phí theo mỗi 1M token (1.000.000 token). Token đầu vào được tính $3,00 cho mỗi 1M token khi cache miss, hoặc $0,30 cho mỗi 1M token khi cache hit. Token đầu ra được tính $15,00 cho mỗi 1M token. Tất cả mức giá trên chưa bao gồm thuế áp dụng, khoản thuế này sẽ được tính khi thanh toán dựa trên khu vực thanh toán của bạn.
Tôi có thể tiết kiệm được bao nhiêu nhờ tính năng cache ngữ cảnh?
Khi ngữ cảnh đã xử lý trước đó được tái sử dụng, các token đầu vào được cache sẽ được tính phí $0,30 cho mỗi 1M token thay vì $3,00, giảm 90% chi phí đầu vào. Điều này đặc biệt hữu ích trong các ứng dụng ngữ cảnh dài và tương tác nhiều lượt, khi cùng một ngữ cảnh được gửi lặp đi lặp lại.
Tôi nên dùng API hay gói thành viên Kimi?
Hãy sử dụng gói thành viên Kimi nếu bạn muốn truy cập trực tiếp Kimi K3 trong không gian làm việc Kimi, bao gồm cả khả năng agent và dung lượng chat siêu dài. Hãy sử dụng API nếu bạn đang xây dựng công cụ, agent hoặc ứng dụng sản xuất tùy chỉnh cần truy cập theo chương trình và khả năng kiểm soát chi tiết mức tiêu thụ token.
Kimi K3 hỗ trợ tối đa bao nhiêu token cho mỗi yêu cầu?
Kimi K3 hỗ trợ cửa sổ ngữ cảnh lên tới 1M token (1.048.576 token), cho phép xử lý toàn bộ codebase, tài liệu dài và các tác vụ agentic đa bước phức tạp chỉ trong một yêu cầu duy nhất.
Những gói thành viên nào bao gồm dung lượng chat siêu dài của K3?
Các gói Allegro và Vivace mở khóa dung lượng chat siêu dài của K3, hỗ trợ các cuộc trò chuyện với ngữ cảnh lên tới 1M token. Tất cả các tính năng thành viên khác, chẳng hạn như tác vụ agent và Swarm, đều được mở rộng theo từng cấp gói như thể hiện trong bảng so sánh gói.
Có thể bạn cũng sẽ thích
Kimi Work Dashboard: Dashboard và Widget AI cá nhân hóa
Kimi Work Dashboard: Dashboard và Widget AI cá nhân hóa
2026-07-23
Kimi Code: Agent lập trình AI thế hệ mới cho Terminal & IDE
Kimi Code: Agent lập trình AI thế hệ mới cho Terminal & IDE
2026-07-22
Kimi Claw: Triển khai OpenClaw Cloud bằng 1 cú nhấp & AI Agent 24/7
Kimi Claw: Triển khai OpenClaw Cloud bằng 1 cú nhấp & AI Agent 24/7
2026-07-22
Giải thích hệ thống đa agent: khái niệm, lợi ích và ứng dụng
Giải thích hệ thống đa agent: khái niệm, lợi ích và ứng dụng
2026-07-22
Giải thích Tác tử Song song: Kiến trúc, Mẫu thiết kế và Ứng dụng
Giải thích Tác tử Song song: Kiến trúc, Mẫu thiết kế và Ứng dụng
2026-07-22