Kimi K2.6 es un modelo de código abierto con capacidades de vanguardia en programación, ejecución de largo horizonte y agent swarm. A continuación se presenta un resumen de los precios de Kimi API y los planes de membresía de Kimi.
Resumen de precios de Kimi K2.6 API
Los precios de Kimi K2.6 API usan un modelo basado en tokens, con uso facturado por cada 1 millón de tokens (1,000,000 tokens) tanto para el procesamiento de entrada como de salida, lo que permite un control de costos claro y predecible.
| Modelo | Unidad | Precio de entrada (acierto de caché) | Precio de entrada (fallo de caché) | Precio de salida | Ventana de contexto |
|---|---|---|---|---|---|
| kimi-k2.6 | 1M tokens | $0.16 | $0.95 | $4.00 | 262,144 tokens |
Modelo de precios de Kimi K2.6 API
Kimi K2.6 API utiliza un modelo de precios basado en tokens para cada solicitud, en el que cada interacción con el modelo consume tokens que se facturan según su tipo. En este modelo, los tokens suelen clasificarse en tres tipos: tokens de entrada, tokens de salida y tokens de entrada en caché.
Tokens de entrada
Los tokens de entrada representan todo lo que se envía al modelo, incluido:
Prompts del usuario
Instrucciones del sistema
Historial de conversación o contexto
Estos tokens determinan cuánto contexto necesita procesar el modelo antes de generar una respuesta.
Tokens de salida
Los tokens de salida son generados por el modelo en respuesta a una solicitud. Representan el contenido real generado por IA, como:
Respuestas de texto
Generación de código
Salidas estructuradas
Como generar la salida requiere cómputo adicional, por lo general tiene un precio más alto que los tokens de entrada.
Tokens de entrada en caché
Los tokens de entrada en caché se producen cuando se reutiliza contexto procesado previamente.
Si se reutiliza el mismo contexto o uno similar, puede procesarse a un costo reducido
Esto mejora significativamente la eficiencia en flujos de trabajo repetitivos
Resulta especialmente útil en aplicaciones de contexto largo o interacciones de varios turnos
Notas sobre precios de Kimi K2.6 API
Los precios de Kimi K2.6 API siguen un modelo transparente basado en consumo, con algunos detalles importantes que se describen a continuación para ayudar a los desarrolladores a entender mejor la facturación y el comportamiento de los costos.
Política de impuestos y facturación
Todos los precios indicados para Kimi K2.6 API excluyen los impuestos aplicables. Los impuestos se calculan automáticamente al finalizar la compra según la región de facturación del usuario y los requisitos fiscales locales, para garantizar una facturación precisa y conforme a la normativa en cada pedido.
Explicación del uso de tokens
Para que los precios de Kimi K2.6 API sean más fáciles de entender, la facturación se calcula con un estándar de tokens uniforme:
1M tokens = 1,000,000 tokens
Los tokens de entrada incluyen prompts e información contextual
Los tokens de salida representan las respuestas generadas por el modelo
Esta estructura garantiza una estimación de costos transparente y predecible en todas las solicitudes de Kimi API.
Eficiencia de costos basada en caché
Kimi K2.6 también incluye un mecanismo de caché que ayuda a optimizar los costos de uso. Al trabajar con entradas repetidas o similares, los tokens de entrada en caché se facturan a una tarifa reducida, lo que ayuda a disminuir el consumo total dentro del modelo de precios de Kimi API.
Los tokens de entrada en caché se facturan con descuento
Reutilizar contexto reduce el consumo total de tokens
Mejora la eficiencia en sesiones largas y flujos de trabajo repetitivos
Esto hace que los precios de Kimi K2.6 API sean más rentables para escenarios de producción donde los prompts o contextos se reutilizan con frecuencia.
Aunque no existe un nivel gratuito permanente de Kimi API para uso en producción, el modelo de precios está diseñado para mantenerse flexible y escalable, lo que permite a los desarrolladores controlar los costos según el consumo real de tokens.
Planes de precios y niveles de uso de Kimi K2.6
Además de los precios de uso basados en API, Kimi ofrece planes de membresía por niveles que se adaptan a tus necesidades, para que sea fácil elegir el nivel adecuado para tu flujo de trabajo. Estos planes permiten a los usuarios seleccionar el nivel más conveniente según sus necesidades de uso diario y requisitos de escala. Para conocer los detalles más recientes de los planes, consulta la página oficial de membresía.
| Función | Adagio | Moderato | Allegretto | Allegro | Vivace |
|---|---|---|---|---|---|
| Facturación anual (mensual efectivo) | $0 / mes | $15 / mes | $31 / mes | $79 / mes | $159 / mes |
| Tareas concurrentes | 1 tarea | 2 tareas | 2 tareas | 4 tareas | 4 tareas |
| Cola prioritaria de Agent | × | Velocidad 4× | Velocidad 4× | Velocidad 4× | Velocidad 4× |
| Agent Swarm | × | ✓ | ✓ | ✓ | ✓ |
| Subagentes concurrentes | × | 2 subagentes | 4 subagentes | 8 subagentes | 8 subagentes |
| Kimi Claw | × | × | ✓ | ✓ | ✓ |
| Kimi Claw (Web, Android, PC) | × | × | ✓ | ✓ | ✓ |
| Chat grupal con Claw | × | × | 10 chats | 10 chats | 10 chats |
| Implementar sitio web con base de datos | × | ✓ | ✓ | ✓ | ✓ |
Conclusión
Kimi K2.6 ofrece precios flexibles tanto para desarrolladores como para usuarios cotidianos. Los precios de API basados en tokens mantienen los costos transparentes y predecibles, con soporte de caché para reducir gastos en flujos de trabajo de alto volumen o de contexto largo. Para quienes prefieren un acceso estructurado, los planes de membresía por niveles escalan desde el uso gratuito hasta el profesional, e incluyen capacidades de Agent, tareas concurrentes y herramientas como Kimi Claw y Agent Swarm. Ya sea que integres mediante API o explores todo el conjunto de funciones de Kimi, hay un plan diseñado para ajustarse a tu flujo de trabajo y presupuesto.