Kimi K3 es el primer modelo abierto de clase 3T del mundo, un modelo insignia de 2.8T de parámetros diseñado para ofrecer inteligencia de vanguardia en programación de largo alcance, trabajo de conocimiento y razonamiento, con visión nativa y una ventana de contexto de 1M de tokens. Está disponible en Kimi.com, Kimi Work, Kimi Code y la Kimi API. A continuación encontrarás un resumen de los planes de membresía de Kimi y los precios de la API de Kimi K3 para ayudarte a elegir la mejor forma de acceder a él.
Planes de membresía y niveles de uso de Kimi K3
La forma más sencilla de usar Kimi K3 es mediante una membresía de Kimi. Kimi ofrece planes por niveles que se adaptan a tus necesidades, desde el uso diario casual hasta flujos de trabajo agénticos intensivos. Los niveles superiores desbloquean más créditos de agente, mayor concurrencia y capacidad de chat extralargo de hasta 1M de tokens impulsada por Kimi K3.
| Moderato | Allegretto | Allegro | Vivace | |
|---|---|---|---|---|
| Facturación anual (equivalente mensual) | $15 / mes | $31 / mes | $79 / mes | $159 / mes |
| Tareas simultáneas del agent | 2 tareas | 2 tareas | 4 tareas | 4 tareas |
| Cola de prioridad del agent | 4× velocidad | 4× velocidad | 4× velocidad | 4× velocidad |
| Capacidad de chat extralargo K3 (hasta 1M de tokens) | × | × | ✓ | ✓ |
| Panel personalizable | ✓ | ✓ | ✓ | ✓ |
| Tareas programadas | 10 tareas | 15 tareas | 20 tareas | 25 tareas |
| Tarea de widget | 10 tareas | 15 tareas | 20 tareas | 25 tareas |
| Complementos | Más de 15 tipos compatibles | Más de 15 tipos compatibles | Más de 15 tipos compatibles | Más de 15 tipos compatibles |
| Swarm | ✓ | ✓ | ✓ | ✓ |
| Subtareas ejecutadas por swarm | 2 subagentes | 4 subagentes | 8 subagentes | 8 subagentes |
| Memoria de sueños | ✓ | ✓ | ✓ | ✓ |
| Habilidad autoevolutiva | ✓ | ✓ | ✓ | ✓ |
| Objetivo | × | ✓ | ✓ | ✓ |
| Kimi Claw (Web, Android, PC) | × | ✓ | ✓ | ✓ |
| Chat grupal con Claw | × | 10 chats grupales | 10 chats grupales | 10 chats grupales |
| Implementar un sitio web con base de datos | ✓ | ✓ | ✓ | ✓ |
Todos los precios anteriores corresponden a facturación anual. También hay facturación mensual disponible a $19, $39, 99 y \199 por mes, respectivamente. Allegro y Vivace desbloquean la capacidad de chat extralargo de K3, que admite hasta 1M de tokens de contexto para conversaciones muy extensas, bases de código grandes e investigación con muchos documentos. Para conocer los detalles más recientes de los planes, consulta la página oficial de membresía.
Precios de la API de Kimi K3
Los precios de la API de Kimi K3 usan un modelo basado en tokens, con facturación por cada 1M de tokens (1,000,000 de tokens) tanto para el procesamiento de entrada como de salida, lo que permite un control de costos claro y predecible.
| Modelo | Unidad | Precio de entrada (acierto de caché) | Precio de entrada (fallo de caché) | Precio de salida | Ventana de contexto |
|---|---|---|---|---|---|
| kimi-k3 | 1M de tokens | $0.30 | $3.00 | $15.00 | 1,048,576 tokens |
Kimi K3 es el modelo insignia de Kimi para programación de largo alcance y trabajo de conocimiento de extremo a extremo. Siempre razona, y el esfuerzo de razonamiento se define mediante el campo de nivel superior reasoning_effort. El modelo admite almacenamiento en caché de contexto automático, llamadas a herramientas, modo JSON, salidas estructuradas y una ventana de contexto completa de 1M de tokens en una sola solicitud.
Cómo funciona la facturación de la API de Kimi K3
La API de Kimi K3 usa un modelo de precios basado en tokens para cada solicitud, donde cada interacción con el modelo consume tokens que se facturan según su tipo. Dentro de este modelo, los tokens se clasifican generalmente en tres tipos: tokens de entrada, tokens de entrada en caché y tokens de salida.
Tokens de entrada
Los tokens de entrada representan todo lo que se envía al modelo, incluidos:
Prompts del usuario
Instrucciones del sistema
Historial de conversación o contexto Estos tokens determinan cuánto contexto necesita procesar el modelo antes de generar una respuesta. Con una ventana de contexto de 1M de tokens, Kimi K3 puede recibir bases de código completas, documentos extensos e historiales de múltiples turnos en una sola solicitud.
Tokens de entrada en caché
Los tokens de entrada en caché se producen cuando se reutiliza contexto ya procesado.
Si se reutiliza el mismo contexto o uno similar, se factura a $0.30 por 1M de tokens en lugar de $3.00, una reducción del 90%
Esto mejora significativamente la eficiencia en flujos de trabajo repetitivos
Es especialmente útil en aplicaciones de contexto extenso e interacciones de múltiples turnos, donde se envía repetidamente un contexto compartido de gran tamaño
Tokens de salida
Los tokens de salida son generados por el modelo en respuesta a una solicitud. Representan el contenido generado por la IA, como:
Respuestas de texto
Generación de código
Salidas estructuradas Como la generación de salida requiere cómputo adicional, suele tener un precio más alto que los tokens de entrada.
Conclusión
Kimi K3 ofrece precios flexibles tanto para usuarios comunes como para desarrolladores: planes de membresía para la experiencia completa de Kimi y una API basada en tokens con almacenamiento en caché de contexto automático que reduce los costos de entrada en un 90%. Elige la opción que se ajuste a tu flujo de trabajo y comienza hoy mismo con Kimi K3.