Precios de Kimi K3 explicados: planes y costos de la API

8 min. de lectura2026-08-12
Precios de Kimi K3

Kimi K3 es el primer modelo abierto de clase 3T del mundo, un modelo insignia de 2.8T de parámetros diseñado para ofrecer inteligencia de vanguardia en programación de largo alcance, trabajo de conocimiento y razonamiento, con visión nativa y una ventana de contexto de 1M de tokens. Está disponible en Kimi.com, Kimi Work, Kimi Code y la Kimi API. A continuación encontrarás un resumen de los planes de membresía de Kimi y los precios de la API de Kimi K3 para ayudarte a elegir la mejor forma de acceder a él.

Planes de membresía y niveles de uso de Kimi K3

La forma más sencilla de usar Kimi K3 es mediante una membresía de Kimi. Kimi ofrece planes por niveles que se adaptan a tus necesidades, desde el uso diario casual hasta flujos de trabajo agénticos intensivos. Los niveles superiores desbloquean más créditos de agente, mayor concurrencia y capacidad de chat extralargo de hasta 1M de tokens impulsada por Kimi K3.

ModeratoAllegrettoAllegroVivace
Facturación anual (equivalente mensual)$15 / mes$31 / mes$79 / mes$159 / mes
Tareas simultáneas del agent2 tareas2 tareas4 tareas4 tareas
Cola de prioridad del agent4× velocidad4× velocidad4× velocidad4× velocidad
Capacidad de chat extralargo K3 (hasta 1M de tokens)××
Panel personalizable
Tareas programadas10 tareas15 tareas20 tareas25 tareas
Tarea de widget10 tareas15 tareas20 tareas25 tareas
ComplementosMás de 15 tipos compatiblesMás de 15 tipos compatiblesMás de 15 tipos compatiblesMás de 15 tipos compatibles
Swarm
Subtareas ejecutadas por swarm2 subagentes4 subagentes8 subagentes8 subagentes
Memoria de sueños
Habilidad autoevolutiva
Objetivo×
Kimi Claw (Web, Android, PC)×
Chat grupal con Claw×10 chats grupales10 chats grupales10 chats grupales
Implementar un sitio web con base de datos

Todos los precios anteriores corresponden a facturación anual. También hay facturación mensual disponible a $19, $39, 99 y \199 por mes, respectivamente. Allegro y Vivace desbloquean la capacidad de chat extralargo de K3, que admite hasta 1M de tokens de contexto para conversaciones muy extensas, bases de código grandes e investigación con muchos documentos. Para conocer los detalles más recientes de los planes, consulta la página oficial de membresía.

Precios de la API de Kimi K3

Los precios de la API de Kimi K3 usan un modelo basado en tokens, con facturación por cada 1M de tokens (1,000,000 de tokens) tanto para el procesamiento de entrada como de salida, lo que permite un control de costos claro y predecible.

ModeloUnidadPrecio de entrada (acierto de caché)Precio de entrada (fallo de caché)Precio de salidaVentana de contexto
kimi-k31M de tokens$0.30$3.00$15.001,048,576 tokens

Kimi K3 es el modelo insignia de Kimi para programación de largo alcance y trabajo de conocimiento de extremo a extremo. Siempre razona, y el esfuerzo de razonamiento se define mediante el campo de nivel superior reasoning_effort. El modelo admite almacenamiento en caché de contexto automático, llamadas a herramientas, modo JSON, salidas estructuradas y una ventana de contexto completa de 1M de tokens en una sola solicitud.

Cómo funciona la facturación de la API de Kimi K3

La API de Kimi K3 usa un modelo de precios basado en tokens para cada solicitud, donde cada interacción con el modelo consume tokens que se facturan según su tipo. Dentro de este modelo, los tokens se clasifican generalmente en tres tipos: tokens de entrada, tokens de entrada en caché y tokens de salida.

Tokens de entrada

Los tokens de entrada representan todo lo que se envía al modelo, incluidos:

  • Prompts del usuario

  • Instrucciones del sistema

  • Historial de conversación o contexto Estos tokens determinan cuánto contexto necesita procesar el modelo antes de generar una respuesta. Con una ventana de contexto de 1M de tokens, Kimi K3 puede recibir bases de código completas, documentos extensos e historiales de múltiples turnos en una sola solicitud.

Tokens de entrada en caché

Los tokens de entrada en caché se producen cuando se reutiliza contexto ya procesado.

  • Si se reutiliza el mismo contexto o uno similar, se factura a $0.30 por 1M de tokens en lugar de $3.00, una reducción del 90%

  • Esto mejora significativamente la eficiencia en flujos de trabajo repetitivos

  • Es especialmente útil en aplicaciones de contexto extenso e interacciones de múltiples turnos, donde se envía repetidamente un contexto compartido de gran tamaño

Tokens de salida

Los tokens de salida son generados por el modelo en respuesta a una solicitud. Representan el contenido generado por la IA, como:

  • Respuestas de texto

  • Generación de código

  • Salidas estructuradas Como la generación de salida requiere cómputo adicional, suele tener un precio más alto que los tokens de entrada.

Conclusión

Kimi K3 ofrece precios flexibles tanto para usuarios comunes como para desarrolladores: planes de membresía para la experiencia completa de Kimi y una API basada en tokens con almacenamiento en caché de contexto automático que reduce los costos de entrada en un 90%. Elige la opción que se ajuste a tu flujo de trabajo y comienza hoy mismo con Kimi K3.

Preguntas frecuentes

¿Cómo se calcula el precio de la API de Kimi K3?
El precio de la API de Kimi K3 se calcula según el uso de tokens, facturado por cada 1M de tokens (1,000,000 tokens). Los tokens de entrada se facturan a $3.00 por 1M de tokens en caso de fallo de caché, o $0.30 por 1M de tokens en caso de acierto de caché. Los tokens de salida se facturan a $15.00 por 1M de tokens. Todos los precios no incluyen los impuestos aplicables, que se calculan al finalizar la compra según tu región de facturación.
¿Cuánto puedo ahorrar con el almacenamiento en caché de contexto?
Cuando se reutiliza contexto procesado previamente, los tokens de entrada en caché se facturan a $0.30 por 1M de tokens en lugar de $3.00, es decir, una reducción del 90% en los costos de entrada. Esto es especialmente útil en aplicaciones con contexto largo e interacciones de varios turnos donde se envía el mismo contexto de forma repetida.
¿Debería usar la API o un plan de membresía de Kimi?
Usa un plan de membresía de Kimi si quieres acceder a Kimi K3 directamente en el espacio de trabajo de Kimi, con capacidades de agente y capacidad de chat extralargo incluidas. Usa la API si estás construyendo herramientas personalizadas, agentes o aplicaciones de producción que requieren acceso programático y control detallado sobre el consumo de tokens.
¿Cuántos tokens admite Kimi K3 por solicitud?
Kimi K3 admite una ventana de contexto de 1M de tokens (1,048,576 tokens), lo que le permite manejar bases de código completas, documentos largos y tareas agentivas complejas de varios pasos dentro de una sola solicitud.
¿Qué planes de membresía incluyen la capacidad de chat extralargo de K3?
Los planes Allegro y Vivace desbloquean la capacidad de chat extralargo de K3, que admite conversaciones con hasta 1M de tokens de contexto. El resto de las funciones de membresía, como las tareas de agente y Swarm, escalan según el nivel, tal como se muestra en la tabla comparativa de planes.
También le puede interesar
Kimi Work Dashboard: dashboard y widgets de IA personalizados
Kimi Work Dashboard: dashboard y widgets de IA personalizados
2026-08-17
Kimi Work: el agente de IA local para tu escritorio
Kimi Work: el agente de IA local para tu escritorio
2026-08-12
Kimi Code: agente de código de IA de nueva generación para terminal e IDE
Kimi Code: agente de código de IA de nueva generación para terminal e IDE
2026-08-12
Kimi Claw: implementación de OpenClaw Cloud con 1 clic y agent de IA 24/7
Kimi Claw: implementación de OpenClaw Cloud con 1 clic y agent de IA 24/7
2026-08-12
Sistema multiagente explicado: qué es, beneficios y usos
Sistema multiagente explicado: qué es, beneficios y usos
2026-08-12