Preços do Kimi K3 Explicados: Planos e Custos de API

Tempo de leitura: 8 minutos2026-08-12
Preços do Kimi K3

O Kimi K3 é o primeiro modelo aberto do mundo na classe 3T, um modelo principal com 2,8T de parâmetros construído para inteligência de ponta em codificação de longo horizonte, trabalho de conhecimento e raciocínio, com visão nativa e uma janela de contexto de 1M de tokens. Ele está disponível no Kimi.com, no Kimi Work, no Kimi Code e na Kimi API. Abaixo, apresentamos uma visão geral dos planos de assinatura Kimi e dos preços da API do Kimi K3 para ajudar você a escolher a melhor forma de acessá-lo.

Planos de assinatura e níveis de uso do Kimi K3

A forma mais fácil de usar o Kimi K3 é por meio de uma assinatura Kimi. O Kimi oferece planos em níveis que se ajustam às suas necessidades, do uso casual diário a fluxos de trabalho agentic intensivos. Níveis mais altos liberam mais créditos de agent, maior concorrência e capacidade de chat extra-longo de até 1M de tokens, alimentada pelo Kimi K3.

ModeratoAllegrettoAllegroVivace
Cobrança Anual (Valor Mensal Efetivo)US$ 15 / mêsUS$ 31 / mêsUS$ 79 / mêsUS$ 159 / mês
Tarefas Simultâneas do Agent2 tarefas2 tarefas4 tarefas4 tarefas
Fila de Prioridade do AgentVelocidade 4×Velocidade 4×Velocidade 4×Velocidade 4×
Capacidade de Chat Extra Longo K3 (Até 1M de Tokens)××
Painel Personalizável
Tarefas Agendadas10 tarefas15 tarefas20 tarefas25 tarefas
Tarefa de Widget10 tarefas15 tarefas20 tarefas25 tarefas
PluginsMais de 15 tipos suportadosMais de 15 tipos suportadosMais de 15 tipos suportadosMais de 15 tipos suportados
Swarm
Subtarefas em Execução no Swarm2 subagentes4 subagentes8 subagentes8 subagentes
Memória de Sonho
Habilidade Autoevolutiva
Objetivo×
Kimi Claw (Web, Android, PC)×
Chat em Grupo com o Claw×10 chats em grupo10 chats em grupo10 chats em grupo
Implantar um Site com Banco de Dados

Todos os preços acima refletem a cobrança anual. A cobrança mensal também está disponível por $19, $39, $99 e $199 por mês, respectivamente. Allegro e Vivace liberam a capacidade de chat extra-longo do K3, com suporte a até 1M de tokens de contexto para conversas extremamente longas, bases de código grandes e pesquisas com muitos documentos. Para os detalhes mais recentes sobre os planos, consulte a página oficial de assinatura.

Preços da API do Kimi K3

Os preços da API do Kimi K3 usam um modelo baseado em tokens, com cobrança por 1M de tokens (1.000.000 de tokens) tanto para processamento de entrada quanto de saída, permitindo um controle de custos claro e previsível.

ModeloUnidadePreço de Entrada (Acerto de Cache)Preço de Entrada (Erro de Cache)Preço de SaídaJanela de Contexto
kimi-k31M de tokens$0.30$3.00$15.001.048.576 tokens

O Kimi K3 é o modelo principal da Kimi para codificação de longo horizonte e trabalho de conhecimento de ponta a ponta. Ele sempre raciocina, com o esforço de raciocínio definido pelo campo de nível superior reasoning_effort. O modelo suporta cache automático de contexto, chamadas de ferramentas, modo JSON, saídas estruturadas e uma janela de contexto completa de 1M de tokens em uma única requisição.

Como funciona a cobrança da API do Kimi K3

A API do Kimi K3 usa um modelo de preços baseado em tokens para cada requisição, em que cada interação com o modelo consome tokens que são cobrados de acordo com o tipo. Nesse modelo, os tokens geralmente são categorizados em três tipos: tokens de entrada, tokens de entrada em cache e tokens de saída.

Tokens de entrada

Os tokens de entrada representam tudo o que é enviado ao modelo, incluindo:

  • Prompts do usuário

  • Instruções do sistema

  • Histórico de conversa ou contexto Esses tokens determinam quanto contexto o modelo precisa processar antes de gerar uma resposta. Com uma janela de contexto de 1M de tokens, o Kimi K3 pode receber bases de código completas, documentos longos e históricos estendidos de múltiplas interações em uma única requisição.

Tokens de entrada em cache

Os tokens de entrada em cache ocorrem quando um contexto processado anteriormente é reutilizado.

  • Se o mesmo contexto, ou um similar, for reutilizado, ele é cobrado a $0,30 por 1M de tokens em vez de $3,00, uma redução de 90%

  • Isso melhora significativamente a eficiência em fluxos de trabalho repetitivos

  • É especialmente útil em aplicações de contexto longo e interações de múltiplas rodadas, nas quais um grande contexto compartilhado é enviado repetidamente

Tokens de saída

Os tokens de saída são gerados pelo modelo em resposta a uma requisição. Eles representam o conteúdo efetivamente gerado pela IA, como:

  • Respostas em texto

  • Geração de código

  • Saídas estruturadas Como a geração de saída exige computação adicional, seu preço costuma ser mais alto do que o dos tokens de entrada.

Conclusão

O Kimi K3 oferece preços flexíveis tanto para usuários do dia a dia quanto para desenvolvedores: planos de assinatura para a experiência completa do Kimi e uma API baseada em tokens com cache automático de contexto que reduz os custos de entrada em 90%. Escolha o caminho que se encaixa no seu fluxo de trabalho e comece com o Kimi K3 hoje mesmo.

Perguntas frequentes

Como é calculado o preço da API do Kimi K3?
O preço da API do Kimi K3 é calculado com base no uso de tokens, cobrado por 1M de tokens (1.000.000 de tokens). Os tokens de entrada são cobrados a $3,00 por 1M de tokens em caso de erro de cache, ou $0,30 por 1M de tokens em caso de acerto de cache. Os tokens de saída são cobrados a $15,00 por 1M de tokens. Todos os preços excluem impostos aplicáveis, que são calculados no checkout com base na sua região de cobrança.
Quanto posso economizar com o cache de contexto?
Quando o contexto processado anteriormente é reutilizado, os tokens de entrada em cache são cobrados a $0,30 por 1M de tokens em vez de $3,00, uma redução de 90% nos custos de entrada. Isso é especialmente útil em aplicações de contexto longo e interações de múltiplos turnos em que o mesmo contexto é enviado repetidamente.
Devo usar a API ou um plano de assinatura Kimi?
Use um plano de assinatura Kimi se quiser acessar o Kimi K3 diretamente no ambiente de trabalho do Kimi, com recursos de agente e capacidade de chat extra longo incluídos. Use a API se estiver criando ferramentas personalizadas, agentes ou aplicações em produção que exijam acesso programático e controle refinado sobre o consumo de tokens.
Quantos tokens o Kimi K3 suporta por requisição?
O Kimi K3 suporta uma janela de contexto de 1M de tokens (1.048.576 tokens), permitindo lidar com bases de código inteiras, documentos longos e tarefas agênticas complexas de múltiplas etapas em uma única solicitação.
Quais planos de assinatura incluem a capacidade de chat extra-longo do K3?
Os planos Allegro e Vivace liberam a capacidade de chat extra-longo do K3, com suporte a conversas de até 1M de tokens de contexto. Todos os outros recursos de assinatura, como tarefas de agent e Swarm, escalam entre os níveis conforme mostrado na tabela comparativa de planos.
Você também pode gostar
Kimi Work Dashboard: Dashboard e Widgets de IA Personalizados
Kimi Work Dashboard: Dashboard e Widgets de IA Personalizados
2026-08-17
Kimi Work: O Agente Local de IA para o Seu Desktop
Kimi Work: O Agente Local de IA para o Seu Desktop
2026-08-12
Kimi Code: Agente de Código com IA de Nova Geração para Terminal e IDE
Kimi Code: Agente de Código com IA de Nova Geração para Terminal e IDE
2026-08-12
Kimi Claw: implantação do OpenClaw Cloud com 1 clique e AI Agent 24/7
Kimi Claw: implantação do OpenClaw Cloud com 1 clique e AI Agent 24/7
2026-08-12
Sistema Multi-Agent explicado: o que é, benefícios e usos
Sistema Multi-Agent explicado: o que é, benefícios e usos
2026-08-12