O Kimi K3 é o primeiro modelo aberto do mundo na classe 3T, um modelo principal com 2,8T de parâmetros construído para inteligência de ponta em codificação de longo horizonte, trabalho de conhecimento e raciocínio, com visão nativa e uma janela de contexto de 1M de tokens. Ele está disponível no Kimi.com, no Kimi Work, no Kimi Code e na Kimi API. Abaixo, apresentamos uma visão geral dos planos de assinatura Kimi e dos preços da API do Kimi K3 para ajudar você a escolher a melhor forma de acessá-lo.
Planos de assinatura e níveis de uso do Kimi K3
A forma mais fácil de usar o Kimi K3 é por meio de uma assinatura Kimi. O Kimi oferece planos em níveis que se ajustam às suas necessidades, do uso casual diário a fluxos de trabalho agentic intensivos. Níveis mais altos liberam mais créditos de agent, maior concorrência e capacidade de chat extra-longo de até 1M de tokens, alimentada pelo Kimi K3.
| Moderato | Allegretto | Allegro | Vivace | |
|---|---|---|---|---|
| Cobrança Anual (Valor Mensal Efetivo) | US$ 15 / mês | US$ 31 / mês | US$ 79 / mês | US$ 159 / mês |
| Tarefas Simultâneas do Agent | 2 tarefas | 2 tarefas | 4 tarefas | 4 tarefas |
| Fila de Prioridade do Agent | Velocidade 4× | Velocidade 4× | Velocidade 4× | Velocidade 4× |
| Capacidade de Chat Extra Longo K3 (Até 1M de Tokens) | × | × | ✓ | ✓ |
| Painel Personalizável | ✓ | ✓ | ✓ | ✓ |
| Tarefas Agendadas | 10 tarefas | 15 tarefas | 20 tarefas | 25 tarefas |
| Tarefa de Widget | 10 tarefas | 15 tarefas | 20 tarefas | 25 tarefas |
| Plugins | Mais de 15 tipos suportados | Mais de 15 tipos suportados | Mais de 15 tipos suportados | Mais de 15 tipos suportados |
| Swarm | ✓ | ✓ | ✓ | ✓ |
| Subtarefas em Execução no Swarm | 2 subagentes | 4 subagentes | 8 subagentes | 8 subagentes |
| Memória de Sonho | ✓ | ✓ | ✓ | ✓ |
| Habilidade Autoevolutiva | ✓ | ✓ | ✓ | ✓ |
| Objetivo | × | ✓ | ✓ | ✓ |
| Kimi Claw (Web, Android, PC) | × | ✓ | ✓ | ✓ |
| Chat em Grupo com o Claw | × | 10 chats em grupo | 10 chats em grupo | 10 chats em grupo |
| Implantar um Site com Banco de Dados | ✓ | ✓ | ✓ | ✓ |
Todos os preços acima refletem a cobrança anual. A cobrança mensal também está disponível por $19, $39, $99 e $199 por mês, respectivamente. Allegro e Vivace liberam a capacidade de chat extra-longo do K3, com suporte a até 1M de tokens de contexto para conversas extremamente longas, bases de código grandes e pesquisas com muitos documentos. Para os detalhes mais recentes sobre os planos, consulte a página oficial de assinatura.
Preços da API do Kimi K3
Os preços da API do Kimi K3 usam um modelo baseado em tokens, com cobrança por 1M de tokens (1.000.000 de tokens) tanto para processamento de entrada quanto de saída, permitindo um controle de custos claro e previsível.
| Modelo | Unidade | Preço de Entrada (Acerto de Cache) | Preço de Entrada (Erro de Cache) | Preço de Saída | Janela de Contexto |
|---|---|---|---|---|---|
| kimi-k3 | 1M de tokens | $0.30 | $3.00 | $15.00 | 1.048.576 tokens |
O Kimi K3 é o modelo principal da Kimi para codificação de longo horizonte e trabalho de conhecimento de ponta a ponta. Ele sempre raciocina, com o esforço de raciocínio definido pelo campo de nível superior reasoning_effort. O modelo suporta cache automático de contexto, chamadas de ferramentas, modo JSON, saídas estruturadas e uma janela de contexto completa de 1M de tokens em uma única requisição.
Como funciona a cobrança da API do Kimi K3
A API do Kimi K3 usa um modelo de preços baseado em tokens para cada requisição, em que cada interação com o modelo consome tokens que são cobrados de acordo com o tipo. Nesse modelo, os tokens geralmente são categorizados em três tipos: tokens de entrada, tokens de entrada em cache e tokens de saída.
Tokens de entrada
Os tokens de entrada representam tudo o que é enviado ao modelo, incluindo:
Prompts do usuário
Instruções do sistema
Histórico de conversa ou contexto Esses tokens determinam quanto contexto o modelo precisa processar antes de gerar uma resposta. Com uma janela de contexto de 1M de tokens, o Kimi K3 pode receber bases de código completas, documentos longos e históricos estendidos de múltiplas interações em uma única requisição.
Tokens de entrada em cache
Os tokens de entrada em cache ocorrem quando um contexto processado anteriormente é reutilizado.
Se o mesmo contexto, ou um similar, for reutilizado, ele é cobrado a $0,30 por 1M de tokens em vez de $3,00, uma redução de 90%
Isso melhora significativamente a eficiência em fluxos de trabalho repetitivos
É especialmente útil em aplicações de contexto longo e interações de múltiplas rodadas, nas quais um grande contexto compartilhado é enviado repetidamente
Tokens de saída
Os tokens de saída são gerados pelo modelo em resposta a uma requisição. Eles representam o conteúdo efetivamente gerado pela IA, como:
Respostas em texto
Geração de código
Saídas estruturadas Como a geração de saída exige computação adicional, seu preço costuma ser mais alto do que o dos tokens de entrada.
Conclusão
O Kimi K3 oferece preços flexíveis tanto para usuários do dia a dia quanto para desenvolvedores: planos de assinatura para a experiência completa do Kimi e uma API baseada em tokens com cache automático de contexto que reduz os custos de entrada em 90%. Escolha o caminho que se encaixa no seu fluxo de trabalho e comece com o Kimi K3 hoje mesmo.