Kimi K2.6 est un modèle open source doté de capacités de pointe en codage, en exécution sur longue durée et en agent swarm. Vous trouverez ci-dessous un aperçu de la tarification de Kimi API et des formules d'abonnement Kimi.
Aperçu de la tarification de l'API Kimi K2.6
La tarification de l'API Kimi K2.6 repose sur un modèle fondé sur les tokens : l'utilisation est facturée par 1M tokens (1 000 000 tokens), pour le traitement des entrées comme des sorties, afin d'offrir un contrôle des coûts clair et prévisible.
| Modèle | Unité | Prix d'entrée (cache atteint) | Prix d'entrée (cache manqué) | Prix de sortie | Fenêtre de contexte |
|---|---|---|---|---|---|
| kimi-k2.6 | 1M tokens | $0.16 | $0.95 | $4.00 | 262,144 tokens |
Modèle tarifaire de l'API Kimi K2.6
L'API Kimi K2.6 utilise un modèle de tarification fondé sur les tokens pour chaque requête : toute interaction avec le modèle consomme des tokens, facturés selon leur type. Dans ce modèle, les tokens sont généralement classés en trois catégories : tokens d'entrée, tokens de sortie et tokens d'entrée mis en cache.
Tokens d'entrée
Les tokens d'entrée correspondent à tout ce qui est envoyé au modèle, notamment :
Prompts utilisateur
Instructions système
Historique ou contexte de conversation
Ces tokens déterminent la quantité de contexte que le modèle doit traiter avant de générer une réponse.
Tokens de sortie
Les tokens de sortie sont générés par le modèle en réponse à une requête. Ils correspondent au contenu réellement généré par l'IA, par exemple :
Réponses textuelles
Génération de code
Sorties structurées
La génération de sortie nécessitant des calculs supplémentaires, elle est généralement facturée plus cher que les tokens d'entrée.
Tokens d'entrée mis en cache
Les tokens d'entrée mis en cache apparaissent lorsqu'un contexte déjà traité est réutilisé.
Si un contexte identique ou similaire est réutilisé, il peut être servi à coût réduit
Cela améliore nettement l'efficacité des workflows répétitifs
C'est particulièrement utile dans les applications à long contexte ou les interactions à plusieurs tours
Notes tarifaires de l'API Kimi K2.6
La tarification de l'API Kimi K2.6 suit un modèle transparent fondé sur la consommation ; quelques points importants ci-dessous aident les développeurs à mieux comprendre la facturation et le comportement des coûts.
Politique fiscale et de facturation
Tous les prix indiqués pour la tarification de l'API Kimi K2.6 s'entendent hors taxes applicables. Les taxes sont calculées automatiquement au moment du paiement selon la région de facturation de l'utilisateur et les exigences fiscales locales, afin de garantir une facturation exacte et conforme pour chaque commande.
Explication de l'utilisation des tokens
Pour rendre la tarification de l'API Kimi K2.6 plus facile à comprendre, la facturation s'appuie sur une unité de référence cohérente pour les tokens :
1M tokens = 1,000,000 tokens
Les tokens d'entrée comprennent les prompts et les informations contextuelles
Les tokens de sortie correspondent aux réponses générées par le modèle
Cette structure garantit une estimation des coûts transparente et prévisible pour toutes les requêtes Kimi API.
Optimisation des coûts par le cache
Kimi K2.6 intègre également un mécanisme de cache qui aide à optimiser les coûts d'utilisation. Lorsque vous travaillez avec des entrées répétées ou similaires, les tokens d'entrée mis en cache sont facturés à un tarif réduit, ce qui contribue à diminuer la consommation globale dans le modèle tarifaire de Kimi API.
Les tokens d'entrée mis en cache sont facturés à un tarif réduit
La réutilisation du contexte réduit la consommation totale de tokens
Améliore l'efficacité des longues sessions et des workflows répétitifs
La tarification de l'API Kimi K2.6 devient ainsi plus rentable pour les scénarios de production où les prompts ou contextes sont fréquemment réutilisés.
Bien qu'il n'existe pas d'offre gratuite permanente de Kimi API pour les usages en production, le modèle tarifaire est conçu pour rester flexible et évolutif, permettant aux développeurs de maîtriser les coûts selon la consommation réelle de tokens.
Formules tarifaires et niveaux d'utilisation de Kimi K2.6
En plus de la tarification à l'usage via l'API, Kimi propose des formules d'abonnement par niveaux qui évoluent avec vos besoins, afin de choisir facilement le niveau adapté à votre workflow. Ces formules permettent aux utilisateurs de sélectionner le palier le plus approprié selon leurs besoins quotidiens et leurs exigences de montée en charge. Pour connaître les derniers détails des formules, consultez la page d'abonnement officielle.
| Fonctionnalité | Adagio | Moderato | Allegretto | Allegro | Vivace |
|---|---|---|---|---|---|
| Facturation annuelle (mensualité effective) | $0 / mois | $15 / mois | $31 / mois | $79 / mois | $159 / mois |
| Tâches simultanées | 1 tâche | 2 tâches | 2 tâches | 4 tâches | 4 tâches |
| File prioritaire Agent | × | Vitesse 4× | Vitesse 4× | Vitesse 4× | Vitesse 4× |
| Agent Swarm | × | ✓ | ✓ | ✓ | ✓ |
| Sous-agents simultanés | × | 2 sous-agents | 4 sous-agents | 8 sous-agents | 8 sous-agents |
| Kimi Claw | × | × | ✓ | ✓ | ✓ |
| Kimi Claw (Web, Android, PC) | × | × | ✓ | ✓ | ✓ |
| Discussion de groupe avec Claw | × | × | 10 discussions | 10 discussions | 10 discussions |
| Déployer un site web avec base de données | × | ✓ | ✓ | ✓ | ✓ |
Conclusion
Kimi K2.6 propose une tarification flexible, adaptée aussi bien aux développeurs qu'aux utilisateurs du quotidien. La tarification de l'API fondée sur les tokens garantit des coûts transparents et prévisibles, avec la prise en charge du cache pour réduire les dépenses dans les workflows à fort volume ou à long contexte. Pour ceux qui préfèrent un accès structuré, les formules d'abonnement par niveaux vont de l'usage gratuit à l'usage professionnel, avec des capacités d'agent, des tâches simultanées et des outils comme Kimi Claw et Agent Swarm. Que vous intégriez Kimi via API ou que vous exploriez l'ensemble de ses fonctionnalités, il existe une formule pensée pour votre workflow et votre budget.