Kimi est gratuit pour commencer, et c'est la façon la plus rapide de résumer la grille tarifaire de Moonshot AI. L'application Kimi vous offre un chat de base illimité, des téléchargements de fichiers et une recherche web avec un forfait Adagio à $0, tandis que les abonnements payants montent de $19 par mois à $199 par mois pour les usages intensifs en agents et en code. Si vous développez via l'API, vous payez à l'usage, et le modèle phare Kimi K3 coûte $3 par million de tokens en entrée et $15 par million de tokens en sortie.
Ce fossé entre une application de chat gratuite et une API développeur à la consommation, c'est tout le sujet des tarifs Kimi, et c'est ce qui perturbe la plupart des acheteurs. Ce guide détaille chaque niveau d'abonnement, la grille tarifaire complète par modèle pour l'API, les vraies limites du forfait gratuit, et comment le coût de Kimi se compare à Claude, GPT et DeepSeek. Tous les tarifs de l'API ont été revérifiés le 25 septembre 2026 dans la documentation développeur de Moonshot, et les forfaits de l'application sont les prix internationaux que Kimi facture en dollars américains.
Les points clés
- Offre gratuite permanente : le forfait Adagio est à $0 avec un chat de base illimité, mais seulement environ 6 crédits d'agent et sans Agent Swarm ni Kimi Code.
- Forfaits application : les abonnements payants sont à $19 (Moderato), $39 (Allegretto), $99 (Allegro) et $199 (Vivace) par mois.
- API phare : Kimi K3 est à $3 / $15 par million de tokens en entrée/sortie, avec un tarif d'entrée en cache à seulement $0.30.
- API économique : Kimi K2.6 coûte $0.95 / $4 par million de tokens, soit un peu plus du quart du tarif de sortie de K3.
- Moins cher que les modèles phares occidentaux, pas que tout : K3 est moins cher que Claude Opus 5.5 ($4 / $20) et GPT-6 Astra ($10 / $50), mais GPT-6.1 Sol d'OpenAI coûte désormais moins, $2 / $10, et obtient un meilleur score.
Combien coûte Kimi ? La réponse rapide
Kimi ne coûte rien à l'essai. L'application Kimi est gratuite avec le niveau Adagio, et les forfaits payants vont de $19 par mois à $199 par mois selon l'intensité de vos besoins en agents et en code. Sur l'API Moonshot, vous payez à l'usage plutôt qu'un forfait fixe : le modèle phare Kimi K3 coûte $3 par million en entrée et $15 par million en sortie, tandis que le modèle K2.6, moins cher, est à $0.95 / $4.
Le chiffre qui compte dépend de la façon dont vous utilisez Kimi. Les utilisateurs occasionnels qui chattent, téléchargent des documents et font des recherches web vivront surtout sur le forfait gratuit ou le forfait à $19. Les développeurs qui intègrent Kimi dans une application, un agent ou un outil de code s'intéressent au tarif par token, car c'est ce qui évolue avec l'usage. Le reste de ce guide couvre les deux aspects en détail.
Forfaits d'abonnement et tarifs d'adhésion Kimi
Moonshot nomme les cinq niveaux d'adhésion de Kimi d'après des tempos musicaux, du lent et gratuit Adagio au rapide et richement doté Vivace. Chaque forfait payant est disponible au mois ou à l'année sur la page officielle d'adhésion de Moonshot, et l'option annuelle permet d'économiser environ 20 % par rapport au tarif mensuel. La facturation annuelle sur le forfait supérieur vous fait économiser jusqu'à $480 par an. Une réserve avant d'établir votre budget : le 19 juillet 2026, Moonshot a suspendu les nouveaux abonnements, la demande pour K3 ayant poussé ses GPU au bord de leur capacité, et a annoncé rouvrir des places par vagues. Un forfait peut donc ne pas être ouvert aux nouvelles inscriptions au moment où vous consultez.
| Forfait | Mensuel | Annuel | Idéal pour |
|---|---|---|---|
| Adagio | Gratuit | Gratuit | Chat occasionnel et tests |
| Moderato | $19 | $180/an | Utilisateurs solo, usage agent léger |
| Allegretto | $39 | $372/an | Utilisateurs avancés, plus de code |
| Allegro | $99 | $948/an | Agents intensifs et Kimi Code |
| Vivace | $199 | $1 908/an | Équipes, concurrence maximale |
Adagio (gratuit)
Le forfait gratuit vous offre un chat de base illimité, des téléchargements de fichiers et un accès web en direct, ce qui couvre la plupart des questions du quotidien. Il inclut environ 6 crédits d'agent, une seule tâche simultanée et 200 appels professionnels à la base de données. Agent Swarm, Kimi Code et Kimi Claw sont verrouillés, donc l'automatisation sérieuse est hors de portée tant que vous ne passez pas à un forfait supérieur.
Moderato ($19/mois)
Le premier niveau payant est le point d'équilibre pour les utilisateurs solo qui veulent de vrais agents. Vous obtenez 60 crédits d'agent, deux tâches simultanées, une priorité de vitesse agent 4x et 25 exécutions d'Agent Swarm en bêta. Il ajoute également Kimi Code à 1x et porte vos appels à la base de données à 2 000.
Allegretto ($39/mois)
Allegretto cible les utilisateurs avancés qui s'appuient sur Kimi pour le code. Il vous passe à 150 crédits d'agent, 50 exécutions d'Agent Swarm avec quatre sous-tâches simultanées et Kimi Code à 5x. C'est aussi le premier niveau à inclure Kimi Claw, l'agent de contrôle du navigateur.
Allegro ($99/mois)
Allegro est le forfait pour les charges de travail intensives, avec 360 crédits d'agent, quatre tâches simultanées et 120 exécutions d'Agent Swarm. Kimi Code passe à 15x et les appels à la base de données atteignent 12 000. La plupart des développeurs indépendants qui font tourner des agents quotidiennement n'auront pas besoin de plus.
Vivace ($199/mois)
Vivace est le niveau supérieur, conçu pour les équipes et l'automatisation non-stop. Il offre 720 crédits d'agent, 240 exécutions d'Agent Swarm avec huit sous-tâches simultanées et Kimi Code à 30x. À $199 par mois, il reste bien en dessous du coût de sièges IA d'entreprise comparables ailleurs, ce qui est une grande partie de l'attrait de Kimi.
Kimi est-il gratuit ? Ce qu'inclut vraiment le niveau Adagio
Oui, Kimi est gratuit à utiliser, et cela n'a pas changé en 2026. Le niveau gratuit Adagio vous donne toujours un chat standard illimité, des téléchargements de documents et une navigation web, alimentés par un modèle capable plutôt que par une version allégée. Pour poser des questions, résumer des fichiers et faire des recherches générales, il est possible que vous n'ayez jamais besoin de payer un centime.
Le bémol est le travail agentique. Moonshot a resserré le niveau gratuit de sorte que les tâches autonomes en plusieurs étapes, Agent Swarm et Kimi Code soient réservés aux forfaits payants. Vous ne disposez que d'une poignée de crédits d'agent par période avec Adagio, ce qui convient pour un test rapide mais pas pour construire. Si vous voulez que Kimi mène de longues missions de recherche, contrôle un navigateur ou écrive et exécute du code, le forfait Moderato à $19 est le vrai point de départ. Vous pouvez lire le détail du modèle dans notre guide sur le modèle Kimi K2.6.
Tarification de l'API Kimi par million de tokens
Si vous êtes développeur, c'est sur l'API Moonshot que la tarification de Kimi devient intéressante. Vous ne payez que pour les tokens que vous envoyez et recevez, facturés par million, et les tarifs varient considérablement selon le modèle. Le modèle le plus récent et le plus puissant est le plus cher, tandis que les modèles de génération précédente restent bien moins onéreux. La mise en cache des prompts peut réduire drastiquement votre coût en entrée lorsque vous réutilisez le même contexte.
| Modèle | Entrée /1M | Sortie /1M | Cache hit | Contexte |
|---|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | $0.30 | 1M |
| Kimi K2.7 Code | $0.95 | $4.00 | $0.19 | 262K |
| Kimi K2.7 Code HighSpeed | $1.90 | $8.00 | $0.38 | 262K |
| Kimi K2.6 | $0.95 | $4.00 | $0.16 | 262K |
Tarification de Kimi K3
Le modèle phare Kimi K3 est un modèle de 2,8 billions de paramètres qui active 104 milliards de paramètres par token, avec une fenêtre de contexte de 1 million de tokens, et son prix reflète cette puissance : $3 en entrée et $15 en sortie par million de tokens. Le chiffre remarquable est le tarif d'entrée en cache à seulement $0.30, soit un dixième du tarif sans cache, ce qui récompense les charges de travail qui réutilisent de longs prompts système ou des documents. Les spécifications complètes et les benchmarks se trouvent dans notre analyse approfondie de Kimi K3.
Tarification de Kimi K2.7 Code et K2.6
K2.7 Code et K2.6 coûtent tous deux $0.95 en entrée et $4 en sortie par million de tokens, ce qui en fait les chevaux de bataille économiques de la gamme. Les deux publient un tarif de cache, $0.19 pour K2.7 Code et $0.16 pour K2.6, et K2.7 Code est optimisé pour le code à long horizon et l'orchestration multi-agents. Si la vitesse compte plus que le prix, K2.7 Code HighSpeed double chaque tarif, à $1.90 / $8, pour une sortie que Moonshot situe autour de 180 tokens par seconde. Pour la plupart des applications en production qui n'ont pas besoin d'un million de tokens de contexte, K2.6 ou K2.7 Code est le choix par défaut judicieux.
Kimi K2.5 et K2 ont été retirés
Si un ancien guide vous oriente vers K2.5 à $0.60 / $3 ou vers le Kimi K2 original à $0.60 / $2.50, sachez qu'aucun des deux n'est plus disponible. Moonshot a retiré la série kimi-k2 le 25 mai 2026 et kimi-k2.5 le 31 août 2026, et les appels à K2.5 renvoient désormais une erreur 404 « model not found », selon sa liste des modèles. Moonshot oriente les utilisateurs de K2.5 vers K3, mais côté prix, le remplaçant le plus proche est K2.6 à $0.95 / $4, plus cher que chacun des modèles retirés.
Un coût supplémentaire à prévoir concerne les outils. La recherche web est facturée à l'appel, en plus de la consommation de tokens. En septembre 2026, Moonshot l'a déplacée vers des endpoints dédiés, à $0.002 par appel Web Search Basic, $0.003 par appel Web Search Pro et $0.002 par récupération d'URL, facturés uniquement lorsqu'un appel renvoie des résultats. L'ancien outil de recherche web intégré coûte toujours $0.005 par appel, et ses résultats comptent comme tokens d'entrée lors de votre requête suivante. Moonshot publie ces frais dans sa documentation tarifaire de la recherche web. Ils sont faibles à l'unité mais s'accumulent à grande échelle.
Combien coûte vraiment Kimi ? Un exemple concret
Les tarifs par million sont abstraits, voici donc une tâche concrète. Supposons que vous envoyiez 1 million de tokens en entrée et génériez 1 million de tokens en sortie, ce qui représente une grande tâche, environ un livre entier dans les deux sens. Sur Kimi K3, cela coûte $3 plus $15, soit $18 au total avant mise en cache. Exécutez la même tâche sur K2.6 et elle tombe à $0.95 plus $4, soit seulement $4.95.
La mise en cache change à nouveau le calcul. Si l'essentiel de cette entrée est un document ou un prompt système répété, K3 facture la partie en cache à $0.30 par million au lieu de $3, ce qui ramène le total près de $15. L'écriture dans le cache est elle aussi facturée, $3 par million pour le cache par défaut de cinq minutes ou $6 pour un cache d'une heure, si bien que la mise en cache est rentable quand le même préfixe est relu de nombreuses fois. Pour les vraies applications de chat, où les entrées sont courtes et les sorties modestes, la plupart des requêtes coûtent des fractions de centime. La conclusion est simple : choisissez K3 quand vous avez besoin de son raisonnement et de son contexte, et passez à K2.6 sinon. Notre guide sur quel modèle d'IA utiliser et quand détaille ces arbitrages.
Tarification de Kimi sur OpenRouter, Groq et autres hébergeurs
Moonshot n'est pas le seul endroit où acheter des tokens Kimi. Des hébergeurs d'inférence tiers revendent les modèles à poids ouverts, parfois en dessous du prix catalogue de Moonshot, et ajoutent des fonctionnalités comme la facturation unifiée et un matériel plus rapide. Sur OpenRouter, sept des 19 offres K3 facturaient le 25 septembre 2026 les $3 / $15 de Moonshot, et dix se situaient en dessous, de DeepInfra à $2.85 / $14.25 jusqu'à environ $0.88 / $10.53 pour l'offre quatre bits la moins chère. K2.6 démarre à environ $0.45 / $1.90 chez le revendeur le moins cher.
Groq, le choix habituel pour l'inférence à haute vitesse, ne propose plus du tout Kimi. Il a arrêté son dernier modèle Kimi K2 le 15 avril 2026 et oriente ses utilisateurs vers GPT-OSS 120B ; pour la vitesse sur Kimi lui-même, la voie passe désormais par K2.7 Code HighSpeed de Moonshot. Pour les tâches qui peuvent attendre, la Batch API de Moonshot, ouverte à tous les utilisateurs depuis avril 2026, fait économiser 40 % par rapport aux appels en temps réel. Si le débit et la latence comptent plus que le prix affiché le plus bas, comparez les hébergeurs avant de vous engager.
Coût de Kimi vs Claude, GPT et DeepSeek
L'argument de Kimi a toujours été une qualité de pointe pour une fraction des prix occidentaux, et face aux modèles phares occidentaux, cela reste vrai. K3 est 25 % moins cher que Claude Opus 5.5 ($4 / $20) en entrée comme en sortie, et 70 % moins cher que GPT-6 Astra ($10 / $50). Il n'est cependant plus moins cher que tout ce qui vient d'Occident. GPT-6.1 Sol, le modèle intermédiaire d'OpenAI, coûte $2 / $10, un tiers de moins que K3, tout comme Claude Sonnet 5.5 d'Anthropic. DeepSeek, l'autre champion chinois des prix bas, reste bien moins cher, mais son tarif double aux heures de pointe en semaine (de 01:00 à 04:00 et de 06:00 à 10:00 UTC). Qwen 3.8 d'Alibaba est l'autre modèle chinois à plusieurs milliers de milliards de paramètres qui vise cette même couronne du rapport qualité-prix. Notre comparatif Kimi vs ChatGPT montre ce que cet écart change dans les applications de chat elles-mêmes.
| Modèle | Entrée /1M | Sortie /1M | Notes |
|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | Phare, contexte 1M |
| Kimi K2.6 | $0.95 | $4.00 | Cheval de bataille économique |
| Claude Fable 5.1 | $10.00 | $50.00 | Le modèle le plus cher d'Anthropic |
| Claude Opus 5.5 | $4.00 | $20.00 | Modèle phare Anthropic, en tête de l'AA Intelligence Index |
| GPT-6 Astra | $10.00 | $50.00 | Modèle phare OpenAI |
| GPT-6.1 Sol | $2.00 | $10.00 | Milieu de gamme OpenAI, moins cher que K3 |
| DeepSeek V4 Pro | $0.66 (pointe $1.32) | $1.98 (pointe $3.96) | Le moins cher ici, double en heure de pointe |
La réserve honnête concerne les capacités, et elle joue désormais aussi contre K3 sur le rapport qualité-prix. Dans l'Artificial Analysis Intelligence Index (v4.3.2, effort maximal, consulté le 30 septembre 2026), K3 obtient 43,6, contre 57,6 pour Claude Opus 5.5, 52,7 pour GPT-6 Astra et 51,8 pour GPT-6.1 Sol. Parmi les modèles à poids ouverts, il est troisième, derrière MiMo-V2.6-Pro de Xiaomi (46,3) et GLM-5.3 (44,8). K3 n'est donc ni le modèle le plus puissant ni le meilleur rapport qualité-prix en haut du classement, puisque GPT-6.1 Sol obtient un meilleur score pour moins cher. Ce que K3 offre toujours, ce sont des poids ouverts, un contexte d'un million de tokens et un prix bien inférieur à Opus 5.5 et Astra. Pour un codeur moins cher et compétent, K2.6 ou DeepSeek pourraient mieux vous convenir, comme expliqué dans notre comparatif des meilleures IA pour coder.
Peut-on utiliser Kimi gratuitement en auto-hébergeant ?
C'est là que Kimi devient intéressant pour les équipes soucieuses des coûts. Moonshot publie ses modèles en open weights, et K3 est disponible depuis le 27 juillet 2026, vous pouvez donc le télécharger dès aujourd'hui et le faire tourner sans aucun frais par token. Le bémol, c'est le matériel. Le dépôt publié est constitué de 96 shards safetensors totalisant environ 1,56 To, et il est déjà livré à environ quatre bits par paramètre, donc aucune astuce de quantisation supplémentaire ne permettra de le faire tenir sur une carte graphique de bureau.
Pour la plupart des gens, l'auto-hébergement ne devient rentable qu'à très fort volume, là où le coût fixe du matériel l'emporte sur une facture API à la consommation. Les petites équipes sont généralement mieux loties avec l'API hébergée ou un abonnement. Tous les modèles Kimi récents sont maintenant téléchargeables, K3 inclus, ce qui explique pourquoi Kimi se classe si haut parmi les meilleurs modèles IA open source pour quiconque veut un contrôle total et zéro frais d'usage. Notez que K3 est distribué sous la propre licence Kimi K3 de Moonshot plutôt que sous les conditions MIT permissives que portaient les versions K2 antérieures.
Quel forfait Kimi choisir ?
Adaptez le forfait à votre usage. Si vous voulez simplement un chatbot intelligent pour des questions, des fichiers et des recherches web, le niveau gratuit Adagio est suffisant. Si vous voulez que Kimi exécute des agents, navigue sur le web et code, commencez par le Moderato à $19 et montez seulement quand vous atteignez ses limites. Les développeurs qui créent des produits devraient passer directement à l'API, en choisissant K3 pour le raisonnement exigeant et K2.6 pour tout le reste.
Si vous préférez ne pas gérer du tout un abonnement Moonshot, une application de création multi-modèles comme Fello AI vous permet d'accéder aux modèles Kimi aux côtés d'autres modèles de pointe comme ChatGPT, Gemini, Grok, Deepseek et bien d'autres, ce qui est pratique quand vous voulez comparer les résultats. Grâce à Fello AI, vous ne payez que $9.99 par mois et utilisez plusieurs modèles à la fois. Sur Mac, il est disponible comme client Kimi natif pour macOS, sans compte Moonshot à recharger. Quelle que soit la voie choisie, Kimi reste l'une des options frontier les plus agressivement tarifées du marché, et le niveau gratuit signifie que le tester ne coûte rien.
FAQ
Kimi est-il gratuit ?
Oui. Le niveau gratuit Adagio vous offre un chat de base illimité, des téléchargements de fichiers et un accès web sans frais. Il est limité à environ 6 crédits d'agent et exclut Agent Swarm, Kimi Code et Kimi Claw, donc les agents intensifs et le code nécessitent un forfait payant à partir de $19 par mois.
Combien coûte l'API Kimi par million de tokens ?
Cela dépend du modèle. Le modèle phare Kimi K3 coûte $3 par million de tokens en entrée et $15 par million de tokens en sortie. Les modèles moins chers K2.6 et K2.7 Code coûtent $0.95 / $4, et K2.7 Code HighSpeed coûte $1.90 / $8. Les accès au cache réduisent le coût d'entrée d'environ 80 à 90 %, et la Batch API retire 40 % sur les tâches qui peuvent attendre.
Quel est le tarif de Kimi K3 ?
Kimi K3 coûte $3 par million de tokens en entrée et $15 par million en sortie, avec un tarif d'entrée en cache de seulement $0.30. Il dispose d'une fenêtre de contexte d'un million de tokens, donc une grande tâche de 1M en entrée et 1M en sortie coûte environ $18 avant mise en cache.
Kimi est-il moins cher que Claude et GPT ?
Que leurs modèles phares, oui. Kimi K3 à $3 / $15 est moins cher que Claude Opus 5.5 ($4 / $20) et GPT-6 Astra ($10 / $50) en entrée comme en sortie. Il n'est pas moins cher que GPT-6.1 Sol ni que Claude Sonnet 5.5, qui coûtent tous deux $2 / $10, et tous deux obtiennent aussi un meilleur score que K3 dans l'Artificial Analysis Intelligence Index (51,8 et 56,0 contre 43,6). DeepSeek V4 Pro est moins cher que tous, à $0.66 / $1.98 hors heures de pointe.
Peut-on utiliser Kimi gratuitement en auto-hébergeant ?
Oui. Moonshot publie ses modèles en open weights et K3 est disponible depuis le 27 juillet 2026, vous pouvez donc le faire tourner localement sans frais par token. La barrière pratique est la taille : le dépôt K3 représente environ 1,56 To sur 96 shards. L'auto-hébergement ne devient rentable qu'à fort volume, et pour la plupart des équipes l'API hébergée reste moins chère.