Kimi est gratuit pour commencer, et c'est la façon la plus rapide de résumer la grille tarifaire de Moonshot AI. L'application Kimi vous offre un chat de base illimité, des téléchargements de fichiers et une recherche web avec un forfait Adagio à $0, tandis que les abonnements payants montent de $19 par mois à $199 par mois pour les usages intensifs en agents et en code. Si vous développez via l'API, vous payez à l'usage, et le modèle phare Kimi K3 coûte $3 par million de tokens en entrée et $15 par million de tokens en sortie.
Ce fossé entre une application de chat gratuite et une API développeur à la consommation, c'est tout le sujet des tarifs Kimi, et c'est ce qui perturbe la plupart des acheteurs. Ce guide détaille chaque niveau d'abonnement, la grille tarifaire complète par modèle pour l'API, les vraies limites du forfait gratuit, et comment le coût de Kimi se compare à Claude, GPT et DeepSeek. Tous les chiffres sont à jour pour juillet 2026 et proviennent des pages de tarification officielles de Moonshot.
Les points clés
- Offre gratuite permanente : le forfait Adagio est à $0 avec un chat de base illimité, mais seulement environ 6 crédits d'agent et sans Agent Swarm ni Kimi Code.
- Forfaits application : les abonnements payants sont à $19 (Moderato), $39 (Allegretto), $99 (Allegro) et $199 (Vivace) par mois.
- API phare : Kimi K3 est à $3 / $15 par million de tokens en entrée/sortie, avec un tarif d'entrée en cache à seulement $0.30.
- API économique : Kimi K2.6 coûte $0.95 / $4 par million de tokens, environ cinq fois moins cher que K3 en sortie.
- Moins cher que les modèles phares occidentaux : K3 est moins cher que Claude Opus 5 ($5 / $25) et GPT-5.6 Sol ($4 / $20) en entrée comme en sortie.
Combien coûte Kimi ? La réponse rapide
Kimi ne coûte rien à l'essai. L'application Kimi est gratuite avec le niveau Adagio, et les forfaits payants vont de $19 par mois à $199 par mois selon l'intensité de vos besoins en agents et en code. Sur l'API Moonshot, vous payez à l'usage plutôt qu'un forfait fixe : le modèle phare Kimi K3 coûte $3 par million en entrée et $15 par million en sortie, tandis que le modèle K2.6, moins cher, est à $0.95 / $4.
Le chiffre qui compte dépend de la façon dont vous utilisez Kimi. Les utilisateurs occasionnels qui chattent, téléchargent des documents et font des recherches web vivront surtout sur le forfait gratuit ou le forfait à $19. Les développeurs qui intègrent Kimi dans une application, un agent ou un outil de code s'intéressent au tarif par token, car c'est ce qui évolue avec l'usage. Le reste de ce guide couvre les deux aspects en détail.
Forfaits d'abonnement et tarifs d'adhésion Kimi
Moonshot nomme les cinq niveaux d'adhésion de Kimi d'après des tempos musicaux, du lent et gratuit Adagio au rapide et richement doté Vivace. Chaque forfait payant est disponible au mois ou à l'année sur la page officielle d'adhésion de Moonshot, et l'option annuelle permet d'économiser environ 20 % par rapport au tarif mensuel. La facturation annuelle sur le forfait supérieur vous fait économiser jusqu'à $480 par an.
| Forfait | Mensuel | Annuel | Idéal pour |
|---|---|---|---|
| Adagio | Gratuit | Gratuit | Chat occasionnel et tests |
| Moderato | $19 | $180/an | Utilisateurs solo, usage agent léger |
| Allegretto | $39 | $372/an | Utilisateurs avancés, plus de code |
| Allegro | $99 | $948/an | Agents intensifs et Kimi Code |
| Vivace | $199 | $1 908/an | Équipes, concurrence maximale |
Adagio (gratuit)
Le forfait gratuit vous offre un chat de base illimité, des téléchargements de fichiers et un accès web en direct, ce qui couvre la plupart des questions du quotidien. Il inclut environ 6 crédits d'agent, une seule tâche simultanée et 200 appels professionnels à la base de données. Agent Swarm, Kimi Code et Kimi Claw sont verrouillés, donc l'automatisation sérieuse est hors de portée tant que vous ne passez pas à un forfait supérieur.
Moderato ($19/mois)
Le premier niveau payant est le point d'équilibre pour les utilisateurs solo qui veulent de vrais agents. Vous obtenez 60 crédits d'agent, deux tâches simultanées, une priorité de vitesse agent 4x et 25 exécutions d'Agent Swarm en bêta. Il ajoute également Kimi Code à 1x et porte vos appels à la base de données à 2 000.
Allegretto ($39/mois)
Allegretto cible les utilisateurs avancés qui s'appuient sur Kimi pour le code. Il vous passe à 150 crédits d'agent, 50 exécutions d'Agent Swarm avec quatre sous-tâches simultanées et Kimi Code à 5x. C'est aussi le premier niveau à inclure Kimi Claw, l'agent de contrôle du navigateur.
Allegro ($99/mois)
Allegro est le forfait pour les charges de travail intensives, avec 360 crédits d'agent, quatre tâches simultanées et 120 exécutions d'Agent Swarm. Kimi Code passe à 15x et les appels à la base de données atteignent 12 000. La plupart des développeurs indépendants qui font tourner des agents quotidiennement n'auront pas besoin de plus.
Vivace ($199/mois)
Vivace est le niveau supérieur, conçu pour les équipes et l'automatisation non-stop. Il offre 720 crédits d'agent, 240 exécutions d'Agent Swarm avec huit sous-tâches simultanées et Kimi Code à 30x. À $199 par mois, il reste bien en dessous du coût de sièges IA d'entreprise comparables ailleurs, ce qui est une grande partie de l'attrait de Kimi.
Kimi est-il gratuit ? Ce qu'inclut vraiment le niveau Adagio
Oui, Kimi est gratuit à utiliser, et cela n'a pas changé en 2026. Le niveau gratuit Adagio vous donne toujours un chat standard illimité, des téléchargements de documents et une navigation web, alimentés par un modèle capable plutôt que par une version allégée. Pour poser des questions, résumer des fichiers et faire des recherches générales, il est possible que vous n'ayez jamais besoin de payer un centime.
Le bémol est le travail agentique. Moonshot a resserré le niveau gratuit de sorte que les tâches autonomes en plusieurs étapes, Agent Swarm et Kimi Code soient réservés aux forfaits payants. Vous ne disposez que d'une poignée de crédits d'agent par période avec Adagio, ce qui convient pour un test rapide mais pas pour construire. Si vous voulez que Kimi mène de longues missions de recherche, contrôle un navigateur ou écrive et exécute du code, le forfait Moderato à $19 est le vrai point de départ. Vous pouvez lire le détail du modèle dans notre guide sur le modèle Kimi K2.6.
Tarification de l'API Kimi par million de tokens
Si vous êtes développeur, c'est sur l'API Moonshot que la tarification de Kimi devient intéressante. Vous ne payez que pour les tokens que vous envoyez et recevez, facturés par million, et les tarifs varient considérablement selon le modèle. Le modèle le plus récent et le plus puissant est le plus cher, tandis que les modèles de génération précédente restent bien moins onéreux. La mise en cache des prompts peut réduire drastiquement votre coût en entrée lorsque vous réutilisez le même contexte.
| Modèle | Entrée /1M | Sortie /1M | Cache hit | Contexte |
|---|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | $0.30 | 1M |
| Kimi K2.7 Code | $0.95 | $4.00 | $0.19 | 262K |
| Kimi K2.6 | $0.95 | $4.00 | n/a | 262K |
| Kimi K2.5 | $0.60 | $3.00 | n/a | 262K |
| Kimi K2 (legacy) | $0.60 | $2.50 | $0.15 | 256K |
Tarification de Kimi K3
Le modèle phare Kimi K3 est un modèle de 2,8 billions de paramètres qui active 104 milliards de paramètres par token, avec une fenêtre de contexte de 1 million de tokens, et son prix reflète cette puissance : $3 en entrée et $15 en sortie par million de tokens. Le chiffre remarquable est le tarif d'entrée en cache à seulement $0.30, soit un dixième du tarif sans cache, ce qui récompense les charges de travail qui réutilisent de longs prompts système ou des documents. Les spécifications complètes et les benchmarks se trouvent dans notre analyse approfondie de Kimi K3.
Tarification de Kimi K2.7 Code et K2.6
K2.7 Code et K2.6 coûtent tous deux $0.95 en entrée et $4 en sortie par million de tokens, ce qui en fait les chevaux de bataille économiques de la gamme. K2.7 Code ajoute un tarif de cache publié à $0.19 et est optimisé pour le code à long horizon et l'orchestration multi-agents. Pour la plupart des applications en production qui n'ont pas besoin d'un million de tokens de contexte, ces deux modèles sont le choix par défaut judicieux.
Tarification de Kimi K2.5 et du K2 legacy
L'ancien modèle K2.5 est encore moins cher à $0.60 / $3, et le Kimi K2 original est à $0.60 / $2.50 avec un tarif cache de $0.15. Ces modèles restent disponibles pour les charges de travail sensibles au coût ou pour les équipes qui ont déjà développé dessus. Ils sont plus lents et moins capables que K3, mais pour les tâches simples à fort volume, la différence de prix est difficile à ignorer.
Un coût supplémentaire à prévoir est celui des outils. La recherche web et certains appels d'outils sont facturés en plus de l'usage en tokens, donc un agent qui fait beaucoup de recherches coûtera un peu plus que le pur calcul par token. Moonshot publie ces frais dans sa documentation de tarification de l'API ; ils sont faibles par appel mais s'accumulent à grande échelle.
Combien coûte vraiment Kimi ? Un exemple concret
Les tarifs par million sont abstraits, voici donc une tâche concrète. Supposons que vous envoyiez 1 million de tokens en entrée et génériez 1 million de tokens en sortie, ce qui représente une grande tâche, environ un livre entier dans les deux sens. Sur Kimi K3, cela coûte $3 plus $15, soit $18 au total avant mise en cache. Exécutez la même tâche sur K2.6 et elle tombe à $0.95 plus $4, soit seulement $4.95.
La mise en cache change à nouveau le calcul. Si la majeure partie de cette entrée est un document répété ou un prompt système qui est mis en cache, le coût d'entrée de K3 peut passer de $3 à $0.30 par million, ramenant le total à environ $15. Pour les vraies applications de chat, où les entrées sont courtes et les sorties modestes, la plupart des requêtes coûtent des fractions de centime. La conclusion est simple : choisissez K3 quand vous avez besoin de son raisonnement et de son contexte, et passez à K2.6 sinon. Notre guide sur quel modèle IA utiliser selon les situations passe en revue ces compromis.
Tarification de Kimi sur OpenRouter, Groq et autres hébergeurs
Moonshot n'est pas le seul endroit où acheter des tokens Kimi. Des hébergeurs d'inférence tiers revendent les modèles, parfois en dessous du prix catalogue de Moonshot, et ils ajoutent des fonctionnalités comme une facturation unifiée et du matériel plus rapide. Sur OpenRouter, K3 est affiché au même prix $3 / $15, mais les tarifs effectifs de K2.6 peuvent avoisiner $0.66 / $3.41 une fois les fournisseurs les moins chers et la mise en cache pris en compte.
Groq héberge Kimi K2 pour son inférence haute vitesse signature à $1.00 en entrée et $3.00 en sortie, avec un tarif d'entrée en cache de $0.50 intégré au prix. Groq cumule également une remise Batch API et la mise en cache des prompts, qui peuvent ensemble faire chuter les coûts effectifs à environ un quart du tarif à la demande pour les tâches asynchrones. Si le débit et la latence comptent plus que le prix le plus bas en valeur absolue, un hébergeur spécialisé en vaut souvent la peine.
Coût de Kimi vs Claude, GPT et DeepSeek
L'argument de vente de Kimi a toujours été des résultats de niveau frontier à une fraction des prix occidentaux, et les chiffres le confirment. K3 est moins cher que Claude Opus 5 et GPT-5.6 Sol en entrée comme en sortie, tout en offrant la même fenêtre de contexte d'un million de tokens. Seul DeepSeek, l'autre champion des prix chinois, revient moins cher, bien que son modèle phare cède un peu de capacité pour ce tarif. Le Qwen 3.8 d'Alibaba est l'autre modèle chinois multi-billons de paramètres qui vise la même couronne du rapport qualité-prix.
| Modèle | Entrée /1M | Sortie /1M | Notes |
|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | Phare, contexte 1M |
| Kimi K2.6 | $0.95 | $4.00 | Cheval de bataille économique |
| Claude Opus 5 | $5.00 | $25.00 | Modèle phare Anthropic, en tête de l'AA Intelligence Index |
| GPT-5.6 Sol | $4.00 | $20.00 | Modèle phare OpenAI |
| DeepSeek V4 Pro | $0.44 | $0.87 | Modèle phare le moins cher |
La nuance honnête concerne la capacité. La couronne du code dépend du tableau de bord que vous consultez : le tableau SWE-bench Verified de llm-stats place Claude Fable 5 en tête à 95,0 % avec Opus 4.8 troisième à 88,6 %, tandis que le Coding Index d'Artificial Analysis place GPT-5.6 Sol juste devant Claude Opus 5. Les propres scores d'agents de Moonshot pour K3 n'ont pas encore été reproduits par des tiers. Donc K3 n'est pas automatiquement le meilleur modèle, c'est le modèle le mieux tarifé dans la tranche haute du contexte et du raisonnement. Pour un développeur de code capable et moins cher, K2.6 ou DeepSeek peuvent mieux vous servir, comme évoqué dans notre sélection des meilleurs IA pour le code.
Peut-on utiliser Kimi gratuitement en auto-hébergeant ?
C'est là que Kimi devient intéressant pour les équipes soucieuses des coûts. Moonshot publie ses modèles en open weights, et K3 est disponible depuis le 27 juillet 2026, vous pouvez donc le télécharger dès aujourd'hui et le faire tourner sans aucun frais par token. Le bémol, c'est le matériel. Le dépôt publié est constitué de 96 shards safetensors totalisant environ 1,56 To, et il est déjà livré à environ quatre bits par paramètre, donc aucune astuce de quantisation supplémentaire ne permettra de le faire tenir sur une carte graphique de bureau.
Pour la plupart des gens, l'auto-hébergement ne devient rentable qu'à très fort volume, là où le coût fixe du matériel l'emporte sur une facture API à la consommation. Les petites équipes sont généralement mieux loties avec l'API hébergée ou un abonnement. Tous les modèles Kimi récents sont maintenant téléchargeables, K3 inclus, ce qui explique pourquoi Kimi se classe si haut parmi les meilleurs modèles IA open source pour quiconque veut un contrôle total et zéro frais d'usage. Notez que K3 est distribué sous la propre licence Kimi K3 de Moonshot plutôt que sous les conditions MIT permissives que portaient les versions K2 antérieures.
Quel forfait Kimi choisir ?
Adaptez le forfait à votre usage. Si vous voulez simplement un chatbot intelligent pour des questions, des fichiers et des recherches web, le niveau gratuit Adagio est suffisant. Si vous voulez que Kimi exécute des agents, navigue sur le web et code, commencez par le Moderato à $19 et montez seulement quand vous atteignez ses limites. Les développeurs qui créent des produits devraient passer directement à l'API, en choisissant K3 pour le raisonnement exigeant et K2.6 pour tout le reste.
Si vous préférez ne pas gérer du tout un abonnement Moonshot, une application de création multi-modèles comme Fello AI vous permet d'accéder aux modèles Kimi aux côtés d'autres modèles de pointe comme ChatGPT, Gemini, Grok, Deepseek et bien d'autres, ce qui est pratique quand vous voulez comparer les résultats. Grâce à Fello AI, vous ne payez que $9.99 par mois et utilisez plusieurs modèles à la fois. Sur Mac, il est disponible comme client Kimi natif pour macOS, sans compte Moonshot à recharger. Quelle que soit la voie choisie, Kimi reste l'une des options frontier les plus agressivement tarifées du marché, et le niveau gratuit signifie que le tester ne coûte rien.
FAQ
Kimi est-il gratuit ?
Oui. Le niveau gratuit Adagio vous offre un chat de base illimité, des téléchargements de fichiers et un accès web sans frais. Il est limité à environ 6 crédits d'agent et exclut Agent Swarm, Kimi Code et Kimi Claw, donc les agents intensifs et le code nécessitent un forfait payant à partir de $19 par mois.
Combien coûte l'API Kimi par million de tokens ?
Cela dépend du modèle. Le modèle phare Kimi K3 coûte $3 par million de tokens en entrée et $15 par million en sortie. Les modèles K2.6 et K2.7 Code moins chers coûtent $0.95 / $4, et l'ancien K2.5 est à $0.60 / $3. La mise en cache des prompts peut réduire les coûts en entrée de 60 à 80 %.
Quel est le tarif de Kimi K3 ?
Kimi K3 coûte $3 par million de tokens en entrée et $15 par million en sortie, avec un tarif d'entrée en cache de seulement $0.30. Il dispose d'une fenêtre de contexte d'un million de tokens, donc une grande tâche de 1M en entrée et 1M en sortie coûte environ $18 avant mise en cache.
Kimi est-il moins cher que Claude et GPT ?
Oui. Kimi K3 à $3 / $15 est moins cher que Claude Opus 5 ($5 / $25) et GPT-5.6 Sol ($4 / $20) en entrée comme en sortie, tout en correspondant à leur fenêtre de contexte d'un million de tokens. Seul DeepSeek est moins cher parmi les modèles phares, bien que Claude Fable 5 reste en tête du tableau SWE-bench Verified de llm-stats avec 95,0 %.
Peut-on utiliser Kimi gratuitement en auto-hébergeant ?
Oui. Moonshot publie ses modèles en open weights et K3 est disponible depuis le 27 juillet 2026, vous pouvez donc le faire tourner localement sans frais par token. La barrière pratique est la taille : le dépôt K3 représente environ 1,56 To sur 96 shards. L'auto-hébergement ne devient rentable qu'à fort volume, et pour la plupart des équipes l'API hébergée reste moins chère.