Introduction
Kimi K3 n'était disponible que depuis environ 48 heures lorsque Moonshot AI a annoncé qu'il cesserait temporairement d'accepter de nouvelles sousscriptions grand public.
La raison n'était ni un changement de produit planifié ni un manque de demande. C'était tout le contraire. Selon Moonshot, les demandes pour Kimi K3 ont dépassé de loin ses prévisions et se sont approchées de la limite de capacité de ses clusters de calcul existants.
Les utilisateurs payants existants ont été autorisés à continuer d'utiliser le service. Moonshot a indiqué qu'il dirigerait les ressources de calcul disponibles vers les abonnés actuels tout en augmentant la capacité, puis rouvrirait les places de nouvelles souscriptions par lots.

Avis du 19 juillet de Moonshot expliquant la pénurie de calcul et la suspension temporaire des souscriptions.
Le problème soudain de capacité a suivi un lancement exceptionnellement fort pour Kimi K3, un modèle natif multimodal de 2,8 billions de paramètres conçu pour le codage à long terme, la création visuelle, le travail de connaissance et les tâches basées sur des agents.
Moonshot décrit K3 comme le premier modèle ouvert de classe 3T. Son article de lancement indique également que les poids complets du modèle doivent être publiés d'ici le 27 juillet 2026, donc « ouvert » au lancement doit être compris dans le contexte de ce calendrier de publication annoncé.
Kimi K3 est devenu populaire en deux jours
La hausse de la demande est plus facile à comprendre lorsqu'on la considère parallèlement aux performances précoces du modèle et au volume de démonstrations utilisateurs apparues peu après le lancement.
Kimi K3 est entré sur le marché avec une fenêtre de contexte d'un million de tokens, des capacités de vision natives et une architecture sparse Mixture-of-Experts avec 2,8 billions de paramètres totaux. Il est conçu pour des tâches qui peuvent se poursuivre sur de longues périodes et nécessitent des appels d'outils répétés, l'exécution de code, l'inspection visuelle ou un raisonnement en plusieurs étapes.
Le blog technique de Moonshot reconnaît que K3 reste encore derrière Claude Fable 5 et GPT-5.6 Sol en termes de performances globales. En même temps, le modèle a affiché de bons résultats dans plusieurs évaluations de codage et axées sur les agents.
Première place dans le classement préliminaire Frontend Code Arena
Au moment couvert par le rapport original, Kimi K3 occupait la première place du classement préliminaire WebDev d'Arena avec un score d'environ 1 679.
Le classement en direct du 21 juillet montrait Kimi K3 en première place avec un score préliminaire de 1 678, devant Claude Fable 5 et GPT-5.6 Sol.

Résultat préliminaire de première place de Kimi K3 dans le classement du développement frontend d'Arena.
Les évaluations frontend sont utiles car elles testent plus que la capacité d'un modèle à produire du code valide. Un bon résultat nécessite souvent que le modèle comprenne un objectif visuel, crée une interface fonctionnelle, inspecte le rendu produit et révise le
mise en œuvre.
Kimi K3 est conçu pour ce type de workflow de « vision en boucle ». Il peut naviguer entre le code source et les captures d'écran en direct, en utilisant le résultat rendu comme retour pour une autre passe de développement.
Étant donné que le classement est basé sur un vote continu, ses scores et positions peuvent changer. La page Arena en direct doit être considérée comme la source actuelle plutôt que tout graphique de lancement statique.
Résultats de codage solides mais mitigés
Le rapport original a également mis en évidence trois évaluations de génie logiciel :
| Référence | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol |
|---|---|---|---|
| DeepSWE | 67,5 | 70,0 | 73,0 |
| Program Bench | 77,8 | 76,8 | 77,6 |
| SWE Marathon | 42,0 | 35,0 | 39,0 |

Résultats rapportés de Kimi K3 sur les benchmarks de codage et de génie logiciel à long terme.
Les résultats dressent un tableau plus équilibré qu'une simple affirmation de « meilleur modèle ».
K3 est resté derrière Claude Fable 5 et GPT-5.6 Sol sur DeepSWE, a légèrement pris l'avance sur Program Bench et a obtenu le score le plus élevé rapporté dans la comparaison SWE Marathon de Moonshot.
La méthodologie des benchmarks compte ici. Moonshot a utilisé différents environnements d'agents selon le modèle et note que son évaluation SWE Marathon a utilisé une branche calibrée H20 des tâches officielles. Il rapporte également que Claude Fable 5 a rencontré un comportement de repli sur une partie de cette évaluation.
Ces différences ne rendent pas les résultats inutiles, mais elles signifient que les scores de différents environnements ne doivent pas être considérés comme provenant de conditions de laboratoire parfaitement identiques.
Les développeurs ont rapidement transformé Kimi K3 en un terrain de jeu créatif
Les classements n'étaient qu'une partie du lancement. Les développeurs ont également commencé à publier des sites web, des outils interactifs, des jeux, des scènes 3D et des expériences visuelles créées avec K3.
Un exemple présentait un jeu en monde ouvert qu'un utilisateur a déclaré difficile à imaginer générer à partir d'une simple invite quelques mois plus tôt.

Démonstration par un utilisateur d'un jeu en monde ouvert créé avec Kimi K3.
Un autre utilisateur a comparé Kimi K3 et Claude Opus 4.8 sur la tâche de génération d'un environnement d'entrepôt virtuel. Dans la comparaison publiée, le résultat de Kimi contenait plus d'éclairage, d'objets, de structure environnementale et de détails visibles.

Comparaison publiée par un utilisateur de scènes d'entrepôt virtuel générées par deux modèles.
Ces exemples sont des démonstrations anecdotiques plutôt que des benchmarks contrôlés. Le libellé de l'invite, la configuration de l'agent, l'accès aux outils, les limites de temps et l'intervention manuelle peuvent tous influencer le résultat.
Néanmoins, l'apparition rapide
Ces projets ont contribué à susciter l'intérêt. Les utilisateurs ne se contentaient pas de poser des questions à K3 ; beaucoup menaient de longues sessions de codage impliquant la construction, le rendu, les tests et la révision de projets conséquents.
Cette distinction est importante pour l'infrastructure.
Une réponse courte de chatbot peut nécessiter une seule requête au modèle. Un agent de codage peut lire des fichiers de manière répétée, planifier, écrire du code, appeler des outils, exécuter des commandes, inspecter les résultats et entamer un nouveau cycle de raisonnement. Une seule tâche utilisateur peut donc consommer beaucoup plus de capacité d'inférence qu'une conversation classique.
Le volume de requêtes a approché la limite du cluster existant
Le 19 juillet, Moonshot a déclaré que Kimi K3 avait suscité beaucoup plus d'intérêt que prévu.
Au cours des 48 heures précédentes, les requêtes des utilisateurs avaient largement dépassé les prévisions et approchaient la limite de capacité des clusters existants de l'entreprise.

Moonshot a indiqué que la demande avait approché la limite de sa capacité de calcul actuelle.
Lorsqu'un trop grand nombre de requêtes d'inférence arrivent simultanément sur un cluster, plusieurs problèmes peuvent survenir :
- Les réponses peuvent devenir plus lentes.
- Les requêtes peuvent patienter dans une file d'attente.
- Les tâches des agents de longue durée peuvent occuper la capacité pendant des périodes prolongées.
- Les utilisateurs peuvent subir des délais d'attente ou des défaillances temporaires du service.
- Le fournisseur peut être amené à limiter l'accès pour protéger la qualité du service.
Kimi K3 rend le problème plus complexe en raison de son échelle et de l'orientation de son produit.
Le modèle contient 2,8 billions de paramètres au total, et nombre de ses cas d'utilisation les plus attrayants impliquent de longs contextes, des raisonnements répétés, des captures d'écran, des opérations sur fichiers et des appels d'outils. Bien que son architecture creuse n'active qu'une partie du modèle complet pour chaque jeton, son service à volume élevé nécessite toujours une infrastructure substantielle.
Moonshot a donc annoncé trois mesures immédiates :
- Suspendre les nouveaux abonnements grand public.
- Prioriser la puissance de calcul pour les membres payants existants.
- Augmenter la capacité et rouvrir progressivement les places d'abonnement.
Les abonnés actuels ne devaient pas perdre leurs avantages existants en raison de cette suspension temporaire.
Note sur le statut : La suspension s'appliquait aux nouveaux abonnements grand public, pas nécessairement à tous les comptes gratuits, produits API, arrangements d'entreprise ou adhésions existantes. La disponibilité des produits pouvant changer rapidement, les utilisateurs devraient consulter les pages officielles de tarification et d'abonnement de Kimi pour connaître le statut actuel.
Les adhésions Kimi et Kimi Code seront séparées
Moonshot a également annoncé que sa structure d'adhésion future changerait.
La société prévoit de séparer les principaux avantages de Kimi—incluant Kimi Web, l'application Kimi et Kimi Work—des avantages de Kimi Code.
Cela indique deux catégories d'utilisation différentes.
Utilisation générale de Kimi
L'adhésion principale à Kimi est destinée à une productivité personnelle plus large, y compris :
- Conversations générales
- Travail de recherche et de connaissance
- Documents et présentations
- Tâches visuelles et multimodales
- Flux de travail des agents Kimi Work
Utilisation de Kimi Code
Kimi Code est conçu pour des tâches soutenues d'ingénierie logicielle, notamment :
Creez un site vitrine et genere des leads en quelques minutes
Decrivez votre idee une fois, et We0 AI peut generer un site vitrine, des pages et un CMS, puis vous aider a attirer clients et trafic apres le lancement.
Une génération de projet complète pour une inscription gratuite
Idéal pour essayer un flux de génération complet et voir rapidement une première ébauche de projet.
- Programmation
y compris :
- la lecture et l'édition de dépôts
- l'exécution de commandes terminal
- le débogage et le refactoring
- le lancement d'outils de développement
- le déclenchement de sous-agents
- la gestion de longues sessions de codage
Le profil de calcul de ces produits peut être très différent.
Un développeur peut laisser un agent de codage tourner pendant qu'il explore un dépôt, modifie plusieurs fichiers, exécute des tests, examine les échecs et répète le cycle. Séparer les plans donne à Moonshot un meilleur contrôle sur les limites de taux, la tarification et l'allocation des ressources pour des utilisateurs ayant des charges de travail très différentes.
L'annonce n'a pas fourni de tarification définitive, de quotas ni de date confirmée pour le nouveau système d'abonnement.
Le défi d'infrastructure derrière la pause
L'arrêt des abonnements illustre un problème plus large pour les fournisseurs d'IA de pointe : un lancement réussi de modèle peut créer une demande plus rapidement que l'infrastructure physique ne peut être étendue.
Augmenter la capacité n'est pas aussi simple que de mettre à jour un paramètre logiciel. Les fournisseurs peuvent avoir besoin d'obtenir des accélérateurs, de déployer des serveurs, de connecter le réseau et le stockage, de configurer les logiciels d'inférence, de valider la fiabilité et de rééquilibrer le trafic entre les clusters.
Kimi a précédemment publié des recherches sur Mooncake, son architecture de service centrée sur le cache KV. Le système sépare les charges de travail de préremplissage et de décodage et utilise la mémoire CPU distribuée, la DRAM et les ressources SSD pour améliorer l'efficacité du service en contexte long.
Le document Mooncake indique que l'architecture a permis à Kimi de gérer 75 % de requêtes supplémentaires sous les charges de travail réelles testées à l'époque.
Kimi K3 crée un défi plus récent et plus vaste. Un service plus efficace peut augmenter le travail géré par le matériel existant, mais cela ne supprime pas le besoin de calcul physique supplémentaire lorsque la demande augmente suffisamment fortement.
C'est pourquoi la pause temporaire est mieux comprise comme une décision de gestion de capacité. Moonshot a choisi de limiter la nouvelle demande payante plutôt que de continuer à vendre des abonnements que ses clusters actuels pourraient ne pas servir de manière fiable.
Croissance des revenus et préparations pour l'introduction en bourse
Le rapport original lie la popularité de K3 à la dynamique commerciale plus large de Moonshot AI.
Selon des rapports médiatiques citant des personnes proches de l'entreprise, les ventes quotidiennes de Moonshot ont augmenté d'au moins six fois après le lancement de K3.
Un rapport de Bloomberg a également indiqué que le revenu annuel récurrent de Moonshot avait atteint environ 300 millions de dollars en juin 2026, contre 200 millions de dollars en avril.
Le revenu annuel récurrent n'est pas la même chose que le revenu annuel audité. Il s'agit d'une mesure prospective basée sur les revenus actuels d'abonnement et de contrat.
Les rapports ont également indiqué que Moonshot avait distribué une résolution d'actionnaires demandant un soutien pour une cotation à Hong Kong et pourrait poursuivre une introduction en bourse dans un délai d'environ six mois.
Reuters a également rapporté que :
- Moonshot démantelait sa structure offshore avant une potentielle introduction en bourse à Hong Kong.
- L'entreprise avait engagé des conseillers, dont Goldman Sachs et China International Capital Corporation.
- Elle avait levé plus de 2 milliards de dollars en mai.
- Le total des levées de fonds historiques avait dépassé 5,5 milliards de dollars.
- Sa valorisation avait atteint environ 30 milliards de dollars en juin.
- Elle avait commencé à chercher jusqu'à 2 milliards de dollars supplémentaires.
Ces détails étaient
rapporté par le biais de sources anonymes ou de documents de collecte de fonds plutôt que par un dépôt officiel de Moonshot. L'entreprise a refusé de commenter le processus d'introduction en bourse auprès de Reuters.
Des informations ultérieures provenant de Bloomberg indiquaient que Moonshot discutait d'un tour de financement pré-IPO pour une valorisation allant jusqu'à 50 milliards de dollars. Ce chiffre représente un objectif en discussion, et non un financement achevé ou une valorisation boursière publique confirmée.
Pourquoi le calendrier est important
Les performances du modèle, la demande des utilisateurs, la croissance des revenus, la collecte de fonds et les préparatifs de cotation sont tous arrivés presque en même temps.
Pour une start-up d'IA, cette combinaison peut renforcer le récit présenté aux investisseurs :
- Le modèle bénéficie d'une dynamique technique visible.
- Les utilisateurs essaient activement le produit.
- La demande est suffisamment forte pour créer un problème de capacité.
- Les revenus des abonnements et de l'API augmentent.
- L'entreprise dispose d'une voie vers des capitaux supplémentaires.
Dans le même temps, la pénurie de puissance de calcul révèle le coût de cette croissance.
Un modèle de codage performant est coûteux à servir. Plus ses fonctions d'agent deviennent performantes, plus les utilisateurs sont susceptibles de lancer des tâches de longue durée plutôt que de courtes discussions.
Cela crée un équilibre difficile. Moonshot a besoin d'une capacité suffisante pour préserver l'expérience utilisateur, mais doit également gérer le coût en capital de l'ajout rapide de matériel.
La décision d'arrêter de vendre de nouveaux abonnements grand public, au moins temporairement, suggère que la fiabilité pour les utilisateurs existants a été priorisée par rapport à la maximisation de la croissance immédiate des adhésions.
Ce que les utilisateurs existants et nouveaux doivent savoir
Pour les membres payants existants, Moonshot a déclaré que les avantages du service resteraient disponibles et que la pénurie actuelle ne supprimerait pas leurs droits d'abonnement.
Pour les personnes qui n'étaient pas encore abonnées, la situation pratique était différente :
- Les nouveaux abonnements grand public étaient temporairement indisponibles.
- Des places supplémentaires seraient rouvertes par lots à mesure que la capacité de calcul augmenterait.
- Les futurs plans Kimi général et Kimi Code seraient séparés.
- Les détails finaux des plans n'avaient pas encore été annoncés.
Les développeurs ayant besoin d'un accès programmatique peuvent toujours consulter la plateforme API Kimi. La disponibilité de l'API, les prix et les limites de débit sont gérés séparément de l'adhésion grand public et peuvent suivre des règles de capacité différentes.
L'API Kimi répertorie actuellement le K3 à :
| Type d'utilisation | Prix par million de tokens |
|---|---|
| Entrée en cache | 0,30 $ |
| Entrée non en cache | 3,00 $ |
| Sortie | 15,00 $ |
Ces prix sont les tarifs actuels de la plateforme au moment de la rédaction de ce fichier et peuvent changer ultérieurement.
Questions fréquentes
Pourquoi Kimi a-t-il suspendu les nouveaux abonnements ?
Moonshot a déclaré que la demande pour Kimi K3 avait dépassé de loin ses prévisions et s'approchait de la limite de capacité de ses clusters de calcul existants. L'entreprise a suspendu les nouveaux abonnements grand public afin de pouvoir prioriser l'expérience des membres payants actuels.
Les abonnés existants de Kimi sont-ils affectés ?
Moonshot a déclaré que les abonnés existants conserveraient leurs avantages et ne seraient pas affectés par la suspension des abonnements. La vitesse réelle du service peut encore varier pendant les périodes de demande exceptionnellement élevée.
Quand Kimi rouvrira-t-il les nouveaux abonnements ?
Aucune date de réouverture fixe n'a été annoncée. Moonshot a déclaré qu'il ajouterait de la capacité de calcul et libérerait de nouveaux
abonnements par lots jusqu'à ce que les abonnements normaux puissent reprendre.
Kimi K3 est-il toujours gratuit ?
La suspension concernait les nouveaux abonnements grand public, pas nécessairement toutes les formes d'accès. L'accès gratuit, l'accès via l'API Kimi, les produits professionnels et les abonnements existants peuvent avoir des limites et des règles de disponibilité différentes.
Pourquoi Kimi K3 nécessite-t-il autant de calcul ?
K3 est un modèle de 2,8 billions de paramètres conçu pour les longs contextes, les entrées multimodales, les agents de codage et l'utilisation répétée d'outils. Les flux de travail de codage peuvent générer de nombreux appels de modèle séquentiels lors d'une même tâche utilisateur, ce qui augmente la demande d'inférence totale.
Que va changer les plans d'abonnement de Kimi ?
Moonshot a déclaré qu'il prévoit de séparer les avantages généraux de Kimi des avantages de Kimi Code. Cela permettrait à l'entreprise d'attribuer des tarifs, des limites d'utilisation et des ressources de calcul différents aux utilisateurs généraux et aux utilisateurs intensifs d'agents de codage.
Kimi K3 est-il le meilleur modèle de codage front-end ?
Kimi K3 occupait la première place du classement préliminaire WebDev d'Arena au moment de la publication. Les résultats d'Arena sont mis à jour en continu, il faut donc consulter le classement en direct pour connaître le dernier classement.
Moonshot AI va-t-il définitivement entrer en bourse dans les six mois ?
Aucune introduction en bourse finale n'a été confirmée. Les médias rapportent que Moonshot se prépare à une possible cotation à Hong Kong et a discuté d'un calendrier d'environ six mois, mais Reuters a noté que le calendrier reste flexible.
Outils associés
- Kimi : le principal espace de travail de Moonshot AI pour les conversations, la recherche, les tâches visuelles et les flux de travail d'agents basés sur K3.
- Kimi Work : l'environnement polyvalent de Kimi pour les documents, les diapositives, la recherche et le travail en plusieurs étapes.
- Kimi Code : le produit d'agent de codage de Moonshot pour les terminaux, les dépôts, le débogage et les tâches d'ingénierie de longue durée.
- Plateforme API Kimi : le service API officiel pour Kimi K3 et d'autres modèles Moonshot.
- Tarifs d'abonnement Kimi : la page officielle pour connaître la disponibilité des abonnements grand public actuels et les informations sur les formules.
- Classement WebDev Arena : le classement en direct par vote communautaire pour les modèles de développement front-end.
- DeepSWE : un benchmark public d'ingénierie logicielle référencé dans l'évaluation technique de K3.
- SWE Marathon : un benchmark axé sur les tâches d'ingénierie logicielle à long terme.
Liens associés
- Blog technique officiel de Kimi K3 : la présentation officielle de Moonshot sur le modèle, l'architecture, les évaluations, la disponibilité et les limites.
- Communiqué officiel de suspension des abonnements Kimi : l'annonce de Moonshot concernant la suspension temporaire des nouveaux abonnements.
- Rapport Reuters sur la pénurie de calcul et l'introduction en bourse : reportage indépendant sur le problème de capacité, la levée de fonds et la possible cotation à Hong Kong.
- Classement WebDev Arena
Classement actuel du frontend Kimi K3 et nombre de votes.
- Plateforme API Kimi : Tarifs officiels de l'API K3, documentation et informations d'accès.
- Kimi Code : Informations officielles sur le produit et guide d'installation de l'agent de codage.
- Article de recherche Mooncake : Recherche de Moonshot sur l'architecture de service centrée sur le cache KV utilisée pour les charges de travail Kimi.
Résumé
Le lancement de Kimi K3 a généré une demande suffisante pour pousser les clusters GPU existants de Moonshot AI près de leur limite de capacité en environ 48 heures. L'entreprise a réagi en suspendant temporairement les nouveaux abonnements consommateurs et en priorisant les abonnés payants existants.
Cette augmentation a suivi de solides résultats en codage, une première place préliminaire sur le classement frontend d'Arena, et une vague de sites web, jeux et applications 3D créés par les utilisateurs. Les tâches de codage et d'agent de longue durée consomment également considérablement plus de capacité d'inférence que les sessions de chat ordinaires.
Moonshot prévoit de séparer l'abonnement général Kimi des avantages Kimi Code, lui donnant ainsi plus de contrôle sur l'allocation des ressources de calcul et la tarification future. Parallèlement, des rapports médiatiques indiquent une croissance rapide des revenus, de nouvelles discussions de levée de fonds et des préparatifs pour une éventuelle introduction en bourse à Hong Kong, bien que ces détails financiers restent largement basés sur des sources anonymes.
Ce lancement a démontré les deux facettes de la demande en IA de pointe : Kimi K3 a rapidement attiré les utilisateurs, mais fournir un service fiable à ces utilisateurs est immédiatement devenu un défi infrastructurel.



