En ce mois de juillet, Kimi-K3 bouscule l’ordre établi de l’intelligence artificielle. Le dernier modèle du laboratoire chinois Moonshot AI vient de prendre la tête du classement Arena.ai dédié au développement frontend, avec un score de 1 679 points, devant Claude Fable 5. Il affiche aussi des tarifs 70 % inférieurs à ceux de son rival américain.
À retenir :
- Kimi-K3 domine le classement Frontend Code d’Arena.ai avec 1 679 points.
- Son prix d’entrée est 70 % inférieur à celui de Claude Fable 5 (3 $/M tokens, soit 2,55 €).
- Le modèle se hisse au 4ᵉ rang mondial sur l’Intelligence Index d’Artificial Analysis.
- Une architecture de 2,8 billions de paramètres, dont les poids seront libres le 27 juillet.
- Plus lent et très verbeux, il impose des arbitrages sur la vitesse et les coûts réels.
Ce lancement attire l’attention des développeurs et des entreprises à la recherche d’un modèle performant sans faire exploser la facture. La guerre des prix s’intensifie, et Kimi-K3 offre une alternative open source crédible aux solutions fermées d’Anthropic et d’OpenAI, à condition d’accepter sa verbosité.
Performance : Kimi-K3 s’impose sur le code
Dès sa mise en ligne, Kimi-K3 a attiré l’attention des développeurs. Sa spécialisation apparente pour les interfaces web ne l’empêche pas d’afficher une polyvalence qui le place dans le top 5 mondial des modèles les plus intelligents.
Frontend : Kimi-K3 prend l’avantage
Sur le benchmark Arena.ai Frontend Code, qui évalue la capacité à générer des pages web fonctionnelles et esthétiques, Kimi-K3 devance nettement Claude Fable 5. Avec 1 679 points, il s’impose dans six des sept catégories, dont le design de référence et l’analyse de données. Moonshot AI confirme ainsi les progrès déjà visibles avec sa version K2.6.
Le modèle excelle sur les tâches demandant une planification visuelle complexe et un suivi strict des instructions.
note un évaluateur d’Artificial Analysis

Une intelligence générale au 4ᵉ rang mondial
Au-delà du code, Kimi-K3 montre aussi des résultats solides sur un périmètre plus large. L’indice d’intelligence général d’Artificial Analysis le place 4ᵉ sur 189 modèles testés, avec un score de 57,1. Il dépasse Claude Opus 4.8 sur le test GDPval-AA v2 (1 687 points) et talonne les mastodontes Fable 5 Max et GPT-5.6 Sol Max. Le modèle ne se limite donc pas à une seule tâche.
Une progression nette depuis K2.6
Par rapport à la génération précédente, Kimi-K3 a gagné 17 places dans le classement général, confirmant une trajectoire de progression rapide. Cette réussite s’appuie sur une architecture Mixture-of-Experts de 2,8 billions de paramètres, avec 896 experts dont 16 activés simultanément, et une fenêtre de contexte de 1 million de tokens. C’est idéal pour analyser des dépôts entiers de code.
La contre-attaque par les prix et l’open source
Moonshot AI ne joue pas seulement la carte des benchmarks. Le laboratoire casse aussi les tarifs qui protégeaient les modèles étasuniens. L’ouverture des poids, prévue bientôt, pourrait encore faire bouger le marché.
70 % moins cher qu’Anthropic
L’offre tarifaire est frontale. Kimi-K3 facture 3 $ (2,55 €) le million de tokens en entrée et 15 $ (12,75 €) en sortie, là où Claude Fable 5 exige 10 $ (8,50 €) et 50 $ (42,50 €). Cela représente une réduction de 70 % sur l’input, un argument massif pour les applications à fort volume. Le cache de tokens bénéficie aussi d’une remise de 90 %, avec un tarif de 0,30 $ (0,26 €).
Une telle agressivité tarifaire signe la fin des modèles chinois perçus comme low cost ; on entre dans la compétition frontale sur le segment premium.
explique un analyste de BriefIA

Verbosité et lenteur : le revers de la médaille
Tout n’est pourtant pas rose. Kimi-K3, à l’instar de nombreux modèles orientés raisonnement, parle trop. Sur les tests d’évaluation d’Artificial Analysis, il a généré 130 millions de tokens, soit le double de la médiane de ses pairs. Résultat : le coût réel par tâche remonte autour de 0,94 $ (0,80 €). Sa vitesse de sortie plafonne aussi à 62 tokens par seconde, bien en deçà des 72 tokens/seconde de la moyenne du marché. Pour un chatbot rapide, c’est un handicap. Pour un assistant de codage méticuleux, c’est un atout.
C’est un modèle taillé pour les longs projets d’ingénierie, pas pour la réactivité instantanée.
résume un développeur de la communauté OpenRouter
En Open Weights le 27 juillet
Moonshot AI a annoncé la publication des poids de Kimi-K3 le 27 juillet 2026, sous un format open-weights. Cela permettra à n’importe quelle entreprise de l’héberger sur ses propres serveurs, sans dépendance aux API propriétaires. Avec sa fenêtre de contexte d’1 million de tokens et son support natif de la vidéo et de l’image, le modèle peut servir de base à un écosystème open source plus large.
À l’approche de cette échéance, Kimi-K3 réunit puissance, prix contenu et ouverture. Les développeurs devront surtout arbitrer entre ces atouts, sa lenteur et son bavardage.

















Laisser un commentaire
Vous devez vous connecter pour publier un commentaire.