Kimi K3, le plus grand modèle d'IA open source chinois, offre des performances de pointe, son niveau d'intelligence global n'étant surpassé que par ceux de Claude Fable 5 et de GPT-5.6 Sol
La société chinoise Moonshot AI a dévoilé Kimi K3, un modèle d'intelligence artificielle (IA) open source doté de 2 800 milliards de paramètres, offrant des capacités de vision natives et une fenêtre contextuelle d'un million de jetons. Selon l'Intelligence Index du site de benchmarking indépendant Artificial Analysis, Kimi K3 devance Claude Opus 4.8 d'Anthropic et GPT-5.6 Terra d'OpenAI, et se classe à seulement deux ou trois points derrière Claude Fable 5 et GPT-5.6 Sol. L'écart entre les modèles d'IA open source et les modèles propriétaires de pointe n'a jamais été aussi faible.
Kimi est un chatbot IA et une série de grands modèles de langage développés par la société chinoise Moonshot AI. Sa première version, lancée en 2023, était connue pour prendre en charge jusqu'à 128 000 tokens de contexte. Kimi K2, un modèle à poids ouverts lancé en juillet 2025, a affiché d'excellentes performances lors des benchmarks de codage. En janvier 2026, Moonshot AI a lancé Kimi K2.5, un modèle MoE comptant 1 000 milliards de paramètres, dont 32 milliards de paramètres actifs. Ce modèle multimodal, capable de traiter à la fois la vision et la compréhension du langage, dispose de capacités agentiques avancées, de modes « instantané » et « raisonnement », ainsi que de paradigmes conversationnels et agentiques. Moonshot AI a lancé Kimi K2.6 en avril 2026, puis Kimi K2.7 Code en juin 2026.
La nouvelle surprise venue de Chine vient de tomber : Moonshot AI a dévoilé Kimi K3, son modèle d’IA le plus performant à ce jour, établissant ainsi une nouvelle référence pour les modèles à poids ouvert. Avec 2,8 billions (2 800 milliards) de paramètres, Kimi K3 est le premier modèle ouvert de la classe des 3 billions, doté de capacités de vision natives et d’une fenêtre contextuelle d’un million de tokens.
« Nous vous présentons aujourd’hui Kimi K3, notre modèle le plus performant. Kimi K3 est un modèle de 2,8 T paramètres, basé sur nos techniques « Kimi Delta Attention » et « Attention Residuals », doté de capacités de vision natives et d’une fenêtre contextuelle d’un million de tokens. Il s’agit du premier modèle ouvert au monde de la classe 3T, conçu pour offrir une intelligence de pointe dans les domaines du codage à long terme, du travail intellectuel et du raisonnement », a déclaré Moonshot AI dans un communiqué.
Les poids complets du modèle devraient être publiés d’ici le 27 juillet 2026. Après cette date, pratiquement toute personne qui le souhaite (et qui en a les moyens) pourra se servir librement de ce modèle à poids ouverts.
Les poids ouverts sont désormais au même niveau que les IA de pointe
Pour les fournisseurs propriétaires bien établis, ce lancement est un coup de semonce : selon le portail indépendant de benchmarking Artificial Analysis, Kimi K3 fait son entrée dans l’Intelligence Index avec 57 points, ce qui le place devant Claude Opus 4.8 d’Anthropic (environ 56 points) et GPT-5.6 Terra d’OpenAI (55 points), et à égalité avec Gemini 3.1 Pro de Google. Seuls les modèles de très haut niveau, Claude Fable 5 (environ 60 points) et GPT-5.6 Sol (59 points), restent en tête – avec un écart de seulement deux à trois points.
Moonshot le reconnaît d’ailleurs : « Bien que ses performances globales restent inférieures à celles des modèles propriétaires les plus puissants, Claude Fable 5 et GPT 5.6 Sol, Kimi K3 a affiché des performances de pointe dans l'ensemble de notre suite d'évaluation, surpassant systématiquement les autres modèles testés », a déclaré l'entreprise dans son communiqué.
Classement d’Artificial Analysis
Il convient tout particulièrement de garder à l'esprit que Kimi K3 est désormais presque aussi performant que les modèles d'IA d'Anthropic et d'OpenAI qui ont été bloqués par le gouvernement américain pour des raisons de sécurité il y a respectivement quelques semaines et quelques mois, et dont la diffusion (partielle) n'a ensuite été autorisée qu'à certaines conditions. Moonshot AI, en revanche, prévoit de commercialiser Kimi K3 en tant que modèle à poids ouvert, accessible à pratiquement tout le monde.
Pour replacer les choses dans leur contexte : il y a un an, un écart important séparait encore les principaux modèles ouverts et propriétaires. En règle générale, les modèles ouverts accusaient un retard de six à douze mois par rapport aux modèles de pointe américains. Le fait qu’un modèle librement accessible dépasse désormais plusieurs modèles propriétaires phares et talonne de près le duo de tête absolu (Fable 4 et GPT-5.6 Sol) accentue considérablement la pression sur les prix exercée sur Anthropic, OpenAI et Google, et remet également en question la capacité des États-Unis à conserver leur position dominante dans le domaine de l’IA à l’avenir.
Annonce du lancement de Kimi K3
Voici un extrait du communiqué de Moonshot AI relatif au lancement du modèle d'IA Kimi K3 : «
Un modèle ouvert de classe 3T
Kimi K3 est le premier modèle ouvert à atteindre 2,8 billions (2 800 milliards) de paramètres. Il marque une nouvelle étape dans la progression constante de Kimi vers les limites de l'évolutivité : au cours de neuf des douze derniers mois, les modèles Kimi ont établi la limite supérieure en matière de taille des modèles ouverts.
Kimi K3 s'appuie sur Kimi Delta Attention (KDA) et Attention Residuals (AttnRes), deux mises à jour architecturales conçues pour améliorer la circulation de l'information sur toute la longueur de la séquence et la profondeur du modèle. Nous avons également renforcé la parcimonie de la méthode Mixture of Experts (MoE), en n’activant effectivement que 16 experts sur 896 lorsqu’elle est associée à un framework Stable LatentMoE. Associées à des recettes d’entraînement et de traitement des données affinées, ces modifications structurelles se traduisent par une amélioration d’environ 2,5 fois de l’efficacité globale de mise à l’échelle par rapport à Kimi K2, ce qui permet au modèle de convertir plus efficacement la puissance de calcul en intelligence.
Codage
Kimi K3 offre d'excellentes performances de codage sur le long terme. Fonctionnant avec un minimum de supervision humaine, il est capable de mener à bien de longues sessions d'ingénierie, de naviguer dans des dépôts de code volumineux et de coordonner l'utilisation d'outils en ligne de commande.
Kimi K3 excelle également dans les tâches alliant ingénierie logicielle et raisonnement visuel : il exploite des captures d'écran et des éléments visuels pour optimiser le développement de jeux vidéo, le front-end et la CAO.
Optimisation des noyaux
Nous avons testé la capacité des modèles à optimiser les noyaux GPU. Chaque modèle fonctionne de manière indépendante dans un environnement de test identique, avec un délai maximal de 24 heures pour profiler, réécrire et évaluer quatre tâches comprenant AttnRes, KDA et un noyau MLA à 512 têtes, sur des cartes NVIDIA H200 et un GPGPU d’un autre fournisseur. Kimi K3 a affiché des performances comparables à celles de Fable 5 (avec solution de repli) et a largement surpassé Opus 4.8, GPT 5.6 Sol et GPT 5.5.
Claude Fable 5 a fait l'objet d'une évaluation par un organisme tiers, et ses résultats peuvent inclure des comportements de repli. Sur la plupart des modèles, certaines trajectoires comportent de légers raccourcis de précision acceptables qui restent dans les limites de notre tolérance numérique. Le terme « GPGPU » désigne les processeurs graphiques à usage général utilisés pour des calculs autres que le rendu graphique.
Au cours des dernières phases du développement de Kimi K3, une version préliminaire de Kimi K3 a pris en charge la majeure partie des travaux d'optimisation du noyau menés par l'équipe.
Développement d’un compilateur GPU
Nous avons ensuite vérifié si Kimi K3 était capable de créer de toutes pièces un système de programmation GPU. Kimi K3 a développé MiniTriton, un compilateur compact de type Triton doté de sa propre couche IR au niveau des tuiles par-dessus MLIR, de passes d’optimisation et d’un pipeline de génération de code PTX. Sur l’ensemble des benchmarks « roofline » pris en charge, MiniTriton offre des performances équivalentes, voire supérieures, à celles de Triton et de torch.compile — surpassant même Triton sur certaines charges de travail.
Au-delà des micro-benchmarks, MiniTriton prend en charge l’entraînement de bout en bout de nanoGPT avec une convergence stable, la courbe de perte suivant de près celle de la référence avec seulement de légères divergences — ce qui valide l’ensemble du pipeline sur une charge de travail réaliste.
Ces résultats démontrent que Kimi K3 est capable de construire un compilateur de bout en bout cohérent — du front-end DSL et des passes IR à la génération de code PTX et à l’exécution — plutôt que des noyaux isolés ; son chemin Tensor Core développé entièrement à partir de zéro rivalise déjà avec la pile largement optimisée de Triton.
Développement de jeux et création numérique
Kimi K3 associe de solides capacités de raisonnement 3D, de programmation et de traitement d'images pour transformer des concepts, des images et des vidéos en expériences interactives entièrement jouables. Kimi K3 met en œuvre une véritable « vision en boucle » en alternant de manière fluide entre le code et les captures d'écran en temps réel, ce qui permet de visualiser et d'affiner instantanément les résultats.
Conception de puces
Dans le cadre d’une première validation de concept, Kimi K3 a conçu une puce destinée à un modèle nano basé sur sa propre architecture. En une seule session autonome de 48 heures, K3 a conçu, optimisé et vérifié la puce à l’aide d’outils EDA open source sur la bibliothèque Nangate 45 nm. Sur une surface de 4 mm², la puce atteint une fréquence de 100 MHz et maintient un débit de décodage supérieur à 8 700 jetons/s en simulation, intégrant 1,46 million de cellules standard, 0,277 Mo de SRAM et un réseau MAC INT4 avec déquantification fusionnée. Une puce conçue par un modèle, pour un modèle, reflète les capacités agentiques à long terme de K3.
Le codage au service de la recherche
Kimi K3 fait le lien entre la littérature scientifique et le code exécutable, en mettant en œuvre, en validant et en analysant de manière autonome des flux de travail complexes liés à la recherche computationnelle.
Dans un cas précis, Kimi K3 a accompli en environ deux heures ce qui aurait normalement nécessité une à deux semaines de travail pour un chercheur expérimenté. Pour reproduire les relations universelles I–Love–Q en astrophysique computationnelle, il a passé en revue et validé de manière croisée plus de 20 articles, mis en œuvre l'ensemble du pipeline numérique, évalué plus de 300 équations d'état, identifié des incohérences dans les formules publiées, généré plus de 3 000 lignes de code Python et produit un tableau de bord HTML interactif permettant d'explorer les résultats.
Disponibilité
Kimi K3 est disponible dès maintenant sur Kimi.com, Kimi Work, Kimi Code et l’API Kimi. Lors de son lancement, Kimi K3 utilisera par défaut le niveau d’effort de réflexion « max » ; les modes « faible » et « élevé » seront introduits lors de mises à jour ultérieures.
- Agents Kimi K3 : téléchargez ou mettez à jour l'application Kimi vers sa dernière version depuis votre boutique d'applications mobile (disponible sur iOS, Android et HarmonyOS), ou rendez-vous sur kimi.com.
- Travailler avec Kimi K3 : téléchargez la dernière version de l'application de bureau Kimi Work, version 3.1.0 ou ultérieure, disponible pour Windows et les Mac équipés d'Apple Silicon.
- Programmez avec Kimi K3 : lancez Kimi Code dans votre terminal et sélectionnez Kimi K3 à l'aide de la commande /model.
- Développez avec l’API Kimi : rendez-vous sur la plateforme API Kimi et sélectionnez kimi-k3. Les tarifs sont de 0,30 $/MTok pour les entrées avec accès au cache, de 3,00 $/MTok pour les entrées sans accès au cache et de 15,00 $/MTok pour les sorties. Grâce à l’architecture d’inférence désagrégée de Mooncake, l’API Kimi officielle atteint un taux de réussite en cache supérieur à 90 % pour les charges de travail de codage.
- Adoptez Kimi au sein de votre organisation : Kimi Enterprise offre une confidentialité des données et une gestion des membres de niveau entreprise, avec une séparation totale entre les comptes personnels et ceux de l’organisation.
Nous travaillons actuellement en étroite collaboration avec nos partenaires d'inférence et les responsables de projets open source afin d'harmoniser les détails techniques et de garantir un déploiement fiable à l'échelle de l'écosystème. Les poids complets du modèle seront publiés d'ici le 27 juillet 2026. De plus amples détails sur l'architecture, l'entraînement et les évaluations seront publiés parallèlement au rapport technique de Kimi K3.
»
Source : Kimi K3 (Moonshot AI)
Et vous ?
Quel est votre avis sur le sujet ?
Trouvez-vous cette initiative de Moonshot AI crédible ou pertinente ?
Voir aussi :
La start-up chinoise Moonshot AI lance Kimi K2.6, un modèle open source surpassant Claude et GPT-5.4, doté d'une exécution à long terme, d'essaims d'agents et de capacités de codage IA de bout en bout
GitHub Copilot ajoute le modèle open source Kimi K2.7 Code de la société chinoise Moonshot AI. Kimi K2.7 Code est moins coûteux, mais son origine soulève des questions de conformité et de sécurité nationale
Moonshot AI lance Kimi WebBridge, une extension de navigateur qui permet à des agents IA d'interagir avec des sites web comme le ferait une personne, en effectuant des recherches et extrayant des données
















Quel est votre avis sur le sujet ?
Répondre avec citation







Partager