Kimi K3 expliqué : Fonctionnalités, prix et bancs d'essai

Kimi K3 est le modèle de 2,8 T en accès libre de Moonshot AI, qui surpasse GPT-5.5 et Opus 4.8 sur les principaux benchmarks. Voir les tarifs complets, les spécifications et comment il se compare à Claude Fable 5.

Image de couverture Kimi K3 expliquant les fonctionnalités, les tarifs et les benchmarks, avec le logo Kimi K3 sur un fond technologique moderne aux accents verts.

Réponse rapide : Kimi K3 est un modèle d'IA à poids ouvert de 2,8 billions de paramètres de la startup chinoise Moonshot AI, lancé le 16 juillet 2026. Il dispose d'une fenêtre contextuelle d'un million de jetons, d'un raisonnement multimodal natif et d'un prix de 3 $ par million de jetons d'entrée et de 15 $ par million de jetons de sortie. Il est en deçà de Claude Fable 5 et GPT-5.6 Sol en termes de performances globales, mais il bat Claude Opus 4.8 et GPT-5.5 sur plusieurs benchmarks de codage et d'agentivité.

Introduction

Moonshot AI, la startup basée à Pékin et soutenue par Alibaba, a lancé Kimi K3 le 16 juillet 2026, que l'entreprise présente comme le plus grand modèle d'IA à poids ouvert au monde par le nombre de paramètres, selon la couverture du lancement par VentureBeat. Le lancement, qui a eu lieu juste avant la Conférence mondiale sur l'intelligence artificielle 2026 à Shanghai, marque un retour en force pour une entreprise dont la position sur le marché s'était érodée au cours des 18 mois précédents, suite à la montée en puissance de DeepSeek.

Moonshot affirme que le modèle est aussi performant que les plateformes de pointe d'OpenAI et d'Anthropic, une affirmation que Bloomberg a rapporté comme le dernier signe que les laboratoires d'IA chinois réduisent l'écart technologique avec les développeurs américains de pointe.

Ce guide couvre ce qu'est Kimi K3, ses principales caractéristiques, sa tarification complète, des benchmarks vérifiés de manière indépendante, et un verdict clair sur qui devrait réellement l'utiliser.

Qu'est-ce que Kimi K3 ?

Kimi K3 est un grand modèle linguistique de classe frontière avec 2,8 billions de paramètres au total, soit environ 75 % de plus que DeepSeek V4 Pro, qui compte environ 1,6 billion de paramètres, selon la description technique de VentureBeat. Moonshot AI a été fondée en 2023 et a levé environ 2 milliards de dollars au cours de ses cycles de financement, avec le soutien d'Alibaba et de Tencent, comme Forbes l'a noté dans son analyse de lancement.

Dans ses propres notes de version, Moonshot décrit le modèle comme sa publication de code open source la plus puissante à ce jour, conçue pour soutenir de longues sessions d'ingénierie, naviguer dans de grands dépôts et orchestrer des outils terminaux avec une supervision humaine minimale.

Principales caractéristiques de Kimi K3

Caractéristique

Détail

Paramètres

2,8 billions au total

Fenêtre contextuelle

1 048 576 jetons (~1M)

Architecture

LatentMoE stable, 896 experts, 16 actifs

Mécanisme d'attention

Kimi Delta Attention (KDA) + Résidus d'attention

Modalité

Multimodal natif (texte et vision)

Mode de raisonnement

"Mode de réflexion" permanent (actuellement effort maximal seulement)

Compatibilité API

Compatible avec le SDK OpenAI

Force principale

Codage, utilisation d'outils, flux de travail agentiques à long terme

Statut du poids

Poids ouvert ; point de contrôle complet prévu pour le 27 juillet 2026

Mieux connu pour

Ingénierie au niveau du dépôt, automatisation de terminal, analyse de documents/images

Les deux innovations architecturales phares, Kimi Delta Attention et Attention Residuals, ont été précédemment publiées en tant que recherches ouvertes par l'équipe de Moonshot, toutes deux visant à améliorer l'efficacité computationnelle à l'échelle. Vous pouvez voir comment elles se manifestent dans des déploiements réels sur la liste officielle de Kimi K3 sur OpenRouter, qui héberge directement le modèle.

Tarification de Kimi K3

Plan / Accès

Prix

Détails

API, jetons d'entrée

3,00 $ / million

Tarif standard

API, jetons de sortie

15,00 $ / million

Tarif standard

API, entrée en cache

0,30 $ / million

Environ trois fois le prix de Kimi K2.6

Application Kimi, Moderato

19 $ / mois

Fenêtre contextuelle de 256K

Application Kimi, Allegretto

39 $ / mois+

Fenêtre contextuelle complète de 1M

OpenRouter

Identique à l'API

Routage à fournisseur unique, pas de solution de repli nécessaire

 

French Kimi K3 pricing table comparing API token costs, Kimi app subscription plans, and OpenRouter pricing, including input, output, cached input rates, and context window details.

Les détails complets de ces tarifs sont disponibles sur la page de tarification d'OpenRouter et dans l' analyse des coûts de The AI Rankings, qui signale également une mise en garde sur les coûts à connaître. Kimi K3 a dominé l'arène de codage WebDev tout en facturant environ un tiers du tarif de Claude Fable 5, mais il est également verbeux. Dans une évaluation indépendante, il a généré 130 millions de jetons de sortie contre une moyenne de 63 millions pour des modèles comparables, ce qui signifie que les coûts réels dépendent fortement de la quantité de jetons de raisonnement que votre charge de travail déclenche.

Benchmarks de Kimi K3

Moonshot a testé K3 contre Claude Fable 5, GPT-5.6 Sol, Claude Opus 4.8, GPT-5.5 et GLM-5.2, tous avec un effort de raisonnement maximal. Des évaluateurs indépendants ont depuis ajouté leurs propres scores.

Benchmark

Score Kimi K3

Résultat vs Concurrents

Terminal-Bench 2.1

88.3

À moins de 0,5 point de GPT-5.6 Sol

Program Bench

77.8

Victoire totale

SWE Marathon

42.0

Victoire totale, avec une large marge

FrontierSWE

81.2

En dessous du 86.6 de Fable 5

DeepSWE (harnais KimiCode)

67.5

Proche de GPT-5.5

DeepSWE (harnais mini-SWE-agent)

67.3

En dessous de GPT-5.6 Sol (73%)

Kimi Code Bench 2.0 (interne)

72.9

Deuxième après Fable 5 (76.9)

Artificial Analysis Intelligence Index

57.1

4ème sur 189 modèles, au-dessus d'Opus 4.8 (55.7)

Classement Arena.ai WebDev

1 679

#1, devant Fable 5 (1 631)

GDPval-AA v2 (travail de connaissance)

1 668 Elo

En hausse par rapport à 1 190 (K2.6), dépasse Opus 4.8

Vals Index (indépendant)

74,7%

2ème sur 38 modèles

Les tableaux de scores complets, avec les notes de provenance source par source, sont suivis en direct sur la page du modèle Kimi K3 de BenchLM et recoupés dans le guide d'évaluation des agents de codage de NxCode, qui vaut la peine d'être lu si vous choisissez un modèle spécifiquement pour les mises à jour de dépendances ou le travail de résolution de problèmes.

Deux mises en garde importantes :

  1. Biais du harnais. Moonshot a exécuté K3 sur son propre harnais KimiCode, tandis que les modèles rivaux ont été exécutés sur les harnais Claude Code ou Codex. Comme le souligne The AI Rankings, ce cadrage favorise structurellement le modèle maison, et l' analyse architecturale approfondie de Graphify confirme que le choix du harnais seul peut faire varier les scores de plusieurs points.

  2. Taux d'hallucination élevé. Artificial Analysis a mesuré un taux d'hallucination de 51 % pour K3, une augmentation par rapport à son prédécesseur, même si la précision brute s'est améliorée, une constatation également relevée dans l' audit indépendant de The AI Rankings.

Aucun score SWE-bench Pro ou SWE-bench Verified vérifié de manière indépendante n'existait au lancement. Les affirmations de Moonshot en matière de codage reposent actuellement sur de nouvelles suites de benchmarks (DeepSWE, FrontierSWE, SWE Marathon) qui ne sont pas encore rejouables de manière indépendante à grande échelle.

Kimi K3 vs Claude Fable 5 vs GPT-5.6 Sol

Moonshot elle-même déclare clairement que K3 est en deçà de Claude Fable 5 et GPT-5.6 Sol en termes de performances globales, tout en surperformant constamment d'autres modèles testés tels qu'Opus 4.8 et GPT-5.5, selon le rapport de CNBC sur la sortie.

Où Fable 5 gagne : Raisonnement brut et la plupart des benchmarks de vision. Selon la comparaison directe de BinaryVerse AI, Fable 5 obtient des scores significativement plus élevés sur HLE-Full, CharXiv et MathVision, et détient une nette avance sur FrontierSWE.

Où K3 gagne : Débit ajusté au coût, codage WebDev et frontend, SWE Marathon (ingénierie soutenue de plusieurs heures) et compréhension de documents via OmniDocBench, selon la même analyse de BinaryVerse AI.

En résumé : Si votre charge de travail est un raisonnement de recherche ouvert ou une analyse visuelle complexe, Fable 5 est le choix le plus fort aujourd'hui. Si votre charge de travail est une automatisation de codage à grand volume où le coût par tâche est important, K3 est une alternative légitime et moins chère.

Qui devrait utiliser Kimi K3 (et qui devrait s'en abstenir)

Utilisez Kimi K3 si :

  • Vous avez besoin d'un agent de codage à contexte élevé pour de grands dépôts à un coût inférieur à celui des modèles frontières fermés

  • Vous voulez un modèle à poids ouvert que vous pourrez éventuellement héberger vous-même une fois que les poids complets seront disponibles

  • Votre charge de travail concerne l'automatisation de terminaux, les tâches de tableur ou l'analyse de documents plutôt que le raisonnement de recherche approfondie

Évitez Kimi K3 si :

  • Votre priorité est de minimiser les hallucinations sur des tâches factuelles ou axées sur la recherche

  • Vous avez besoin des performances de vision ou de raisonnement à long terme les plus solides disponibles

  • Vous êtes sensible aux coûts liés aux jetons de sortie, car la verbosité de K3 peut éroder son avantage de prix en pratique.

Réaction de l'industrie

Les analystes de Bank of America ont salué l'approche de Moonshot dans une note couverte par Forbes, écrivant que malgré un accès limité aux puces avancées, l'entreprise a démontré qu'elle pouvait réaliser des progrès majeurs grâce à une meilleure méthodologie d'entraînement et une meilleure conception de modèle.

La réaction du marché a été vive. Selon le même rapport de Forbes, les actions des concurrents chinois Zhipu et MiniMax ont chuté respectivement de 28,4 % et 15,6 % à la Bourse de Hong Kong suite à l'annonce, et les actions de Z.ai, qui avait lancé son propre modèle en juin, ont chuté de la même ampleur que Zhipu.

Les commentateurs indépendants ont été plus mesurés que le marché. Dans des commentaires à CNBC, un dirigeant de startup d'IA a noté que K3 est véritablement fort dans des domaines comme le codage et pourrait intéresser les développeurs des laboratoires d'IA, tandis qu'un autre analyste a attribué une partie de l'intensité autour du lancement à des débats plus larges sur la politique américano-chinoise concernant l'accès aux modèles open source plutôt qu'aux seuls mérites techniques du modèle.

★ Certificat PDF gratuit inclus

Maîtriser la loi européenne sur l'IA et la gouvernance de l'IA.

Acquérez des connaissances pratiques de la loi européenne sur l'IA, des cadres de gouvernance de l'IA, de la gestion des risques, des exigences en matière de documentation et des pratiques d'IA responsable. Obtenez un certificat PDF reconnu sans frais supplémentaires. Apprenez à élaborer des programmes de gouvernance de l'IA conformes, à gérer les obligations réglementaires et à soutenir l'adoption d'une IA fiable au sein de votre organisation.

S'inscrire maintenant →

Kimi K3 est-il Open Source ?

Oui, avec une nuance de temps. Kimi K3 est conçu comme une version à poids ouverts, mais aucun point de contrôle, licence ou carte de modèle n'avait été publié au lancement. Les poids complets étaient prévus pour le 27 juillet 2026, selon la documentation technique examinée par des chercheurs avant la publication. Sa lignée précédente, Kimi K2, reste disponible en poids ouverts sous une licence MIT modifiée, selon The AI Rankings.

L'adoption des modèles Kimi précédents par les développeurs est déjà en cours. Comme Fortune l'a rapporté, Cursor, la startup de codage IA, a utilisé un modèle Kimi antérieur pour aider à construire Composer 2, son propre agent de codage.

Comment accéder à Kimi K3

  • Application Kimi : Abonnement payant requis (niveaux Moderato ou Allegretto)

  • API Moonshot : Compatible OpenAI SDK, paiement par jeton

  • OpenRouter : Hébergement par un seul fournisseur, redirection directe des requêtes

Foire aux questions

Kimi K3 a été développé par Moonshot AI, une startup basée à Pékin et soutenue par Alibaba et Tencent.

Kimi K3 a été lancé le 16 juillet 2026.

Kimi K3 compte 2,8 billions (2,8 trillions) de paramètres au total.

Kimi K3 prend en charge une fenêtre de contexte de 1 048 576 jetons, soit environ 1 million de jetons.

Kimi K3 est légèrement en retrait par rapport à Claude Fable 5 pour les performances globales et les tâches de raisonnement complexes, mais il surpasse Claude Opus 4.8 sur plusieurs benchmarks de programmation et d'agents IA.

Non. Lors de son lancement, Kimi K3 n'était pas entièrement open source. La publication complète des poids du modèle était prévue pour le 27 juillet 2026.

Oui. Kimi K3 est conçu pour orchestrer des outils en ligne de commande, automatiser des tâches complexes et exécuter de longues sessions d'ingénierie avec une supervision minimale.

Kimi K3 repose sur une architecture Stable LatentMoE (Mixture of Experts) comprenant 896 experts, dont 16 sont activés à chaque passage, associée aux technologies Kimi Delta Attention et Attention Residuals.