Information de dernière minute : Moonshot AI publie Kimi K3, le premier modèle open source au monde comportant 2 800 milliards de paramètres.

17/07/2026
RUPTURE//KIMI K3 LIBÉRÉ//2,8 BILLIONS DE PARAMÈTRES//896 EXPERTS, 16 ACTIFS//POIDS OPEN-SOURCE 27 JUILLET//RUPTURE//KIMI K3 LIBÉRÉ//2,8 BILLIONS DE PARAMÈTRES//896 EXPERTS, 16 ACTIFS//POIDS OPEN-SOURCE 27 JUILLET// 
WIRE REPORT · IA MOONSHOT

Information exclusive : Moonshot AI lance Kimi K3, une première mondiale. 2,8 billions de paramètres Modèle open source

Le paysage de l'IA open source vient de connaître un bouleversement majeur. Moonshot AI l'a officiellement annoncé. Kimi K3, brisant les limitations précédentes des logiciels libres en introduisant une stupéfiante Modèle de mélange d'experts (MoE) à 2,8 billions de paramètres.

Conçue dès le départ pour l'ingénierie logicielle à long terme, la gestion intégrée des connaissances et le raisonnement multi-étapes approfondi, Kimi K3 représente une étape cruciale. C'est la première fois qu'une architecture open source franchit aisément le cap des 2 000 milliards de paramètres, défiant ainsi les géants propriétaires sur leur propre terrain.

Voici un aperçu complet de l'architecture, des performances, de l'utilité concrète et de l'impact sur les développeurs de cette nouvelle plateforme d'IA ultra-performante.

2,8T
Paramètres
896
Experts totaux
16
Actif / Jeton
1M
Fenêtre contextuelle
Pièce 01 Aperçu du Kimi K3
01

Brillance architecturale : LatentMoE stable et ultra-parcimonie

Au cœur de la machine Kimi K3, d'une puissance colossale de 2,8 tonnes, se cache un modèle d'efficacité informatique. Elle utilise une technologie révolutionnaire. LatentMoE stable Dans ce cadre, Moonshot AI a considérablement étendu la parcimonie du modèle.

Ce modèle présente une caractéristique sans précédent 896 experts au totalmais il achemine et active dynamiquement uniquement 16 experts par jeton.

[Jeton d'entrée] [Routeur LatentMoE stable] (Active 16 experts sur 896) [Sortie optimisée]

Cette avancée structurelle majeure offre des avantages considérables :

  • Mise à l'échelle massive, calcul minimal : Tout en conservant 2,8 billions de paramètres de connaissances fondamentales, le coût d'inférence active imite un modèle beaucoup plus petit.
  • Fenêtre de contexte de jeton natif de 1M : Kimi K3 gère nativement une fenêtre de contexte d'un million de jetons, prise en charge par une mise en cache automatique avancée du contexte pour réduire considérablement la latence de l'API et les coûts supplémentaires.
  • Mode de raisonnement permanent : Contrairement à ses prédécesseurs, Kimi K3 est configuré nativement avec un mode de raisonnement immuable et profond.
Note aux développeurs

⚠️ Note du développeur : Kimi K3 déprécie l'ancien pensée Le paramètre de K2.x. Les développeurs doivent désormais utiliser le effort de raisonnement configuration (actuellement par défaut) max) pour orchestrer sa profondeur cognitive.

02

Comparaison mondiale des performances : Où se situe Kimi K3 ?

Les évaluations internes et les premiers tests de performance de Moonshot AI placent Kimi K3 à l'avant-garde mondiale de l'intelligence artificielle. Dans des séries d'évaluations complètes, les capacités cognitives globales de Kimi K3 se classent parmi les meilleures. juste derrière les fleurons propriétaires comme Claude Fable 5 et GPT-5.6 Sol, surpassant tous ses homologues open source existants.

Pièce 02 Tableau de référence Kimi K3

La matrice des forces fondamentales

Kimi K3 excelle dans trois domaines clés, optimisés pour les flux de travail des agents d'entreprise :

Pilier des capacités Mise en œuvre technique Focus pratique sur l'entreprise
Codage à long terme Exécution de tâches en plusieurs étapes, interactions avec les outils de terminal natifs, ingestion de bases de code volumineuses. Correction autonome des bogues, refactorisation des référentiels existants, agents d'automatisation logicielle.
Raisonnement visuel et SE Allie les flux de travail du génie logiciel à une compréhension visuelle de l'interface utilisateur et de l'expérience utilisateur. Optimisation du frontend, débogage du développement de jeux et analyse de la mise en page CAO à l'aide de captures d'écran.
Travail du savoir Recherche approfondie, synthèse automatisée de documents, déductions logiques à plusieurs étapes. Examen juridique à enjeux élevés, audits de conformité financière et synthèse de documents multiples.
Pièce 03 Schéma d'architecture Kimi K3
03

Analyse approfondie : Cas d’utilisation en entreprise et économie des API

Kimi K3 n'est pas qu'une prouesse technique ; elle est hautement optimisée pour une production rentable. Moonshot AI a mis en place une structure d'API non hiérarchisée et très compétitive, tirant parti de la mise en cache automatique du contexte.

Structure tarifaire de l'API Kimi K3

Plutôt que de sanctionner les développeurs pour les grandes fenêtres de contexte par des pénalités progressives, Kimi K3 facture l'utilisation à des tarifs volumétriques fixes :

Jetons d'entrée (standard)20,00 ¥ / MTok
Succès du cache de contexte (Remise de 90 % pour les structures contextuelles répétées !)2,00 ¥ / MTok
Jetons de sortie100,00 ¥ / MTok
Pièce 04 Tableau des prix de l'API Kimi K3

Boîte à outils d'agent avancé

Pour prendre en charge les flux de travail multi-agents de nouvelle génération, Kimi K3 déploie également de puissantes améliorations de son API :

  • Chargement et contraintes dynamiques des outils : avancé choix_outil Les paramètres permettent aux développeurs d'imposer strictement ou d'ajuster dynamiquement les outils locaux que le modèle peut invoquer en cours de traitement.
  • Sorties structurées haute fidélité : Mode JSON natif et strict format_de_réponse via JSON Schema, assurez-vous que le modèle formate son raisonnement de 2,8 T en structures de données entièrement prévisibles pour l'ingestion par le backend.
04

Chronologie et impact sur l'écosystème des logiciels libres

La communauté open source n'aura pas à attendre longtemps pour obtenir les poids. Moonshot AI collabore actuellement directement avec des partenaires d'inférence, des fabricants de puces et des mainteneurs de projets open source afin d'harmoniser les détails d'optimisation.

Publication publique des poids complets
27 juillet 2026
Accompagnant un rapport technique complet

Cette version ouverte est sur le point de démocratiser complètement la modélisation MoE à très grande échelle. Historiquement, l'exécution ou le réglage fin de modèles à près de 3 000 milliards de paramètres était réservé aux géants de la tech. En optimisant la structure Stable LatentMoE, Moonshot AI offre à l'écosystème mondial des développeurs un modèle pour créer, exécuter et faire évoluer des modèles à paramètres massifs sans nécessiter un supercalculateur dédié.

Verdict : Une nouvelle ère audacieuse pour l'IA open source

Kimi K3 prouve que l'IA open source n'est plus à la traîne ; elle donne le ton. En combinant une base de 2,8 milliards de paramètres avec une activation ultra-précise par 16 experts, Moonshot AI a conçu un modèle à la fois extrêmement intelligent et commercialement viable.

Pour les entreprises technologiques qui cherchent à déployer des agents logiciels complexes et autonomes ou des pipelines de traitement de documents en profondeur sans dépendance vis-à-vis d'un fournisseur propriétaire, le compte à rebours jusqu'au 27 juillet a officiellement commencé.

Que pensez-vous de l'architecture de la Kimi K3 ? La réduction de 90 % sur la mise en cache du contexte va-t-elle changer votre façon de concevoir des agents d'IA ? Faites-nous part de votre avis dans les commentaires ci-dessous et n'oubliez pas de partager cette analyse avec votre équipe d'ingénierie !

Rapport de fil Moonshot AI Kimi K3

Plus de 300 modèles d'IA pour
OpenClaw et agents IA

Économisez 20 % sur vos coûts