Capture d'écran de la page d'accueil sombre du service Kimi montrant le champ de saisie du modèle d'IA

Le plus grand modèle ouvert au monde est arrivé : Huawei et Alibaba s’unissent pour Kimi K3

Le modèle à poids ouverts le plus massif au monde est disponible ! Moonshot AI vient de publier les 2,8 trillions de paramètres de Kimi K3. En quelques heures, Huawei et Alibaba ont déployé l’infrastructure pour le faire tourner sur du matériel chinois.

Publier l’intégralité des paramètres d’une matrice de 2 800 milliards de paramètres (2.8T) pour bousculer la domination des modèles propriétaires américains : c’est le coup de force réalisé cette semaine par le chinois Moonshot AI. Dans une annonce sur X, la start-up de Pékin a officialisé la mise à disposition des poids de Kimi K3, son modèle multimodal natif le plus performant.

L’engouement de la communauté a été immédiat : les fichiers publiés sur la page Hugging Face de Kimi K3 ont pris la tête des tendances mondiales en seulement trente minutes. Les équipes de recherche peuvent également consulter le rapport technique de Kimi K3 et le code source sur le dépôt GitHub de Moonshot AI.

Une architecture sparse taillée pour le travail autonome

Contrairement aux idées reçues sur la lourdeur des modèles géants, Kimi K3 repose sur une architecture Mixture-of-Experts (MoE) ultra-frugale appelée Stable LatentMoE. Sur un total de 896 experts disponibles, le système n’active que 16 experts par token, offrant un gain d’efficacité d’entraînement d’un facteur 2,5 par rapport à la génération précédente.

Distribué sous la licence spécifique Kimi K3 License, le système se distingue par plusieurs avancées  :

  • Poids ouverts et fenêtre géante : accès aux paramètres du modèle (open weight) tout en gérant une fenêtre de contexte d’un million de tokens.

  • Multimodalité native : traitement direct du texte, des images et des flux vidéo au sein d’un même réseau de neurones sans passer par des encodeurs externes séparés.

  • Capacités d’agent autonome : exécution de tâches complexes de programmation au long cours, navigation dans d’immenses dépôts de code et orchestration d’outils système sans supervision humaine.

Mobilisation express chez Huawei et Alibaba

L’enjeu de cette publication dépasse le cadre logiciel : il s’agit d’orchestrer le déploiement d’une IA souveraine (Ndlr : pour la Chine), capable de tourner sur des infrastructures matérielles affranchies des puces américaines sous embargo.

Quelques heures seulement après la mise en ligne des poids, Alibaba Cloud a confirmé la compatibilité immédiate de son instance Zhenwu M890 avec le modèle, permettant son intégration sur la plateforme applicative Kimi.com et via l’API Bailian. De son côté, la division Ascend de Huawei a annoncé la prise en charge de Kimi K3 sur ses accélérateurs Ascend 950 et Atlas A3, exploitant l’architecture à 896 experts sur des super-nœuds distribués.

Pour exécuter une inférence fluide sur un tel volume de paramètres, Kimi K3 exige un cluster minimal de 64 GPU interconnectés. Cette exigence pousse les acteurs internationaux de l’hébergement cloud (comme Baseten ou Fireworks) et les outils de développement (à l’image de Cursor ou de l’agent virtuel Devin) à adapter leurs infrastructures en urgence pour proposer ce niveau de performance ouvert à leurs utilisateurs.

🦋 L’actualité de l’open source en français dans votre flux. Suivez Goodtech sur Bluesky (ou vos applications AT Protocol comme W Social et Mu) grâce à notre compte officiel. Suivez, partagez, abonnez-vous à @goodtech.info !

Retour en haut