La transition des architectures d’intelligence artificielle de la phase de R&D vers la production industrielle impose de nouvelles contraintes économiques et de gouvernance. Pour régler cela, l’éditeur Mirantis a annoncé cette semaine le déploiement de fonctionnalités majeures pour sa plateforme open source k0rdent AI.
Quelques semaines après avoir analysé l’alliance open source entre Nebul et k0rdent pour le cloud souverain, cette mise à jour marque un tournant stratégique. La plateforme ne se contente plus de gérer l’infrastructure physique sous-jacente ; elle fournit désormais aux entreprises, aux neoclouds et aux opérateurs de clouds GPU les outils nécessaires pour gouverner, optimiser et monétiser directement leurs services d’inférence.
Le déploiement industriel de l’IA se heurtait jusqu’alors à une asymétrie technique : les équipes informatiques traitaient souvent les modèles de langage comme de simples conteneurs logiciels traditionnels. Or, les grands modèles (LLM) possèdent des cycles de vie, des exigences de conformité et des contraintes d’infrastructure qui leur sont propres. Pour sortir du bricolage de scripts fragiles, Mirantis introduit trois briques logicielles interconnectées.
Le premier composant, k0rdent AI Inference Mesh, fait office de tour de contrôle pour les requêtes. Il se charge de router, mesurer, auditer et sécuriser chaque demande d’inférence à travers les différents clusters, régions et fournisseurs de calcul. Cette visibilité en temps réel permet aux directeurs financiers et aux responsables de la conformité de suivre précisément les coûts opérationnels et de détecter les éventuels écarts vis-à-vis des cadres réglementaires.
Pour rentabiliser ces requêtes, le moteur k0rdent AI Inference Runtime intervient au niveau de la performance brute. Son architecture logicielle est optimisée pour maximiser le nombre de tokens traités par seconde par GPU, augmentant ainsi le taux d’utilisation du matériel et réduisant le coût global d’exploitation pour l’hébergeur.
k0rdent AI Model Registry : la distribution sécurisée au format OCI
Le stockage et la distribution des versions de modèles au sein d’une infrastructure hautement distribuée (du datacenter central à la périphérie du réseau) représentent un casse-tête de sécurité. La brique k0rdent AI Model Registry apporte une réponse standardisée en proposant un registre sécurisé natif OCI (Open Container Initiative).
Ce registre est spécifiquement optimisé pour cataloguer et déployer les LLM de base, leurs variantes affinées (fine-tuned), ainsi que les builds quantifiés. En centralisant ces actifs, la plateforme simplifie l’application des règles de souveraineté numérique, garantissant que les modèles entraînés sur des données privées restent confinés dans des zones d’atterrissage hautement contrôlées.
Ces nouveautés logicielles consolident l’écosystème de calcul Kubernetes-native de Mirantis, qui englobe le bare metal, les instances virtuelles et les architectures de clouds isolés (air-gapped).
Les trois modules sont accessibles dès à présent en préversion publique sur le site officiel de k0rdent.
