Mark Zuckerberg s'exprimant lors d'une conférence sur la stratégie IA de Meta

Mark Zuckerberg a encore changĂ© d’avis : Meta libère Muse Glimmer 30B en open source

Mark Zuckerberg a encore changĂ© d’avis ! Après avoir fermĂ© ses modèles phares pendant des mois, Meta fait volte-face et publie Muse Glimmer 30B sous licence Apache 2.0. Un modèle taillĂ© pour faire tourner des agents d’IA souverains sur votre machine.

L’intention de verrouiller son modèle phare Muse Spark au sein de la division Superintelligence Labs laissait craindre un abandon dĂ©finitif du logiciel libre, mais le gĂ©ant de Menlo Park pivote de nouveau. Dans une annonce officielle publiĂ©e par Meta AI, l’entreprise dĂ©voile Muse Glimmer, un modèle de 30 milliards de paramètres spĂ©cialement taillĂ© pour exĂ©cuter des agents autonomes directement sur les machines des utilisateurs. Les poids du modèle sont mis Ă  disposition sous licence Apache 2.0 sur la plateforme Hugging Face.

Le lancement s’accompagne d’un essai de 14 pages signĂ© par le PDG intitulĂ© « L’avenir de l’IA appartient Ă  tous », s’inscrivant dans la continuitĂ© de sa promesse estivale oĂą Mark Zuckerberg s’engageait Ă  promouvoir l’IA open source. Le dirigeant y rĂ©affirme sa vision : « Au lieu de centraliser la superintelligence, nous devrions la distribuer. Cela pourrait ouvrir une nouvelle ère d’Ă©mancipation individuelle. »

30 milliards de paramètres comprimés pour tourner sur GPU grand public

Si la dĂ©clinaison propriĂ©taire Muse Spark reste un service payant accessible uniquement par API cloud, Muse Glimmer offre une alternative locale quasi identique, optimisĂ©e pour fonctionner sur un simple PC ou Mac Ă©quipĂ© de 24 Go ou 32 Go de mĂ©moire vidĂ©o (VRAM). Pour rĂ©ussir ce tour de force sans sacrifier la prĂ©cision d’exĂ©cution, les ingĂ©nieurs de Meta ont appliquĂ© plusieurs techniques d’ingĂ©nierie clĂ©s :

  • Quantification 4 bits (K-Quant) : la taille du modèle passe de plus de 55 Go en pleine prĂ©cision Ă  moins de 20 Go, laissant l’espace nĂ©cessaire au cache mĂ©moire et au module de perception visuelle.
  • DĂ©codage spĂ©culatif avec DFlash : l’intĂ©gration d’un petit rĂ©seau compagnon accĂ©lère la vitesse de gĂ©nĂ©ration de 1,5x Ă  3,1x sur les cartes graphiques grand public comme la RTX 5090 ou les puces Apple M4/M5 Max.
  • Distillation de connaissances : le modèle a Ă©tĂ© prĂ©entraĂ®nĂ© sur les sorties de Muse Spark pour transfĂ©rer les capacitĂ©s de raisonnement complexe vers une architecture compacte.

PensĂ© nativement pour les workflows agentiques, le système gère le chaĂ®nage d’instructions sur de longs horizons, la correction autonome d’erreurs en cas d’Ă©chec d’un outil, ainsi que le traitement multimodal combinant texte et images.

Un fonds pour calmer les tensions locales

Cette publication intervient dans un climat de vive concurrence internationale avec les modèles ouverts diffusĂ©s par les acteurs chinois et les dĂ©bats rĂ©glementaires Ă  Washington. En parallèle, Meta annonce la crĂ©ation d’un fonds de 920 millions d’euros (1 milliard de dollars) destinĂ© aux communautĂ©s riveraines de ses centres de donnĂ©es. Une mesure d’accompagnement visant Ă  apaiser l’opposition locale face Ă  la montĂ©e en charge industrielle de ses infrastructures, notamment autour de son gigantesque complexe en Louisiane dont le budget dĂ©passe dĂ©jĂ  les 46 milliards d’euros.

Disponible immĂ©diatement, Muse Glimmer s’intègre dĂ©jĂ  aux environnements de dĂ©ploiement locaux comme llama.cpp, ExecuTorch, LM Studio et MLX, permettant aux dĂ©veloppeurs de concevoir des agents IA indĂ©pendants du cloud.


🦋 L’actualité de l’open source en français dans votre flux. Suivez Goodtech sur Bluesky (ou vos applications AT Protocol comme W Social et Mu) grâce à notre compte officiel. Suivez, partagez, abonnez-vous à @goodtech.info !

Retour en haut