Visuel publicitaire abstrait de la firme Cohere. Le fond affiche un dégradé de couleurs fluorescentes très saturées mêlant du rouge vif, du jaune acide, du vert émeraude et du bleu turquoise. Au centre de l'image, le logo de Cohere, composé de trois formes organiques noires texturées, est placé à gauche de l'inscription textuelle noire "Command A+".

Oubliez OpenAI : Cohere lâche un monstre de 218 milliards de paramètres (sous licence Apache)

Coup d’éclat pour la licorne canadienne Cohere. Elle vient de publier ce week-end un nouveau modèle d’élite, Command A+, sous la licence ultra-permissive Apache 2.0. C’est une rupture radicale pour l’éditeur, qui abandonne pour la première fois ses restrictions commerciales habituelles pour livrer un modèle d’infrastructure entièrement gratuit, sans frais de licence ni verrous propriétaires.

Cette annonce s’inscrit dans une stratégie d’ouverture agressive. En février dernier, la startup avait déjà amorcé ce virage en dévoilant la famille Tiny Aya de modèles multilingues open weight pour démocratiser l’accès à l’IA hors ligne. Avec le lancement de Command A+, détaillé dans l’annonce officielle de Cohere, l’entreprise passe à la vitesse supérieure en offrant des capacités agentiques industrielles au monde de l’open source.

Un colosse d’efficacité taillé pour l’IA souveraine

Command A+ s’appuie sur une architecture de type Mixture-of-Experts (MoE) totalisant 218 milliards de paramètres, dont seulement 25 milliards sont activés par jeton (token). Cette prouesse d’ingénierie lui permet d’accepter des entrées multimodales (textes et images) à travers une immense fenêtre de contexte de 128 000 tokens, tout en réduisant drastiquement l’empreinte informatique requise pour l’exploiter. Le modèle prend en charge nativement 48 langues et se montre particulièrement redoutable sur les tâches de raisonnement complexe, de programmation et de traitement de documents multi-pages.

Au-delà des performances brutes, cette publication sous licence Apache 2.0 est un manifeste politique en faveur de l’IA souveraine. À l’heure où les gouvernements et les industries réglementées refusent de dépendre des géants du cloud américains ou chinois, Command A+ offre une alternative privatisable, exécutable en toute sécurité au sein d’infrastructures isolées (air-gapped). Cette philosophie fait écho à la récente fusion de Cohere avec l’allemand Aleph Alpha et au rachat de Reliant AI, consolidant un pôle occidental hautement stratégique dédié à la confidentialité des données.

Comparaison des capacités de Command A+ avec d'autres modèles de la famille Command A
Comparaison des capacités de Command A+ avec d’autres modèles de la famille Command A

Une vitesse hallucinante optimisée pour tourner en local sur un seul GPU

La force de Command A+ réside dans son optimisation matérielle extrême. Conçu dès le départ pour la compression à faible perte, le modèle délivre des performances exceptionnelles grâce à sa quantification en 4 bits (W4A4). En production, cette architecture permet à ce colosse de s’exécuter de manière fluide sur un unique GPU Nvidia Blackwell B200 ou sur une paire de puces H100, réduisant de 17 % le temps de latence avant le premier jeton généré par rapport aux générations précédentes.

Aller plus loin

Les ingénieurs peuvent dès à présent télécharger les poids ouverts sur Hugging Face dans plusieurs formats de quantification ou se plonger dans la documentation technique de Command A+ pour configurer leurs pipelines d’agents autonomes. Enfin, pour les curieux qui souhaitent évaluer le comportement du modèle et son nouveau tokenizer multilingue ultra-rapide avant de le déployer, il est possible de tester gratuitement Command A+ sur son espace Hugging Face Space dédié.

Retour en haut