Claude 3.7 Sonnet et Claude Code : tout ce qu’il faut savoir

Cette semaine, Anthropic a dévoilé Claude 3.7 Sonnet, présenté comme « le premier modèle de raisonnement hybride » de l’entreprise et son « modèle le plus intelligent à ce jour ». Cette nouvelle version, pour laquelle nous poserons la question de l’open source dans cet article, s’accompagne du lancement de Claude Code, un outil de codage agentique, actuellement disponible en version préliminaire limitée.

Claude 3.7 Sonnet et Claude Code représentent une évolution significative dans l’offre d’Anthropic, avec un accent particulier sur les capacités de raisonnement et la collaboration en matière de développement logiciel. L’intégration GitHub constitue une avancée particulièrement intéressante pour la communauté open source, même si le modèle lui-même reste propriétaire.

Claude 3.7 raisonne mieux

Claude 3.7 Sonnet se distingue principalement par ses capacités de raisonnement étendues. Selon Anthropic, ce modèle est « à la pointe de la technologie pour le codage » et offre « des améliorations significatives dans la génération de contenu, l’analyse de données et la planification ».

Une fonctionnalité particulièrement notable est le mode « extended thinking » (pensée étendue), disponible pour les abonnés au plan Pro. Cette fonction permet aux utilisateurs de visualiser le processus de réflexion de Claude parallèlement à sa réponse finale, ce qui améliore considérablement ses performances dans des domaines comme les mathématiques, la physique et les défis de codage complexes.

Claude Code : un collaborateur de développement actif

Claude Code représente la première incursion d’Anthropic dans les outils de codage agentiques. Disponible en version préliminaire de recherche limitée, cet outil en ligne de commande permet aux développeurs d’interagir directement avec Claude depuis leur terminal.

Contrairement à une simple interface de chat, Claude Code peut activement rechercher et lire du code, modifier des fichiers, écrire et exécuter des tests, effectuer des commits et pousser du code vers GitHub, tout en maintenant l’utilisateur informé à chaque étape. Depuis juin 2024, Sonnet est devenu le modèle préféré des développeurs du monde entier, et Claude Code vient renforcer cette position.

Intégration GitHub : un atout majeur pour la communauté open source

Un point particulièrement important pour la communauté des développeurs open source est le lancement d’une intégration GitHub pour tous les plans Claude. Cette nouveauté permet aux développeurs de connecter directement leurs dépôts de code à Claude, offrant ainsi au modèle une compréhension plus approfondie des projets personnels et open source. Gitlab n’est pas encore concerné, par contre.

Grâce à cette intégration, Claude devient un partenaire encore plus puissant pour la correction de bugs, le développement de fonctionnalités et la documentation. Cette fonctionnalité, disponible sur tous les plans, représente un engagement significatif envers la communauté des développeurs et pourrait considérablement faciliter les contributions aux projets open source.

Open source, sécurité et développement responsable

Malgré son soutien à la communauté des développeurs open source via l’intégration GitHub, il est important de noter que Claude 3.7 Sonnet lui-même n’est pas un modèle open source. Anthropic n’a pas rendu public le code source du modèle, ses poids ou sa méthodologie d’entraînement complète. Cette approche contraste avec celle d’autres acteurs du secteur qui proposent des modèles entièrement ou partiellement open source. Anthropic se positionne davantage dans une approche propriétaire, tout en fournissant des outils et des intégrations qui facilitent le travail avec des projets open source.

Anthropic met en avant ses efforts en matière de développement responsable. L’entreprise affirme avoir « mené des tests et des évaluations approfondis de Claude 3.7 Sonnet, travaillant avec des experts externes pour s’assurer qu’il répond à nos normes de sécurité et de fiabilité. »

Le nouveau modèle fait apparemment des « distinctions plus nuancées entre les demandes nuisibles et bénignes », réduisant les refus inutiles de 45% par rapport à son prédécesseur. Anthropic a également publié une « carte système » détaillant les résultats de sécurité dans plusieurs catégories et expliquant comment l’entreprise évalue et atténue les vulnérabilités comme les attaques par injection de prompt.

 

Retour en haut