Pour ne rien manquer

Actualités

Anthropic lance Claude Sonnet 5.5, un modèle plus rapide pour les tâches courantes

Claude Sonnet 5.5 arrive avec la même tarification par jeton que son prédécesseur, mais Anthropic affirme qu’il exécute les tâches plus vite et avec moins de jetons.

Par Le Journal IAPublié le Annonce du 6 min de lectureMis à jour le
Illustration générée par IA : trois ordinateurs portables affichent des graphiques flous sur l’établi usé d’un atelier de réparation, près d’un chronomètre et d’un câble réseau orange.

Un modèle intermédiaire destiné au travail quotidien

Anthropic a lancé Claude Sonnet 5.5 le 28 septembre 2026. L’entreprise le présente comme le deuxième membre de sa famille Claude 5.5, après Opus 5.5, et comme une option conçue pour les tâches bien définies : corriger un bogue, préparer un document, bâtir une présentation, analyser un tableau ou exécuter un flux de travail agentique. Opus demeure la proposition privilégiée par Anthropic pour les mandats ouverts qui demandent un jugement soutenu. Sonnet 5.5 est maintenant offert dans les applications Claude, sur la plateforme destinée aux développeurs et chez les grands fournisseurs infonuagiques mentionnés par Anthropic, dont Amazon Web Services, Google Cloud et Microsoft Azure. Son identifiant d’API est claude-sonnet-5-5. L’annonce ne signifie pas que tous les produits utilisant Claude migreront automatiquement. Chaque équipe doit vérifier le modèle réellement sélectionné, le réglage d’effort et les conséquences d’une migration sur ses outils, ses consignes et ses contrôles.

Même prix par jeton, économie annoncée par tâche

La tarification publiée pour Sonnet 5.5 reste fixée à 2 $ US par million de jetons d’entrée et à 10 $ US par million de jetons de sortie. Les lectures de cache coûtent 0,20 $ US par million de jetons et les écritures de cache, 2,50 $ US. Anthropic affirme néanmoins que le nouveau modèle peut coûter jusqu’à 30 % moins cher par tâche que Sonnet 5, parce qu’il utiliserait moins de jetons pour arriver au résultat. L’entreprise dit aussi qu’il produit ses réponses plus de 30 % plus rapidement. Cette nuance compte pour une PME. Un prix identique au million de jetons ne garantit ni une facture identique ni une économie. Le coût réel dépend de la longueur des demandes, des réponses, des appels d’outils, des reprises et du niveau d’effort choisi. Une équipe qui veut vérifier le gain devrait faire exécuter les mêmes cas à l’ancien et au nouveau modèle, puis comparer le coût complet d’un résultat accepté. Mesurer seulement la vitesse d’une première réponse peut masquer les corrections humaines et les relances nécessaires.

Des résultats de tests élevés, accompagnés de limites importantes

Anthropic rapporte un score de 70,6 % sur Terminal-Bench 4.0 pour Sonnet 5.5, contre 10,3 % pour Sonnet 5. Sur CursorBench 4.0, le nouveau modèle obtient 55,5 %, comparativement à 34,1 % pour son prédécesseur. L’entreprise publie aussi des progrès sur des évaluations de travail intellectuel, d’utilisation d’ordinateur et de compréhension de graphiques. Ces chiffres suggèrent une amélioration importante dans certains scénarios, particulièrement pour le développement logiciel et les tâches effectuées avec des outils. Ils ne constituent toutefois pas une mesure universelle de qualité. Les résultats proviennent de l’annonce et de la carte système d’Anthropic, avec des méthodes, des réglages d’effort et des environnements précis. Anthropic reconnaît elle-même que les bancs d’essai ne couvrent qu’une partie des capacités et qu’Opus 5.5 demeure plus fort pour les travaux complexes et ouverts. Une note précise aussi que certaines évaluations ont été menées sur une version préalable touchée par un bogue de sorties structurées. Pour une organisation québécoise, un essai sur ses propres documents, accents, logiciels et critères demeure plus utile qu’un classement général.

Des capacités cyber plus fortes et de nouveaux garde-fous

Anthropic indique que les capacités de Sonnet 5.5 en cybersécurité progressent assez pour justifier des mesures semblables à celles de ses modèles les plus puissants. Les demandes ordinaires de programmation et de correction de bogues doivent continuer de fonctionner, tandis que certaines tâches à risque élevé peuvent être redirigées vers Sonnet 5. L’entreprise annonce également des classificateurs destinés à freiner l’extraction industrielle du raisonnement du modèle au moyen de milliers de comptes. Sur un audit comportemental automatisé couvrant environ 1 850 scénarios, Anthropic affirme que Sonnet 5.5 égale ou améliore Sonnet 5 sur la plupart des mesures examinées. La carte système rappelle cependant qu’aucun ensemble d’évaluations ne peut repérer toutes les défaillances. Pour une entreprise, ces protections du fournisseur ne remplacent donc pas les permissions minimales, les journaux d’activité, l’approbation humaine et la possibilité d’interrompre un agent. Un modèle plus efficace peut accomplir plus d’étapes avant qu’une erreur soit remarquée; la surveillance doit suivre cette nouvelle cadence.

Une migration à traiter comme un essai contrôlé

Le lancement peut intéresser les équipes qui utilisent déjà Sonnet pour des volumes importants de soutien, de rédaction, d’analyse ou de code. La première étape raisonnable consiste à choisir une vingtaine de tâches représentatives, avec les réponses acceptées et les erreurs connues. Il faut ensuite exécuter l’ancien et le nouveau modèle avec les mêmes outils, documents et contraintes, tout en enregistrant le temps, le nombre de jetons, les interventions humaines, les erreurs et le coût final. Une migration ne devrait pas reposer uniquement sur une réduction annoncée de 30 %. Les équipes doivent vérifier la stabilité des sorties structurées, le comportement lors d’un outil indisponible, le respect des consignes, les réponses en français canadien et les cas où le système doit demander une approbation. Anthropic précise aussi qu’un réglage appelé between_tools est requis pour certains usages où le raisonnement initial est désactivé. Ce détail technique illustre le point principal : un meilleur modèle peut réduire les délais, mais sa valeur dépend encore de la qualité du processus qui l’entoure et de la preuve obtenue dans le contexte réel de l’organisation.

Cette actualité repose sur l’annonce et la carte système publiées par Anthropic le 28 septembre 2026. Les résultats de bancs d’essai, les gains de vitesse, les économies et les conclusions de sécurité sont attribués à l’entreprise; Le Journal IA n’a pas reproduit ces évaluations de façon indépendante.

Notre démarche éditoriale · Signaler une erreur

Pour poursuivre