Anthropic a mis en ligne Claude Sonnet 5.5 le 28 septembre 2026, six jours à peine après Opus 5.5. Le tarif du million de tokens ne change pas : 2 dollars en entrée, 10 dollars en sortie, identique à Sonnet 5. Ce qui bouge, c'est le nombre de tokens et d'allers-retours nécessaires pour boucler une tâche, jusqu'à 30 % de moins selon les chiffres publiés par Anthropic. Pour une entreprise qui fait tourner Claude Cowork sur des dizaines de workflows chaque jour, cette baisse-là pèse plus lourd sur la facture de fin d'année qu'une remise affichée sur un tarif catalogue. Reste à savoir où elle s'applique vraiment, et où elle ne change rien.

Quatre familles de modèles en moins d'un mois

Le calendrier mérite d'être posé à plat. Anthropic a sorti Fable 5.1 et Mythos 5.1 le 1er septembre 2026, Opus 5.5 le 22, puis Sonnet 5.5 le 28. Quatre familles de modèles en moins de quatre semaines, un rythme qu'aucune direction des systèmes d'information ne peut suivre au même tempo qu'un comité de validation trimestriel. Combien d'entreprises ont eu le temps d'auditer sérieusement un changement de modèle avant que le suivant n'arrive sur le marché ?

Anthropic présente Sonnet 5.5 comme le complément rapide et économique d'Opus 5.5, pas comme son remplaçant. La distinction compte pour votre feuille de route IA : Opus 5.5 reste réservé aux tâches qui exigent le raisonnement le plus poussé, tandis que Sonnet 5.5 devient le modèle par défaut pour l'écrasante majorité des usages quotidiens. Claude Code 2.1.284, publié le même jour que Sonnet 5.5, en fait d'ailleurs le nouveau modèle Sonnet par défaut de l'éditeur de code d'Anthropic, un signal assez net sur l'usage que l'entreprise elle-même en attend en interne.

Ce séquencement n'est pas neutre pour votre budget IA. Nous avions détaillé la baisse de prix d'Opus 5.5 dans notre article sur l'impact d'Opus 5.5 sur le budget IA, un modèle taillé pour les dossiers complexes et donc, par nature, minoritaire dans le volume total de requêtes d'une entreprise. Sonnet 5.5, lui, touche le cœur du volume : rédaction de synthèses, génération de code, mise à jour de tableurs, préparation de présentations, tout ce que vos équipes lancent une vingtaine de fois par jour sans même y penser.

Anthropic ne communique pas sur ce point par hasard. Le marché des modèles de langage s'est installé dans un rythme de sortie qui ressemble davantage à celui des applications mobiles qu'à celui des logiciels d'entreprise classiques, où une montée de version majeure se planifie sur plusieurs trimestres. Une direction achats qui négocie encore un contrat IA sur des hypothèses de coût vieilles de six mois travaille déjà sur des bases obsolètes, quelle que soit la qualité de la négociation initiale.

Même tarif catalogue, coût réel en baisse de 30 %

Sur le papier, rien ne change : 2 dollars le million de tokens en entrée, 10 dollars en sortie, un cache en lecture facturé 0,20 dollar et un cache en écriture à 2,50 dollars, des chiffres strictement identiques à ceux de Sonnet 5. C'est deux fois moins cher qu'Opus 5.5, resté à 4 dollars et 20 dollars le million de tokens. Le tarif catalogue, pourtant, ne raconte qu'une partie de l'histoire, et c'est justement la partie la moins intéressante pour votre direction financière.

Anthropic annonce une génération de sortie 30 % plus rapide et un coût par tâche réduit jusqu'à 30 %, obtenu en consommant moins de tokens et en déclenchant moins d'appels d'outils pour arriver au même résultat. L'éditeur va plus loin encore sur un point qui mérite d'être vérifié dans vos propres usages avant d'être pris pour argent comptant : à effort de raisonnement bas ou moyen, Sonnet 5.5 dépasserait, selon Anthropic, les meilleurs résultats obtenus avec Sonnet 5, pour environ un dixième du coût par tâche.

Prenez l'exemple communiqué par Base44, un client cité par Anthropic dans son annonce : une tâche qui réclamait en moyenne 7,7 itérations avec Opus 5 n'en demande plus que 3,6 avec Sonnet 5.5. C'est comme si votre juriste bouclait la relecture d'un contrat en deux allers-retours avec le client au lieu de sept. Le nombre d'échanges chute, le temps de traitement aussi, et la facture suit la même courbe descendante.

Ce type de baisse ne se voit jamais sur une facture mensuelle classique, qui affiche un volume de tokens consommés sans jamais préciser combien de tâches ce volume a permis de terminer. C'est là que le bât blesse pour beaucoup de directions financières : elles pilotent un poste de dépense IA en croissance rapide avec des indicateurs de coût par token, alors que la seule mesure vraiment pertinente reste le coût par tâche terminée avec succès.

Ce que racontent les scores techniques

Les benchmarks publiés par Anthropic dessinent un modèle qui referme l'écart avec le haut de gamme sur plusieurs tâches. Sur Terminal-Bench 4.0, qui mesure la capacité à mener à bien des tâches réelles en ligne de commande, Sonnet 5.5 obtient 70,6 %, contre seulement 10,3 % pour Sonnet 5. Un saut de cette ampleur en une seule génération de modèle reste rare, et il concerne directement les agents qui exécutent des scripts, des extractions de données ou des automatisations dans vos environnements Claude Cowork.

Sur GDPval-AA, un indice composite de tâches professionnelles réelles, Sonnet 5.5 signe 1844 points, à deux points seulement des 1846 obtenus par Opus 5.5, son grand frère deux fois plus cher à l'usage. Sur OSWorld 2.1, qui évalue l'utilisation d'un ordinateur comme le ferait un humain, navigateur, fichiers, interfaces, Sonnet 5.5 atteint 80,1 %. Sur CursorBench 4.0, il plafonne à 55,5 %, contre 57,8 % pour Opus 5.5, l'un des rares écarts où le modèle premium garde une avance nette qui justifie encore son tarif.

Techniquement, Sonnet 5.5 conserve une fenêtre de contexte d'un million de tokens et une sortie maximale de 128 000 tokens, avec une date de connaissance fiable arrêtée à juin 2026. Le raisonnement adaptatif à cinq niveaux d'effort reste activé par défaut, ce qui permet au modèle de doser lui-même l'effort de calcul selon la complexité perçue de la tâche, sans configuration supplémentaire de votre part.

Pour un cabinet qui exploite l'utilisation d'ordinateur de Claude Cowork sur des tâches de saisie ou de vérification croisée entre applications, le score OSWorld 2.1 mérite une attention particulière. C'est précisément le type de scénario où un modèle plus rapide et moins gourmand en tokens change la donne, puisque ces tâches s'exécutent en général par lots de plusieurs centaines, voire plusieurs milliers d'occurrences par mois dans une organisation de taille moyenne.

Les retours clients qui parlent un langage de DAF

Anthropic cite plusieurs entreprises qui ont testé Sonnet 5.5 avant son lancement public, et leurs chiffres parlent davantage à une direction financière que n'importe quel score de benchmark. Chez Box, le traitement des tâches est 2,4 fois plus rapide, avec 12 % de tokens en moins consommés pour y parvenir. Chez Zendesk, le traitement des tickets de support gagne 20 % de vitesse. Chez Slack, la génération de réponses consomme 14 % de tokens en sortie en moins.

L'éditeur de no-code Lovable rapporte un tiers d'appels d'outils en moins et deux fois moins d'exécutions shell pour livrer une fonctionnalité comparable. Voilà qui parlera à toute direction juridique ou tout cabinet de conseil qui automatise des revues de documents avec Claude Cowork : moins d'allers-retours entre l'IA et vos systèmes, c'est moins de temps de traitement facturé, et souvent moins de risque d'erreur d'enchaînement entre deux appels d'outils successifs.

Transposez ces chiffres à un cabinet de courtage qui traite des dossiers de souscription, ou à une compagnie d'assurance qui instruit des sinistres à la chaîne : chaque pourcentage de token économisé sur une tâche répétée des milliers de fois par mois se traduit en économie réelle, pas en gain théorique de laboratoire. Qui, dans votre organisation, a déjà recalculé le coût mensuel de vos flux Cowork les plus répétitifs à la lumière de ces chiffres ?

Aucun de ces clients cités par Anthropic n'opère dans les secteurs réglementés que nous accompagnons au quotidien, ce qui invite à la prudence avant de transposer leurs gains tels quels. Un flux de vérification documentaire en assurance n'a pas la même tolérance à l'erreur qu'une réponse de support client chez Slack, et le vrai test reste celui que vous ferez sur vos propres workflows, avec vos propres volumes.

Sonnet ou Opus : lequel confier à vos équipes

La question n'est plus de savoir si Sonnet 5.5 vaut le coup, mais quelles tâches lui confier plutôt qu'à Opus 5.5. La règle qui se dégage des chiffres publiés par Anthropic reste assez simple : Sonnet 5.5 couvre désormais l'essentiel du volume, rédaction de synthèses, revue de contrats standards, préparation de tableaux de bord, extraction de données de rapports. Opus 5.5 garde son utilité sur les dossiers qui exigent un raisonnement en plusieurs étapes difficilement automatisable, un audit de due diligence complexe ou un arbitrage financier à fort enjeu.

Le risque, pour une direction financière ou une DSI, serait de figer cette répartition une fois pour toutes. Le rythme des sorties de modèles observé depuis le 1er septembre, quatre familles en moins d'un mois, suggère plutôt une revue trimestrielle du routage de vos tâches entre modèles. Une entreprise qui a budgété sa consommation IA sur la base d'Opus 5.5 il y a cinq jours à peine devrait déjà recalculer son coût moyen par tâche à la lumière de Sonnet 5.5, surtout si le gros de son volume Cowork tourne sur des usages de routine plutôt que sur du raisonnement complexe.

Dans les directions financières que nous accompagnons, l'essentiel du volume mensuel de tâches Cowork reste constitué d'usages de routine, bien loin devant les dossiers réellement complexes qui justifient un modèle premium. Si votre organisation ressemble à celles-ci, la baisse de coût par tâche de Sonnet 5.5 touche la majorité de votre volume, potentiellement plus que ce qu'une remise de 20 % sur le tarif d'Opus 5.5 peut apporter à elle seule.

Ce raisonnement vaut aussi pour un cabinet d'avocats qui hésite encore entre confier la rédaction de premières versions de contrats à un modèle unique par souci de simplicité, ou router intelligemment selon la complexité du dossier. La seconde option demande un peu plus de configuration au démarrage, mais elle absorbe mécaniquement chaque nouvelle baisse de coût qu'Anthropic publie, plutôt que de rester figée sur un seul modèle par habitude.

Comment capter cette baisse sans changer vos habitudes

La bonne nouvelle, c'est que la plupart de vos équipes n'ont rien à faire pour bénéficier de cette baisse. Claude Cowork route déjà l'essentiel des tâches courantes vers le modèle Sonnet le plus récent, ce qui signifie que la migration se fait, dans bien des cas, sans intervention de votre DSI. Mais qui, dans votre comité budgétaire, a déjà mis à jour cette hypothèse depuis le 28 septembre ? Ce qui mérite une action de votre part, c'est la mise à jour de vos hypothèses budgétaires : un coût par tâche recalculé il y a cinq jours sur la base d'Opus 5.5 ne tient déjà plus la route pour l'ensemble de votre volume.

Concrètement, trois vérifications suffisent. Recalculez d'abord le coût moyen mensuel de vos trois workflows Cowork les plus répétés, ceux qui tournent des centaines ou des milliers de fois. Vérifiez ensuite avec votre éditeur ou votre intégrateur quels modèles sont réellement mobilisés derrière chaque automatisation, un point que notre formation Claude Cowork couvre en détail pour les équipes qui pilotent ces choix en interne. Gardez enfin un œil sur le rythme des annonces Anthropic : après quatre familles de modèles en un mois, une cinquième sortie avant la fin de l'année ne serait pas une surprise, et Claude Haiku 5.5 est déjà annoncé pour les prochaines semaines.

Le contexte réglementaire ajoute une couche que peu d'entreprises anticipent encore : un modèle moins gourmand en tokens change aussi le volume de données transitant par vos connecteurs, un paramètre que les équipes conformité doivent documenter au même titre que le choix du modèle lui-même. Nous détaillions récemment un exemple voisin dans notre article sur la hausse de quotas de Claude Code, où un geste tarifaire présenté comme favorable cachait un arbitrage moins visible sur l'usage réel. Sonnet 5.5 ne semble pas relever du même cas de figure, mais la vigilance reste de mise avant d'ajuster une ligne budgétaire sur la seule foi d'un communiqué.

Reste la question de fond, valable pour n'importe quel secteur que nous accompagnons, legal, assurance, conseil, immobilier ou gestion d'actifs : un modèle 30 % moins cher par tâche ne sert à rien s'il tourne sur des workflows mal conçus ou des connecteurs mal calibrés. C'est là que se joue la vraie économie, bien plus que dans le choix entre Sonnet et Opus. Claude Cowork vous donne accès au modèle le plus rentable du marché à ce jour ; encore faut-il l'entourer de workflows qui exploitent réellement cette baisse de coût. Réservez 30 minutes avec nous pour recalculer, ligne par ligne, ce que Sonnet 5.5 change concrètement à votre budget IA.