Même grille tarifaire, facture plus basse
Anthropic a lancé Claude Sonnet 5.5 le 28 septembre 2026, deuxième modèle de la famille Claude 5.5 après Opus 5.5. Son prix est exactement celui de Sonnet 5 : 2 dollars par million de tokens en entrée, 10 dollars par million de tokens en sortie et 0,20 dollar par million de tokens pour les lectures du cache. L'économie vient du fait que le modèle a besoin de bien moins de tokens pour finir le même travail.
| Benchmark | Sonnet 5 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 10,3 % | 70,6 % | 66,4 % |
| CursorBench 4.0 | 34,1 % | 55,5 % | 57,8 % |
| GDPval-AA v2.1 | 1449 | 1844 | 1846 |
| FrontierCode 1.1, jeu principal | 42,4 % | 46,2 % en effort maximal | 54,4 % |
| OSWorld 2.1, partiel | 57,0 % | 80,1 % | 81,8 % |
Ce sont des chiffres d'Anthropic elle-même, et l'entreprise précise qu'Opus 5.5 reste nettement plus fort sur le travail complexe et ouvert qui exige un jugement soutenu. Sonnet 5.5 vise les tâches quotidiennes bien délimitées, la correction de bogues et les documents, présentations et tableurs soignés.
Pourquoi le coût par tâche est le chiffre à suivre
Anthropic dit que Sonnet 5.5 coûte jusqu'à 30 pour cent de moins par tâche que Sonnet 5 et génère ses sorties plus de 30 pour cent plus vite, ce qui en fait le Sonnet le plus rapide à ce jour. Une grille tarifaire plate le cache, car la facture dépend du nombre de tokens qu'un travail exige.
Le réglage d'effort déplace encore la facture. Selon Anthropic, en effort moyen, réglage par défaut des applications Claude, Sonnet 5.5 dépasse le meilleur score de Sonnet 5 sur Terminal-Bench pour moins d'un dixième du coût par tâche. En effort élevé, réglage par défaut de la Claude Platform, il égale le meilleur score de GPT-6 Sol sur FrontierCode pour environ un cinquième du coût par tâche. Anthropic précise que GPT-6 Sol n'a pas été publié sur certains benchmarks, elle a donc utilisé GPT-5.6 Sol.
Le risque se trouve à l'autre bout. Simon Willison, qui a testé le modèle le jour du lancement, a rapporté qu'en effort maximal un prompt a tourné 128 000 tokens pour 1,28 dollar sans produire de réponse. Son essai xhigh du même prompt a coûté 5,74 centimes et pris 41 secondes.
Ce qui a changé d'autre avec cette sortie
Sonnet 5.5 est le premier modèle Sonnet à sortir avec des garde-fous de cybersécurité et des solutions de repli comme ceux qu'Anthropic a conçus pour ses modèles les plus capables, car ses capacités de cybersécurité sont comparables à celles d'Opus 5. Les garde-fous visent un ensemble étroit de requêtes à haut risque, et Anthropic dit que le développement logiciel courant et la plupart des travaux en sciences de la vie ne sont pas touchés.
Willison a aussi noté que Sonnet 5.5 est désormais le modèle de l'offre gratuite de claude.ai, et dit que, selon sa lecture, l'offre gratuite de ChatGPT utilise le plus faible Luna 5.6. Si c'est exact, un compte gratuit accède désormais à un modèle plus puissant du côté d'Anthropic.
Anthropic a répété que Claude Haiku 5.5, conçu pour les gros volumes et le travail sensible aux coûts, rejoindra la famille dans les prochaines semaines.
Que faire avant de changer
Relancez vos propres tâches en effort faible et moyen, pas seulement au réglage maximal, et comparez le coût par travail terminé plutôt que le prix par token. Les benchmarks du fabricant ne disent pas combien de tokens vos prompts vont brûler.
Fixez un plafond strict de tokens et un effort par défaut par charge de travail avant que le modèle n'entre dans une boucle d'agent, car le défaut rencontré par Willison coûte de l'argent réel quand il se répète à grande échelle. Si votre équipe fait des tests de sécurité, vérifiez comment les nouveaux garde-fous traitent vos requêtes.
Gardez les modèles de classe Opus pour le travail de jugement ouvert qu'Anthropic leur réserve elle-même, et orientez vers Sonnet le volume bien délimité.
Mise à jour, 7 octobre 2026 : Anthropic a lancé Claude Haiku 5.5 comme promis et divisé par deux le prix de lecture du cache de Sonnet 5.5, de 0,20 à 0,10 dollar par million de tokens, ce qui rend Sonnet, selon elle, environ 20 pour cent moins cher sur la plupart des tâches d'agents.
Servola Journal
Nous faisons cela pour tous ceux qui essaient de suivre ce que la technologie fait à nos vies. Les personnes qui la construisent, et les personnes à qui cela arrive. Le Servola Journal existe pour que ce que nous apprenons appartienne à tous.
Personne ne nous paie pour cela. Pas de publicité, pas de mur payant, gratuit pour tous. Nous croyons simplement que comprendre ce qui nous arrive à tous ne devrait pas dépendre de qui peut se permettre de payer pour cela.
Si cela vous a apporté quelque chose aujourd'hui, dites-le-nous pour que nous continuions. Suivez-nous, laissez un like, ou écrivez un commentaire positif. Nous les lisons tous, et ce sont eux qui nous font continuer.
À lire ensuite: Haiku 5.5 : 10x moins cher par token, pas par tâche | Vos requêtes de cybersécurité ont été redirigées en silence



