Le 28 septembre 2026, Anthropic a annoncé Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5 après Opus 5.5. Le message est simple : c’est une mise à jour nette de Sonnet 5 qui tourne plus de 30 % plus vite et coûte jusqu’à 30 % moins cher par tâche.

Le positionnement est clair. Opus 5.5 reste le modèle pour le travail complexe qui demande du jugement ; Sonnet 5.5 vise les tâches bien cadrées, la correction de bugs et la production de documents, slides et tableurs propres. Haiku 5.5, pour le volume et les usages sensibles au coût, arrivera « dans les prochaines semaines ».

Les chiffres qui sautent aux yeux

Sur les benchmarks publiés par Anthropic :

  • Terminal-Bench 4.0 (coding agentique) : 70,6 % pour Sonnet 5.5, contre 10,3 % pour Sonnet 5. Le bond est énorme.
  • GDPval-AA (travail réel sur 44 métiers) : Sonnet 5.5 arrive quasiment au niveau d’Opus 5.5 et environ 400 points au-dessus de Sonnet 5.
  • CursorBench 4.0 : meilleur score à ~2 points d’Opus 5.5.
  • C’est le premier modèle Sonnet à finir Pokémon Red uniquement à partir de captures d’écran.

Le prix ne bouge pas : 2 $ / million de tokens en entrée, 10 $ / million en sortie, 0,20 $ / million de cache reads — soit moitié moins qu’Opus 5.5 (4 $ / 20 $). La baisse de coût vient de l’efficacité : Sonnet 5.5 utilise beaucoup moins de tokens par tâche. Un testeur (Balyasny) rapporte ~121k tokens par réponse contre 497k pour Sonnet 5.

Pourquoi c’est important

Le vrai sujet n’est pas le bond de score, c’est le coût par tâche. Anthropic insiste sur ses courbes « score vs coût » : à effort faible ou moyen, Sonnet 5.5 bat le meilleur score de Sonnet 5 pour environ un dixième du prix. Pour les équipes qui font tourner des agents en continu, c’est ce chiffre-là qui compte, pas le leaderboard.

Second signal : Sonnet 5.5 est le premier Sonnet à arriver avec des garde-fous cyber équivalents à ceux d’Opus 5.5. Ses capacités en cybersécurité étant proches d’Opus 5, les tâches à haut risque basculent visiblement vers Sonnet 5. Anthropic ouvre aussi un Cyber Verification Program pour les défenseurs. Côté biologie, les garde-fous restent ceux de Sonnet 5. Et c’est aussi le premier Sonnet doté de classifieurs anti-distillation qui bloquent l’extraction du raisonnement.

Ce que ça change pour les devs et le web

  • Réévaluez vos choix de modèle par usage. Un Sonnet 5.5 à effort moyen peut remplacer un modèle plus cher sur du coding quotidien et de la génération de docs. Faites tourner vos propres evals avant de trancher.
  • Le coût par tâche, pas le coût par token. Un modèle qui consomme moins de tokens et fait moins d’appels d’outils peut être moins cher même à tarif égal. Mesurez les tokens par tâche.
  • Attention à la migration « thinking off ». Si vous tournez avec le raisonnement désactivé, il faut passer au nouveau réglage between_tools avant de migrer. Lisez le guide de migration.
  • Disponibilité. Sonnet 5.5 est déjà sur AWS, Google Cloud, Microsoft Azure et la plateforme Claude (claude-sonnet-5-5), en rétention zéro de données. L’effort par défaut est Medium dans Claude Code et les apps, High sur la plateforme.

Même logique que le reste de l’année : la frontière de capacité progresse lentement, mais le prix de la tâche, lui, chute vite. Pour un dev, c’est souvent la meilleure nouvelle.

Source