Claude Sonnet 5.5 d’Anthropic est conçu pour être un cheval de bataille fiable : un débit plus rapide, un coût par tâche réduit et une meilleure efficacité dans les flux de travail réels. Sur Terminal-Bench 4.0, il atteint 70,6 %, une progression spectaculaire par rapport à Sonnet 5, tandis que CursorBench le place à quelques points d’Opus 5.5. Le résultat est un modèle qui semble plus rapide à piloter et plus décisif dans les modifications de code, la finition de la documentation et les suggestions de conception d’interface. Fait important, le prix par token reste identique à Sonnet 5, mais le modèle nécessite généralement moins de tokens pour arriver à terme — vous bénéficiez donc des économies sans devoir revoir vos budgets ou conditions d’achat.
L’économie est essentielle. Avec un coût d’entrée d’environ 2 $/M et un coût de sortie de 10 $/M, Sonnet 5.5 gagne en faisant moins pour accomplir plus : moins de tentatives, moins d’appels d’outils, moins de détours verbeux. Dans les tests de codage agentique et les pilotes en entreprise, cela se traduit par des chaînes plus courtes et des traces plus compactes, réduisant à la fois la latence et les dépenses. Les équipes ont aussi rapporté une meilleure compréhension des grandes bases de code et une meilleure gestion groupée des appels d’outils, ce qui permet aux tâches longues de s’achever en moins d’étapes. À l’échelle de centaines de vérifications CI, macros de support ou tâches de nettoyage de données, la différence de coût par tâche devient visible en quelques jours, pas en trimestres.
Positionné face à la gamme d’Anthropic, Sonnet 5.5 complète Opus 5.5 plutôt que de le remplacer. Opus reste leader pour les travaux complexes et ouverts nécessitant un jugement soutenu, mais Sonnet prend désormais en charge une plus grande part des tâches bien définies : correction de bugs, modifications structurées, lecture de graphiques et création de diapositives. Comparé aux références GPT-6 Sol partagées lors des évaluations, Sonnet 5.5 est compétitif sur les mesures clés de codage et de travail à long terme à un coût par tâche nettement inférieur pour un effort similaire. La conclusion pratique : orientez par défaut les charges de travail routinières vers Sonnet 5.5, et passez à Opus 5.5 lorsque la nuance, les compromis multiples ou le raisonnement à enjeux élevés prédominent.
Opérationnellement, Sonnet 5.5 renforce aussi la posture de sécurité. Il est lancé avec des protections cyber améliorées comparables à celles d’Opus 5, tout en conservant les garde-fous biologiques de Sonnet 5 et en ajoutant des protections par distillation pour décourager l’extraction de capacités à grande échelle. Pour les développeurs, deux points d’attention : le modèle est disponible sur les principaux clouds avec des options de non-rétention des données, et si vous utilisiez Sonnet avec la pensée désactivée, vous devrez adopter le paramètre between_tools pour une migration fluide. En pratique, cela préserve des itérations rapides pour le travail courant tout en maintenant l’alignement pour les requêtes à risque élevé.


