Produit · 2 octobre 2026

Anthropic lance Claude Sonnet 5.5, un modèle d'IA capable de rédiger du code et d'analyser des images plus rapidement tout en réduisant le coût par tâche de 30 %

a hallway with glass doors
Brecht Corbeel / Unsplash

Anthropic a annoncé le 29 septembre 2026 le lancement de Claude Sonnet 5.5, le deuxième modèle de la gamme Claude 5.5 après Opus 5.5. Ce dernier affiche des performances supérieures à celles de Claude Sonnet 5, avec une vitesse de traitement augmentée de 30 % et un coût par tâche réduit de 30 % dans la plupart des cas. La société positionne Sonnet 5.5 comme un modèle plus rapide et moins coûteux que Opus 5.5, ce dernier étant réservé aux tâches complexes nécessitant une réflexion approfondie, tandis que Sonnet 5.5 s'adapte mieux aux tâches quotidiennes structurées, à la correction de bugs et à la création de documents, de présentations et de feuilles de calcul.

Les résultats des tests Benchmarks montrent que Sonnet 5.5 dépasse Opus 5.5 dans plusieurs domaines. Sur Terminal-Bench 4.0, il obtient 70,6 % contre 66,4 % pour Opus 5.5. Sur CursorBench 4.0, il réalise 55,5 % contre 34,1 % pour Sonnet 5 et se rapproche de Opus 5.5 (57,8 %). Sur FrontierCode 1.1, il atteint 46,2 % contre 54,4 % pour Opus 5.5 et 52,1 % pour GPT-6 Sol.

Dans les tâches de connaissance, Sonnet 5.5 obtient 1844 points sur GDPval-AA v2.1, proche de Opus 5.5 (1846) et supérieur de 400 points à Sonnet 5. Sur AA-Briefcase v1.1, il réalise 1811 points, largement devant Sonnet 5 (1359) et GPT-6 Sol (1483). Dans les tâches d'utilisation d'ordinateurs, il obtient 80,1 % sur OSWorld 2.1, proche de Opus 5.5 (81,8 %) et supérieur de 23 points à Sonnet 5 (57,0 %). Sur Chartography, il réalise 61,6 % contre 15,6 % pour Sonnet 5 et 53,6 % pour GPT-6 Sol.

Anthropic précise que les scores Benchmarks ne reflètent qu'une partie des capacités. Opus 5.5 reste plus performant dans les tâches complexes nécessitant une réflexion continue. Les prix de Sonnet 5.5 restent identiques à ceux de Sonnet 5 : 2 dollars par million de tokens d'entrée, 10 dollars par million de tokens de sortie, 0,20 dollar pour les lectures en cache et 2,50 dollars pour les écritures en cache. Le coût par tâche est réduit de 30 % grâce à une utilisation moindre de tokens.

Les tests internes et externes montrent que Sonnet 5.5 est plus efficace dans les tâches de codage, avec une réduction de 15 fois le coût par tâche sur FrontierCode. Daniel Vogel, PDG d'Epic Games, a souligné que le modèle gère efficacement des architectures de jeux complexes. Curtis Allen, ingénieur principal chez Slack, a noté une amélioration de 14 % dans l'utilisation des tokens pour Slackbot.

Anthropic a également testé la conformité comportementale de Sonnet 5.5, constatant une réduction des risques liés à la désalignement par rapport aux autres modèles.

Rapporté par Techsauce.