Logo Claude AI - Anthropic
Actualité

Claude Sonnet 5.5 : Anthropic lance un modèle plus rapide et moins cher, presque au niveau d’Opus 5.5

Partager
Partager
Pinterest Hidden

Anthropic Révolutionne l’IA avec Claude Sonnet 5.5 : Vitesse, Économie et Performance au Rendez-vous

À peine une semaine après avoir dévoilé son fleuron, Claude Opus 5.5, Anthropic surprend à nouveau le monde de l’intelligence artificielle en lançant ce lundi 28 septembre Claude Sonnet 5.5. Ce nouveau modèle intermédiaire promet de redéfinir le rapport performance-prix, se positionnant comme un concurrent redoutable pour les géants du secteur.

Une Nouvelle Ère de Performance et d’Accessibilité

Claude Sonnet 5.5 se distingue par une vélocité accrue de plus de 30 % par rapport à son prédécesseur, Sonnet 5. Mais l’innovation ne s’arrête pas là : il offre également une réduction des coûts pouvant atteindre 30 % par tâche, tout en conservant le même tarif par token. Pour les entreprises et les développeurs, cela se traduit par des économies substantielles sans compromis sur la qualité.

Anthropic maintient ses tarifs pour Sonnet 5.5 : deux dollars le million de tokens en entrée et dix dollars en sortie. Les lectures de cache, optimisant la réutilisation de contextes déjà traités, restent à un tarif avantageux de 0,20 dollar. L’astuce réside dans l’efficacité du modèle, qui consomme moins de tokens pour accomplir les mêmes tâches, rendant la facture finale plus légère.

L’entreprise clarifie la segmentation de ses offres : Opus 5.5 demeure le choix privilégié pour les travaux complexes exigeant un jugement nuancé, tandis que Sonnet 5.5 est conçu pour exceller dans les missions courantes et bien définies, telles que la correction de bugs, la production de documents, de présentations ou de tableurs.

Sonnet 5.5 : Des Benchmarks Qui Boustoulent la Hiérarchie

La Programmation Agentique à l’Honneur

Sur le test de codage Terminal-Bench 4.0, Claude Sonnet 5.5 réalise un bond spectaculaire, passant de 10,3 % pour Sonnet 5 à un impressionnant 70,6 %. Ce benchmark évalue la capacité d’un modèle à exécuter de manière autonome des tâches professionnelles multi-étapes via une interface en ligne de commande, un domaine crucial pour la programmation agentique. Fait notable, Sonnet 5.5 surpasse même le fleuron Opus 5.5, qui obtient un score de 66,4 % au réglage Xhigh.

Une Proximité Étonnante avec Opus 5.5

Bien qu’Opus 5.5 conserve une légère prééminence sur d’autres évaluations, Sonnet 5.5 talonne de près le modèle phare. Sur GDPval-AA, qui mesure l’efficacité sur des tâches bureautiques variées issues de 44 professions distinctes, Sonnet 5.5 atteint 1 844 points, contre 1 846 pour Opus 5.5 et 1 449 pour Sonnet 5. L’écart se réduit également sur CursorBench 4.0, un test basé sur de réelles sessions de l’éditeur de code Cursor, où Sonnet 5.5 obtient 55,5 % face aux 57,8 % d’Opus 5.5.

Anthropic admet toutefois que les seuls benchmarks ne sauraient refléter l’intégralité des performances, affirmant qu’Opus 5.5 reste « manifestement supérieur » pour les travaux complexes et ouverts. En matière de cybersécurité, les capacités de Sonnet 5.5 se rapprochent de celles d’Opus 5, marquant une avancée significative. C’est le premier Sonnet lancé avec des garde-fous de sécurité comparables à ceux des modèles haut de gamme d’Anthropic, les requêtes à haut risque étant visiblement redirigées vers Sonnet 5, tandis que la correction de bugs courants n’est pas affectée. Côté biologie, Anthropic maintient les dispositifs de protection de Sonnet 5.

Le Duel Face à GPT-6 Sol : Anthropic Prend les Devants

Le tableau comparatif d’Anthropic place également Sonnet 5.5 face à GPT-6 Sol, le modèle lancé par OpenAI le même jour qu’Opus 5.5, avec une stratégie tarifaire agressive. Les deux modèles sont facturés de manière identique : 2 dollars en entrée et 10 dollars en sortie par million de tokens.

Cependant, sur Terminal-Bench 4.0, la ligne dédiée à GPT-6 Sol demeure étonnamment vierge, OpenAI n’ayant pas divulgué de score officiel. Anthropic a dû se rabattre sur l’ancien GPT-5.6 Sol pour ses comparatifs. L’entité indépendante Artificial Analysis a évalué GPT-6 Sol à 43 % sur Terminal-Bench 4.0 au réglage maximal, mais cette mesure a été effectuée dans Codex, l’outil de code d’OpenAI, avec une méthodologie distincte, rendant toute comparaison directe délicate.

Là où les deux modèles sont directement confrontés, Sonnet 5.5 prend l’avantage sur GDPval-AA, avec 1 844 points contre 1 487 pour GPT-6 Sol. Sur FrontierCode, qui juge la pertinence d’une modification de code sans nécessiter de révision, Sonnet 5.5 obtient 52,1 % au réglage Xhigh, surpassant les 49,3 % de GPT-6 Sol. Néanmoins, il chute à 46,2 % au réglage Max, le plus poussé. Selon Anthropic, cette baisse s’explique par la tendance du modèle à initier plus fréquemment une relecture de code par des sous-agents multiples, ce qui a parfois mené à des dépassements de délais ou des altérations excédant le cadre initial, deux aspects que FrontierCode sanctionne.

Disponibilité et Perspectives Futures

Claude Sonnet 5.5 est déjà accessible dès ce lundi dans les applications Claude. Il opère par défaut avec un niveau d’effort « Medium » dans Claude et Claude Code, contre « High » sur la plateforme développeurs, ce paramètre ajustant le temps de réflexion alloué au modèle. Il est également déployé sur les plateformes cloud majeures : AWS, Google Cloud et Microsoft Azure.

Pour les développeurs, l’identifiant à utiliser est « claude-sonnet-5-5 ». Ceux qui utilisaient l’ancienne version de Sonnet devront migrer vers le nouveau paramètre « between_tools » pour bénéficier de cette itération. Pour les applications à très fort volume, Anthropic annonce l’arrivée de Claude Haiku 5.5 « dans les semaines à venir », sans toutefois préciser de date exacte. L’avenir de l’IA s’accélère, et Anthropic semble bien décidé à en être un acteur majeur.


Pour plus de détails, visitez notre site.

Source: Lien externe

Partager

Laisser un commentaire

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *