Une évolution notable vient d’être rendue publique dans le domaine.
Anthropic Claude : Sonnet 5, Sonnet 4.6 et Opus 4.8 : comparaison des benchmarks de codage agentique, des tarifs des API et des compromis entre coût et performance
Anthropic vient de lancer Claude Sonnet 5. L’entreprise le présente comme son modèle Sonnet le plus « agentique » à ce jour. Il est capable de planifier des actions, de piloter des navigateurs et des terminaux, et de fonctionner de manière autonome sur des tâches de longue durée.
À ce sujet, le Sonnet 5 est actuellement le système par défaut pour les formules Free et Pro. Les utilisateurs des formules Max, Team et Enterprise peuvent le sélectionner. Il est également disponible dans Claude Code et sur la plateforme Claude.
Le Sonnet se situe au milieu de la gamme d’Anthropic. Il se place au-dessus du Haiku 4.5, moins cher, et en dessous du modèle phare, l’Opus 4.8.
Sonnet 5 est une mise à jour de Sonnet 4.6, lancé en février 2026. Anthropic met l’accent, dans cette version, sur la fiabilité agentique plutôt que sur un seul benchmark phare.
Concrètement, cela se traduit par des chaînes de tâches plus longues sans perte de contexte. Cela permet une meilleure autocorrection en cas d’échec d’un appel d’outil. Cela garantit un comportement plus stable lors de sessions prolongées dans Claude Code ou Cowork.
Précisons, le modèle propose différents niveaux d’effort : faible, moyen, élevé et xélevé (très élevé). Un niveau d’effort plus élevé nécessite davantage de jetons pour le raisonnement. Cela augmente à la fois la qualité et le coût.
Il est significatif de noter que Sonnet 5 utilise un tokeniseur mis à jour, le même que celui introduit avec Opus 4.7. Un même texte peut désormais correspondre à environ 1,0 à 1,35 fois plus de tokens.
Point notable, estimez le coût par tâche pour différents modèles et comparez-les aux résultats de référence publiés. Tous les chiffres proviennent du mise en service d’Anthropic du 30 juin 2026.
En synthèse :
- Le modèle propose différents niveaux d’effort : faible, moyen, élevé et xélevé (très élevé).
- Il est significatif de noter que Sonnet 5 utilise un tokeniseur mis à jour, le même que celui introduit avec Opus 4.7.
- Estimez le coût par tâche pour différents modèles et comparez-les aux résultats de référence publiés.
Les mois à venir apporteront sans doute plus de précisions.
Dans le même ordre d’idées :
- Ce que révèle — et ce que ne met en lumière pas — la dernière découverte d’Anthropic en matière d’IA
- Selon Clem Delangue, de Hugging Face, l’IA open source revêt plus d’importance que jamais
Reportage initial : MarkTechPost : MarkTechPost