Aller au contenu
Anthropic

Claude Sonnet 5.5

Le modèle intermédiaire d'Anthropic: à deux points d'Opus 5.5 sur un test de travail réel, pour la moitié du prix. Je l'utilise toujours comme sous-agent plutôt que de le choisir à la main.

Qualité

Modalité

Multimodal

Fenêtre de contexte

1M tokens

Accès

Fermé

L'avis de Fabian

FM

"Une sortie curieuse: presque aussi bon qu'Opus, et moins cher. J'ai le sentiment que je resterai quand même sur Opus dans mon installation actuelle, et qu'il confiera à Sonnet, comme sous-agent, les tâches plus petites et clairement définies."

Claude Sonnet 5.5 remplace Sonnet 5 comme modèle intermédiaire d’Anthropic, sorti le 28 septembre 2026, six jours après Opus 5.5. C’est le deuxième modèle de la famille Claude 5.5. Haiku 5.5 reste annoncé « dans les semaines à venir ».

Ce qui a changé

Pas le prix: 2 dollars par million de tokens en entrée et 10 dollars par million en sortie, avec la lecture du cache à 0,20 dollar par million. Ce que vous payez par tâche baisse pourtant. Selon Anthropic, Sonnet 5.5 fait le même travail avec moins de tokens, si bien que la plupart des tâches coûtent jusqu’à 30 % de moins, et sa sortie arrive plus de 30 % plus vite que celle de Sonnet 5.

Le changement le plus important, c’est à quel point il est désormais proche d’Opus. Sur GDPval-AA d’Artificial Analysis, un test de travail réel couvrant 44 métiers, Sonnet 5.5 obtient 1844. Sonnet 5 obtenait 1449, Opus 5.5 obtient 1846. Sur Terminal-Bench 4.0, qui teste des agents travaillant en ligne de commande, il atteint 70,6 %. Anthropic le positionne pour les tâches quotidiennes bien délimitées, la correction de bugs et la production de documents, de présentations et de tableurs soignés.

Ce qu’il faut savoir avant de migrer

Si votre code désactivait la réflexion, passez-le au réglage de réflexion between_tools avant la mise à niveau, car la désactivation n’est plus acceptée. Si vous travaillez avec les applications Claude ou Claude Code plutôt qu’avec l’API, cela ne vous concerne pas.

Sa place dans la gamme

Sur le papier, l’écart avec Opus est désormais minime, et Sonnet coûte deux fois moins cher par token. Je reste quand même sur Opus 5.5 dans mon installation actuelle. Opus planifie et décide, puis confie à Sonnet, comme sous-agent, les tâches plus petites et clairement définies: fouiller une base de code, rédiger une section, appliquer une modification bien définie. C’est là que le prix plus bas paie, car ces tâches consomment beaucoup de tokens sans avoir besoin du modèle le plus puissant.

Si vous développez sur l’API et payez au token pour du travail en volume, c’est le modèle Claude à tester en premier. Si vous travaillez dans l’application Claude, essayez-le sur votre prochaine tâche bien délimitée et voyez si vous remarquez une différence avec Opus. Pour en savoir plus sur le choix du modèle selon la tâche, lisez Pensez cher, exécutez pas cher.

Le verdict

Idéal pour: Les tâches quotidiennes bien délimitées, la correction de bugs, les documents et présentations soignés, et les tâches ciblées qu'un modèle plus puissant lui confie en tant que sous-agent.

Avantages

  • À deux points d'Opus 5.5 sur le test GDPval-AA d'Artificial Analysis consacré au travail réel (1844 contre 1846), pour la moitié du prix par token d'Opus
  • Une sortie plus de 30 % plus rapide que Sonnet 5, et jusqu'à 30 % moins cher par tâche au même prix par token
  • 70,6 % sur Terminal-Bench 4.0, un test du travail des agents en ligne de commande

Inconvénients

  • Le code qui désactivait la réflexion doit passer au réglage between_tools avant la mise à niveau
  • Pour le travail le plus difficile et le plus ouvert, Opus reste le choix le plus sûr

Caractéristiques

  • Tarifs 2 $/M en entrée, 10 $/M en sortie · lecture du cache 0,20 $/M, écriture du cache 2,50 $/M
  • Niveau de coût Modéré
  • ⚡
    Vitesse Rapide
  • Licence Propriétaire
Documentation développeur

Accéder à ce modèle via