Claude Sonnet 5
Le modèle Sonnet-class le plus capable d'Anthropic, avec un contexte de 1 000 000 tokens. Il fait partie des modèles proposés dans Claude Code. Cette fiche s'appuie sur les sources primaires citées.
En bref
Le modèle intermédiaire d'Anthropic, positionné sur le travail quotidien : contexte de 1 000 000 tokens, sortie jusqu'à 128 000 tokens, pensée adaptative à plusieurs niveaux d'effort, entrées texte, image et fichier. Il est proposé dans Claude Code pour le travail sur un dépôt. Deux choses à savoir avant de comparer son prix : le tarif d'entrée à 2 $ par million de tokens est une offre d'intro qui expire le 31 août 2026, et Sonnet 5 utilise un tokenizer qui produit environ 30 % de tokens en plus pour le même texte. Les deux changent le calcul.
01 C'est quoi
Le modèle Sonnet-class le plus capable d'Anthropic, avec une performance de pointe en code, en agents et en travail pro. Amélioration nette sur Sonnet 4.6, à prix égal.
Contexte 1M tokens
1 000 000 tokens en entrée, sortie jusqu'à 128 000 tokens. Pratique pour les gros dépôts et les longs documents.
Pensée adaptative
Niveaux d'effort configurables (low, medium, high, max, x-high) pour doser le raisonnement selon la tâche.
Entrées multiples
Texte, image et fichier. Pensé pour le code agentique, la vision et le computer-use.
Claude Code donne accès aux modèles Claude selon le compte et la configuration. Sonnet 5 reste positionné pour les refactors, la rédaction et la navigation dans un dépôt ; Opus 5 vise les tâches plus complexes.
02 Comment ça marche
Trois mécaniques décident de ce que Sonnet 5 te coûtera réellement. Aucune n'est évidente à la lecture d'un tarif.
- Tu paies au token, pas au mot. Un token vaut environ quatre caractères en anglais. Le modèle découpe ton texte en tokens, les compte en entrée, compte sa réponse en sortie, et facture les deux séparément. La sortie coûte cinq fois l'entrée.
- Sonnet 5 ne compte pas les tokens comme ses prédécesseurs. C'est le point que la grille tarifaire ne met pas en avant. Anthropic indique que Sonnet 5, comme Fable 5, Mythos 5 et les Opus 4.7 et suivants, utilise un tokenizer plus récent qui « produit environ 30 % de tokens en plus pour le même texte ». Le même document précise que l'augmentation exacte dépend du contenu. Autrement dit, à texte identique, la facture ne se déduit pas du prix affiché.
- Le cache de prompt change l'économie d'un agent. Réutiliser un contexte déjà traité coûte 10 % du prix d'entrée standard. L'écrire coûte 1,25 fois ce prix pour cinq minutes, ou 2 fois pour une heure. Un cache de cinq minutes devient donc rentable dès la première relecture, un cache d'une heure dès la deuxième.
- La pensée adaptative est un curseur de coût. Les niveaux d'effort configurables font varier le raisonnement, donc les tokens de sortie, donc le prix. Un effort élevé n'est pas un réglage gratuit.
Le contexte de 1 million de tokens est facturé au tarif standard, sans surcoût de long contexte. Anthropic le formule ainsi : « une requête de 900 000 tokens est facturée au même tarif par token qu'une requête de 9 000 tokens ». C'est loin d'être universel sur le marché.
03 Ce que ça sait faire
Ce qu'Anthropic annonce, avec ses prix, ses limites et son positionnement dans Claude Code.
✓ Ce qui est fort
- ✓Code agentique et refactors multi-fichiers : le cas d'usage mis en avant par Anthropic.
- ✓Contexte 1M : de gros dépôts et de longs documents dans une seule requête.
- ✓Prix maîtrisé : 2/10 en intro puis 3/15, avec jusqu'à -90 % en cache et -50 % en batch.
- ✓Pensée adaptative : on dose l'effort de raisonnement selon la difficulté.
04 Ce que ça ne sait pas faire
Les limites annoncées, et deux échéances que le tarif d'appel masque.
- Ce n'est pas le modèle le plus capable d'Anthropic. Sonnet est la classe intermédiaire. Opus 5 vise le travail complexe à 5 dollars par million de tokens en entrée ; Fable 5 reste positionné pour la capacité maximale à 10 dollars.
- La sortie plafonne à 128 000 tokens. C'est confortable, mais cela reste un plafond par passe : une génération plus longue doit être découpée.
- Le tarif d'entrée est une offre temporaire. Les 2 et 10 dollars par million de tokens valent jusqu'au 31 août 2026. Au 1er septembre, la grille passe à 3 et 15 dollars, soit 50 % de hausse.
- Le tokenizer relativise la comparaison. Environ 30 % de tokens en plus pour le même texte, d'après Anthropic. À texte égal, les 2 dollars d'entrée reviennent donc à environ 2,60 dollars par million de tokens de l'ancien tokenizer. Face aux 3 dollars de Sonnet 4.6, l'économie réelle avoisine 13 % et non 33 %. Et au 1er septembre, à 3 dollars affichés, le coût par texte grimpe à environ 3,90 dollars : Sonnet 5 devient alors plus cher que Sonnet 4.6 pour le même contenu.
- Le calcul dépend de ton contenu. Anthropic précise que l'augmentation exacte varie selon le contenu et la forme de la charge de travail. Les ordres de grandeur ci-dessus sont une projection à partir de ses deux chiffres publiés, pas une mesure de notre part.
- Certaines options renchérissent la note. Contraindre l'inférence aux États-Unis applique un multiplicateur de 1,1 sur toutes les catégories de tokens. La recherche web coûte 10 dollars pour 1 000 recherches, en plus des tokens.
05 Les versions
Le nom seul ne dit rien : c'est la version et sa date qui fixent le prix.
- Sonnet 5
- La version courante. Contexte 1M, sortie 128K, pensée adaptative, nouveau tokenizer. Tarif d'intro 2 $ / 10 $ par million de tokens jusqu'au 31 août 2026, puis 3 $ / 15 $.
- Sonnet 4.6
- La génération précédente, à 3 $ / 15 $. Elle utilise l'ancien tokenizer, ce qui la rend moins chère que Sonnet 5 à texte égal une fois l'intro terminée. Elle inclut aussi le contexte 1M au tarif standard.
- Sonnet 4.5
- Encore listée à 3 $ / 15 $, ancien tokenizer.
- Sonnet 4
- Retirée, sauf sur Bedrock et Google Cloud, d'après la page de dépréciation d'Anthropic.
Le changement de tokenizer sépare nettement la gamme : Sonnet 5 et les Opus 4.7 et suivants comptent d'un côté, Sonnet 4.6 et antérieurs de l'autre. Comparer deux prix par million de tokens de part et d'autre de cette frontière n'a pas de sens sans corriger du tokenizer.
06 Prix & accès
Un tarif d'intro, puis un tarif régulier. Le tout par million de tokens, avec des remises fortes.
Tarifs en date de juillet 2026. Les prix, offres et quotas affichés correspondent à l'état documenté à cette date. Ils peuvent évoluer ; consulte la source officielle citée sur la page avant achat.
- Intro (jusqu'au 31 août 2026)
- 2 $ / M en entrée, 10 $ / M en sortie.
- Puis tarif régulier
- 3 $ / M en entrée, 15 $ / M en sortie.
- Remises
- Jusqu'à -90 % avec le cache prompt, -50 % en batch.
Le tarif exact peut évoluer : vérifie la grille officielle Anthropic. Sonnet 5 est aussi disponible via Claude Code et les plans d'abonnement.
07 Quand le choisir
Sonnet 5 est le bon défaut. Voici les cas où il gagne.
- Du code agentique et des refactors multi-fichiers au quotidien.
- Du long-contexte 1M pour de gros dépôts ou de longs documents.
- De la production sensible au coût quand Opus 5 est surdimensionné.
- De la vision et du computer-use avec entrées texte, image et fichier.
- Pour le travail complexe, monte sur Opus 5. Pour la capacité maximale selon Anthropic, regarde Fable 5.
Le voir à l'œuvre : la méthode « Créer un site avec Claude Code » →
08 Alternatives
Aucun modèle n'est le meilleur partout. Le bon choix dépend de ton budget et de ta tâche.
Claude Opus 5
Code agentique complexe, contexte 1M, sortie 128k et raisonnement adaptatif.
Code au sommetClaude Fable 5
Le plus capable d'Anthropic en accès général : code au niveau dépôt, agents longs. Prix 10/50.
Côté OpenAIGPT-5.6 Terra
L'équilibré d'OpenAI, un autre bon défaut. À comparer selon ton écosystème.
09 Verdict
Sonnet 5 est à considérer comme modèle équilibré dans Claude Code. Le contexte 1M, la pensée adaptative et un tarif maîtrisé en font le bon défaut pour le code agentique et les refactors. Opus 5 prend le relais pour le travail complexe ; Fable 5 reste positionné par Anthropic pour la capacité maximale.
- Code agentique et long-contexte : excellent rapport capacité/prix.
- Pensée adaptative et entrées multiples : polyvalent.
- À anticiper : pas le plus fort en absolu, sortie plafonnée à 128K.
10 Questions fréquentes
Claude Sonnet 5, c'est quoi ?
Le modèle Sonnet-class le plus capable d'Anthropic : contexte 1 000 000 tokens, sortie max 128 000 tokens, pensée adaptative. Pensé pour le code agentique, les refactors multi-fichiers et le travail pro.
Combien coûte Claude Sonnet 5 ?
Tarif API en intro : 2 $ entrée / 10 $ sortie par million de tokens jusqu'au 31 août 2026, puis 3 $ / 15 $. Jusqu'à -90 % avec le cache prompt et -50 % en batch. Tarifs en date de juillet 2026.
Quel est son contexte ?
1 000 000 tokens en entrée, sortie maximale de 128 000 tokens. Idéal pour les gros dépôts et les longs documents.
Sonnet 5 ou Opus 5 ?
Sonnet 5 pour la production sensible au coût et le contexte 1M à bon prix ; Opus 5 pour le code agentique complexe et le travail d'entreprise. Fable 5 reste positionné par Anthropic pour la capacité maximale.
Faits et chiffres issus des pages officielles d'Anthropic : Claude Sonnet 5 · Claude Opus 5 · catalogue des modèles · tarifs Claude.
Choisis le bon modèle Claude
Compare Sonnet 5 aux autres modèles Claude, ou vois comment il s'intègre à Claude Code.