Guide · Tarifs
Les tarifs officiels d'Anthropic au 13 septembre 2026, les deux mécanismes qui divisent la facture, et trois exemples de coûts calculés pour des usages d'entreprise.
Tarifs officiels
De 1 $ à 10 $ le million de tokens en entrée, selon le modèle.
Tarifs
Quatre modèles composent la gamme actuelle d'Anthropic. Les prix sont exprimés en dollars par million de tokens.
| Modèle | Identifiant API | Entrée | Sortie | Contexte |
|---|---|---|---|---|
| Claude Haiku 4.5 | claude-haiku-4-5 | 1 $ | 5 $ | 200 000 tokens |
| Claude Sonnet 5 | claude-sonnet-5 | 2 $ | 10 $ | 1 million |
| Claude Opus 5 | claude-opus-5 | 5 $ | 25 $ | 1 million |
| Claude Fable 5.1 | claude-fable-5-1 | 10 $ | 50 $ | 1 million |
Le prix de Claude Sonnet 5 mérite une précision. Anthropic l'avait lancé à 2 $ et 10 $ comme tarif de lancement jusqu'au 31 août 2026, avec une hausse prévue à 3 $ et 15 $ le 1ᵉʳ septembre. Cette hausse n'a pas eu lieu : 2 $ et 10 $ sont devenus le prix standard.
Les modèles de la génération précédente restent disponibles. Claude Opus 4.8, 4.7, 4.6 et 4.5 coûtent 5 $ et 25 $, Claude Sonnet 4.6 et 4.5 coûtent 3 $ et 15 $, et Claude Fable 5 coûte 10 $ et 50 $. Pour un nouveau projet, Sonnet 5 fait mieux que Sonnet 4.6 pour un prix au token plus bas.
Sur les modèles récents, la fenêtre d'un million de tokens est facturée au tarif standard : une requête de 900 000 tokens coûte le même prix au token qu'une requête de 9 000.
Mécanique
Un token est un fragment de texte, souvent une partie de mot. Anthropic estime qu'un token représente environ 4 caractères ou 0,75 mot en anglais. Le français en consomme en général un peu plus pour le même contenu.
Vous payez séparément les tokens envoyés au modèle (l'entrée : consignes, documents, historique de la conversation) et les tokens qu'il produit (la sortie). La sortie coûte cinq fois plus cher que l'entrée sur tous les modèles actuels, ce qui explique qu'une réponse longue pèse vite sur la facture.
Un piège attend ceux qui comparent les générations. Les modèles Claude 4.7 et suivants, dont Sonnet 5, Opus 5 et Fable 5.1, utilisent un nouveau tokenizer qui produit environ 30 % de tokens en plus pour le même texte, selon Anthropic. Sonnet 5 à 2 $ correspond donc à environ 2,60 $ mesurés avec l'ancien tokenizer, face aux 3 $ de Sonnet 4.6. L'économie réelle existe, mais elle est plus faible que l'écart affiché.
Réduire la facture
Quand plusieurs requêtes commencent par le même contenu (des consignes longues, une base de procédures, un contrat de référence), le prompt caching évite de payer ce contenu plein tarif à chaque fois. La première requête l'écrit en cache, les suivantes le relisent pour une fraction du prix.
| Modèle | Écriture 5 min | Écriture 1 h | Lecture en cache |
|---|---|---|---|
| Claude Haiku 4.5 | 1,25 $ | 2 $ | 0,10 $ |
| Claude Sonnet 5 | 2,50 $ | 4 $ | 0,20 $ |
| Claude Opus 5 | 6,25 $ | 10 $ | 0,50 $ |
| Claude Fable 5.1 | 12,50 $ | 20 $ | 0,25 $ |
La règle générale est simple : l'écriture coûte 1,25 fois le prix d'entrée pour un cache de 5 minutes et 2 fois pour un cache d'une heure, la lecture coûte 0,1 fois. Claude Fable 5.1 fait exception avec une lecture à 0,025 fois, soit 0,25 $ le million de tokens.
Le cache de 5 minutes est rentable dès la première relecture, celui d'une heure à partir de deux. La condition est que les requêtes partageant le même début arrivent dans le délai choisi : un assistant interne sollicité en continu en profite pleinement, un traitement lancé une fois par jour beaucoup moins.
Réduire la facture
La Batch API traite des requêtes en différé et facture l'entrée comme la sortie à 50 % du tarif normal. Elle se cumule avec le prompt caching.
| Modèle | Entrée en batch | Sortie en batch |
|---|---|---|
| Claude Haiku 4.5 | 0,50 $ | 2,50 $ |
| Claude Sonnet 5 | 1 $ | 5 $ |
| Claude Opus 5 | 2,50 $ | 12,50 $ |
| Claude Fable 5.1 | 5 $ | 25 $ |
Elle convient à tout ce qui n'attend pas de réponse immédiate : extraire les données d'un lot de factures, classer des demandes accumulées pendant la nuit, enrichir une base de contacts. Pour un agent qui répond à un client en direct, elle ne s'applique pas.
En pratique
Support client sur Haiku 4.5. Anthropic publie cet exemple : 10 000 tickets de support d'environ 3 700 tokens chacun reviennent à environ 37 $ avec Claude Haiku 4.5.
Extraction de factures sur Sonnet 5. Hypothèse : 1 000 factures par mois, 3 000 tokens en entrée (consignes et facture) et 500 en sortie par document. L'entrée coûte 6 $, la sortie 5 $, soit 11 $ par mois, ou 5,50 $ en passant par la Batch API.
Assistant interne avec prompt caching sur Sonnet 5. Hypothèse : 20 000 tokens de procédures placés au début de chaque question. Sans cache, ce préfixe coûte 0,04 $ par question, soit 40 $ pour 1 000 questions. Relu en cache, il coûte 0,004 $ par question, soit 4 $ pour les mêmes 1 000 questions, plus le coût des écritures.
Ces montants ne couvrent que la consommation de l'API. Dans un projet réel, l'intégration avec vos outils et sa maintenance coûtent en général davantage : c'est ce que chiffre un audit avant tout développement. Notre page intégration de Claude en entreprise détaille ce travail.
Conformité
L'API d'Anthropic route les requêtes de façon globale par défaut, au tarif standard. Son paramètre de géographie propose une seule restriction, le traitement aux États-Unis, facturé 1,1 fois le tarif pour les modèles Claude 4.6 et suivants. Aucune option européenne n'y figure.
Pour garantir qu'un traitement reste dans une région précise, il faut passer par un fournisseur cloud. Amazon Bedrock et Google Cloud proposent des points de terminaison régionaux, facturés 10 % de plus que leurs points de terminaison globaux. Ils fixent leurs propres tarifs et leurs propres dates de disponibilité des modèles.
Pour une entreprise soumise au RGPD qui traite des données de santé, juridiques ou de candidats, ce surcoût de 10 % est rarement le point bloquant. La question est de savoir où transitent les données et sous quel contrat. Notre guide IA Act pour les entreprises détaille les obligations qui s'appliquent.
Décision
Anthropic recommande de choisir le modèle selon la difficulté de la tâche :
Avant de construire sur un modèle, vérifiez sa date de retrait. Anthropic annonce Haiku 4.5 retirable au plus tôt le 15 octobre 2026. Un agent conçu autour d'un modèle en fin de vie devra être migré puis retesté.
Deux services facturés à part s'ajoutent parfois : la recherche web coûte 10 $ pour 1 000 recherches, tandis que la récupération de pages web n'est facturée qu'en tokens. Pour connecter Claude à vos logiciels, voir le MCP en entreprise, et pour comparer avec OpenAI, Claude ou ChatGPT en entreprise.
FAQ
Guides liés
Un cas d’usage concret, et ce qu’il consomme.
Faire répondre Claude à partir de vos documents, et l’effet sur le nombre de tokens.
Si vous préférez déléguer le développement.
Liens vérifiés à la publication. Les textes réglementaires évoluent : reportez-vous toujours à la source officielle.
Une question, un projet, une idee ? On vous repond sous 24h. Audit gratuit, sans engagement.