Au 6 octobre 2026, le million de jetons de sortie se facture entre 0,50 dollar (GPT-6 Luna) et 50 dollars (GPT-6 Astra, Claude Fable 5.1) parmi les dix-huit offres retenues ci-dessous. L'écart va de 1 à 100 sur les grilles publiques d'OpenAI, Anthropic, Google, Mistral AI, DeepSeek et xAI. ActuIA a relevé ces tarifs sur les pages de tarification des éditeurs et de deux clouds, Amazon Bedrock et Google Cloud. Ils sont convertis en euros au taux de référence de la BCE du 5 octobre, dernier publié au moment du relevé, soit 1 euro pour 1,1204 dollar.

Mise à jour. Relevé effectué le 6 octobre 2026 entre 0 h et 1 h UTC, sur les pages citées en lien dans chaque ligne. Un tarif peut changer entre deux relevés ; la page de l'éditeur fait foi.

Le tableau du 6 octobre 2026, en dollars par million de jetons

Les montants correspondent au tarif standard, en contexte court et sur le point d'accès global de chaque éditeur. Le contexte court s'arrête à 272 000 jetons d'entrée chez OpenAI et à 200 000 jetons pour Gemini 3.1 Pro et Grok 4.7. Chez xAI, une requête dont l'invite atteint ce seuil est facturée au tarif supérieur « pour tous les jetons de la requête », selon la fiche du modèle. Google indexe son tarif sur la taille de l'invite (« prompts > 200k tokens »), soit 4 et 18 dollars au-delà pour Gemini 3.1 Pro. OpenAI ne précise pas sur sa grille comment s'applique la bascule à 272 000 jetons. La colonne « entrée en cache » donne le prix d'un jeton relu depuis le cache de requête, hors frais d'écriture. La colonne « lots » renvoie aux interfaces de traitement différé (Batch API).

ÉditeurModèleEntréeEntrée en cacheSortieLots (entrée / sortie)RelevéSource
OpenAIGPT-6 Astra (gpt-6-astra)10,001,0050,005,00 / 25,0006/10/2026grille
OpenAIGPT-6.1 Sol (gpt-6.1-sol)2,000,1010,001,00 / 5,0006/10/2026grille
OpenAIGPT-6 Luna (gpt-6-luna)0,100,010,500,05 / 0,2506/10/2026grille
AnthropicClaude Fable 5.110,000,2550,005,00 / 25,0006/10/2026grille
AnthropicClaude Opus 5.54,000,2020,002,00 / 10,0006/10/2026grille
AnthropicClaude Sonnet 5.52,000,2010,001,00 / 5,0006/10/2026grille
AnthropicClaude Haiku 4.51,000,105,000,50 / 2,5006/10/2026grille
GoogleGemini 3.1 Pro Preview2,000,2012,001,00 / 6,0006/10/2026grille
GoogleGemini 3.8 Flash (1)0,750,0753,750,375 / 1,87506/10/2026grille
GoogleGemini 3.5 Flash-Lite0,300,032,500,15 / 1,2506/10/2026grille
Mistral AIMistral Medium 3.51,500,157,500,75 / 3,75 (2)06/10/2026grille
Mistral AIMistral Large 30,500,051,500,25 / 0,75 (2)06/10/2026grille
Mistral AIMistral Small 40,150,0150,600,075 / 0,30 (2)06/10/2026grille
DeepSeekdeepseek-flash (V4.1 Flash), heures pleines (3)0,300,0061,20n.c.06/10/2026grille
DeepSeekdeepseek-flash, heures creuses0,150,0030,60n.c.06/10/2026grille
DeepSeekdeepseek-v4-pro, heures pleines1,320,0443,96n.c.06/10/2026grille
DeepSeekdeepseek-v4-pro, heures creuses0,660,0221,98n.c.06/10/2026grille
xAIGrok 4.72,000,506,00non proposé06/10/2026fiche

(1) Tarif d'introduction affiché jusqu'au 31 décembre 2026 ; Google annonce 1,50 et 7,50 dollars à partir du 1er janvier 2027. (2) Montant calculé par ActuIA : Mistral AI applique une remise de 50 % en mode lots, selon sa page de tarifs et sa documentation sur le traitement par lots. (3) Heures pleines : de 1 h à 4 h et de 6 h à 10 h UTC, du lundi au vendredi. n.c. : non communiqué sur la page relevée. Pour Grok 4.7, la page de lancement du 21 septembre annonce 2 et 6 dollars. La fiche du modèle affiche 0,50 dollar en entrée relue depuis le cache, puis 4, 1 et 12 dollars à partir de 200 000 jetons, et indique que l'API de lots n'est pas prise en charge.

Les mêmes tarifs convertis en euros

La conversion applique le taux de référence publié par la Banque centrale européenne le 5 octobre 2026. Les éditeurs facturent en dollars ; l'écart de change entre la date du relevé et celle de la facture reste à la charge du client.

ModèleEntrée (€)Entrée en cache (€)Sortie (€)
GPT-6 Astra8,9250,892544,63
GPT-6.1 Sol1,7850,08938,93
GPT-6 Luna0,0890,00890,45
Claude Fable 5.18,9250,223144,63
Claude Opus 5.53,5700,178517,85
Claude Sonnet 5.51,7850,17858,93
Claude Haiku 4.50,8930,08934,46
Gemini 3.1 Pro Preview1,7850,178510,71
Gemini 3.8 Flash0,6690,06693,35
Gemini 3.5 Flash-Lite0,2680,02682,23
Mistral Medium 3.51,3390,13396,69
Mistral Large 30,4460,04461,34
Mistral Small 40,1340,01340,54
deepseek-flash (heures pleines)0,2680,00541,07
deepseek-flash (heures creuses)0,1340,00270,54
deepseek-v4-pro (heures pleines)1,1780,03933,53
deepseek-v4-pro (heures creuses)0,5890,01961,77
Grok 4.71,7850,44635,36

Les changements de grille depuis le 1er septembre, date par date

  • 1er septembre : Anthropic lance Claude Fable 5.1 et ramène la lecture de cache à 0,25 dollar, soit 0,025 fois le prix d'entrée, selon ses notes de version. L'entrée et la sortie restent à 10 et 50 dollars.
  • 2 septembre : Google sort Gemini 3.8 Flash au tarif d'introduction de Gemini 3.7 Flash, 0,75 et 3,75 dollars.
  • 3 septembre : OpenAI publie GPT-6 Astra, facturé 10 et 50 dollars.
  • 10 septembre : DeepSeek met en ligne V4.1 Flash, appelé dans l'API sous le nom deepseek-flash, et baisse ses prix en conséquence. Les anciens identifiants deepseek-v4-flash et deepseek-v4-flash-vision-exp sont « temporairement » redirigés vers V4.1 Flash et facturés à ce tarif ; les modèles correspondants sont retirés.
  • 21 septembre : xAI sort Grok 4.7 au prix de Grok 4.6.
  • 22 septembre : OpenAI lance GPT-6 Sol à 2 et 10 dollars, contre 4 et 20 pour le tarif promotionnel de GPT-5.6 Sol, et GPT-6 Luna à 0,10 et 0,50 dollar. Le même jour, Anthropic sort Claude Opus 5.5, à 4 et 20 dollars contre 5 et 25 pour Opus 5, et à 0,20 dollar en lecture de cache au lieu de 0,50. ActuIA a recalculé une session d'agent type avec ces deux grilles dans son analyse du 25 septembre.
  • 28 septembre : Claude Sonnet 5.5 sort au prix de Sonnet 5, 2 et 10 dollars, avec une lecture de cache à 0,20 dollar.
  • 29 septembre : GPT-6.1 Sol garde les 2 et 10 dollars de GPT-6 Sol mais divise par deux la lecture de cache, à 0,10 dollar, comme ActuIA l'a détaillé le 1er octobre.

Le journal des modifications d'OpenAI date les trois lancements du 3, du 22 et du 29 septembre. Un mouvement antérieur reste en vigueur. Le 10 août, Anthropic a fait du tarif d'introduction de Claude Sonnet 5, 2 et 10 dollars, son prix standard, selon ses notes de version ; la hausse à 3 et 15 dollars prévue le 1er septembre n'a pas eu lieu.

Trois des lancements de septembre portent d'abord sur la relecture du cache. Fable 5.1 et GPT-6.1 Sol ne changent que cette ligne, et Opus 5.5 la baisse de 60 % quand l'entrée et la sortie reculent de 20 %. C'est la ligne qui, selon Anthropic, représente la majorité du coût des usages agentiques et de programmation.

Cache et lots : de 75 % à 98 % de moins sur l'entrée relue

La remise sur un jeton relu depuis le cache va de 75 % pour Grok 4.7 (0,50 dollar contre 2) à 98 % pour deepseek-flash (0,006 contre 0,30 en heures pleines). Elle atteint 95 % sur GPT-6.1 Sol et Claude Opus 5.5, 97,5 % sur Claude Fable 5.1 et 90 % chez Google et Mistral AI. Le cache ne s'applique qu'au début de requête identique d'un appel à l'autre : les consignes, les définitions d'outils et les documents de référence doivent précéder les données propres à chaque appel, sans quoi la remise ne joue pas.

Le cache a aussi un prix d'entrée. Chez Anthropic, l'écriture coûte 1,25 fois le tarif d'entrée pour une conservation de cinq minutes et 2 fois pour une heure. L'éditeur calcule qu'elle est amortie dès la première relecture dans le premier cas, à partir de la deuxième dans le second. OpenAI facture aussi l'écriture, à 1,25 fois le tarif d'entrée en contexte court : 12,50 dollars sur GPT-6 Astra, 2,50 dollars sur GPT-6.1 Sol et 0,125 dollar sur GPT-6 Luna. Google ajoute, sur Gemini 3.8 Flash, une location de stockage de 0,50 dollar par million de jetons et par heure, portée à 4,50 dollars sur Gemini 3.1 Pro Preview : un cache conservé sans être relu se paie quand même.

Le traitement par lots divise la facture par deux chez OpenAI, Anthropic, Google et Mistral AI, en échange d'un délai de réponse. Anthropic précise que ses multiplicateurs se cumulent : remise de lots, cache et résidence des données s'appliquent les uns sur les autres. La remise disparaît dans plusieurs configurations relevées le 6 octobre : sur Amazon Bedrock pour Claude Opus 5.5 et Sonnet 5.5, sur les points d'accès régionaux de Mistral AI et chez xAI pour Grok 4.7. La page de DeepSeek ne mentionne aucune offre de lots.

Quatre postes de facture absents des grilles

Le tokenizer

Un prix par million de jetons ne dit pas combien de jetons produit un texte donné. Anthropic indique que Claude 4.7 et les modèles suivants utilisent un nouveau tokenizer qui produit « environ 30 % de jetons en plus pour le même texte », une hausse que l'éditeur dit variable selon le contenu. À prix affiché égal, la facture d'un même corpus la suit. Aleph Alpha publie, avec son modèle Kolibri sorti le 3 octobre, une mesure de compression sur un corpus web allemand : 4,90 pour son tokenizer bilingue, 4,35 pour celui de GPT-5 et 3,72 pour celui de DeepSeek V4. Le même texte allemand donne ainsi environ 30 % de jetons de plus chez DeepSeek que chez Kolibri. ActuIA n'a trouvé sur les grilles relevées aucun coefficient propre au français. Il se mesure sur ses propres documents, avec les points d'accès de comptage de jetons que documentent OpenAI et Anthropic.

La résidence des données

OpenAI facture 10 % de plus sur ses points d'accès régionaux, dont eu.api.openai.com, pour les modèles sortis à partir du 5 mars 2026. L'accès passe par l'équipe commerciale et, hors États-Unis, par une approbation des contrôles de surveillance des abus et un avenant sur la conservation des données, selon sa documentation. L'API d'Anthropic ne propose que deux valeurs pour la géographie d'inférence, « global » et « us », cette dernière facturée 1,1 fois, d'après sa page sur la résidence des données. Aucune géographie européenne n'y figure ; Bedrock et Google Cloud proposent des points d'accès en Europe, avec 10 % de supplément. Mistral AI applique le même supplément sur api.eu.mistral.ai, dont les centres de données sont situés dans l'UE et l'AELE, et précise que son point d'accès global « ne s'engage pas sur un lieu d'inférence ».

Les heures pleines de DeepSeek

Depuis le 16 août 2026, DeepSeek facture ses heures creuses à la moitié du tarif des heures pleines. Ces dernières couvrent 1 h à 4 h et 6 h à 10 h UTC en semaine. À Paris, cela correspond à 3 h à 6 h et 8 h à 12 h jusqu'au 25 octobre, puis à 2 h à 5 h et 7 h à 11 h après le passage à l'heure d'hiver. Une équipe européenne qui sollicite l'API pendant sa matinée de travail paie donc le plein tarif ; les week-ends et les jours fériés chinois sont entièrement en heures creuses. La faiblesse du prix de lecture du cache tient à un choix d'architecture que ActuIA a décrit en septembre.

Les jetons de raisonnement

Les jetons de raisonnement ne sont pas visibles dans la réponse mais sont « facturés comme des jetons de sortie », écrit OpenAI dans son guide ; Google intitule sa ligne « prix de sortie (jetons de réflexion inclus) ». La sortie étant le tarif le plus élevé de chaque grille, le réglage de l'effort de raisonnement agit directement sur la ligne la plus chère de la facture.

Héberger en Europe : clouds, point d'accès UE de Mistral et poids ouverts

Pour une contrainte de localisation, le tarif de référence n'est pas celui du tableau principal. Les grilles régionales relevées le 6 octobre, en dollars par million de jetons, ajoutent 10 % au tarif global de l'éditeur.

AccèsModèleEntréeEntrée en cacheSortieLots (entrée / sortie)RelevéSource
Amazon Bedrock, inférence géographique ou régionale (Paris, Francfort)Claude Opus 5.54,400,2222,00non proposé06/10/2026grille
Amazon Bedrock, idemClaude Sonnet 5.52,200,2211,00non proposé06/10/2026grille
Google Cloud, multirégion UE (5)Claude Opus 5.54,400,2222,002,20 / 11,0006/10/2026grille
Google Cloud, multirégion UEClaude Sonnet 5.52,200,2211,001,10 / 5,5006/10/2026grille
Google Cloud, point d'accès non globalGemini 3.8 Flash0,8250,08254,1250,4125 / 2,0625 (6)06/10/2026grille
Mistral, point d'accès api.eu.mistral.ai (4)Mistral Medium 3.51,650,1658,25non proposé06/10/2026doc

(4) Tarif global de Mistral AI multiplié par 1,1, selon la règle publiée par l'éditeur. Les lots, les agents et l'API de fichiers ne sont pas disponibles sur ses points d'accès régionaux, et l'appel de fonctions est le seul outil pris en charge. (5) Sur la même page Google Cloud, l'onglet du point d'accès global affiche au 6 octobre des lots à 2,50 et 12,50 dollars pour Claude Opus 5.5. C'est le tarif de lots d'Opus 5, supérieur à la cellule européenne, alors qu'Anthropic facture les lots d'Opus 5.5 à 2 et 10 dollars. (6) Montant calculé par ActuIA : Google Cloud indique que les modèles Gemini sont disponibles en mode lots avec 50 % de remise, sans afficher le montant pour ce point d'accès.

Les modèles à poids ouverts déplacent le coût du jeton vers l'infrastructure. Mistral Large 3 et Mistral Small 4 sont publiés sous licence Apache 2.0, Mistral Medium 3.5 sous une licence MIT modifiée, d'après la liste des modèles de l'éditeur. Kolibri, publié le 3 octobre par Aleph Alpha, est un modèle à mélange d'experts de 78 milliards de paramètres, dont 3 milliards actifs, téléchargeable sous licence Apache 2.0 ; le billet de lancement ne publie pas de tarif par jeton. Le coût d'usage dépend alors du matériel, du taux d'occupation et de l'exploitation, qu'aucune grille ne capture.

Deux tâches types, calculées au tarif du 6 octobre

Premier cas : 10 000 tickets de support, chacun avec 2 000 jetons d'entrée, dont 1 500 de consignes communes relues depuis le cache et 500 propres au ticket, et 400 jetons de réponse, raisonnement compris. Soit 15 millions de jetons relus, 5 millions de jetons neufs et 4 millions en sortie, écritures de cache exclues. Second cas : la synthèse de 1 000 documents de 20 000 jetons chacun, sans cache, avec 1 000 jetons de sortie par document, soit 20 millions de jetons d'entrée et 1 million en sortie.

Modèle10 000 tickets1 000 documents, temps réel1 000 documents, en lots
GPT-6.1 Sol51,50 $ (45,97 €)50,00 $25,00 $
GPT-6 Luna2,65 $ (2,37 €)2,50 $1,25 $
Claude Opus 5.5103,00 $ (91,93 €)100,00 $50,00 $
Claude Sonnet 5.553,00 $ (47,30 €)50,00 $25,00 $
Gemini 3.8 Flash19,88 $ (17,74 €)18,75 $9,38 $
Mistral Medium 3.539,75 $ (35,48 €)37,50 $18,75 $
deepseek-flash, heures pleines / creuses6,39 $ / 3,20 $7,20 $ / 3,60 $n.c.

Sans cache, le premier cas coûte 80 dollars sur GPT-6.1 Sol et Claude Sonnet 5.5, contre 51,50 et 53 dollars avec : le cache retire environ un tiers de la facture. Le passage en lots divise par deux le second cas chez les éditeurs qui le proposent. Ces montants reproduisent une grille sur un volume donné ; ils ne disent rien du taux de réussite de chaque modèle sur ces tâches.

Pourquoi la facture d'un agent ne suit pas la grille

Deux modèles au même prix par jeton ne coûtent pas le même prix par tâche. Anthropic facture Claude Sonnet 5.5 au tarif de Sonnet 5 mais affirme qu'il « coûte jusqu'à 30 % de moins par tâche », parce qu'il consomme moins de jetons. Pour Opus 5.5, l'éditeur annonce qu'« aux réglages par défaut » le modèle « coûtera 40 % de moins qu'Opus 5 sur des charges typiques ». Cette mesure interne n'est pas détaillée et ne se vérifie pas sur une grille.

Le mouvement inverse est documenté par Bain & Company dans son Technology Report 2026 : la baisse du prix par jeton est compensée par la hausse des usages, « ce qui laisse le coût global par tâche obstinément élevé ». Le cabinet estime qu'une nouvelle chaîne agentique « peut coûter dix fois plus qu'elle ne le devrait » avant optimisation des requêtes, de l'orchestration et du choix des modèles. Le cas d'Uber, qui a plafonné Claude Code et Cursor après avoir épuisé son budget IA en quatre mois, illustre l'écart entre une grille stable et une consommation qui ne l'est pas. La grille fixe le prix du jeton ; l'architecture fixe le nombre de jetons.

Méthode et journal des relevés

Chaque tarif provient de la page officielle de l'éditeur ou du cloud, consultée le 6 octobre 2026 entre 0 h et 1 h UTC : grille d'OpenAI, grille d'Anthropic, grille de l'API Gemini, grille de Mistral AI, grille de DeepSeek, documentation des modèles de xAI, tarifs d'Amazon Bedrock et tarifs de Google Cloud. Les montants en dollars sont reportés sans arrondi, sauf ceux signalés comme calculés en note, en tarif public, hors remises négociées, engagements de capacité et offres gratuites. Sur l'offre gratuite de l'API Gemini, Google indique que les données servent à améliorer ses produits, ce qui n'est pas le cas en offre payante. La conversion en euros utilise le dernier taux de référence de la BCE disponible au moment du relevé.

Trois échéances figurent déjà dans les grilles et le calendrier de retrait d'Anthropic. La promotion de GPT-5.6 Sol reste garantie au moins jusqu'au 21 novembre 2026 et Claude Sonnet 4.5 sera retiré de l'API d'Anthropic le 30 novembre. Le tarif de Gemini 3.8 Flash doit doubler le 1er janvier 2027.