25 modèles suivis · vérifié le September 10, 2026
TARIFS DES API LLM, VÉRIFIÉS ET DATÉS

Comparez le prix de chaque modèle d'IA — avant de construire dessus.

Tarifs d'entrée et de sortie pour 10 fournisseurs — OpenAI, Anthropic, Google, Mistral, DeepSeek, xAI et plus — vérifiés directement sur la page de tarifs de chaque fournisseur, avec la source et la date pour chaque ligne.

MODÈLES SUIVIS · MOYENNE $/1M TOKENS
$2.03
moy. entrée
$9.73
moy. sortie
Calculé sur les 25 modèles suivis, vérifiés une première fois le September 10, 2026. Nous revérifions toutes les 48 heures, une courbe de tendance apparaîtra après le prochain passage.
Le moins cher suivi
Mistral Small 4
$0.15 / $0.60
Le plus cher suivi
Claude Fable 5.1 (ex æquo)
$10.00 / $50.00
Écart de prix
66.7x
taux d'entrée le plus cher vs. le moins cher
Fournisseurs suivis
10
25 modèles au total
Prix d'entrée, tous les modèles suivis
$/1M tokens · échelle logarithmique · comparaison complète →
Claude Fable 5.1
$10.00
GPT-6 Astra
$10.00
Claude Opus 5
$5.00
GPT-5.6 Sol
$4.00
Command A
$2.50
Claude Sonnet 5
$2.00
GPT-5.6 Terra
$2.00
Gemini 3.1 Pro Preview
$2.00
Grok 4.6
$2.00
Qwen3.8-Max
$2.00
Mistral Medium 3.5
$1.50
Grok 4.3
$1.25
Amazon Nova 2 Pro
$1.25
Claude Haiku 4.5
$1.00
Grok Build 0.1
$1.00
Gemini 3.8 Flash
$0.75
Mistral Large 3
$0.50
Qwen3.7-Plus
$0.40
DeepSeek V4.1 Flash
$0.30
Amazon Nova 2 Lite
$0.30
Llama 4 Maverick
$0.27
Gemini 3.1 Flash-Lite
$0.25
GPT-5.6 Luna
$0.20
Llama 4 Scout
$0.18
Mistral Small 4
$0.15
Haut de gamme Équilibré Économique

Les prix des modèles aujourd'hui

Sources : la page de tarifs publique de chaque fournisseur · vérifié le September 10, 2026
25 modèles affichés sur 25
Modèle Fournisseur Entrée /1M Sortie /1M Contexte Palier Source
Mistral $0.15 $0.60 Non publié Économique mistral.ai — API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate.
Meta (via Together AI) $0.18 $0.59 1M tokens Économique together.ai — Llama 4 Scout ↗
OpenAI $0.20 $1.20 ~1,05M tokens Économique platform.openai.com/docs — Pricing ↗
Audio input priced separately at $0.50/1M.
Google $0.25 $1.50 Non publié Économique ai.google.dev — Gemini API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate, one of several inference providers serving this open-weight model.
Meta (via Together AI) $0.27 $0.85 ~1,05M tokens Économique together.ai — Llama 4 Maverick ↗
Peak-hour, cache-miss rate shown. Off-peak (01:00–04:00 & 06:00–10:00 UTC, Mon–Fri) is half price; cache-hit input is far cheaper still ($0.006/1M peak).
DeepSeek $0.30 $1.20 1M tokens Économique api-docs.deepseek.com — Pricing ↗
Bedrock Standard tier. Flex tier: $0.15 / $1.25.
Amazon $0.30 $2.50 1M tokens Économique aws.amazon.com — Bedrock pricing ↗
Rate shown for 0–256K input tokens; both 256K–1M tier and above bill higher on input only.
Alibaba $0.40 $1.60 1M tokens Économique alibabacloud.com — Model Studio pricing ↗
Despite the "Large" name, priced below Medium 3.5 in Mistral's current lineup.
Mistral $0.50 $1.50 Non publié Économique mistral.ai — API pricing ↗
Promotional rate through Dec 31, 2026; steps up to $1.50 / $7.50 on Jan 1, 2027.
Google $0.75 $3.75 Non publié Équilibré ai.google.dev — Gemini API pricing ↗
Anthropic $1.00 $5.00 200K tokens Économique platform.claude.com/docs — Pricing ↗
xAI $1.00 $2.00 256K tokens Économique docs.x.ai — Pricing ↗
Long-context tier (>200K input) doubles to $2.50 / $5.
xAI $1.25 $2.50 1M tokens Équilibré docs.x.ai — Pricing ↗
Preview model, Bedrock Standard tier. A cheaper "Flex" tier and pricier "Priority" tier also exist.
Amazon $1.25 $10.00 Non publié (aperçu) Équilibré aws.amazon.com — Bedrock pricing ↗
Positioned by Mistral as its top general-purpose / agentic model — priced above "Large 3".
Mistral $1.50 $7.50 Non publié Équilibré mistral.ai — API pricing ↗
Launched at introductory pricing through Aug 31, 2026; the scheduled increase to $3/$15 was cancelled — $2/$10 is now the standing price.
Anthropic $2.00 $10.00 1M tokens Équilibré platform.claude.com/docs — Pricing ↗
OpenAI $2.00 $12.00 ~1,05M tokens Équilibré platform.openai.com/docs — Pricing ↗
Requests over 200K input tokens bill at $4 / $18 instead.
Google $2.00 $12.00 Palier ≤200K tokens Haut de gamme ai.google.dev — Gemini API pricing ↗
Long-context tier (>200K input) doubles to $4 / $12.
xAI $2.00 $6.00 500K tokens Haut de gamme docs.x.ai — Pricing ↗
Singapore-region rate, flat regardless of prompt length.
Alibaba $2.00 $6.00 1M tokens Équilibré alibabacloud.com — Model Studio pricing ↗
Current flagship; priced on Cohere's docs site rather than its main pricing page.
Cohere $2.50 $10.00 256K tokens Équilibré docs.cohere.com — Command A ↗
Pricing is promotional, guaranteed only through Nov 21, 2026.
OpenAI $4.00 $20.00 ~1,05M tokens Équilibré platform.openai.com/docs — Pricing ↗
Optional "fast mode" (research preview) available at $10 / $50, first-party API only.
Anthropic $5.00 $25.00 1M tokens Haut de gamme platform.claude.com/docs — Pricing ↗
Cache hits priced at 0.025x base input (vs 0.1x standard) — the lowest cache rate Anthropic offers.
Anthropic $10.00 $50.00 1M tokens Haut de gamme platform.claude.com/docs — Pricing ↗
Short-context tier shown; long-context requests (very large prompts) bill at $20 / $75.
OpenAI $10.00 $50.00 ~1,05M tokens Haut de gamme platform.openai.com/docs — Pricing ↗

Comment les prix se comparent

Page de comparaison complète →
TAUX D'ENTRÉE LE MOINS CHER
Mistral · $0.15 entrée / $0.60 sortie par million de tokens. Bon point de départ pour des tâches à fort volume et faible complexité — classification, extraction, résumé simple.
MOYENNE SUR TOUS LES MODÈLES SUIVIS
$2.03 / $9.73
Le taux moyen d'entrée/sortie sur les 25 modèles suivis, tous paliers confondus — un repère approximatif pour juger si un devis est raisonnable, pas une recommandation.
TAUX D'ENTRÉE LE PLUS CHER
Claude Fable 5.1 ex æquo avec GPT-6 Astra
Anthropic · $10.00 entrée / $50.00 sortie par million de tokens — 66.7x le taux le moins cher suivi. Nous ne suivons pas les scores de benchmark : voyez ceci comme une comparaison de prix, pas un classement de capacités.

Comment nous vérifions chaque prix

Méthodologie complète →
01
Nous lisons la source
Chaque prix vient de la page de tarifs publique du fournisseur — jamais d'un agrégateur tiers, d'une réponse API scrapée, ou d'une estimation. Quand un modèle est en poids ouverts (comme Llama), nous précisons l'hébergeur dont le prix est affiché, car les hébergeurs facturent différemment le même modèle.
02
Nous datons chaque vérification
Ce suivi est récent — le tableau ci-dessus reflète une seule vérification, le September 10, 2026. Nous revérifions chaque prix toutes les 48 heures ; tout changement reçoit une nouvelle date et est consigné plutôt que silencieusement écrasé.
03
Nous restons gratuits et honnêtes
Aucun compte requis pour consulter le site. Nous ne sommes sponsorisés ni affiliés à aucun fournisseur listé ici — chaque ligne est sourcée et traitée de la même façon. Les prix affichés sont les taux standards à contexte court ; la plupart des fournisseurs proposent aussi des paliers de cache, de traitement par lots ou de long contexte, que nous mentionnons sans les détailler entièrement dans le tableau.

Questions fréquentes

Toutes les FAQ →

Mistral Small 4 (Mistral) est le modèle le moins cher que nous suivons, à $0.15 par million de tokens en entrée et $0.60 par million en sortie. Plusieurs autres modèles économiques sont juste derrière — voir le tableau complet ci-dessus.

Important. Claude Fable 5.1 (Anthropic) facture 66.7x plus cher par token d'entrée que Mistral Small 4 (ex æquo avec GPT-6 Astra en haut de gamme). Les tarifs haut de gamme reflètent généralement des modèles plus grands avec un raisonnement plus poussé, pas une amélioration linéaire de la qualité — à comparer avec votre propre cas d'usage avant de supposer que le modèle le plus cher est le bon choix.

Les tokens d'entrée sont ce que vous envoyez au modèle — votre prompt, le contexte, des documents, l'historique de conversation. Les tokens de sortie sont ce qu'il génère en retour. La sortie est presque toujours facturée plus cher, souvent 3 à 5 fois le taux d'entrée, car générer du texte coûte plus cher en calcul que le lire.

Meta ne vend pas d'accès API en direct à Llama — l'entreprise publie les poids du modèle et laisse d'autres sociétés l'héberger. Les prix affichés pour Llama 4 sont ceux de Together AI, l'un des hébergeurs d'inférence qui le propose ; d'autres (Groq, Fireworks, et d'autres encore) peuvent le facturer différemment.

Chaque prix de cette page a été vérifié directement sur la page de tarifs du fournisseur le September 10, 2026. Nous revérifions désormais toutes les 48 heures — c'était la première passe, il n'y a donc pas encore d'historique, mais chaque future vérification sera datée et tout changement consigné, pour que l'historique se construise à partir de maintenant.

Non. PerTokens est indépendant et non sponsorisé. Chaque fournisseur est listé de la même façon, avec la même source (sa propre page de tarifs publique) et la même date de vérification.