Comparez le prix de chaque modèle d'IA — avant de construire dessus.
Tarifs d'entrée et de sortie pour 10 fournisseurs — OpenAI, Anthropic, Google, Mistral, DeepSeek, xAI et plus — vérifiés directement sur la page de tarifs de chaque fournisseur, avec la source et la date pour chaque ligne.
Les prix des modèles aujourd'hui
Sources : la page de tarifs publique de chaque fournisseur · vérifié le September 10, 2026| Modèle | Fournisseur | Entrée /1M | Sortie /1M | Contexte | Palier | Source |
|---|---|---|---|---|---|---|
| Mistral | $0.15 | $0.60 | Non publié | Économique | mistral.ai — API pricing ↗ | |
|
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate.
|
Meta (via Together AI) | $0.18 | $0.59 | 1M tokens | Économique | together.ai — Llama 4 Scout ↗ |
| OpenAI | $0.20 | $1.20 | ~1,05M tokens | Économique | platform.openai.com/docs — Pricing ↗ | |
|
Audio input priced separately at $0.50/1M.
|
$0.25 | $1.50 | Non publié | Économique | ai.google.dev — Gemini API pricing ↗ | |
|
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate, one of several inference providers serving this open-weight model.
|
Meta (via Together AI) | $0.27 | $0.85 | ~1,05M tokens | Économique | together.ai — Llama 4 Maverick ↗ |
|
Peak-hour, cache-miss rate shown. Off-peak (01:00–04:00 & 06:00–10:00 UTC, Mon–Fri) is half price; cache-hit input is far cheaper still ($0.006/1M peak).
|
DeepSeek | $0.30 | $1.20 | 1M tokens | Économique | api-docs.deepseek.com — Pricing ↗ |
|
Bedrock Standard tier. Flex tier: $0.15 / $1.25.
|
Amazon | $0.30 | $2.50 | 1M tokens | Économique | aws.amazon.com — Bedrock pricing ↗ |
|
Rate shown for 0–256K input tokens; both 256K–1M tier and above bill higher on input only.
|
Alibaba | $0.40 | $1.60 | 1M tokens | Économique | alibabacloud.com — Model Studio pricing ↗ |
|
Despite the "Large" name, priced below Medium 3.5 in Mistral's current lineup.
|
Mistral | $0.50 | $1.50 | Non publié | Économique | mistral.ai — API pricing ↗ |
|
Promotional rate through Dec 31, 2026; steps up to $1.50 / $7.50 on Jan 1, 2027.
|
$0.75 | $3.75 | Non publié | Équilibré | ai.google.dev — Gemini API pricing ↗ | |
| Anthropic | $1.00 | $5.00 | 200K tokens | Économique | platform.claude.com/docs — Pricing ↗ | |
| xAI | $1.00 | $2.00 | 256K tokens | Économique | docs.x.ai — Pricing ↗ | |
|
Long-context tier (>200K input) doubles to $2.50 / $5.
|
xAI | $1.25 | $2.50 | 1M tokens | Équilibré | docs.x.ai — Pricing ↗ |
|
Preview model, Bedrock Standard tier. A cheaper "Flex" tier and pricier "Priority" tier also exist.
|
Amazon | $1.25 | $10.00 | Non publié (aperçu) | Équilibré | aws.amazon.com — Bedrock pricing ↗ |
|
Positioned by Mistral as its top general-purpose / agentic model — priced above "Large 3".
|
Mistral | $1.50 | $7.50 | Non publié | Équilibré | mistral.ai — API pricing ↗ |
|
Launched at introductory pricing through Aug 31, 2026; the scheduled increase to $3/$15 was cancelled — $2/$10 is now the standing price.
|
Anthropic | $2.00 | $10.00 | 1M tokens | Équilibré | platform.claude.com/docs — Pricing ↗ |
| OpenAI | $2.00 | $12.00 | ~1,05M tokens | Équilibré | platform.openai.com/docs — Pricing ↗ | |
|
Requests over 200K input tokens bill at $4 / $18 instead.
|
$2.00 | $12.00 | Palier ≤200K tokens | Haut de gamme | ai.google.dev — Gemini API pricing ↗ | |
|
Long-context tier (>200K input) doubles to $4 / $12.
|
xAI | $2.00 | $6.00 | 500K tokens | Haut de gamme | docs.x.ai — Pricing ↗ |
|
Singapore-region rate, flat regardless of prompt length.
|
Alibaba | $2.00 | $6.00 | 1M tokens | Équilibré | alibabacloud.com — Model Studio pricing ↗ |
|
Current flagship; priced on Cohere's docs site rather than its main pricing page.
|
Cohere | $2.50 | $10.00 | 256K tokens | Équilibré | docs.cohere.com — Command A ↗ |
|
Pricing is promotional, guaranteed only through Nov 21, 2026.
|
OpenAI | $4.00 | $20.00 | ~1,05M tokens | Équilibré | platform.openai.com/docs — Pricing ↗ |
|
Optional "fast mode" (research preview) available at $10 / $50, first-party API only.
|
Anthropic | $5.00 | $25.00 | 1M tokens | Haut de gamme | platform.claude.com/docs — Pricing ↗ |
|
Cache hits priced at 0.025x base input (vs 0.1x standard) — the lowest cache rate Anthropic offers.
|
Anthropic | $10.00 | $50.00 | 1M tokens | Haut de gamme | platform.claude.com/docs — Pricing ↗ |
|
Short-context tier shown; long-context requests (very large prompts) bill at $20 / $75.
|
OpenAI | $10.00 | $50.00 | ~1,05M tokens | Haut de gamme | platform.openai.com/docs — Pricing ↗ |
Comment les prix se comparent
Page de comparaison complète →Comment nous vérifions chaque prix
Méthodologie complète →Questions fréquentes
Toutes les FAQ →Mistral Small 4 (Mistral) est le modèle le moins cher que nous suivons, à $0.15 par million de tokens en entrée et $0.60 par million en sortie. Plusieurs autres modèles économiques sont juste derrière — voir le tableau complet ci-dessus.
Important. Claude Fable 5.1 (Anthropic) facture 66.7x plus cher par token d'entrée que Mistral Small 4 (ex æquo avec GPT-6 Astra en haut de gamme). Les tarifs haut de gamme reflètent généralement des modèles plus grands avec un raisonnement plus poussé, pas une amélioration linéaire de la qualité — à comparer avec votre propre cas d'usage avant de supposer que le modèle le plus cher est le bon choix.
Les tokens d'entrée sont ce que vous envoyez au modèle — votre prompt, le contexte, des documents, l'historique de conversation. Les tokens de sortie sont ce qu'il génère en retour. La sortie est presque toujours facturée plus cher, souvent 3 à 5 fois le taux d'entrée, car générer du texte coûte plus cher en calcul que le lire.
Meta ne vend pas d'accès API en direct à Llama — l'entreprise publie les poids du modèle et laisse d'autres sociétés l'héberger. Les prix affichés pour Llama 4 sont ceux de Together AI, l'un des hébergeurs d'inférence qui le propose ; d'autres (Groq, Fireworks, et d'autres encore) peuvent le facturer différemment.
Chaque prix de cette page a été vérifié directement sur la page de tarifs du fournisseur le September 10, 2026. Nous revérifions désormais toutes les 48 heures — c'était la première passe, il n'y a donc pas encore d'historique, mais chaque future vérification sera datée et tout changement consigné, pour que l'historique se construise à partir de maintenant.
Non. PerTokens est indépendant et non sponsorisé. Chaque fournisseur est listé de la même façon, avec la même source (sa propre page de tarifs publique) et la même date de vérification.