QUESTIONS

Questions fréquentes

Sur les données, la méthodologie, et le site lui-même.

Mistral Small 4 (Mistral) est le modèle le moins cher que nous suivons, à $0.15 par million de tokens en entrée et $0.60 par million en sortie. Plusieurs autres modèles économiques sont juste derrière — voir le tableau complet ci-dessus.

Important. Claude Fable 5.1 (Anthropic) facture 66.7x plus cher par token d'entrée que Mistral Small 4 (ex æquo avec GPT-6 Astra en haut de gamme). Les tarifs haut de gamme reflètent généralement des modèles plus grands avec un raisonnement plus poussé, pas une amélioration linéaire de la qualité — à comparer avec votre propre cas d'usage avant de supposer que le modèle le plus cher est le bon choix.

Les tokens d'entrée sont ce que vous envoyez au modèle — votre prompt, le contexte, des documents, l'historique de conversation. Les tokens de sortie sont ce qu'il génère en retour. La sortie est presque toujours facturée plus cher, souvent 3 à 5 fois le taux d'entrée, car générer du texte coûte plus cher en calcul que le lire.

Meta ne vend pas d'accès API en direct à Llama — l'entreprise publie les poids du modèle et laisse d'autres sociétés l'héberger. Les prix affichés pour Llama 4 sont ceux de Together AI, l'un des hébergeurs d'inférence qui le propose ; d'autres (Groq, Fireworks, et d'autres encore) peuvent le facturer différemment.

Chaque prix de cette page a été vérifié directement sur la page de tarifs du fournisseur le September 10, 2026. Nous revérifions désormais toutes les 48 heures — c'était la première passe, il n'y a donc pas encore d'historique, mais chaque future vérification sera datée et tout changement consigné, pour que l'historique se construise à partir de maintenant.

Non. PerTokens est indépendant et non sponsorisé. Chaque fournisseur est listé de la même façon, avec la même source (sa propre page de tarifs publique) et la même date de vérification.

Pas encore dans le tableau principal — nous affichons le tarif standard, à contexte court et à la demande de chaque modèle pour garder une comparaison équitable entre fournisseurs. Quand un fournisseur publie un tarif de lot ou de cache nettement différent, nous le mentionnons dans les notes du modèle ou sur sa page dédiée.

Écrivez à contact@pertokens.com en indiquant le modèle ou le fournisseur et un lien vers sa page de tarifs officielle. La liste suivie est sélectionnée à la main parmi les fournisseurs majeurs avec une page de tarifs API publique — les ajouts reçoivent le même traitement que tout ce qui est déjà présent : sourcé directement depuis la page du fournisseur, daté, et jamais estimé.

Cette page répond à des questions précises ; la page méthodologie explique tout le processus de sourcing et de vérification en un seul endroit, y compris ce sur quoi nous nous standardisons et ce que nous excluons volontairement.