Compare o preço de cada modelo de IA — antes de construir sobre ele.
Preços de entrada e saída de 10 fornecedores — OpenAI, Anthropic, Google, Mistral, DeepSeek, xAI e mais — verificados diretamente na página de preços de cada fornecedor, com a fonte e a data em cada linha.
Preços dos modelos hoje
Fontes: a página de preços pública de cada fornecedor · verificado em September 10, 2026| Modelo | Fornecedor | Entrada /1M | Saída /1M | Contexto | Escalão | Fonte |
|---|---|---|---|---|---|---|
| Mistral | $0.15 | $0.60 | Não publicado | Económico | mistral.ai — API pricing ↗ | |
|
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate.
|
Meta (via Together AI) | $0.18 | $0.59 | 1M tokens | Económico | together.ai — Llama 4 Scout ↗ |
| OpenAI | $0.20 | $1.20 | ~1,05M tokens | Económico | platform.openai.com/docs — Pricing ↗ | |
|
Audio input priced separately at $0.50/1M.
|
$0.25 | $1.50 | Não publicado | Económico | ai.google.dev — Gemini API pricing ↗ | |
|
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate, one of several inference providers serving this open-weight model.
|
Meta (via Together AI) | $0.27 | $0.85 | ~1,05M tokens | Económico | together.ai — Llama 4 Maverick ↗ |
|
Peak-hour, cache-miss rate shown. Off-peak (01:00–04:00 & 06:00–10:00 UTC, Mon–Fri) is half price; cache-hit input is far cheaper still ($0.006/1M peak).
|
DeepSeek | $0.30 | $1.20 | 1M tokens | Económico | api-docs.deepseek.com — Pricing ↗ |
|
Bedrock Standard tier. Flex tier: $0.15 / $1.25.
|
Amazon | $0.30 | $2.50 | 1M tokens | Económico | aws.amazon.com — Bedrock pricing ↗ |
|
Rate shown for 0–256K input tokens; both 256K–1M tier and above bill higher on input only.
|
Alibaba | $0.40 | $1.60 | 1M tokens | Económico | alibabacloud.com — Model Studio pricing ↗ |
|
Despite the "Large" name, priced below Medium 3.5 in Mistral's current lineup.
|
Mistral | $0.50 | $1.50 | Não publicado | Económico | mistral.ai — API pricing ↗ |
|
Promotional rate through Dec 31, 2026; steps up to $1.50 / $7.50 on Jan 1, 2027.
|
$0.75 | $3.75 | Não publicado | Equilibrado | ai.google.dev — Gemini API pricing ↗ | |
| Anthropic | $1.00 | $5.00 | 200K tokens | Económico | platform.claude.com/docs — Pricing ↗ | |
| xAI | $1.00 | $2.00 | 256K tokens | Económico | docs.x.ai — Pricing ↗ | |
|
Long-context tier (>200K input) doubles to $2.50 / $5.
|
xAI | $1.25 | $2.50 | 1M tokens | Equilibrado | docs.x.ai — Pricing ↗ |
|
Preview model, Bedrock Standard tier. A cheaper "Flex" tier and pricier "Priority" tier also exist.
|
Amazon | $1.25 | $10.00 | Não publicado (pré-visualização) | Equilibrado | aws.amazon.com — Bedrock pricing ↗ |
|
Positioned by Mistral as its top general-purpose / agentic model — priced above "Large 3".
|
Mistral | $1.50 | $7.50 | Não publicado | Equilibrado | mistral.ai — API pricing ↗ |
|
Launched at introductory pricing through Aug 31, 2026; the scheduled increase to $3/$15 was cancelled — $2/$10 is now the standing price.
|
Anthropic | $2.00 | $10.00 | 1M tokens | Equilibrado | platform.claude.com/docs — Pricing ↗ |
| OpenAI | $2.00 | $12.00 | ~1,05M tokens | Equilibrado | platform.openai.com/docs — Pricing ↗ | |
|
Requests over 200K input tokens bill at $4 / $18 instead.
|
$2.00 | $12.00 | Escalão ≤200K tokens | Topo de gama | ai.google.dev — Gemini API pricing ↗ | |
|
Long-context tier (>200K input) doubles to $4 / $12.
|
xAI | $2.00 | $6.00 | 500K tokens | Topo de gama | docs.x.ai — Pricing ↗ |
|
Singapore-region rate, flat regardless of prompt length.
|
Alibaba | $2.00 | $6.00 | 1M tokens | Equilibrado | alibabacloud.com — Model Studio pricing ↗ |
|
Current flagship; priced on Cohere's docs site rather than its main pricing page.
|
Cohere | $2.50 | $10.00 | 256K tokens | Equilibrado | docs.cohere.com — Command A ↗ |
|
Pricing is promotional, guaranteed only through Nov 21, 2026.
|
OpenAI | $4.00 | $20.00 | ~1,05M tokens | Equilibrado | platform.openai.com/docs — Pricing ↗ |
|
Optional "fast mode" (research preview) available at $10 / $50, first-party API only.
|
Anthropic | $5.00 | $25.00 | 1M tokens | Topo de gama | platform.claude.com/docs — Pricing ↗ |
|
Cache hits priced at 0.025x base input (vs 0.1x standard) — the lowest cache rate Anthropic offers.
|
Anthropic | $10.00 | $50.00 | 1M tokens | Topo de gama | platform.claude.com/docs — Pricing ↗ |
|
Short-context tier shown; long-context requests (very large prompts) bill at $20 / $75.
|
OpenAI | $10.00 | $50.00 | ~1,05M tokens | Topo de gama | platform.openai.com/docs — Pricing ↗ |
Como os preços se comparam
Página de comparação completa →Como verificamos cada preço
Metodologia completa →Perguntas frequentes
Todas as perguntas →Mistral Small 4 (Mistral) é o modelo mais barato que monitorizamos, a $0.15 por milhão de tokens de entrada e $0.60 por milhão de saída. Vários outros modelos económicos estão logo atrás — veja a tabela completa acima.
Grande. Claude Fable 5.1 (Anthropic) cobra 66.7x mais por token de entrada do que Mistral Small 4 (empatado com GPT-6 Astra no topo). Os preços de topo de gama refletem geralmente modelos maiores com raciocínio mais profundo, não uma melhoria linear na qualidade da saída — vale a pena comparar com a sua própria tarefa antes de assumir que o modelo mais caro é o adequado.
Os tokens de entrada são o que envia ao modelo — o seu prompt, contexto, documentos, histórico da conversa. Os tokens de saída são o que ele gera de volta. A saída custa quase sempre mais, muitas vezes 3 a 5 vezes a taxa de entrada, porque gerar texto é computacionalmente mais caro do que lê-lo.
A Meta não vende acesso direto à sua própria API para o Llama — publica os pesos do modelo e deixa que outras empresas o alojem. Os preços que mostramos para o Llama 4 são os da Together AI, um dos vários fornecedores de inferência que o disponibilizam; outros alojamentos (Groq, Fireworks, e outros) podem cobrar valores diferentes.
Cada preço nesta página foi verificado diretamente na página de preços do fornecedor em September 10, 2026. Doravante, voltamos a verificar a cada 48 horas — esta foi a primeira verificação, por isso ainda não há histórico, mas cada verificação futura terá uma data e qualquer alteração será registada, para que o histórico se construa a partir daqui.
Não. PerTokens é independente e não patrocinado. Cada fornecedor é listado da mesma forma, com a mesma fonte (a sua própria página de preços pública) e a mesma data de verificação.