25 modelos monitorizados · verificado em September 10, 2026
PREÇOS DE API DE LLM, VERIFICADOS E DATADOS

Compare o preço de cada modelo de IA — antes de construir sobre ele.

Preços de entrada e saída de 10 fornecedores — OpenAI, Anthropic, Google, Mistral, DeepSeek, xAI e mais — verificados diretamente na página de preços de cada fornecedor, com a fonte e a data em cada linha.

MODELOS MONITORIZADOS · MÉDIA $/1M TOKENS
$2.03
média entrada
$9.73
média saída
Calculado com base nos 25 modelos monitorizados, verificados pela primeira vez em September 10, 2026. Voltamos a verificar a cada 48 horas, por isso uma tendência aparecerá após a próxima verificação.
Mais barato monitorizado
Mistral Small 4
$0.15 / $0.60
Mais caro monitorizado
Claude Fable 5.1 (empatado)
$10.00 / $50.00
Diferença de preço
66.7x
taxa de entrada mais cara vs. mais barata
Fornecedores monitorizados
10
25 modelos no total
Preço de entrada, todos os modelos monitorizados
$/1M tokens · escala logarítmica · comparação completa →
Claude Fable 5.1
$10.00
GPT-6 Astra
$10.00
Claude Opus 5
$5.00
GPT-5.6 Sol
$4.00
Command A
$2.50
Claude Sonnet 5
$2.00
GPT-5.6 Terra
$2.00
Gemini 3.1 Pro Preview
$2.00
Grok 4.6
$2.00
Qwen3.8-Max
$2.00
Mistral Medium 3.5
$1.50
Grok 4.3
$1.25
Amazon Nova 2 Pro
$1.25
Claude Haiku 4.5
$1.00
Grok Build 0.1
$1.00
Gemini 3.8 Flash
$0.75
Mistral Large 3
$0.50
Qwen3.7-Plus
$0.40
DeepSeek V4.1 Flash
$0.30
Amazon Nova 2 Lite
$0.30
Llama 4 Maverick
$0.27
Gemini 3.1 Flash-Lite
$0.25
GPT-5.6 Luna
$0.20
Llama 4 Scout
$0.18
Mistral Small 4
$0.15
Topo de gama Equilibrado Económico

Preços dos modelos hoje

Fontes: a página de preços pública de cada fornecedor · verificado em September 10, 2026
25 de 25 modelos apresentados
Modelo Fornecedor Entrada /1M Saída /1M Contexto Escalão Fonte
Mistral $0.15 $0.60 Não publicado Económico mistral.ai — API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate.
Meta (via Together AI) $0.18 $0.59 1M tokens Económico together.ai — Llama 4 Scout ↗
OpenAI $0.20 $1.20 ~1,05M tokens Económico platform.openai.com/docs — Pricing ↗
Audio input priced separately at $0.50/1M.
Google $0.25 $1.50 Não publicado Económico ai.google.dev — Gemini API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate, one of several inference providers serving this open-weight model.
Meta (via Together AI) $0.27 $0.85 ~1,05M tokens Económico together.ai — Llama 4 Maverick ↗
Peak-hour, cache-miss rate shown. Off-peak (01:00–04:00 & 06:00–10:00 UTC, Mon–Fri) is half price; cache-hit input is far cheaper still ($0.006/1M peak).
DeepSeek $0.30 $1.20 1M tokens Económico api-docs.deepseek.com — Pricing ↗
Bedrock Standard tier. Flex tier: $0.15 / $1.25.
Amazon $0.30 $2.50 1M tokens Económico aws.amazon.com — Bedrock pricing ↗
Rate shown for 0–256K input tokens; both 256K–1M tier and above bill higher on input only.
Alibaba $0.40 $1.60 1M tokens Económico alibabacloud.com — Model Studio pricing ↗
Despite the "Large" name, priced below Medium 3.5 in Mistral's current lineup.
Mistral $0.50 $1.50 Não publicado Económico mistral.ai — API pricing ↗
Promotional rate through Dec 31, 2026; steps up to $1.50 / $7.50 on Jan 1, 2027.
Google $0.75 $3.75 Não publicado Equilibrado ai.google.dev — Gemini API pricing ↗
Anthropic $1.00 $5.00 200K tokens Económico platform.claude.com/docs — Pricing ↗
xAI $1.00 $2.00 256K tokens Económico docs.x.ai — Pricing ↗
Long-context tier (>200K input) doubles to $2.50 / $5.
xAI $1.25 $2.50 1M tokens Equilibrado docs.x.ai — Pricing ↗
Preview model, Bedrock Standard tier. A cheaper "Flex" tier and pricier "Priority" tier also exist.
Amazon $1.25 $10.00 Não publicado (pré-visualização) Equilibrado aws.amazon.com — Bedrock pricing ↗
Positioned by Mistral as its top general-purpose / agentic model — priced above "Large 3".
Mistral $1.50 $7.50 Não publicado Equilibrado mistral.ai — API pricing ↗
Launched at introductory pricing through Aug 31, 2026; the scheduled increase to $3/$15 was cancelled — $2/$10 is now the standing price.
Anthropic $2.00 $10.00 1M tokens Equilibrado platform.claude.com/docs — Pricing ↗
OpenAI $2.00 $12.00 ~1,05M tokens Equilibrado platform.openai.com/docs — Pricing ↗
Requests over 200K input tokens bill at $4 / $18 instead.
Google $2.00 $12.00 Escalão ≤200K tokens Topo de gama ai.google.dev — Gemini API pricing ↗
Long-context tier (>200K input) doubles to $4 / $12.
xAI $2.00 $6.00 500K tokens Topo de gama docs.x.ai — Pricing ↗
Singapore-region rate, flat regardless of prompt length.
Alibaba $2.00 $6.00 1M tokens Equilibrado alibabacloud.com — Model Studio pricing ↗
Current flagship; priced on Cohere's docs site rather than its main pricing page.
Cohere $2.50 $10.00 256K tokens Equilibrado docs.cohere.com — Command A ↗
Pricing is promotional, guaranteed only through Nov 21, 2026.
OpenAI $4.00 $20.00 ~1,05M tokens Equilibrado platform.openai.com/docs — Pricing ↗
Optional "fast mode" (research preview) available at $10 / $50, first-party API only.
Anthropic $5.00 $25.00 1M tokens Topo de gama platform.claude.com/docs — Pricing ↗
Cache hits priced at 0.025x base input (vs 0.1x standard) — the lowest cache rate Anthropic offers.
Anthropic $10.00 $50.00 1M tokens Topo de gama platform.claude.com/docs — Pricing ↗
Short-context tier shown; long-context requests (very large prompts) bill at $20 / $75.
OpenAI $10.00 $50.00 ~1,05M tokens Topo de gama platform.openai.com/docs — Pricing ↗

Como os preços se comparam

Página de comparação completa →
TAXA DE ENTRADA MAIS BARATA
Mistral · $0.15 entrada / $0.60 saída por milhão de tokens. Bom ponto de partida para tarefas de alto volume e baixa complexidade — classificação, extração, resumos simples.
MÉDIA DE TODOS OS MODELOS MONITORIZADOS
$2.03 / $9.73
A taxa média de entrada/saída entre os 25 modelos monitorizados, incluindo topo de gama e económico — uma referência aproximada para avaliar se um orçamento é razoável, não uma recomendação.
TAXA DE ENTRADA MAIS CARA
Claude Fable 5.1 empatado com GPT-6 Astra
Anthropic · $10.00 entrada / $50.00 saída por milhão de tokens — 66.7x a taxa mais barata monitorizada. Não seguimos pontuações de benchmark: veja isto como uma comparação de preços, não uma classificação de capacidades.

Como verificamos cada preço

Metodologia completa →
01
Lemos a fonte
Cada preço vem da página de preços pública do fornecedor — nunca de um agregador terceiro, uma resposta de API extraída, ou uma estimativa. Quando um modelo é de peso aberto (como o Llama), indicamos o alojamento específico cujo preço mostramos, já que diferentes alojamentos cobram valores diferentes pelo mesmo modelo.
02
Datamos cada verificação
Este é um acompanhamento recente — a tabela acima reflete uma única verificação, em September 10, 2026. Voltamos a verificar cada preço a cada 48 horas; qualquer alteração recebe uma nova data e fica registada em vez de ser silenciosamente substituída.
03
Mantemo-nos gratuitos e honestos
Não é necessária conta para consultar o site. Não somos patrocinados nem afiliados a nenhum fornecedor listado aqui — cada linha é tratada e obtida da mesma forma. Os preços apresentados são as taxas padrão de contexto curto; a maioria dos fornecedores também oferece escalões de cache, processamento em lote ou contexto longo, que ligamos sem detalhar totalmente na tabela.

Perguntas frequentes

Todas as perguntas →

Mistral Small 4 (Mistral) é o modelo mais barato que monitorizamos, a $0.15 por milhão de tokens de entrada e $0.60 por milhão de saída. Vários outros modelos económicos estão logo atrás — veja a tabela completa acima.

Grande. Claude Fable 5.1 (Anthropic) cobra 66.7x mais por token de entrada do que Mistral Small 4 (empatado com GPT-6 Astra no topo). Os preços de topo de gama refletem geralmente modelos maiores com raciocínio mais profundo, não uma melhoria linear na qualidade da saída — vale a pena comparar com a sua própria tarefa antes de assumir que o modelo mais caro é o adequado.

Os tokens de entrada são o que envia ao modelo — o seu prompt, contexto, documentos, histórico da conversa. Os tokens de saída são o que ele gera de volta. A saída custa quase sempre mais, muitas vezes 3 a 5 vezes a taxa de entrada, porque gerar texto é computacionalmente mais caro do que lê-lo.

A Meta não vende acesso direto à sua própria API para o Llama — publica os pesos do modelo e deixa que outras empresas o alojem. Os preços que mostramos para o Llama 4 são os da Together AI, um dos vários fornecedores de inferência que o disponibilizam; outros alojamentos (Groq, Fireworks, e outros) podem cobrar valores diferentes.

Cada preço nesta página foi verificado diretamente na página de preços do fornecedor em September 10, 2026. Doravante, voltamos a verificar a cada 48 horas — esta foi a primeira verificação, por isso ainda não há histórico, mas cada verificação futura terá uma data e qualquer alteração será registada, para que o histórico se construa a partir daqui.

Não. PerTokens é independente e não patrocinado. Cada fornecedor é listado da mesma forma, com a mesma fonte (a sua própria página de preços pública) e a mesma data de verificação.