25 modelos seguidos · verificado el September 10, 2026
PRECIOS DE API DE LLM, VERIFICADOS Y FECHADOS

Compara el precio de cada modelo de IA — antes de construir sobre él.

Precios de entrada y salida de 10 proveedores — OpenAI, Anthropic, Google, Mistral, DeepSeek, xAI y más — verificados directamente en la página de precios de cada proveedor, con la fuente y la fecha en cada fila.

MODELOS SEGUIDOS · PROMEDIO $/1M TOKENS
$2.03
prom. entrada
$9.73
prom. salida
Calculado sobre los 25 modelos seguidos, verificados por primera vez el September 10, 2026. Volvemos a comprobar cada 48 horas, así que aparecerá una tendencia tras la próxima verificación.
Más barato seguido
Mistral Small 4
$0.15 / $0.60
Más caro seguido
Claude Fable 5.1 (empatado)
$10.00 / $50.00
Diferencia de precio
66.7x
tarifa de entrada más cara vs. más barata
Proveedores seguidos
10
25 modelos en total
Precio de entrada, todos los modelos seguidos
$/1M tokens · escala logarítmica · comparación completa →
Claude Fable 5.1
$10.00
GPT-6 Astra
$10.00
Claude Opus 5
$5.00
GPT-5.6 Sol
$4.00
Command A
$2.50
Claude Sonnet 5
$2.00
GPT-5.6 Terra
$2.00
Gemini 3.1 Pro Preview
$2.00
Grok 4.6
$2.00
Qwen3.8-Max
$2.00
Mistral Medium 3.5
$1.50
Grok 4.3
$1.25
Amazon Nova 2 Pro
$1.25
Claude Haiku 4.5
$1.00
Grok Build 0.1
$1.00
Gemini 3.8 Flash
$0.75
Mistral Large 3
$0.50
Qwen3.7-Plus
$0.40
DeepSeek V4.1 Flash
$0.30
Amazon Nova 2 Lite
$0.30
Llama 4 Maverick
$0.27
Gemini 3.1 Flash-Lite
$0.25
GPT-5.6 Luna
$0.20
Llama 4 Scout
$0.18
Mistral Small 4
$0.15
Gama alta Equilibrado Económico

Precios de los modelos hoy

Fuentes: la página de precios pública de cada proveedor · verificado el September 10, 2026
25 de 25 modelos mostrados
Modelo Proveedor Entrada /1M Salida /1M Contexto Nivel Fuente
Mistral $0.15 $0.60 No publicado Económico mistral.ai — API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate.
Meta (via Together AI) $0.18 $0.59 1M tokens Económico together.ai — Llama 4 Scout ↗
OpenAI $0.20 $1.20 ~1,05M tokens Económico platform.openai.com/docs — Pricing ↗
Audio input priced separately at $0.50/1M.
Google $0.25 $1.50 No publicado Económico ai.google.dev — Gemini API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate, one of several inference providers serving this open-weight model.
Meta (via Together AI) $0.27 $0.85 ~1,05M tokens Económico together.ai — Llama 4 Maverick ↗
Peak-hour, cache-miss rate shown. Off-peak (01:00–04:00 & 06:00–10:00 UTC, Mon–Fri) is half price; cache-hit input is far cheaper still ($0.006/1M peak).
DeepSeek $0.30 $1.20 1M tokens Económico api-docs.deepseek.com — Pricing ↗
Bedrock Standard tier. Flex tier: $0.15 / $1.25.
Amazon $0.30 $2.50 1M tokens Económico aws.amazon.com — Bedrock pricing ↗
Rate shown for 0–256K input tokens; both 256K–1M tier and above bill higher on input only.
Alibaba $0.40 $1.60 1M tokens Económico alibabacloud.com — Model Studio pricing ↗
Despite the "Large" name, priced below Medium 3.5 in Mistral's current lineup.
Mistral $0.50 $1.50 No publicado Económico mistral.ai — API pricing ↗
Promotional rate through Dec 31, 2026; steps up to $1.50 / $7.50 on Jan 1, 2027.
Google $0.75 $3.75 No publicado Equilibrado ai.google.dev — Gemini API pricing ↗
Anthropic $1.00 $5.00 200K tokens Económico platform.claude.com/docs — Pricing ↗
xAI $1.00 $2.00 256K tokens Económico docs.x.ai — Pricing ↗
Long-context tier (>200K input) doubles to $2.50 / $5.
xAI $1.25 $2.50 1M tokens Equilibrado docs.x.ai — Pricing ↗
Preview model, Bedrock Standard tier. A cheaper "Flex" tier and pricier "Priority" tier also exist.
Amazon $1.25 $10.00 No publicado (vista previa) Equilibrado aws.amazon.com — Bedrock pricing ↗
Positioned by Mistral as its top general-purpose / agentic model — priced above "Large 3".
Mistral $1.50 $7.50 No publicado Equilibrado mistral.ai — API pricing ↗
Launched at introductory pricing through Aug 31, 2026; the scheduled increase to $3/$15 was cancelled — $2/$10 is now the standing price.
Anthropic $2.00 $10.00 1M tokens Equilibrado platform.claude.com/docs — Pricing ↗
OpenAI $2.00 $12.00 ~1,05M tokens Equilibrado platform.openai.com/docs — Pricing ↗
Requests over 200K input tokens bill at $4 / $18 instead.
Google $2.00 $12.00 Nivel ≤200K tokens Gama alta ai.google.dev — Gemini API pricing ↗
Long-context tier (>200K input) doubles to $4 / $12.
xAI $2.00 $6.00 500K tokens Gama alta docs.x.ai — Pricing ↗
Singapore-region rate, flat regardless of prompt length.
Alibaba $2.00 $6.00 1M tokens Equilibrado alibabacloud.com — Model Studio pricing ↗
Current flagship; priced on Cohere's docs site rather than its main pricing page.
Cohere $2.50 $10.00 256K tokens Equilibrado docs.cohere.com — Command A ↗
Pricing is promotional, guaranteed only through Nov 21, 2026.
OpenAI $4.00 $20.00 ~1,05M tokens Equilibrado platform.openai.com/docs — Pricing ↗
Optional "fast mode" (research preview) available at $10 / $50, first-party API only.
Anthropic $5.00 $25.00 1M tokens Gama alta platform.claude.com/docs — Pricing ↗
Cache hits priced at 0.025x base input (vs 0.1x standard) — the lowest cache rate Anthropic offers.
Anthropic $10.00 $50.00 1M tokens Gama alta platform.claude.com/docs — Pricing ↗
Short-context tier shown; long-context requests (very large prompts) bill at $20 / $75.
OpenAI $10.00 $50.00 ~1,05M tokens Gama alta platform.openai.com/docs — Pricing ↗

Cómo se comparan los precios

Página de comparación completa →
TARIFA DE ENTRADA MÁS BARATA
Mistral · $0.15 entrada / $0.60 salida por millón de tokens. Buen punto de partida para tareas de alto volumen y baja complejidad — clasificación, extracción, resúmenes simples.
PROMEDIO DE TODOS LOS MODELOS SEGUIDOS
$2.03 / $9.73
La tarifa media de entrada/salida entre los 25 modelos que seguimos, incluyendo gama alta y económica — una referencia aproximada para juzgar si un presupuesto es razonable, no una recomendación.
TARIFA DE ENTRADA MÁS CARA
Claude Fable 5.1 empatado con GPT-6 Astra
Anthropic · $10.00 entrada / $50.00 salida por millón de tokens — 66.7x la tarifa más barata seguida. No seguimos puntuaciones de benchmark, así que trata esto como una comparación de precios, no un ranking de capacidades.

Cómo verificamos cada precio

Metodología completa →
01
Leemos la fuente
Cada precio proviene de la página de precios pública del proveedor — nunca de un agregador externo, una respuesta de API extraída, o una estimación. Cuando un modelo es de peso abierto (como Llama), indicamos el proveedor de hospedaje concreto cuyo precio mostramos, ya que distintos proveedores cobran distinto por el mismo modelo.
02
Fechamos cada verificación
Este es un rastreador nuevo — la tabla anterior refleja una sola verificación, el September 10, 2026. Volvemos a comprobar cada precio cada 48 horas; cualquier cambio recibe una nueva fecha y queda registrado en vez de sobrescribirse en silencio.
03
Nos mantenemos gratuitos y honestos
No hace falta cuenta para navegar. No estamos patrocinados ni afiliados a ningún proveedor listado aquí — cada fila se trata y se obtiene de la misma manera. Los precios mostrados son las tarifas estándar de contexto corto; la mayoría de proveedores también ofrecen niveles de caché, procesamiento por lotes o contexto largo que enlazamos sin detallar del todo en la tabla.

Preguntas frecuentes

Todas las preguntas →

Mistral Small 4 (Mistral) es el modelo más barato que seguimos, a $0.15 por millón de tokens de entrada y $0.60 por millón de salida. Otros modelos económicos están muy cerca — consulta la tabla completa arriba.

Grande. Claude Fable 5.1 (Anthropic) cobra 66.7x más por token de entrada que Mistral Small 4 (empatado con GPT-6 Astra en la parte alta). Los precios de gama alta suelen reflejar modelos más grandes con razonamiento más profundo, no una mejora lineal en la calidad de salida — conviene comparar con tu propia tarea antes de asumir que el modelo más caro es el adecuado.

Los tokens de entrada son lo que envías al modelo — tu prompt, contexto, documentos, historial de conversación. Los tokens de salida son lo que genera de vuelta. La salida casi siempre cuesta más, a menudo de 3 a 5 veces la tarifa de entrada, porque generar texto es más costoso computacionalmente que leerlo.

Meta no vende acceso directo a su propia API para Llama — publica los pesos del modelo y deja que otras empresas lo alojen. Los precios que mostramos para Llama 4 son los de Together AI, uno de varios proveedores de inferencia que lo ofrecen; otros (Groq, Fireworks, y otros) pueden cobrar distinto.

Cada precio de esta página se comprobó directamente en la página de tarifas del proveedor el September 10, 2026. A partir de ahora volvemos a verificar cada 48 horas — esta fue la primera pasada, así que aún no hay historial, pero cada futura comprobación tendrá fecha y cualquier cambio quedará registrado, para que el historial se construya desde aquí.

No. PerTokens es independiente y no está patrocinado. Cada proveedor se lista de la misma forma, con la misma fuente (su propia página de precios pública) y la misma fecha de verificación.