Confronta il prezzo di ogni modello IA — prima di costruirci sopra.
Prezzi di input e output per 10 provider — OpenAI, Anthropic, Google, Mistral, DeepSeek, xAI e altri — verificati direttamente sulla pagina prezzi di ciascun provider, con fonte e data per ogni riga.
I prezzi dei modelli oggi
Fonti: la pagina prezzi pubblica di ogni provider · verificato il September 10, 2026| Modello | Provider | Input /1M | Output /1M | Contesto | Fascia | Fonte |
|---|---|---|---|---|---|---|
| Mistral | $0.15 | $0.60 | Non pubblicato | Economico | mistral.ai — API pricing ↗ | |
|
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate.
|
Meta (via Together AI) | $0.18 | $0.59 | 1M token | Economico | together.ai — Llama 4 Scout ↗ |
| OpenAI | $0.20 | $1.20 | ~1,05M token | Economico | platform.openai.com/docs — Pricing ↗ | |
|
Audio input priced separately at $0.50/1M.
|
$0.25 | $1.50 | Non pubblicato | Economico | ai.google.dev — Gemini API pricing ↗ | |
|
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate, one of several inference providers serving this open-weight model.
|
Meta (via Together AI) | $0.27 | $0.85 | ~1,05M token | Economico | together.ai — Llama 4 Maverick ↗ |
|
Peak-hour, cache-miss rate shown. Off-peak (01:00–04:00 & 06:00–10:00 UTC, Mon–Fri) is half price; cache-hit input is far cheaper still ($0.006/1M peak).
|
DeepSeek | $0.30 | $1.20 | 1M token | Economico | api-docs.deepseek.com — Pricing ↗ |
|
Bedrock Standard tier. Flex tier: $0.15 / $1.25.
|
Amazon | $0.30 | $2.50 | 1M token | Economico | aws.amazon.com — Bedrock pricing ↗ |
|
Rate shown for 0–256K input tokens; both 256K–1M tier and above bill higher on input only.
|
Alibaba | $0.40 | $1.60 | 1M token | Economico | alibabacloud.com — Model Studio pricing ↗ |
|
Despite the "Large" name, priced below Medium 3.5 in Mistral's current lineup.
|
Mistral | $0.50 | $1.50 | Non pubblicato | Economico | mistral.ai — API pricing ↗ |
|
Promotional rate through Dec 31, 2026; steps up to $1.50 / $7.50 on Jan 1, 2027.
|
$0.75 | $3.75 | Non pubblicato | Bilanciato | ai.google.dev — Gemini API pricing ↗ | |
| Anthropic | $1.00 | $5.00 | 200K token | Economico | platform.claude.com/docs — Pricing ↗ | |
| xAI | $1.00 | $2.00 | 256K token | Economico | docs.x.ai — Pricing ↗ | |
|
Long-context tier (>200K input) doubles to $2.50 / $5.
|
xAI | $1.25 | $2.50 | 1M token | Bilanciato | docs.x.ai — Pricing ↗ |
|
Preview model, Bedrock Standard tier. A cheaper "Flex" tier and pricier "Priority" tier also exist.
|
Amazon | $1.25 | $10.00 | Non pubblicato (anteprima) | Bilanciato | aws.amazon.com — Bedrock pricing ↗ |
|
Positioned by Mistral as its top general-purpose / agentic model — priced above "Large 3".
|
Mistral | $1.50 | $7.50 | Non pubblicato | Bilanciato | mistral.ai — API pricing ↗ |
|
Launched at introductory pricing through Aug 31, 2026; the scheduled increase to $3/$15 was cancelled — $2/$10 is now the standing price.
|
Anthropic | $2.00 | $10.00 | 1M token | Bilanciato | platform.claude.com/docs — Pricing ↗ |
| OpenAI | $2.00 | $12.00 | ~1,05M token | Bilanciato | platform.openai.com/docs — Pricing ↗ | |
|
Requests over 200K input tokens bill at $4 / $18 instead.
|
$2.00 | $12.00 | Fascia ≤200K token | Top di gamma | ai.google.dev — Gemini API pricing ↗ | |
|
Long-context tier (>200K input) doubles to $4 / $12.
|
xAI | $2.00 | $6.00 | 500K token | Top di gamma | docs.x.ai — Pricing ↗ |
|
Singapore-region rate, flat regardless of prompt length.
|
Alibaba | $2.00 | $6.00 | 1M token | Bilanciato | alibabacloud.com — Model Studio pricing ↗ |
|
Current flagship; priced on Cohere's docs site rather than its main pricing page.
|
Cohere | $2.50 | $10.00 | 256K token | Bilanciato | docs.cohere.com — Command A ↗ |
|
Pricing is promotional, guaranteed only through Nov 21, 2026.
|
OpenAI | $4.00 | $20.00 | ~1,05M token | Bilanciato | platform.openai.com/docs — Pricing ↗ |
|
Optional "fast mode" (research preview) available at $10 / $50, first-party API only.
|
Anthropic | $5.00 | $25.00 | 1M token | Top di gamma | platform.claude.com/docs — Pricing ↗ |
|
Cache hits priced at 0.025x base input (vs 0.1x standard) — the lowest cache rate Anthropic offers.
|
Anthropic | $10.00 | $50.00 | 1M token | Top di gamma | platform.claude.com/docs — Pricing ↗ |
|
Short-context tier shown; long-context requests (very large prompts) bill at $20 / $75.
|
OpenAI | $10.00 | $50.00 | ~1,05M token | Top di gamma | platform.openai.com/docs — Pricing ↗ |
Come si confrontano i prezzi
Pagina di confronto completa →Come verifichiamo ogni prezzo
Metodologia completa →Domande frequenti
Tutte le FAQ →Mistral Small 4 (Mistral) è il modello più economico che monitoriamo, a $0.15 per milione di token di input e $0.60 per milione di output. Diversi altri modelli economici sono molto vicini — vedi la tabella completa sopra.
Ampio. Claude Fable 5.1 (Anthropic) fa pagare 66.7x in più per token di input rispetto a Mistral Small 4 (a pari merito con GPT-6 Astra ai vertici). I prezzi top di gamma riflettono generalmente modelli più grandi con un ragionamento più approfondito, non un miglioramento lineare della qualità dell'output — vale la pena confrontarlo con il proprio caso d'uso prima di assumere che il modello più costoso sia quello giusto.
I token di input sono ciò che invii al modello — il tuo prompt, contesto, documenti, cronologia della conversazione. I token di output sono ciò che genera in risposta. L'output costa quasi sempre di più, spesso 3-5 volte la tariffa di input, perché generare testo è computazionalmente più costoso che leggerlo.
Meta non vende accesso diretto alla propria API per Llama — pubblica i pesi del modello e lascia che altre aziende lo ospitino. I prezzi che mostriamo per Llama 4 sono quelli di Together AI, uno dei diversi provider di inferenza che lo offrono; altri host (Groq, Fireworks e altri) potrebbero applicare tariffe diverse.
Ogni prezzo in questa pagina è stato verificato direttamente sulla pagina prezzi del provider il September 10, 2026. D'ora in poi ricontrolliamo ogni 48 ore — questa è stata la prima verifica, quindi non c'è ancora uno storico, ma ogni controllo futuro avrà una data e ogni cambiamento sarà registrato, così lo storico si costruirà da qui in avanti.
No. PerTokens è indipendente e non sponsorizzato. Ogni provider è elencato allo stesso modo, con la stessa fonte (la propria pagina prezzi pubblica) e la stessa data di verifica.