25 modelli monitorati · verificato il September 10, 2026
PREZZI DELLE API LLM, VERIFICATI E DATATI

Confronta il prezzo di ogni modello IA — prima di costruirci sopra.

Prezzi di input e output per 10 provider — OpenAI, Anthropic, Google, Mistral, DeepSeek, xAI e altri — verificati direttamente sulla pagina prezzi di ciascun provider, con fonte e data per ogni riga.

MODELLI MONITORATI · MEDIA $/1M TOKEN
$2.03
media input
$9.73
media output
Calcolato sui 25 modelli monitorati, verificati per la prima volta il September 10, 2026. Ricontrolliamo ogni 48 ore, quindi un trend comparirà dopo la prossima verifica.
Più economico monitorato
Mistral Small 4
$0.15 / $0.60
Più costoso monitorato
Claude Fable 5.1 (a pari merito)
$10.00 / $50.00
Divario di prezzo
66.7x
tariffa di input più cara vs. più economica
Provider monitorati
10
25 modelli in totale
Prezzo di input, tutti i modelli monitorati
$/1M token · scala logaritmica · confronto completo →
Claude Fable 5.1
$10.00
GPT-6 Astra
$10.00
Claude Opus 5
$5.00
GPT-5.6 Sol
$4.00
Command A
$2.50
Claude Sonnet 5
$2.00
GPT-5.6 Terra
$2.00
Gemini 3.1 Pro Preview
$2.00
Grok 4.6
$2.00
Qwen3.8-Max
$2.00
Mistral Medium 3.5
$1.50
Grok 4.3
$1.25
Amazon Nova 2 Pro
$1.25
Claude Haiku 4.5
$1.00
Grok Build 0.1
$1.00
Gemini 3.8 Flash
$0.75
Mistral Large 3
$0.50
Qwen3.7-Plus
$0.40
DeepSeek V4.1 Flash
$0.30
Amazon Nova 2 Lite
$0.30
Llama 4 Maverick
$0.27
Gemini 3.1 Flash-Lite
$0.25
GPT-5.6 Luna
$0.20
Llama 4 Scout
$0.18
Mistral Small 4
$0.15
Top di gamma Bilanciato Economico

I prezzi dei modelli oggi

Fonti: la pagina prezzi pubblica di ogni provider · verificato il September 10, 2026
25 modelli mostrati su 25
Modello Provider Input /1M Output /1M Contesto Fascia Fonte
Mistral $0.15 $0.60 Non pubblicato Economico mistral.ai — API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate.
Meta (via Together AI) $0.18 $0.59 1M token Economico together.ai — Llama 4 Scout ↗
OpenAI $0.20 $1.20 ~1,05M token Economico platform.openai.com/docs — Pricing ↗
Audio input priced separately at $0.50/1M.
Google $0.25 $1.50 Non pubblicato Economico ai.google.dev — Gemini API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate, one of several inference providers serving this open-weight model.
Meta (via Together AI) $0.27 $0.85 ~1,05M token Economico together.ai — Llama 4 Maverick ↗
Peak-hour, cache-miss rate shown. Off-peak (01:00–04:00 & 06:00–10:00 UTC, Mon–Fri) is half price; cache-hit input is far cheaper still ($0.006/1M peak).
DeepSeek $0.30 $1.20 1M token Economico api-docs.deepseek.com — Pricing ↗
Bedrock Standard tier. Flex tier: $0.15 / $1.25.
Amazon $0.30 $2.50 1M token Economico aws.amazon.com — Bedrock pricing ↗
Rate shown for 0–256K input tokens; both 256K–1M tier and above bill higher on input only.
Alibaba $0.40 $1.60 1M token Economico alibabacloud.com — Model Studio pricing ↗
Despite the "Large" name, priced below Medium 3.5 in Mistral's current lineup.
Mistral $0.50 $1.50 Non pubblicato Economico mistral.ai — API pricing ↗
Promotional rate through Dec 31, 2026; steps up to $1.50 / $7.50 on Jan 1, 2027.
Google $0.75 $3.75 Non pubblicato Bilanciato ai.google.dev — Gemini API pricing ↗
Anthropic $1.00 $5.00 200K token Economico platform.claude.com/docs — Pricing ↗
xAI $1.00 $2.00 256K token Economico docs.x.ai — Pricing ↗
Long-context tier (>200K input) doubles to $2.50 / $5.
xAI $1.25 $2.50 1M token Bilanciato docs.x.ai — Pricing ↗
Preview model, Bedrock Standard tier. A cheaper "Flex" tier and pricier "Priority" tier also exist.
Amazon $1.25 $10.00 Non pubblicato (anteprima) Bilanciato aws.amazon.com — Bedrock pricing ↗
Positioned by Mistral as its top general-purpose / agentic model — priced above "Large 3".
Mistral $1.50 $7.50 Non pubblicato Bilanciato mistral.ai — API pricing ↗
Launched at introductory pricing through Aug 31, 2026; the scheduled increase to $3/$15 was cancelled — $2/$10 is now the standing price.
Anthropic $2.00 $10.00 1M token Bilanciato platform.claude.com/docs — Pricing ↗
OpenAI $2.00 $12.00 ~1,05M token Bilanciato platform.openai.com/docs — Pricing ↗
Requests over 200K input tokens bill at $4 / $18 instead.
Google $2.00 $12.00 Fascia ≤200K token Top di gamma ai.google.dev — Gemini API pricing ↗
Long-context tier (>200K input) doubles to $4 / $12.
xAI $2.00 $6.00 500K token Top di gamma docs.x.ai — Pricing ↗
Singapore-region rate, flat regardless of prompt length.
Alibaba $2.00 $6.00 1M token Bilanciato alibabacloud.com — Model Studio pricing ↗
Current flagship; priced on Cohere's docs site rather than its main pricing page.
Cohere $2.50 $10.00 256K token Bilanciato docs.cohere.com — Command A ↗
Pricing is promotional, guaranteed only through Nov 21, 2026.
OpenAI $4.00 $20.00 ~1,05M token Bilanciato platform.openai.com/docs — Pricing ↗
Optional "fast mode" (research preview) available at $10 / $50, first-party API only.
Anthropic $5.00 $25.00 1M token Top di gamma platform.claude.com/docs — Pricing ↗
Cache hits priced at 0.025x base input (vs 0.1x standard) — the lowest cache rate Anthropic offers.
Anthropic $10.00 $50.00 1M token Top di gamma platform.claude.com/docs — Pricing ↗
Short-context tier shown; long-context requests (very large prompts) bill at $20 / $75.
OpenAI $10.00 $50.00 ~1,05M token Top di gamma platform.openai.com/docs — Pricing ↗

Come si confrontano i prezzi

Pagina di confronto completa →
TARIFFA DI INPUT PIÙ ECONOMICA
Mistral · $0.15 input / $0.60 output per milione di token. Buon punto di partenza per attività ad alto volume e bassa complessità — classificazione, estrazione, riassunti semplici.
MEDIA SU TUTTI I MODELLI MONITORATI
$2.03 / $9.73
La tariffa media di input/output sui 25 modelli monitorati, incluse le fasce top di gamma ed economiche — un riferimento approssimativo per capire se un preventivo è ragionevole, non una raccomandazione.
TARIFFA DI INPUT PIÙ COSTOSA
Claude Fable 5.1 a pari merito con GPT-6 Astra
Anthropic · $10.00 input / $50.00 output per milione di token — 66.7x la tariffa più economica monitorata. Non monitoriamo punteggi di benchmark: consideralo un confronto di prezzo, non una classifica di capacità.

Come verifichiamo ogni prezzo

Metodologia completa →
01
Leggiamo la fonte
Ogni prezzo proviene dalla pagina prezzi pubblica del provider — mai da un aggregatore terzo, una risposta API estratta o una stima. Quando un modello è open-weight (come Llama), indichiamo l'host specifico di cui mostriamo il prezzo, perché host diversi applicano tariffe diverse per lo stesso modello.
02
Datiamo ogni verifica
Questo monitoraggio è recente — la tabella sopra riflette un'unica verifica, il September 10, 2026. Ricontrolliamo ogni prezzo ogni 48 ore; qualsiasi cambiamento riceve una nuova data e viene registrato invece di essere sovrascritto in silenzio.
03
Restiamo gratuiti e onesti
Nessun account richiesto per consultare il sito. Non siamo sponsorizzati né affiliati a nessun provider elencato qui — ogni riga è trattata e reperita allo stesso modo. I prezzi mostrati sono le tariffe standard a contesto breve; la maggior parte dei provider offre anche fasce di cache, batch o lungo contesto, che colleghiamo senza dettagliarle del tutto nella tabella.

Domande frequenti

Tutte le FAQ →

Mistral Small 4 (Mistral) è il modello più economico che monitoriamo, a $0.15 per milione di token di input e $0.60 per milione di output. Diversi altri modelli economici sono molto vicini — vedi la tabella completa sopra.

Ampio. Claude Fable 5.1 (Anthropic) fa pagare 66.7x in più per token di input rispetto a Mistral Small 4 (a pari merito con GPT-6 Astra ai vertici). I prezzi top di gamma riflettono generalmente modelli più grandi con un ragionamento più approfondito, non un miglioramento lineare della qualità dell'output — vale la pena confrontarlo con il proprio caso d'uso prima di assumere che il modello più costoso sia quello giusto.

I token di input sono ciò che invii al modello — il tuo prompt, contesto, documenti, cronologia della conversazione. I token di output sono ciò che genera in risposta. L'output costa quasi sempre di più, spesso 3-5 volte la tariffa di input, perché generare testo è computazionalmente più costoso che leggerlo.

Meta non vende accesso diretto alla propria API per Llama — pubblica i pesi del modello e lascia che altre aziende lo ospitino. I prezzi che mostriamo per Llama 4 sono quelli di Together AI, uno dei diversi provider di inferenza che lo offrono; altri host (Groq, Fireworks e altri) potrebbero applicare tariffe diverse.

Ogni prezzo in questa pagina è stato verificato direttamente sulla pagina prezzi del provider il September 10, 2026. D'ora in poi ricontrolliamo ogni 48 ore — questa è stata la prima verifica, quindi non c'è ancora uno storico, ma ogni controllo futuro avrà una data e ogni cambiamento sarà registrato, così lo storico si costruirà da qui in avanti.

No. PerTokens è indipendente e non sponsorizzato. Ogni provider è elencato allo stesso modo, con la stessa fonte (la propria pagina prezzi pubblica) e la stessa data di verifica.