DOMANDE

Domande frequenti

Sui dati, sulla metodologia e sul sito stesso.

Mistral Small 4 (Mistral) è il modello più economico che monitoriamo, a $0.15 per milione di token di input e $0.60 per milione di output. Diversi altri modelli economici sono molto vicini — vedi la tabella completa sopra.

Ampio. Claude Fable 5.1 (Anthropic) fa pagare 66.7x in più per token di input rispetto a Mistral Small 4 (a pari merito con GPT-6 Astra ai vertici). I prezzi top di gamma riflettono generalmente modelli più grandi con un ragionamento più approfondito, non un miglioramento lineare della qualità dell'output — vale la pena confrontarlo con il proprio caso d'uso prima di assumere che il modello più costoso sia quello giusto.

I token di input sono ciò che invii al modello — il tuo prompt, contesto, documenti, cronologia della conversazione. I token di output sono ciò che genera in risposta. L'output costa quasi sempre di più, spesso 3-5 volte la tariffa di input, perché generare testo è computazionalmente più costoso che leggerlo.

Meta non vende accesso diretto alla propria API per Llama — pubblica i pesi del modello e lascia che altre aziende lo ospitino. I prezzi che mostriamo per Llama 4 sono quelli di Together AI, uno dei diversi provider di inferenza che lo offrono; altri host (Groq, Fireworks e altri) potrebbero applicare tariffe diverse.

Ogni prezzo in questa pagina è stato verificato direttamente sulla pagina prezzi del provider il September 10, 2026. D'ora in poi ricontrolliamo ogni 48 ore — questa è stata la prima verifica, quindi non c'è ancora uno storico, ma ogni controllo futuro avrà una data e ogni cambiamento sarà registrato, così lo storico si costruirà da qui in avanti.

No. PerTokens è indipendente e non sponsorizzato. Ogni provider è elencato allo stesso modo, con la stessa fonte (la propria pagina prezzi pubblica) e la stessa data di verifica.

Non ancora nella tabella principale — mostriamo la tariffa standard, a contesto breve e on-demand di ogni modello per mantenere il confronto equo tra provider. Quando un provider pubblica una tariffa batch o cache notevolmente diversa, la menzioniamo nelle note del modello o nella sua pagina dedicata.

Scrivi a contact@pertokens.com indicando il modello o il provider e un link alla sua pagina prezzi ufficiale. L'elenco monitorato è curato a mano tra i principali provider con una pagina prezzi API pubblica — le aggiunte ricevono lo stesso trattamento di tutto ciò che è già presente: reperito direttamente dalla pagina del provider, datato e mai stimato.

Questa pagina risponde a domande specifiche; la pagina metodologia spiega l'intero processo di reperimento e verifica in un unico posto, incluso su cosa ci standardizziamo e cosa escludiamo deliberatamente.