Häufig gestellte Fragen
Zu den Daten, der Methodik und der Seite selbst.
Mistral Small 4 (Mistral) ist das günstigste von uns erfasste Modell, mit $0.15 pro Million Input-Tokens und $0.60 pro Million Output-Tokens. Mehrere andere Budget-Modelle liegen dicht dahinter — siehe die vollständige Tabelle oben.
Groß. Claude Fable 5.1 (Anthropic) verlangt 66.7x mehr pro Input-Token als Mistral Small 4 (gleichauf mit GPT-6 Astra an der Spitze). Flaggschiff-Preise spiegeln in der Regel größere Modelle mit tieferem Reasoning wider, nicht eine lineare Verbesserung der Ausgabequalität — es lohnt sich, dies an der eigenen Aufgabe zu messen, bevor man annimmt, das teurere Modell sei die richtige Wahl.
Input-Tokens sind das, was Sie an das Modell senden — Ihr Prompt, Kontext, Dokumente, Gesprächsverlauf. Output-Tokens sind das, was es zurückgibt. Output ist fast immer teurer, oft 3- bis 5-mal so teuer wie der Input-Preis, weil das Generieren von Text rechnerisch aufwendiger ist als das Lesen.
Meta verkauft keinen eigenen API-Zugang zu Llama — das Unternehmen veröffentlicht die Modellgewichte und lässt andere Firmen es hosten. Die von uns gezeigten Preise für Llama 4 stammen von Together AI, einem von mehreren Inferenz-Anbietern, die es bereitstellen; andere Hoster (Groq, Fireworks und andere) berechnen es möglicherweise anders.
Jeder Preis auf dieser Seite wurde am September 10, 2026 direkt anhand der Preisseite des Anbieters geprüft. Ab sofort prüfen wir alle 48 Stunden erneut — dies war die erste Prüfung, es gibt also noch keinen Verlauf, aber jede künftige Prüfung erhält ein Datum und jede Änderung wird protokolliert, sodass der Verlauf von hier an entsteht.
Nein. PerTokens ist unabhängig und nicht gesponsert. Jeder Anbieter wird auf die gleiche Weise gelistet, mit derselben Quelle (seiner eigenen öffentlichen Preisseite) und demselben Verifizierungsdatum.
Noch nicht in der Haupttabelle — wir zeigen den Standard-, Kurzkontext-, On-Demand-Preis jedes Modells, um den Vergleich anbieterübergreifend fair zu halten. Veröffentlicht ein Anbieter einen deutlich abweichenden Batch- oder Cache-Preis, erwähnen wir das in den Notizen des Modells oder auf seiner eigenen Seite.
Schreib an contact@pertokens.com mit dem Modell oder Anbieter und einem Link zur offiziellen Preisseite. Die erfasste Liste wird manuell aus großen Anbietern mit einer öffentlichen API-Preisseite kuratiert — Ergänzungen erhalten dieselbe Behandlung wie alles bereits Vorhandene: direkt von der Anbieterseite bezogen, datiert und nie geschätzt.
Diese Seite beantwortet konkrete Fragen; die Methodik-Seite erklärt den gesamten Beschaffungs- und Verifizierungsprozess an einem Ort, einschließlich dessen, worauf wir standardisieren und was wir bewusst weglassen.