25 Modelle erfasst · verifiziert am September 10, 2026
LLM-API-PREISE, VERIFIZIERT UND DATIERT

Vergleichen Sie den Preis jedes KI-Modells — bevor Sie darauf aufbauen.

Input- und Output-Preise für 10 Anbieter — OpenAI, Anthropic, Google, Mistral, DeepSeek, xAI und mehr — direkt auf der Preisseite jedes Anbieters geprüft, mit Quelle und Datum in jeder Zeile.

ERFASSTE MODELLE · DURCHSCHNITT $/1M TOKENS
$2.03
Ø Input
$9.73
Ø Output
Berechnet über alle 25 erfassten Modelle, erstmals geprüft am September 10, 2026. Wir prüfen alle 48 Stunden erneut — nach der nächsten Prüfung erscheint ein Trend.
Günstigstes erfasstes Modell
Mistral Small 4
$0.15 / $0.60
Teuerstes erfasstes Modell
Claude Fable 5.1 (gleichauf)
$10.00 / $50.00
Preisspanne
66.7x
teuerster vs. günstigster Input-Preis
Erfasste Anbieter
10
25 Modelle insgesamt
Input-Preis, alle erfassten Modelle
$/1M Tokens · logarithmische Skala · vollständiger Vergleich →
Claude Fable 5.1
$10.00
GPT-6 Astra
$10.00
Claude Opus 5
$5.00
GPT-5.6 Sol
$4.00
Command A
$2.50
Claude Sonnet 5
$2.00
GPT-5.6 Terra
$2.00
Gemini 3.1 Pro Preview
$2.00
Grok 4.6
$2.00
Qwen3.8-Max
$2.00
Mistral Medium 3.5
$1.50
Grok 4.3
$1.25
Amazon Nova 2 Pro
$1.25
Claude Haiku 4.5
$1.00
Grok Build 0.1
$1.00
Gemini 3.8 Flash
$0.75
Mistral Large 3
$0.50
Qwen3.7-Plus
$0.40
DeepSeek V4.1 Flash
$0.30
Amazon Nova 2 Lite
$0.30
Llama 4 Maverick
$0.27
Gemini 3.1 Flash-Lite
$0.25
GPT-5.6 Luna
$0.20
Llama 4 Scout
$0.18
Mistral Small 4
$0.15
Flaggschiff Ausgewogen Budget

Modellpreise heute

Quellen: die öffentliche Preisseite jedes Anbieters · verifiziert am September 10, 2026
25 von 25 Modellen angezeigt
Modell Anbieter Input /1M Output /1M Kontext Stufe Quelle
Mistral $0.15 $0.60 Nicht veröffentlicht Budget mistral.ai — API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate.
Meta (via Together AI) $0.18 $0.59 1M Tokens Budget together.ai — Llama 4 Scout ↗
OpenAI $0.20 $1.20 ~1,05M Tokens Budget platform.openai.com/docs — Pricing ↗
Audio input priced separately at $0.50/1M.
Google $0.25 $1.50 Nicht veröffentlicht Budget ai.google.dev — Gemini API pricing ↗
Meta doesn't sell first-party API access — price shown is Together AI's hosted rate, one of several inference providers serving this open-weight model.
Meta (via Together AI) $0.27 $0.85 ~1,05M Tokens Budget together.ai — Llama 4 Maverick ↗
Peak-hour, cache-miss rate shown. Off-peak (01:00–04:00 & 06:00–10:00 UTC, Mon–Fri) is half price; cache-hit input is far cheaper still ($0.006/1M peak).
DeepSeek $0.30 $1.20 1M Tokens Budget api-docs.deepseek.com — Pricing ↗
Bedrock Standard tier. Flex tier: $0.15 / $1.25.
Amazon $0.30 $2.50 1M Tokens Budget aws.amazon.com — Bedrock pricing ↗
Rate shown for 0–256K input tokens; both 256K–1M tier and above bill higher on input only.
Alibaba $0.40 $1.60 1M Tokens Budget alibabacloud.com — Model Studio pricing ↗
Despite the "Large" name, priced below Medium 3.5 in Mistral's current lineup.
Mistral $0.50 $1.50 Nicht veröffentlicht Budget mistral.ai — API pricing ↗
Promotional rate through Dec 31, 2026; steps up to $1.50 / $7.50 on Jan 1, 2027.
Google $0.75 $3.75 Nicht veröffentlicht Ausgewogen ai.google.dev — Gemini API pricing ↗
Anthropic $1.00 $5.00 200K Tokens Budget platform.claude.com/docs — Pricing ↗
xAI $1.00 $2.00 256K Tokens Budget docs.x.ai — Pricing ↗
Long-context tier (>200K input) doubles to $2.50 / $5.
xAI $1.25 $2.50 1M Tokens Ausgewogen docs.x.ai — Pricing ↗
Preview model, Bedrock Standard tier. A cheaper "Flex" tier and pricier "Priority" tier also exist.
Amazon $1.25 $10.00 Nicht veröffentlicht (Vorschau) Ausgewogen aws.amazon.com — Bedrock pricing ↗
Positioned by Mistral as its top general-purpose / agentic model — priced above "Large 3".
Mistral $1.50 $7.50 Nicht veröffentlicht Ausgewogen mistral.ai — API pricing ↗
Launched at introductory pricing through Aug 31, 2026; the scheduled increase to $3/$15 was cancelled — $2/$10 is now the standing price.
Anthropic $2.00 $10.00 1M Tokens Ausgewogen platform.claude.com/docs — Pricing ↗
OpenAI $2.00 $12.00 ~1,05M Tokens Ausgewogen platform.openai.com/docs — Pricing ↗
Requests over 200K input tokens bill at $4 / $18 instead.
Google $2.00 $12.00 Stufe ≤200K Tokens Flaggschiff ai.google.dev — Gemini API pricing ↗
Long-context tier (>200K input) doubles to $4 / $12.
xAI $2.00 $6.00 500K Tokens Flaggschiff docs.x.ai — Pricing ↗
Singapore-region rate, flat regardless of prompt length.
Alibaba $2.00 $6.00 1M Tokens Ausgewogen alibabacloud.com — Model Studio pricing ↗
Current flagship; priced on Cohere's docs site rather than its main pricing page.
Cohere $2.50 $10.00 256K Tokens Ausgewogen docs.cohere.com — Command A ↗
Pricing is promotional, guaranteed only through Nov 21, 2026.
OpenAI $4.00 $20.00 ~1,05M Tokens Ausgewogen platform.openai.com/docs — Pricing ↗
Optional "fast mode" (research preview) available at $10 / $50, first-party API only.
Anthropic $5.00 $25.00 1M Tokens Flaggschiff platform.claude.com/docs — Pricing ↗
Cache hits priced at 0.025x base input (vs 0.1x standard) — the lowest cache rate Anthropic offers.
Anthropic $10.00 $50.00 1M Tokens Flaggschiff platform.claude.com/docs — Pricing ↗
Short-context tier shown; long-context requests (very large prompts) bill at $20 / $75.
OpenAI $10.00 $50.00 ~1,05M Tokens Flaggschiff platform.openai.com/docs — Pricing ↗

So vergleichen sich die Preise

Vollständige Vergleichsseite →
GÜNSTIGSTER INPUT-PREIS
Mistral · $0.15 Input / $0.60 Output pro Million Tokens. Guter Ausgangspunkt für Aufgaben mit hohem Volumen und geringer Komplexität — Klassifizierung, Extraktion, einfache Zusammenfassungen.
DURCHSCHNITT ÜBER ALLE ERFASSTEN MODELLE
$2.03 / $9.73
Der durchschnittliche Input-/Output-Preis über alle 25 erfassten Modelle, Flaggschiff- und Budget-Stufe eingeschlossen — ein grober Richtwert, ob ein Angebot fair ist, keine Empfehlung.
TEUERSTER INPUT-PREIS
Claude Fable 5.1 gleichauf mit GPT-6 Astra
Anthropic · $10.00 Input / $50.00 Output pro Million Tokens — 66.7x der günstigste erfasste Preis. Wir verfolgen keine Benchmark-Werte — verstehen Sie dies als Preisvergleich, nicht als Fähigkeiten-Ranking.

Wie wir jeden Preis verifizieren

Vollständige Methodik →
01
Wir lesen die Quelle
Jeder Preis stammt von der öffentlichen Preisseite des Anbieters — nie von einem Drittanbieter-Aggregator, einer gescrapten API-Antwort oder einer Schätzung. Bei Modellen mit offenen Gewichten (wie Llama) nennen wir den konkreten Hoster, dessen Preis wir zeigen, da verschiedene Hoster für dasselbe Modell unterschiedliche Preise verlangen.
02
Wir datieren jede Prüfung
Dies ist eine neue Übersicht — die Tabelle oben zeigt eine einzige Prüfung vom September 10, 2026. Wir prüfen jeden Preis alle 48 Stunden erneut; jede Änderung erhält ein neues Datum und wird protokolliert statt stillschweigend überschrieben.
03
Wir bleiben kostenlos und ehrlich
Kein Konto zum Durchsuchen nötig. Wir werden von keinem hier gelisteten Anbieter gesponsert oder sind mit ihm verbunden — jede Zeile wird gleich behandelt und gleich beschafft. Angezeigt werden die Standard-Kurzkontext-Preise; die meisten Anbieter bieten auch Cache-, Batch- oder Langkontext-Stufen an, die wir verlinken, aber nicht vollständig in der Tabelle auflisten.

Häufig gestellte Fragen

Alle FAQ →

Mistral Small 4 (Mistral) ist das günstigste von uns erfasste Modell, mit $0.15 pro Million Input-Tokens und $0.60 pro Million Output-Tokens. Mehrere andere Budget-Modelle liegen dicht dahinter — siehe die vollständige Tabelle oben.

Groß. Claude Fable 5.1 (Anthropic) verlangt 66.7x mehr pro Input-Token als Mistral Small 4 (gleichauf mit GPT-6 Astra an der Spitze). Flaggschiff-Preise spiegeln in der Regel größere Modelle mit tieferem Reasoning wider, nicht eine lineare Verbesserung der Ausgabequalität — es lohnt sich, dies an der eigenen Aufgabe zu messen, bevor man annimmt, das teurere Modell sei die richtige Wahl.

Input-Tokens sind das, was Sie an das Modell senden — Ihr Prompt, Kontext, Dokumente, Gesprächsverlauf. Output-Tokens sind das, was es zurückgibt. Output ist fast immer teurer, oft 3- bis 5-mal so teuer wie der Input-Preis, weil das Generieren von Text rechnerisch aufwendiger ist als das Lesen.

Meta verkauft keinen eigenen API-Zugang zu Llama — das Unternehmen veröffentlicht die Modellgewichte und lässt andere Firmen es hosten. Die von uns gezeigten Preise für Llama 4 stammen von Together AI, einem von mehreren Inferenz-Anbietern, die es bereitstellen; andere Hoster (Groq, Fireworks und andere) berechnen es möglicherweise anders.

Jeder Preis auf dieser Seite wurde am September 10, 2026 direkt anhand der Preisseite des Anbieters geprüft. Ab sofort prüfen wir alle 48 Stunden erneut — dies war die erste Prüfung, es gibt also noch keinen Verlauf, aber jede künftige Prüfung erhält ein Datum und jede Änderung wird protokolliert, sodass der Verlauf von hier an entsteht.

Nein. PerTokens ist unabhängig und nicht gesponsert. Jeder Anbieter wird auf die gleiche Weise gelistet, mit derselben Quelle (seiner eigenen öffentlichen Preisseite) und demselben Verifizierungsdatum.