Preise von KI-Modellen, nebeneinander.
Preis pro Million Eingabe- und Ausgabetokens, Kontextfenster und Anbieter. Filtern, sortieren und sehen, welche mit offenen Gewichten laufen. Diese können Sie auch selbst hosten.
- Modul
- Router
- Eingabe
- Nichts, sie ist bereits fertig
- Läuft auf
- Ihr Browser
- Kosten
- Kostenlos, ohne Anmeldung
| Modell | Eingabe / 1M | Ausgabe / 1M | Kontext |
|---|---|---|---|
| Nova LiteAmazon | 0.06 | 0.24 | 300k |
| Gemini 2.5 Flash-LiteGoogle | 0.10 | 0.40 | 1,000k |
| Qwen 3 32BAlibaba · offene Gewichte | 0.10 | 0.30 | 128k |
| Llama 4 ScoutMeta · offene Gewichte | 0.11 | 0.34 | 10,000k |
| Mistral SmallMistral · offene Gewichte | 0.20 | 0.60 | 128k |
| DeepSeek V3DeepSeek · offene Gewichte | 0.27 | 1.10 | 128k |
| Llama 4 MaverickMeta · offene Gewichte | 0.27 | 0.85 | 1,000k |
| Gemini 3 FlashGoogle | 0.30 | 2.50 | 1,000k |
| Grok 4 minixAI | 0.30 | 0.50 | 128k |
| GPT-4.1 miniOpenAI | 0.40 | 1.60 | 1,000k |
| DeepSeek R1DeepSeek · offene Gewichte | 0.55 | 2.19 | 128k |
| GPT-5 miniOpenAI | 0.60 | 2.40 | 400k |
| Nova ProAmazon | 0.80 | 3.20 | 300k |
| Claude Haiku 4.5Anthropic | 1.00 | 5.00 | 200k |
| o4-miniOpenAI | 1.10 | 4.40 | 200k |
| Qwen 3 MaxAlibaba | 1.20 | 6.00 | 262k |
| GPT-4.1OpenAI | 2.00 | 8.00 | 1,000k |
| Mistral LargeMistral | 2.00 | 6.00 | 128k |
| Gemini 3 ProGoogle | 2.50 | 15.00 | 2,000k |
| Command ACohere · offene Gewichte | 2.50 | 10.00 | 256k |
| Claude Sonnet 5Anthropic | 3.00 | 15.00 | 1,000k |
| Grok 4xAI | 3.00 | 15.00 | 256k |
| GPT-5OpenAI | 10.00 | 30.00 | 400k |
| Claude Opus 5Anthropic | 15.00 | 75.00 | 1,000k |
Werte in US-Dollar pro Million Token, öffentlicher Listenpreis. Aktualisiert am 2026-08-11.
Preis ist keine Fußnote, sondern eine Architekturentscheidung
Zwischen dem teuersten und dem günstigsten Modell in dieser Tabelle liegt ein Unterschied von mehr als dem Hundertfachen pro Token. Das ist keine Marktschwankung, sondern der Unterschied zwischen einem Produkt, das sich rechnet, und einem, das sich nicht rechnet. Wer das Modell zu Beginn des Projekts auswählt und es nie wieder prüft, zahlt meist für Kapazität, die nicht genutzt wird.
Neben dem Preis sind zwei Spalten wichtig: das Kontextfenster, das bestimmt, wie viel in einen Aufruf passt, und die Kennzeichnung für offene Gewichte. Ein Modell mit offenen Gewichten kann bei Ihnen gehostet werden. Damit wird aus der Frage "Was kostet die Miete?" die Frage "Was kostet der Besitz?".
- 01
Anbieter auswählen oder alle anzeigen
Die Tabelle beginnt beim ganzen Markt und filtert danach, wer liefert.
- 02
Nach dem sortieren, was in Ihrem Fall entscheidet
Günstigste Eingabe, wenn Sie viel Text schicken; günstigste Ausgabe, wenn Sie viel erzeugen; größter Kontext, wenn Sie mit langen Dokumenten arbeiten.
- 03
Achten Sie auf offene Gewichte
Diese können Sie in Ihrer eigenen Infrastruktur ausführen, und genau dort wird Preis zu Souveränität.
- 01
Was bedeutet Preis pro Million Token?
- Es ist die Standardmaßeinheit des Marktes: Was die Verarbeitung von einer Million Wortteilen kostet. Eine Million Tokens entsprechen grob etwa 750.000 Wörtern auf Portugiesisch, ungefähr zehn Büchern mittlerer Länge.
- 02
Warum werden Eingabe und Ausgabe getrennt abgerechnet?
- Weil sie unterschiedliche Dinge kosten. Die Eingabe zu lesen ist ein einziger Durchlauf, die Ausgabe zu erzeugen erfolgt Token für Token und benötigt deutlich mehr Rechenleistung. Deshalb kostet die Ausgabe meist drei bis fünf Mal so viel wie die Eingabe, und wer sie bei der Kostenschätzung ignoriert, liegt um die Hälfte daneben.
- 03
Was sind „offene Gewichte“ und warum zählt das?
- Es ist das Modell, dessen Gewichte veröffentlicht wurden: Sie können es herunterladen und auf Ihrem eigenen Rechner oder Server ausführen. Das ist wichtig, weil es die Art der Beziehung verändert. Statt Zugriff auf eine Blackbox zu mieten, deren Preis sich ändern kann oder die verschwinden kann, haben Sie die Möglichkeit, sie selbst zu betreiben.
- 04
Ist ein großes Kontextfenster den Aufpreis wert?
- Nur wenn Sie es nutzen. Kontext ist, wie viel in einen Aufruf passt, nicht wie viel das Modell „weiß“. Ein Fenster von Millionen Token zu bezahlen, um Prompts von zweitausend Wörtern zu schicken, heißt Platz kaufen, der leer bleibt.
- 05
Wie oft ändern sich diese Preise?
- Häufig gab es bei einigen Familien im Verlauf von 2024 und 2025 Kürzungen von mehr als 90 %, und jeden Monat kommen neue Modelle hinzu. Deshalb ist das Aktualisierungsdatum in der Fußzeile der Tabelle sichtbar: Einer Preiszahl ohne Datum kann man nicht vertrauen.
- 06
Kann ich mehrere Modelle nutzen, ohne mehrere Konten zu führen?
- Ja, mit einem Router davor: nur ein Schlüssel, und die Entscheidung, welches Modell jeden Aufruf bearbeitet, liegt intern. Das übernimmt das Modul Router und verhindert die Abhängigkeit von Anbietern, die den Preis erhöht haben.
Sie haben ein Modell gewählt. Und wenn der Preis sich ändert?
Das Router-Modul setzt einen einzigen Schlüssel vor den ganzen Markt und wählt das Ziel je Aufgabe. Ein Modellwechsel ist dann keine Migration mehr, sondern eine Einstellung.
