Was kostet dieser Text in jedem Modell?
Dieselbe Arbeit kostet je nach Ausführendem Größenordnungen mehr oder weniger. Fügen Sie den Text ein und sehen Sie die Preise nebeneinander, vom günstigsten zum teuersten.
- Modul
- Router
- Eingabe
- Ein Text
- Läuft auf
- Ihr Browser
- Kosten
- Kostenlos, ohne Anmeldung
Schätzung nach Schrift: Lateinisch ≈ 4 Zeichen pro Token; Chinesisch, Japanisch und Koreanisch brauchen deutlich mehr. Öffentliche Listenpreise, in US-Dollar.
Derselbe Text, dieselbe Arbeit, Preise mit Faktor 100 dazwischen
KI-Modelle berechnen Tokens, Wortteile, bei Ein- und Ausgabe. Was fast niemand betrachtet, ist, wie stark dieser Preis variiert: Derselbe Text, der bei einem leichten Modell Cent kostet, kostet beim Spitzenmodell ein Vielfaches. Bei einer einfachen Aufgabe ist dieser Unterschied jeden Monat rausgeworfenes Geld.
Das Tool schätzt die Tokens Ihres Textes, addiert die erwartete Antwort und wendet den öffentlichen Preis jedes Modells an. Die Liste ist vom günstigsten bis zum teuersten Modell sortiert. Modelle mit offenen Gewichten sind markiert, denn diese können Sie auch selbst betreiben.
- 01
Sie fügen den Text ein
Prompt, Dokument, Transkription, ganz gleich was. Nichts verlässt den Browser: Die Zählung erfolgt direkt hier.
- 02
Sie geben die Länge der Antwort an
Die Ausgabe kostet meist drei- bis fünfmal so viel wie die Eingabe; sie zu ignorieren halbiert die geschätzte Rechnung.
- 03
Der Vergleich erscheint nach Preis sortiert
Vom günstigsten zum teuersten, wobei der Balken den tatsächlichen Abstand zeigt.
- 01
Was ist ein Token überhaupt?
- Es ist die Einheit, in der das Modell liest und schreibt, normalerweise ein Wortteil. Im Portugiesischen ergibt ein gewöhnliches Wort meist zwischen einem und zwei Tokens. Im Chinesischen oder Japanischen entspricht ein einzelnes Zeichen meist bereits einem ganzen Token, deshalb kostet derselbe Inhalt in diesen Sprachen mehr.
- 02
Ist die Zählung exakt?
- Nein, und keine Schätzung ohne den offiziellen Tokenizer jedes Modells wird es sein. Jede Familie tokenisiert anders. Die Schätzung hier ist nach Schreibweise kalibriert und dient zur Einschätzung von Kosten und Kontext. Um eine Rechnung abzuschließen, verwenden Sie die Zahl, die der Anbieter in der API-Antwort zurückgibt.
- 03
Wird mein Text an einen Server geschickt?
- Nein. Zählung und Rechnung laufen vollständig in Ihrem Browser. Deshalb können Sie hier ein Dokument einfügen, das Sie in ein Tool, welches den Inhalt hochlädt, nicht einfügen würden.
- 04
Warum kosten Eingabe und Ausgabe unterschiedlich?
- Weil Generieren mehr kostet als Lesen. Das Modell verarbeitet die Eingabe auf einmal, erzeugt die Ausgabe aber Token für Token, und genau diese Generierung verbraucht mehr Rechenleistung. Deshalb kostet die Ausgabe in der Regel drei- bis fünfmal so viel wie die Eingabe.
- 05
Ist ein teureres Modell immer besser?
- Nicht für jede Aufgabe. Klassifizieren, ein Feld herauslösen und kurzen Text zusammenfassen erledigen leichte Modelle gut. Das teure Modell dem vorzubehalten, was wirklich Denkarbeit verlangt, ist der Unterschied zwischen einer gesunden und einer absurden Rechnung am Monatsende.
- 06
Wie wählt man in der Praxis, ohne auf eines zu setzen?
- Nach Aufgabe routen: Die einfache Anfrage geht an das günstige Modell, die schwierige wird weitergeleitet. Das bei jedem Aufruf manuell zu machen, ist nicht machbar, genau dafür gibt es das Modul Router, das das Ziel festlegt und aus dem Ergebnis lernt.
Sie haben den Preisabstand gesehen. Wer wählt das Ziel?
Bei jedem Aufruf das passende Modell zu wählen, leistet das Router-Modul: ein Schlüssel für den ganzen Markt, mit der Entscheidung pro Aufgabe statt pro Vertrag.
