Prijzen van AI-modellen, naast elkaar.
Prijs per miljoen invoer en uitvoertokens, contextvenster en provider. Filter, sorteer en zie welke met open weights draaien, die kun je ook zelf hosten.
- Module
- Router
- Invoer
- Niets, het is al klaar
- Draait op
- Je browser
- Kosten
- Gratis, zonder registratie
| Model | Invoer / 1M | Uitvoer / 1M | Context |
|---|---|---|---|
| Nova LiteAmazon | 0.06 | 0.24 | 300k |
| Gemini 2.5 Flash-LiteGoogle | 0.10 | 0.40 | 1,000k |
| Qwen 3 32BAlibaba · open gewichten | 0.10 | 0.30 | 128k |
| Llama 4 ScoutMeta · open gewichten | 0.11 | 0.34 | 10,000k |
| Mistral SmallMistral · open gewichten | 0.20 | 0.60 | 128k |
| DeepSeek V3DeepSeek · open gewichten | 0.27 | 1.10 | 128k |
| Llama 4 MaverickMeta · open gewichten | 0.27 | 0.85 | 1,000k |
| Gemini 3 FlashGoogle | 0.30 | 2.50 | 1,000k |
| Grok 4 minixAI | 0.30 | 0.50 | 128k |
| GPT-4.1 miniOpenAI | 0.40 | 1.60 | 1,000k |
| DeepSeek R1DeepSeek · open gewichten | 0.55 | 2.19 | 128k |
| GPT-5 miniOpenAI | 0.60 | 2.40 | 400k |
| Nova ProAmazon | 0.80 | 3.20 | 300k |
| Claude Haiku 4.5Anthropic | 1.00 | 5.00 | 200k |
| o4-miniOpenAI | 1.10 | 4.40 | 200k |
| Qwen 3 MaxAlibaba | 1.20 | 6.00 | 262k |
| GPT-4.1OpenAI | 2.00 | 8.00 | 1,000k |
| Mistral LargeMistral | 2.00 | 6.00 | 128k |
| Gemini 3 ProGoogle | 2.50 | 15.00 | 2,000k |
| Command ACohere · open gewichten | 2.50 | 10.00 | 256k |
| Claude Sonnet 5Anthropic | 3.00 | 15.00 | 1,000k |
| Grok 4xAI | 3.00 | 15.00 | 256k |
| GPT-5OpenAI | 10.00 | 30.00 | 400k |
| Claude Opus 5Anthropic | 15.00 | 75.00 | 1,000k |
Bedragen in dollars per miljoen tokens, publieke lijstprijs. Bijgewerkt op 2026-08-11.
Prijs is geen voetnoot: het is een architectuurbeslissing
Tussen het duurste en het goedkoopste model in deze tabel zit een verschil van meer dan honderd keer per token. Dat is geen marktvariatie, het is het verschil tussen een product dat rendabel is en een product dat dat niet is. Wie het model aan het begin van een project kiest en het daarna nooit meer herziet, betaalt vaak voor capaciteit die niet wordt gebruikt.
Naast de prijs zijn twee kolommen belangrijk: het contextvenster, dat bepaalt hoeveel in één oproep past, en de markering voor open gewichten. Een model met open gewichten kun je zelf hosten, waardoor het gesprek verschuift van "wat kost huren" naar "wat kost bezitten".
- 01
Kies de aanbieder, of bekijk ze allemaal
De tabel begint bij de hele markt en filtert op wie levert.
- 02
Sorteer op wat in jouw geval beslist
Laagste invoer als je veel tekst stuurt; laagste uitvoer als je veel genereert; grootste context als je met lange documenten werkt.
- 03
Let op welke open gewichten hebben
Deze kun je op je eigen infrastructuur draaien, en daar wordt prijs soevereiniteit.
- 01
Wat betekent prijs per miljoen tokens?
- Het is de standaard eenheid van de markt: wat het kost om een miljoen woordfragmenten te verwerken. Eén miljoen tokens komt ruwweg overeen met ongeveer 750 duizend woorden in het Portugees, ongeveer tien boeken van gemiddelde omvang.
- 02
Waarom worden invoer en uitvoer apart gefactureerd?
- Omdat ze verschillende dingen kosten. De invoer lezen is één keer verwerken, de uitvoer genereren gaat token voor token en verbruikt veel meer rekenkracht. Daarom kost uitvoer meestal drie tot vijf keer zoveel als invoer, en daarom klopt de berekening maar half als je die bij een kostenraming negeert.
- 03
Wat zijn "open gewichten" en waarom telt dat?
- Het is een model waarvan de gewichten zijn gepubliceerd: je kunt het downloaden en op je eigen machine of server draaien. Dat is belangrijk omdat het de aard van de relatie verandert: in plaats van toegang te huren tot een doos waarvan de prijs kan veranderen of die kan verdwijnen, krijg je de optie om het zelf te beheren.
- 04
Is een groot contextvenster de meerprijs waard?
- Alleen als je het gebruikt. Context is hoeveel er in één aanroep past, niet hoeveel het model "weet". Betalen voor een venster van miljoenen tokens om prompts van tweeduizend woorden te sturen, is ruimte kopen die leeg blijft.
- 05
Hoe vaak veranderen deze prijzen?
- Regelmatig waren er in sommige families verlagingen van meer dan 90% in 2024 en 2025, en elke maand komen er nieuwe modellen bij. Daarom staat de updatedatum zichtbaar in de footer van de tabel: een prijs zonder datum is een getal dat je niet kunt vertrouwen.
- 06
Kan ik meerdere modellen gebruiken zonder meerdere accounts?
- Dat kan, met een router ervoor: één sleutel, en de beslissing welk model elke oproep afhandelt blijft intern. Dat doet de module Router, en zo voorkom je dat je vastzit aan wie de prijs heeft verhoogd.
Je koos een model. En als de prijs verandert?
De Router-module zet één sleutel voor de hele markt en kiest de bestemming per taak. Van model wisselen is dan geen migratie meer, maar een instelling.
