Prix des modèles d’IA, côte à côte.
Prix par million de tokens d’entrée et de sortie, fenêtre de contexte et fournisseur. Filtrez, triez et voyez lesquels fonctionnent avec des poids ouverts, vous pouvez aussi les héberger vous-même.
- Module
- Routeur
- Entrée
- Rien, elle est déjà prête
- Où ça tourne
- Votre navigateur
- Coût
- Gratuit, sans inscription
| Modèle | Entrée / 1M | Sortie / 1M | Contexte |
|---|---|---|---|
| Nova LiteAmazon | 0.06 | 0.24 | 300k |
| Gemini 2.5 Flash-LiteGoogle | 0.10 | 0.40 | 1,000k |
| Qwen 3 32BAlibaba · poids ouverts | 0.10 | 0.30 | 128k |
| Llama 4 ScoutMeta · poids ouverts | 0.11 | 0.34 | 10,000k |
| Mistral SmallMistral · poids ouverts | 0.20 | 0.60 | 128k |
| DeepSeek V3DeepSeek · poids ouverts | 0.27 | 1.10 | 128k |
| Llama 4 MaverickMeta · poids ouverts | 0.27 | 0.85 | 1,000k |
| Gemini 3 FlashGoogle | 0.30 | 2.50 | 1,000k |
| Grok 4 minixAI | 0.30 | 0.50 | 128k |
| GPT-4.1 miniOpenAI | 0.40 | 1.60 | 1,000k |
| DeepSeek R1DeepSeek · poids ouverts | 0.55 | 2.19 | 128k |
| GPT-5 miniOpenAI | 0.60 | 2.40 | 400k |
| Nova ProAmazon | 0.80 | 3.20 | 300k |
| Claude Haiku 4.5Anthropic | 1.00 | 5.00 | 200k |
| o4-miniOpenAI | 1.10 | 4.40 | 200k |
| Qwen 3 MaxAlibaba | 1.20 | 6.00 | 262k |
| GPT-4.1OpenAI | 2.00 | 8.00 | 1,000k |
| Mistral LargeMistral | 2.00 | 6.00 | 128k |
| Gemini 3 ProGoogle | 2.50 | 15.00 | 2,000k |
| Command ACohere · poids ouverts | 2.50 | 10.00 | 256k |
| Claude Sonnet 5Anthropic | 3.00 | 15.00 | 1,000k |
| Grok 4xAI | 3.00 | 15.00 | 256k |
| GPT-5OpenAI | 10.00 | 30.00 | 400k |
| Claude Opus 5Anthropic | 15.00 | 75.00 | 1,000k |
Valeurs en dollars par million de tokens, prix public de catalogue. Mis à jour le 2026-08-11.
Le prix n’est pas une note de bas de page : c’est une décision d’architecture
Entre le modèle le plus cher et le moins cher de ce tableau, il existe un écart de plus de cent fois par token. Ce n’est pas une variation de marché, c’est la différence entre un produit qui est rentable et un autre qui ne l’est pas. Ceux qui choisissent le modèle au début du projet et ne le réévaluent jamais paient souvent pour une capacité qu’ils n’utilisent pas.
Au-delà du prix, deux colonnes comptent : la fenêtre de contexte, qui définit ce qui tient dans un appel, et l’indication de poids ouverts. Un modèle à poids ouverts peut être hébergé par vous, ce qui fait passer la question de « combien coûte la location » à « combien coûte la possession ».
- 01
Choisissez le fournisseur, ou voyez-les tous
Le tableau part du marché entier et filtre par celui qui fournit.
- 02
Triez selon ce qui tranche dans votre cas
Entrée la plus basse si vous envoyez beaucoup de texte ; sortie la plus basse si vous générez beaucoup ; plus grand contexte si vous travaillez sur des documents longs.
- 03
Repérez ceux à poids ouverts
Vous pouvez les exécuter sur votre propre infrastructure, et c’est là que le prix devient souveraineté.
- 01
Que signifie prix par million de tokens ?
- C’est l’unité standard du marché : le coût de traitement d’un million de fragments de mots. Un million de tokens équivaut, en gros, à environ 750 000 mots en portugais, soit une dizaine de livres de taille moyenne.
- 02
Pourquoi entrée et sortie sont-elles facturées séparément ?
- Parce qu’ils coûtent des choses différentes. Lire l’entrée ne demande qu’un seul passage ; générer la sortie se fait token par token et consomme bien plus de calcul. C’est pourquoi la sortie coûte généralement trois à cinq fois plus que l’entrée, et pourquoi l’ignorer lors de l’estimation du coût divise le calcul par deux.
- 03
Que sont les « poids ouverts » et pourquoi cela compte ?
- C’est un modèle dont les poids ont été publiés : vous pouvez le télécharger et l’exécuter sur votre propre machine ou serveur. C’est important car cela change la nature de la relation, au lieu de louer l’accès à une boîte dont le prix peut changer ou qui peut disparaître, vous avez la possibilité de l’exploiter vous-même.
- 04
Une grande fenêtre de contexte vaut-elle son prix ?
- Seulement si vous vous en servez. Le contexte, c’est ce qui tient dans un appel, pas ce que le modèle « sait ». Payer une fenêtre de plusieurs millions de tokens pour envoyer des prompts de deux mille mots, c’est acheter de l’espace qui reste vide.
- 05
À quelle fréquence ces prix changent-ils ?
- Fréquemment, certaines familles ont connu des baisses de plus de 90 % au cours de 2024 et 2025, et de nouveaux modèles arrivent chaque mois. C’est pourquoi la date de mise à jour reste visible dans le pied de page du tableau : un prix sans date est un chiffre auquel on ne peut pas se fier.
- 06
Puis-je utiliser plusieurs modèles sans tenir plusieurs comptes ?
- Oui, avec un routeur devant : une seule clé, et la décision du modèle qui traite chaque appel reste interne. C’est ce que fait le module Routeur, et ce qui évite de rester dépendant de celui qui a augmenté ses prix.
Vous avez choisi un modèle. Et quand le prix changera ?
Le module Routeur place une seule clé devant tout le marché et décide de la destination par tâche. Changer de modèle cesse d’être une migration pour devenir un réglage.
