Outils

Prix des modèles d’IA, côte à côte.

Prix par million de tokens d’entrée et de sortie, fenêtre de contexte et fournisseur. Filtrez, triez et voyez lesquels fonctionnent avec des poids ouverts, vous pouvez aussi les héberger vous-même.

Module
Routeur
Entrée
Rien, elle est déjà prête
Où ça tourne
Votre navigateur
Coût
Gratuit, sans inscription
ModèleEntrée / 1MSortie / 1MContexte
Nova LiteAmazon0.060.24300k
Gemini 2.5 Flash-LiteGoogle0.100.401,000k
Qwen 3 32BAlibaba · poids ouverts0.100.30128k
Llama 4 ScoutMeta · poids ouverts0.110.3410,000k
Mistral SmallMistral · poids ouverts0.200.60128k
DeepSeek V3DeepSeek · poids ouverts0.271.10128k
Llama 4 MaverickMeta · poids ouverts0.270.851,000k
Gemini 3 FlashGoogle0.302.501,000k
Grok 4 minixAI0.300.50128k
GPT-4.1 miniOpenAI0.401.601,000k
DeepSeek R1DeepSeek · poids ouverts0.552.19128k
GPT-5 miniOpenAI0.602.40400k
Nova ProAmazon0.803.20300k
Claude Haiku 4.5Anthropic1.005.00200k
o4-miniOpenAI1.104.40200k
Qwen 3 MaxAlibaba1.206.00262k
GPT-4.1OpenAI2.008.001,000k
Mistral LargeMistral2.006.00128k
Gemini 3 ProGoogle2.5015.002,000k
Command ACohere · poids ouverts2.5010.00256k
Claude Sonnet 5Anthropic3.0015.001,000k
Grok 4xAI3.0015.00256k
GPT-5OpenAI10.0030.00400k
Claude Opus 5Anthropic15.0075.001,000k

Valeurs en dollars par million de tokens, prix public de catalogue. Mis à jour le 2026-08-11.

Ce que montre le tableau

Le prix n’est pas une note de bas de page : c’est une décision d’architecture

Entre le modèle le plus cher et le moins cher de ce tableau, il existe un écart de plus de cent fois par token. Ce n’est pas une variation de marché, c’est la différence entre un produit qui est rentable et un autre qui ne l’est pas. Ceux qui choisissent le modèle au début du projet et ne le réévaluent jamais paient souvent pour une capacité qu’ils n’utilisent pas.

Au-delà du prix, deux colonnes comptent : la fenêtre de contexte, qui définit ce qui tient dans un appel, et l’indication de poids ouverts. Un modèle à poids ouverts peut être hébergé par vous, ce qui fait passer la question de « combien coûte la location » à « combien coûte la possession ».

Comment ça marche
  1. 01

    Choisissez le fournisseur, ou voyez-les tous

    Le tableau part du marché entier et filtre par celui qui fournit.

  2. 02

    Triez selon ce qui tranche dans votre cas

    Entrée la plus basse si vous envoyez beaucoup de texte ; sortie la plus basse si vous générez beaucoup ; plus grand contexte si vous travaillez sur des documents longs.

  3. 03

    Repérez ceux à poids ouverts

    Vous pouvez les exécuter sur votre propre infrastructure, et c’est là que le prix devient souveraineté.

Questions fréquentes
01

Que signifie prix par million de tokens ?

C’est l’unité standard du marché : le coût de traitement d’un million de fragments de mots. Un million de tokens équivaut, en gros, à environ 750 000 mots en portugais, soit une dizaine de livres de taille moyenne.
02

Pourquoi entrée et sortie sont-elles facturées séparément ?

Parce qu’ils coûtent des choses différentes. Lire l’entrée ne demande qu’un seul passage ; générer la sortie se fait token par token et consomme bien plus de calcul. C’est pourquoi la sortie coûte généralement trois à cinq fois plus que l’entrée, et pourquoi l’ignorer lors de l’estimation du coût divise le calcul par deux.
03

Que sont les « poids ouverts » et pourquoi cela compte ?

C’est un modèle dont les poids ont été publiés : vous pouvez le télécharger et l’exécuter sur votre propre machine ou serveur. C’est important car cela change la nature de la relation, au lieu de louer l’accès à une boîte dont le prix peut changer ou qui peut disparaître, vous avez la possibilité de l’exploiter vous-même.
04

Une grande fenêtre de contexte vaut-elle son prix ?

Seulement si vous vous en servez. Le contexte, c’est ce qui tient dans un appel, pas ce que le modèle « sait ». Payer une fenêtre de plusieurs millions de tokens pour envoyer des prompts de deux mille mots, c’est acheter de l’espace qui reste vide.
05

À quelle fréquence ces prix changent-ils ?

Fréquemment, certaines familles ont connu des baisses de plus de 90 % au cours de 2024 et 2025, et de nouveaux modèles arrivent chaque mois. C’est pourquoi la date de mise à jour reste visible dans le pied de page du tableau : un prix sans date est un chiffre auquel on ne peut pas se fier.
06

Puis-je utiliser plusieurs modèles sans tenir plusieurs comptes ?

Oui, avec un routeur devant : une seule clé, et la décision du modèle qui traite chaque appel reste interne. C’est ce que fait le module Routeur, et ce qui évite de rester dépendant de celui qui a augmenté ses prix.

Vous avez choisi un modèle. Et quand le prix changera ?

Le module Routeur place une seule clé devant tout le marché et décide de la destination par tâche. Changer de modèle cesse d’être une migration pour devenir un réglage.