Outils

Combien coûte ce texte dans chaque modèle ?

Le même travail coûte des ordres de grandeur différents selon qui l’exécute. Collez le texte et voyez le prix côte à côte, du moins cher au plus cher.

Module
Routeur
Entrée
Un texte
Où ça tourne
Votre navigateur
Coût
Gratuit, sans inscription
0caractères
0tokens estimés

Estimation par écriture : latin ≈ 4 caractères par token ; chinois, japonais et coréen consomment bien plus. Prix publics de catalogue, en dollars.

Ce que le calcul montre

Même texte, même travail, des prix qui varient d’un facteur 100

Les modèles d’IA facturent par token, des fragments de mots, en entrée comme en sortie. Ce que presque personne ne regarde, c’est à quel point ce prix varie : le même texte qui coûte quelques centimes avec un modèle léger coûte des dizaines de fois plus avec un modèle haut de gamme. Pour une tâche simple, cette différence est de l’argent gaspillé chaque mois.

L’outil estime les tokens de votre texte, ajoute la réponse attendue et applique le prix public de chaque modèle. La liste est classée du moins cher au plus cher, et les modèles à poids ouverts sont signalés, car vous pouvez aussi les exécuter vous-même.

Comment ça marche
  1. 01

    Vous collez le texte

    Prompt, document, transcription : peu importe. Rien ne quitte le navigateur, le comptage se fait ici même.

  2. 02

    Vous fixez la taille de la réponse

    La sortie coûte d’ordinaire trois à cinq fois plus que l’entrée : l’ignorer sous-estime la facture de moitié.

  3. 03

    La comparaison sort triée par prix

    Du moins cher au plus cher, la barre montrant l’écart réel entre eux.

Questions fréquentes
01

Qu’est-ce qu’un token, au juste ?

C’est l’unité avec laquelle le modèle lit et écrit, généralement un morceau de mot. En portugais, un mot courant représente généralement entre un et deux tokens. En chinois ou en japonais, un seul caractère vaut souvent déjà un token entier, c’est pourquoi le même contenu coûte plus cher dans ces langues.
02

Le comptage est-il exact ?

Non, et aucune estimation qui n’utilise pas le tokeniseur officiel de chaque modèle ne le sera. Chaque famille tokenise différemment. L’estimation ici est calibrée selon l’écriture et sert à dimensionner le coût et le contexte, pour clôturer la facture, utilisez le nombre renvoyé par le fournisseur dans la réponse de l’API.
03

Mon texte est-il envoyé à un serveur ?

Non. Le comptage et le calcul se font entièrement dans votre navigateur. C’est pour cela que vous pouvez coller ici un document que vous ne colleriez pas dans un outil qui téléverse le contenu.
04

Pourquoi entrée et sortie n’ont-elles pas le même prix ?

Parce que générer coûte plus cher que lire. Le modèle traite l’entrée en une fois, mais produit la sortie token par token, et c’est cette génération qui consomme le plus de calcul. La sortie coûte donc généralement trois à cinq fois plus que l’entrée.
05

Un modèle plus cher est-il toujours meilleur ?

Pas pour toute tâche. Classer, extraire un champ, résumer un texte court : les modèles légers s’en sortent très bien. Réserver le modèle cher à ce qui exige vraiment du raisonnement, c’est la différence entre une facture saine et une facture absurde en fin de mois.
06

Comment choisir en pratique, sans tout miser sur un seul ?

En routant selon la tâche : la demande simple va vers le modèle bon marché, la demande difficile monte. Le faire manuellement à chaque appel est irréalisable, c’est exactement le travail du module Routeur, qui choisit la destination et apprend aussi du résultat.

Vous avez vu l’écart de prix. Qui décide de la destination ?

Choisir le bon modèle à chaque appel, c’est ce que fait le module Routeur : une clé pour tout le marché, la décision prise par tâche et non par contrat.