Quanto custa esse texto em cada modelo?
O mesmo trabalho custa ordens de grandeza diferentes conforme quem executa. Cole o texto e veja o preço lado a lado, do mais barato ao mais caro.
- Módulo
- Roteador
- Entrada
- Um texto
- Onde roda
- Seu navegador
- Custo
- Grátis, sem cadastro
Estimativa por escrita: latino ≈ 4 caracteres por token; chinês, japonês e coreano gastam bem mais. Preço de tabela pública, em dólar.
O mesmo texto, o mesmo trabalho, preços que diferem em 100 vezes
Modelo de IA cobra por token, pedaços de palavra, na entrada e na saída. O que quase ninguém olha é o quanto esse preço varia: o mesmo texto que custa centavos num modelo leve custa dezenas de vezes mais no topo de linha. Para uma tarefa simples, essa diferença é dinheiro jogado fora todo mês.
A ferramenta estima os tokens do seu texto, soma o que você espera de resposta e aplica o preço público de cada modelo. A lista sai ordenada do mais barato para o mais caro, e os modelos de peso aberto ficam marcados, porque esses você também pode rodar por conta própria.
- 01
Você cola o texto
Prompt, documento, transcrição: o que for. Nada sai do navegador: a contagem é feita aqui mesmo.
- 02
Você diz o tamanho da resposta
A saída costuma custar de três a cinco vezes mais que a entrada, então ignorá-la subestima a conta pela metade.
- 03
A comparação sai ordenada por preço
Do mais barato ao mais caro, com a barra mostrando a distância real entre eles.
- 01
O que é um token, afinal?
- É a unidade em que o modelo lê e escreve, normalmente um pedaço de palavra. Em português, uma palavra comum costuma dar entre um e dois tokens. Em chinês ou japonês, um único caractere já costuma valer um token inteiro, por isso o mesmo conteúdo sai mais caro nessas línguas.
- 02
A contagem é exata?
- Não, e nenhuma que não use o tokenizador oficial de cada modelo será. Cada família tokeniza de um jeito. A estimativa aqui é calibrada por escrita e serve para dimensionar custo e contexto, para fechar fatura, use o número que o provedor devolve na resposta da API.
- 03
Meu texto é enviado para algum servidor?
- Não. A contagem e o cálculo acontecem inteiros no seu navegador. É por isso que dá para colar aqui um documento que você não colaria numa ferramenta que sobe o conteúdo.
- 04
Por que entrada e saída têm preços diferentes?
- Porque gerar custa mais do que ler. O modelo processa a entrada de uma vez, mas produz a saída token a token, e é essa geração que consome mais computação. Daí a saída custar, em regra, de três a cinco vezes a entrada.
- 05
Modelo mais caro é sempre melhor?
- Não para toda tarefa. Classificar, extrair campo e resumir texto curto são bem resolvidos por modelos leves. Reservar o modelo caro para o que realmente exige raciocínio é a diferença entre uma conta saudável e uma conta absurda no fim do mês.
- 06
Como escolher na prática, sem apostar em um só?
- Roteando por tarefa: o pedido simples vai para o modelo barato, o difícil sobe. Fazer isso na mão em cada chamada é inviável, é exatamente o trabalho do módulo Roteador, que decide o destino e ainda aprende com o resultado.
Você viu a diferença de preço. Quem decide o destino?
Escolher o modelo certo em cada chamada é o que o módulo Roteador faz: uma chave para todo o mercado, com a decisão tomada por tarefa e não por contrato.
