Preços de modelos de IA, lado a lado.
Preço por milhão de tokens de entrada e de saída, janela de contexto e provedor. Filtre, ordene e veja quais rodam com peso aberto, esses você também pode hospedar por conta própria.
- Módulo
- Roteador
- Entrada
- Nada, já está pronta
- Onde roda
- Seu navegador
- Custo
- Grátis, sem cadastro
| Modelo | Entrada / 1M | Saída / 1M | Contexto |
|---|---|---|---|
| Nova LiteAmazon | 0.06 | 0.24 | 300k |
| Gemini 2.5 Flash-LiteGoogle | 0.10 | 0.40 | 1,000k |
| Qwen 3 32BAlibaba · peso aberto | 0.10 | 0.30 | 128k |
| Llama 4 ScoutMeta · peso aberto | 0.11 | 0.34 | 10,000k |
| Mistral SmallMistral · peso aberto | 0.20 | 0.60 | 128k |
| DeepSeek V3DeepSeek · peso aberto | 0.27 | 1.10 | 128k |
| Llama 4 MaverickMeta · peso aberto | 0.27 | 0.85 | 1,000k |
| Gemini 3 FlashGoogle | 0.30 | 2.50 | 1,000k |
| Grok 4 minixAI | 0.30 | 0.50 | 128k |
| GPT-4.1 miniOpenAI | 0.40 | 1.60 | 1,000k |
| DeepSeek R1DeepSeek · peso aberto | 0.55 | 2.19 | 128k |
| GPT-5 miniOpenAI | 0.60 | 2.40 | 400k |
| Nova ProAmazon | 0.80 | 3.20 | 300k |
| Claude Haiku 4.5Anthropic | 1.00 | 5.00 | 200k |
| o4-miniOpenAI | 1.10 | 4.40 | 200k |
| Qwen 3 MaxAlibaba | 1.20 | 6.00 | 262k |
| GPT-4.1OpenAI | 2.00 | 8.00 | 1,000k |
| Mistral LargeMistral | 2.00 | 6.00 | 128k |
| Gemini 3 ProGoogle | 2.50 | 15.00 | 2,000k |
| Command ACohere · peso aberto | 2.50 | 10.00 | 256k |
| Claude Sonnet 5Anthropic | 3.00 | 15.00 | 1,000k |
| Grok 4xAI | 3.00 | 15.00 | 256k |
| GPT-5OpenAI | 10.00 | 30.00 | 400k |
| Claude Opus 5Anthropic | 15.00 | 75.00 | 1,000k |
Valores em dólar por milhão de tokens, preço público de tabela. Atualizado em 2026-08-11.
Preço não é detalhe de rodapé: é decisão de arquitetura
Entre o modelo mais caro e o mais barato desta tabela existe uma diferença de mais de cem vezes por token. Isso não é uma variação de mercado, é a diferença entre um produto que fecha a conta e um que não fecha. Quem escolhe o modelo no começo do projeto e nunca mais revisa costuma estar pagando por capacidade que não usa.
Além do preço, duas colunas importam: a janela de contexto, que define quanto cabe numa chamada, e a marcação de peso aberto. Modelo de peso aberto pode ser hospedado por você, o que muda a conversa de "quanto custa alugar" para "quanto custa possuir".
- 01
Escolha o provedor, ou veja todos
A tabela começa com o mercado inteiro e filtra por quem fornece.
- 02
Ordene pelo que decide no seu caso
Menor entrada para quem manda muito texto; menor saída para quem gera muito; maior contexto para quem trabalha com documento longo.
- 03
Repare em quem tem peso aberto
Esses você pode rodar na sua própria infraestrutura, e é aí que preço vira soberania.
- 01
O que significa preço por milhão de tokens?
- É a unidade padrão do mercado: quanto custa processar um milhão de pedaços de palavra. Um milhão de tokens equivale, grosso modo, a umas 750 mil palavras em português, cerca de dez livros de tamanho médio.
- 02
Por que entrada e saída são cobradas em separado?
- Porque custam coisas diferentes. Ler a entrada é uma passada só; gerar a saída é token a token, e consome muito mais computação. Por isso a saída costuma custar de três a cinco vezes a entrada, e por isso ignorá-la ao estimar custo erra a conta pela metade.
- 03
O que é "peso aberto" e por que isso importa?
- É o modelo cujos pesos foram publicados: você pode baixar e rodar na sua própria máquina ou servidor. Importa porque muda a natureza da relação, em vez de alugar acesso a uma caixa que pode mudar de preço ou sumir, você passa a ter a opção de operar aquilo por conta própria.
- 04
Janela de contexto grande vale mais caro?
- Só se você usar. Contexto é o quanto cabe numa chamada, não o quanto o modelo "sabe". Pagar por uma janela de milhões de tokens para mandar prompts de duas mil palavras é comprar espaço que fica vazio.
- 05
Com que frequência estes preços mudam?
- Com frequência, houve cortes de mais de 90% em algumas famílias ao longo de 2024 e 2025, e modelos novos entram todo mês. Por isso a data de atualização fica visível no rodapé da tabela: número de preço sem data é número em que não se pode confiar.
- 06
Dá para usar vários modelos sem manter várias contas?
- Dá, com um roteador na frente: uma chave só, e a decisão de qual modelo atende cada chamada fica do lado de dentro. É o que o módulo Roteador faz, e o que evita ficar preso a quem subiu o preço.
Escolheu o modelo. E quando o preço mudar?
O módulo Roteador põe uma chave só na frente do mercado inteiro e decide o destino por tarefa. Trocar de modelo deixa de ser migração e vira configuração.
