Precios de modelos de IA, uno al lado del otro.
Precio por millón de tokens de entrada y salida, ventana de contexto y proveedor. Filtra, ordena y ve cuáles funcionan con pesos abiertos, esos también los puedes alojar por tu cuenta.
- Módulo
- Router
- Entrada
- Nada, ya está lista
- Dónde funciona
- Tu navegador
- Coste
- Gratis, sin registro
| Modelo | Entrada / 1M | Salida / 1M | Contexto |
|---|---|---|---|
| Nova LiteAmazon | 0.06 | 0.24 | 300k |
| Gemini 2.5 Flash-LiteGoogle | 0.10 | 0.40 | 1,000k |
| Qwen 3 32BAlibaba · peso abierto | 0.10 | 0.30 | 128k |
| Llama 4 ScoutMeta · peso abierto | 0.11 | 0.34 | 10,000k |
| Mistral SmallMistral · peso abierto | 0.20 | 0.60 | 128k |
| DeepSeek V3DeepSeek · peso abierto | 0.27 | 1.10 | 128k |
| Llama 4 MaverickMeta · peso abierto | 0.27 | 0.85 | 1,000k |
| Gemini 3 FlashGoogle | 0.30 | 2.50 | 1,000k |
| Grok 4 minixAI | 0.30 | 0.50 | 128k |
| GPT-4.1 miniOpenAI | 0.40 | 1.60 | 1,000k |
| DeepSeek R1DeepSeek · peso abierto | 0.55 | 2.19 | 128k |
| GPT-5 miniOpenAI | 0.60 | 2.40 | 400k |
| Nova ProAmazon | 0.80 | 3.20 | 300k |
| Claude Haiku 4.5Anthropic | 1.00 | 5.00 | 200k |
| o4-miniOpenAI | 1.10 | 4.40 | 200k |
| Qwen 3 MaxAlibaba | 1.20 | 6.00 | 262k |
| GPT-4.1OpenAI | 2.00 | 8.00 | 1,000k |
| Mistral LargeMistral | 2.00 | 6.00 | 128k |
| Gemini 3 ProGoogle | 2.50 | 15.00 | 2,000k |
| Command ACohere · peso abierto | 2.50 | 10.00 | 256k |
| Claude Sonnet 5Anthropic | 3.00 | 15.00 | 1,000k |
| Grok 4xAI | 3.00 | 15.00 | 256k |
| GPT-5OpenAI | 10.00 | 30.00 | 400k |
| Claude Opus 5Anthropic | 15.00 | 75.00 | 1,000k |
Valores en dólares por millón de tokens, precio público de tarifa. Actualizado el 2026-08-11.
El precio no es una nota al pie: es una decisión de arquitectura
Entre el modelo más caro y el más barato de esta tabla hay una diferencia de más de cien veces por token. Eso no es una variación de mercado, es la diferencia entre un producto que cierra las cuentas y uno que no. Quien elige el modelo al inicio del proyecto y nunca vuelve a revisarlo suele estar pagando por capacidad que no usa.
Además del precio, importan dos columnas: la ventana de contexto, que define cuánto cabe en una llamada, y la marca de peso abierto. Un modelo de peso abierto puede ser alojado por ti, lo que cambia la conversación de "cuánto cuesta alquilar" a "cuánto cuesta poseer".
- 01
Elige el proveedor, o míralos todos
La tabla empieza con el mercado entero y filtra por quién lo suministra.
- 02
Ordena por lo que decide en tu caso
Menor entrada si mandas mucho texto; menor salida si generas mucho; mayor contexto si trabajas con documentos largos.
- 03
Fíjate en cuáles tienen peso abierto
Estos puedes ejecutarlos en tu propia infraestructura, y ahí es donde el precio se convierte en soberanía.
- 01
¿Qué significa precio por millón de tokens?
- Es la unidad estándar del mercado: cuánto cuesta procesar un millón de fragmentos de palabra. Un millón de tokens equivale, a grandes rasgos, a unas 750 mil palabras en portugués, cerca de diez libros de tamaño medio.
- 02
¿Por qué se cobran por separado entrada y salida?
- Porque cuestan cosas distintas. Leer la entrada es una sola pasada; generar la salida es token por token, y consume mucha más computación. Por eso la salida suele costar de tres a cinco veces más que la entrada, y por eso ignorarla al estimar el costo equivoca el cálculo a la mitad.
- 03
¿Qué es "peso abierto" y por qué importa?
- Es el modelo cuyos pesos fueron publicados: puedes descargarlo y ejecutarlo en tu propia máquina o servidor. Importa porque cambia la naturaleza de la relación, en lugar de alquilar acceso a una caja que puede cambiar de precio o desaparecer, pasas a tener la opción de operarla por tu cuenta.
- 04
¿Una ventana de contexto grande vale más caro?
- Solo si la usas. El contexto es cuánto cabe en una llamada, no cuánto "sabe" el modelo. Pagar por una ventana de millones de tokens para mandar prompts de dos mil palabras es comprar espacio que queda vacío.
- 05
¿Con qué frecuencia cambian estos precios?
- Con frecuencia, hubo recortes de más del 90% en algunas familias a lo largo de 2024 y 2025, y entran modelos nuevos cada mes. Por eso la fecha de actualización permanece visible al pie de la tabla: un número de precio sin fecha es un número en el que no se puede confiar.
- 06
¿Puedo usar varios modelos sin mantener varias cuentas?
- Sí, con un Router delante: una sola clave, y la decisión sobre qué modelo atiende cada llamada queda del lado interno. Es lo que hace el módulo Router, y lo que evita quedar atado a quien subió el precio.
Elegiste el modelo. ¿Y cuando cambie el precio?
El módulo Router pone una sola clave delante del mercado entero y decide el destino por tarea. Cambiar de modelo deja de ser una migración y pasa a ser una configuración.
