AI 模型价格,并排看清。
每百万输入和输出 token 的价格、上下文窗口和提供商。筛选、排序,并查看哪些以开放权重运行,这些你也可以自行托管。
- 所属模块
- 路由器
- 输入
- 无,已就绪
- 运行位置
- 你的浏览器
- 费用
- 免费,无需注册
| 模型 | 输入 / 1M | 输出 / 1M | 上下文 |
|---|---|---|---|
| Nova LiteAmazon | 0.06 | 0.24 | 300k |
| Gemini 2.5 Flash-LiteGoogle | 0.10 | 0.40 | 1,000k |
| Qwen 3 32BAlibaba · 开放权重 | 0.10 | 0.30 | 128k |
| Llama 4 ScoutMeta · 开放权重 | 0.11 | 0.34 | 10,000k |
| Mistral SmallMistral · 开放权重 | 0.20 | 0.60 | 128k |
| DeepSeek V3DeepSeek · 开放权重 | 0.27 | 1.10 | 128k |
| Llama 4 MaverickMeta · 开放权重 | 0.27 | 0.85 | 1,000k |
| Gemini 3 FlashGoogle | 0.30 | 2.50 | 1,000k |
| Grok 4 minixAI | 0.30 | 0.50 | 128k |
| GPT-4.1 miniOpenAI | 0.40 | 1.60 | 1,000k |
| DeepSeek R1DeepSeek · 开放权重 | 0.55 | 2.19 | 128k |
| GPT-5 miniOpenAI | 0.60 | 2.40 | 400k |
| Nova ProAmazon | 0.80 | 3.20 | 300k |
| Claude Haiku 4.5Anthropic | 1.00 | 5.00 | 200k |
| o4-miniOpenAI | 1.10 | 4.40 | 200k |
| Qwen 3 MaxAlibaba | 1.20 | 6.00 | 262k |
| GPT-4.1OpenAI | 2.00 | 8.00 | 1,000k |
| Mistral LargeMistral | 2.00 | 6.00 | 128k |
| Gemini 3 ProGoogle | 2.50 | 15.00 | 2,000k |
| Command ACohere · 开放权重 | 2.50 | 10.00 | 256k |
| Claude Sonnet 5Anthropic | 3.00 | 15.00 | 1,000k |
| Grok 4xAI | 3.00 | 15.00 | 256k |
| GPT-5OpenAI | 10.00 | 30.00 | 400k |
| Claude Opus 5Anthropic | 15.00 | 75.00 | 1,000k |
单位为每百万 token 的美元金额,取公开标价。更新于 2026-08-11。
这张表说明什么
价格不是脚注,而是架构决策
这张表里,最贵和最便宜的模型之间,每个token的价格相差超过一百倍。这不是市场上的正常波动,而是一个产品能否收支平衡的分水岭。如果在项目一开始选定模型后就再也不重新评估,往往就是在为用不到的能力付费。
除了价格,还有两列很重要:上下文窗口,决定一次调用能容纳多少内容,以及开放权重的标记。开放权重模型可以由你自己托管,这就把问题从“租用要花多少钱”变成了“拥有要花多少钱”。
工作原理
- 01
选一家提供方,或看全部
表格从整个市场开始,再按供应方筛选。
- 02
按你这边真正起决定作用的项排序
发送大量文本就看输入最低;生成量大就看输出最低;处理长文档就看上下文最大。
- 03
留意哪些是开放权重
这些模型你可以在自己的基础设施上运行,这时候,价格就变成了自主权。
常见问题
- 01
每百万 token 的价格是什么意思?
- 这是市场上的标准计量单位:处理一百万个词语片段需要多少成本。一百万个token大致相当于75万个葡萄牙语单词,大约十本中等篇幅的书。
- 02
为什么输入和输出分开计费?
- 因为它们的成本不一样。读取输入只需要一次处理,生成输出则是逐个token进行的,消耗的计算量要大得多。因此输出的成本通常是输入的三到五倍,如果在估算成本时忽略输出,结果会差出一半以上。
- 03
什么是"开放权重",它为什么重要?
- 这是指权重已经公开发布的模型:你可以下载下来,在自己的设备或服务器上运行。这一点很重要,因为它改变了关系的本质,你不再只是租用一个可能随时涨价或消失的黑箱,而是有了自己运营它的选择。
- 04
上下文窗口大,值得多花钱吗?
- 用得上才值。上下文是一次调用装得下多少,不是模型"知道"多少。为了发两千字的提示词而买下百万级的窗口,等于买了一片空着的地方。
- 05
这些价格多久会变?
- 经常发生。在2024和2025年间,部分系列的价格降幅超过90%,而且每个月都有新模型出现。这就是为什么更新日期会显示在表格底部:没有日期的价格数字,是不能信任的数字。
- 06
能同时用多个模型,而不必维护多个账号吗?
- 可以,在前面放一个路由器:只用一把密钥,由内部决定每次调用交给哪个模型处理。这正是路由器模块所做的事,也能避免被涨价的一方困住。
其他免费工具
