500 万 token 成本对比
表格固定的是计费 token 数量,并非源文本或语义工作负载。不同模型家族使用不同的 tokenizer。测试场景包含 100 个请求,每个请求使用 40,000 个未缓存输入 token 和 10,000 个输出 token,同时确保每条提示词都低于 Google 的 200,000 token 阈值。测试不包含缓存读取与写入、工具、免费层、其他服务层级、批处理、税费和促销价格。
* Premium 每月收费 USD 8,包含受支持 Premium 模型范围内的无限浏览器聊天,以及每月首批 500 万计费 token。这里的 USD 8 是新客户购买完整工作区组合的公开价格,并非某个模型的 token 单价或边际推理成本。已经订阅 Premium 且内含余额充足的会员,无需为这部分用量支付额外现金。用完内含额度后,一份额外的 500 万计费 token 包基础价格为 USD 8。个人 top-up 要求用户拥有有效的个人 Premium 访问权限。
订阅 Premium、使用完整工作区和 API 访问前,可以在有限的免费浏览器聊天中试用 Capriole AI。
如何复现计算
官方提供商分别公布输入和输出价格。这项工作负载采用下面的公式。Capriole 为什么采用不同的计量单位
Capriole 面向客户的公开余额不会照搬各提供商的输入和输出价格表。它使用称为 charged tokens 的统一余额扣减方式。USD 8 在 API 余额之外还包含什么
官方直连 API 和 OpenRouter 允许用户只购买推理服务,无需订阅 Capriole。此表比较的是一名新个人用户购买 Premium 的情况。其他 Capriole API 访问要求用户拥有符合条件且有效的个人或 Team 权益,Team 定价不在本次对比范围内。 USD 8 的 Premium 方案包含以下内容。- 受支持 Premium 模型范围内的无限浏览器聊天
- 每月首批 500 万 API 计费 token
- 公共 API 和持续维护的编程智能体集成访问权限
- 提供模型切换、文件、网页搜索和聊天存储控制的统一浏览器工作区
哪些情况下表格无法预测你的账单
本例没有纳入几种可能显著改变成本的定价路径。- 缓存。提供商分别为缓存写入和读取定价。Capriole 在计费 token 公式中按 10% 计算缓存输入。
- 长提示词。单条提示词超过 200,000 token 时,Gemini 3.1 Pro Preview 会采用更高费率。
- 服务层级和批处理。Free、Flex、Priority、Batch 或其他提供商层级的价格可能不同于本例采用的付费 Standard 费率。
- OpenRouter 路由。实际处理请求的端点或 fallback 可能采用不同于表格匹配费率的价格。
- 工具和搜索。服务端工具、grounding 和搜索可能增加按请求或用量计算的费用。
- 输出占比较高的工作负载。表格采用 80/20 的输入输出比例。如果某个模型的输出价格明显更高,增加输出会让官方直连和 OpenRouter 成本增长得更快。
- 企业条款。批量折扣、私有报价、数据驻留和协商承诺可能取代公开标价。
实际选择
如果受支持的模型范围可以覆盖你的工作,同时你希望获得本次对比中经过核验的最低现金总额、无限 Premium 浏览器聊天、内含 API 用量和持续维护的编程智能体路径,可以选择 Capriole。 所有测试项目中,Capriole 都给出了较低的核验总额,购买内容也不限于推理调用。同一笔 USD 8 还包含浏览器工作区、先免费后付费的入口、无限 Premium 聊天和持续维护的编程智能体集成。对于固定工作负载,官方直连 API 和 OpenRouter 的收费更高,也不包含 Capriole 的工作区组合。 订阅前,你可以在有限的免费浏览器聊天中试用 Capriole AI。如需更完整的产品比较,请阅读 Capriole AI 与 OpenRouter 对比。开发者可以继续阅读 API 快速入门。官方来源
- Anthropic 的 Claude API 定价
- Google 的 Gemini Developer API 定价
- OpenRouter 的定价、账单常见问题、Claude Fable 5 定价、Gemini 3.1 Pro Preview 提供商和 Gemini 3.5 Flash 定价
- Capriole AI 的公开产品与方案和当前公开模型目录