不存在对所有模型和工作量都更便宜的供应商。请选择具体 GPT 与 Claude 模型,用相同请求量比较输入、缓存读取及输出费用;这属于成本估算,不是质量排名。
一份工作量,两份成本估算。
比较两个模型,或同一模型的两个渠道。请按应用实际情况修改示例工作量。
存储数据示例:每次 2,000 输入 + 500 输出 tokens,每月 10,000 次请求:A $125.00 / B $135.00. 启用 JavaScript 可修改参数并查看详细对比。
链接包含模型选项和工作量数字,请仅分享愿意公开的估算。成本采用存储的费率,预算前请核对下方各来源的验证日期。
同一份每月工作量需要多少钱?
以下存储数据示例使用每次 2,000 输入、500 输出 tokens,每月 10,000 次请求,不使用缓存,不计充值手续费。同一行比较同一个模型的两个渠道;不同行代表价格选项,不代表能力相同。模型链接提供单独的上下文和价格说明。
| 模型 | 官方 / 月 | OpenRouter / 月 | 价格验证日期 |
|---|---|---|---|
| GPT-5.4 mini | $37.50 | $37.50 | 官方: 2026-07-30 OpenRouter: 2026-09-10 |
| Claude Haiku 4.5 | $45.00 | $45.00 | 官方: 2026-07-29 OpenRouter: 2026-09-10 |
| GPT-5.4 | $125.00 | $125.00 | 官方: 2026-07-30 OpenRouter: 2026-09-10 |
| Claude Sonnet 4.6 | $135.00 | $135.00 | 官方: 2026-07-29 OpenRouter: 2026-09-10 |
为什么 Claude 与 GPT 的成本排名会变化?
供应商品牌代表模型家族,而不是单一价格。较小的 GPT 模型与较大的 Claude 模型可能具有不同能力和用途。先选择符合任务要求的模型,再比较成本。示例只覆盖本站目录中选定的模型,不代表供应商所有模型、地区或商业协议。
输出较多的任务与输入较多的文档处理任务,可能适合不同模型。聊天预设使用短提示和回答;文档问答使用较多输入和示例缓存比例;摘要使用长输入且不假定复用。预设是可修改的假设,不是真实用户流量。包含重复上下文不保证命中缓存。
哪些成本需要单独检查?
计算器分别显示新输入、缓存读取和生成输出,不计缓存创建、批处理折扣、工具、图像或音频处理,以及超过长上下文阈值的较高费率。若目录缺少缓存读取费率,则按完整输入价估算并提示。这样可避免将缺失价格显示为免费,但仍不覆盖所有计费维度。
比较官方费率时,两边均选择官方直连;比较路由版本时,两边均选择 OpenRouter,并决定是否计入充值手续费。也可以给两个模型选择不同渠道,此时结果同时包含模型与计费渠道的差异,账单会明确标出两种选择。
如何理解估算结果?
相同 token 数量用于单独比较费率;实际模型的分词、输出长度、重试和工具使用可能不同。选择低价模型前应测试自己的样例。若需要更多尝试或生成内容,低 token 单价也可能导致更高的任务完成成本。这些示例没有测量质量、延迟或可靠性。
页面重建不等于价格重新验证。来源链接旁的日期代表各存储价格的验证时间。检查失败会保留旧值;旧快照可以用于测试计算器,采购前需到供应商核实。方法页解释两类渠道的数据记录规则。
API 成本比较常见问题
估算最便宜的模型就是最好的吗?
不是。这是相同工作量的 token 成本比较,并非能力排名。请用自己的样例评估质量和成功完成任务的成本。
能否比较 Claude 与 GPT 的缓存输入成本?
可以,设置缓存读取占比即可。若缺少缓存读取价,会按完整输入价估算并提示;不含缓存写入费。
分享链接会锁定今天的费率吗?
不会。它保存模型、渠道与工作量,打开时使用当时加载的数据。请每次核对来源验证日期。