在 1M 输入 + 250K 输出的示例工作负载下,当前选取的模型中 Gemini 2.5 Flash-Lite 的官方示例成本最低,为 $0.20。这只是价格比较,不代表模型能力等价。
三家 API 的成本如何比较?
下表给每个模型使用相同工作负载:1M 新输入 tokens 和 250K 输出 tokens。官方列表价格与 OpenRouter 推理价格分开显示,不应用缓存折扣。
| 模型 | 官方输入 / 输出 | OpenRouter 输入 / 输出 | 示例官方成本 | 上下文 |
|---|---|---|---|---|
| GPT-5.4OpenAI | $2.50 / $15.00 | $2.50 / $15.00 | $6.25 | 1050K |
| GPT-5.4 miniOpenAI | $0.75 / $4.50 | $0.75 / $4.50 | $1.875 | 400K |
| GPT-5.6 LunaOpenAI | $1.00 / $6.00 | $0.10 / $0.60 | $2.50 | 1050K |
| Claude Opus 5Anthropic | $5.00 / $25.00 | $5.00 / $25.00 | $11.25 | 见供应商 |
| Claude Sonnet 5Anthropic | $2.00 / $10.00 | $2.00 / $10.00 | $4.50 | 见供应商 |
| Claude Haiku 4.5Anthropic | $1.00 / $5.00 | $1.00 / $5.00 | $2.25 | 见供应商 |
| Gemini 3.1 Pro PreviewGoogle | $2.00 / $12.00 | $2.00 / $12.00 | $5.00 | 见供应商 |
| Gemini 3.6 FlashGoogle | $1.50 / $7.50 | $0.75 / $3.75 | $3.375 | 见供应商 |
| Gemini 2.5 Flash-LiteGoogle | $0.10 / $0.40 | $0.10 / $0.40 | $0.20 | 见供应商 |
高频工作负载应该如何选择?
先用真实日志估算输入、缓存、输出、重试和每月运行次数。低 token 单价如果带来更多重试、更长输出或频繁升级,实际成本优势可能会缩水。
什么时候适合使用 OpenRouter?
当应用需要多种模型家族、统一 API 或备用路由时,OpenRouter 可以减少集成工作。需要一方功能、合同、支持或精确控制供应商关系时,直连可能更合适。
三家供应商价格常见问题
OpenAI、Anthropic 和 Gemini 哪个更便宜?
在本页选取的代表性模型和示例工作负载中,Gemini 2.5 Flash-Lite 最便宜,但输入输出比例或模型档位改变后结论也会改变。
OpenRouter 会改变模型价格吗?
有些 OpenRouter 推理价格与官方相同,有些不同。平台充值费用也需要单独比较。
上下文窗口越大就越划算吗?
不是。上下文窗口代表可容纳的容量,实际成本仍按处理的 token、长上下文规则和输出量计算。