简短答案

在 1M 输入 + 250K 输出的示例工作负载下,当前选取的模型中 Gemini 2.5 Flash-Lite 的官方示例成本最低,为 $0.20。这只是价格比较,不代表模型能力等价。

三家 API 的成本如何比较?

下表给每个模型使用相同工作负载:1M 新输入 tokens 和 250K 输出 tokens。官方列表价格与 OpenRouter 推理价格分开显示,不应用缓存折扣。

模型官方输入 / 输出OpenRouter 输入 / 输出示例官方成本上下文
GPT-5.4OpenAI$2.50 / $15.00$2.50 / $15.00$6.251050K
GPT-5.4 miniOpenAI$0.75 / $4.50$0.75 / $4.50$1.875400K
GPT-5.6 LunaOpenAI$1.00 / $6.00$0.10 / $0.60$2.501050K
Claude Opus 5Anthropic$5.00 / $25.00$5.00 / $25.00$11.25见供应商
Claude Sonnet 5Anthropic$2.00 / $10.00$2.00 / $10.00$4.50见供应商
Claude Haiku 4.5Anthropic$1.00 / $5.00$1.00 / $5.00$2.25见供应商
Gemini 3.1 Pro PreviewGoogle$2.00 / $12.00$2.00 / $12.00$5.00见供应商
Gemini 3.6 FlashGoogle$1.50 / $7.50$0.75 / $3.75$3.375见供应商
Gemini 2.5 Flash-LiteGoogle$0.10 / $0.40$0.10 / $0.40$0.20见供应商

官方来源:OpenAIAnthropicGemini

高频工作负载应该如何选择?

先用真实日志估算输入、缓存、输出、重试和每月运行次数。低 token 单价如果带来更多重试、更长输出或频繁升级,实际成本优势可能会缩水。

什么时候适合使用 OpenRouter?

当应用需要多种模型家族、统一 API 或备用路由时,OpenRouter 可以减少集成工作。需要一方功能、合同、支持或精确控制供应商关系时,直连可能更合适。

三家供应商价格常见问题

OpenAI、Anthropic 和 Gemini 哪个更便宜?

在本页选取的代表性模型和示例工作负载中,Gemini 2.5 Flash-Lite 最便宜,但输入输出比例或模型档位改变后结论也会改变。

OpenRouter 会改变模型价格吗?

有些 OpenRouter 推理价格与官方相同,有些不同。平台充值费用也需要单独比较。

上下文窗口越大就越划算吗?

不是。上下文窗口代表可容纳的容量,实际成本仍按处理的 token、长上下文规则和输出量计算。