在当前已验证的一方价格中,Ministral 3 14B 的输出 token 单价最低,为 $0.20 / 百万 tokens。你的输入输出比例不同,排名也可能改变。
当前低价 LLM API 排名
下面按输出 token 价格排序,并保留输入价格、OpenRouter 价格和一份 1M 输入 + 250K 输出的示例成本。价格单位均为 USD / 百万 tokens。
| 模型 | 官方输入 | 官方输出 | OpenRouter 输入 / 输出 | 示例官方成本 |
|---|---|---|---|---|
| 1. Ministral 3 14BMistral AI | $0.20 | $0.20 | $0.20 / $0.20 | $0.25 |
| 2. DeepSeek V4 FlashDeepSeek | $0.14 | $0.28 | $0.0643 / $0.1285 | $0.21 |
| 3. Gemini 2.5 Flash-LiteGoogle | $0.10 | $0.40 | $0.10 / $0.40 | $0.20 |
| 4. Mistral Small 4Mistral AI | $0.15 | $0.60 | $0.15 / $0.60 | $0.30 |
| 5. DeepSeek V4 ProDeepSeek | $0.435 | $0.87 | $1.168 / $2.336 | $0.6525 |
| 6. MiniMax M2.7MiniMax | $0.30 | $1.20 | $0.30 / $1.20 | $0.60 |
| 7. MiniMax M2.5MiniMax | $0.30 | $1.20 | $0.22 / $0.90 | $0.60 |
| 8. Gemini 3.1 Flash-LiteGoogle | $0.25 | $1.50 | $0.25 / $1.50 | $0.625 |
| 9. Mistral Large 3Mistral AI | $0.50 | $1.50 | $0.50 / $1.50 | $0.875 |
| 10. Qwen 3.7 PlusAlibaba Cloud | $0.40 | $1.60 | $0.32 / $1.28 | $0.80 |
示例成本 = 1M 输入 + 250K 输出,不包含缓存、工具、税费、区域差异和 OpenRouter 充值手续费。
如何选择便宜的 API?
先把自己的请求拆成新输入、重复上下文、输出和每月运行次数,再看总成本。低价模型如果需要更长输出、更多重试或频繁升级到高级模型,实际优势可能会变小。
价格排行适合建立候选列表,不是质量排名。上线前仍应测试准确率、工具调用、延迟、上下文、可用性和数据政策。
低价 LLM API 常见问题
哪个 LLM API 最便宜?
在当前目录的已验证官方价格中,Ministral 3 14B 的输出 token 价格最低。但真正的月度成本还取决于输入、输出、缓存和请求次数。
OpenRouter 一定更便宜吗?
不一定。OpenRouter 的推理价格可能相同、更低或更高,充值手续费也需要单独考虑。
只看输出价格够吗?
不够。聊天、搜索、编码和批处理的输入输出比例差异很大,应使用实际工作负载计算。