简短答案

在当前已验证的一方价格中,Ministral 3 14B 的输出 token 单价最低,为 $0.20 / 百万 tokens。你的输入输出比例不同,排名也可能改变。

当前低价 LLM API 排名

下面按输出 token 价格排序,并保留输入价格、OpenRouter 价格和一份 1M 输入 + 250K 输出的示例成本。价格单位均为 USD / 百万 tokens。

模型官方输入官方输出OpenRouter 输入 / 输出示例官方成本
1. Ministral 3 14BMistral AI$0.20$0.20$0.20 / $0.20$0.25
2. DeepSeek V4 FlashDeepSeek$0.14$0.28$0.0643 / $0.1285$0.21
3. Gemini 2.5 Flash-LiteGoogle$0.10$0.40$0.10 / $0.40$0.20
4. Mistral Small 4Mistral AI$0.15$0.60$0.15 / $0.60$0.30
5. DeepSeek V4 ProDeepSeek$0.435$0.87$1.168 / $2.336$0.6525
6. MiniMax M2.7MiniMax$0.30$1.20$0.30 / $1.20$0.60
7. MiniMax M2.5MiniMax$0.30$1.20$0.22 / $0.90$0.60
8. Gemini 3.1 Flash-LiteGoogle$0.25$1.50$0.25 / $1.50$0.625
9. Mistral Large 3Mistral AI$0.50$1.50$0.50 / $1.50$0.875
10. Qwen 3.7 PlusAlibaba Cloud$0.40$1.60$0.32 / $1.28$0.80

示例成本 = 1M 输入 + 250K 输出,不包含缓存、工具、税费、区域差异和 OpenRouter 充值手续费。

如何选择便宜的 API?

先把自己的请求拆成新输入、重复上下文、输出和每月运行次数,再看总成本。低价模型如果需要更长输出、更多重试或频繁升级到高级模型,实际优势可能会变小。

价格排行适合建立候选列表,不是质量排名。上线前仍应测试准确率、工具调用、延迟、上下文、可用性和数据政策。

低价 LLM API 常见问题

哪个 LLM API 最便宜?

在当前目录的已验证官方价格中,Ministral 3 14B 的输出 token 价格最低。但真正的月度成本还取决于输入、输出、缓存和请求次数。

OpenRouter 一定更便宜吗?

不一定。OpenRouter 的推理价格可能相同、更低或更高,充值手续费也需要单独考虑。

只看输出价格够吗?

不够。聊天、搜索、编码和批处理的输入输出比例差异很大,应使用实际工作负载计算。