算盘·LLM Abacus
中文优先的 AI 大模型价格对比。
一张表看清 55 个主流模型,30 秒回答「跑哪个最便宜」。
算盘(LLM Abacus)是 AI 大模型 API 价格对比与 Token 成本估算平台。全量收录 Claude Opus 5、GPT-5.6 Sol、Gemini 3.6 Flash、DeepSeek V4、Kimi K3、Qwen3.7 等 55+ 个主流模型。当前近 14 天已核验 7/16 家厂商;全库最旧核验日期为 ,最新一笔核验为 2026-08-26,各行另列具体厂商日期。
Spark Pro 价格调整:输入单价由 CNY 7/M 变动 -29%(现 5),输出单价由 CNY 7/M 变动 -29%(现 5)。
Spark Ultra 价格调整:输入单价由 CNY 2/M 变动 -60%(现 0.8),输出单价由 CNY 2/M 变动 -60%(现 0.8)。
Spark X2 价格调整:输入单价由 CNY 3/M 变动 -33%(现 2),输出单价由 CNY 3/M 变动 -33%(现 2)。
MiniMax M3 价格调整:输入单价由 CNY 4.2/M 变动 -50%(现 2.1),输出单价由 CNY 16.8/M 变动 -50%(现 8.4)。
全球用量热度榜
OpenRouter 周 token 用量(2026-08-17 自动核对)——海外开发者真实用量,反映热度而非质量;国产模型走国内端点的用量不计入。 仅显示本站收录且当周在榜的模型,掉出榜单即不再显示名次。
仅展示本站收录的模型在 OpenRouter 周榜中的名次;完整榜单见 openrouter.ai/rankings。榜上多为海外可直连模型,本站收录的国产模型走国内端点、不进此榜。
最便宜的 5 个模型
按输入价排序。卡片里是「单次典型问答(输入 2000 + 输出 500 tokens)」的估算成本。
模型价格表
默认按输入价升序,便宜的在最上面
共 55 / 55 个模型 · 价格单位 ¥/百万 tokens(海外厂商附 $ 美元原价,按 1 USD = 6.737 换算)· 点击表头列名可排序 · 绿色高亮 = 最便宜 · 性价比↑ = 质量/价格比最高(需有质量评分) · 热度 = OpenRouter 周榜名次(token 用量,反映海外开发者实际用量而非质量;国产模型国内端点用量不经 OR,仅供参考)
| 厂商 | 缓存价 | 最大输出 | 知识截止 | 模态 | 标签 | 去试用 | ||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Flash | 🇨🇳阿里通义 自动核对: 2026-08-26 | — | — | ¥0.20阶梯▲ | ¥2.00 | — | 1.0M | 16K | — | — | 文本 | 极便宜快速 | 使用 → | |
| Gemini 2.5 Flash-Lite | 🇺🇸Google 人工监控: 2026-08-01>14天未核 | — | — | ¥0.67$0.10 | ¥2.69$0.40 | ¥0.07 | 1.0M | 64K | — | — | 文本视觉 | 极便宜快速 | 使用 → | |
| Qwen3.5 Plus | 🇨🇳阿里通义 自动核对: 2026-08-26 | — | — | ¥0.80阶梯▲ | ¥4.80 | — | 1.0M | 32K | — | — | 文本视觉 | 性价比新发布 | 使用 → | |
| Doubao 1.6 | 🇨🇳字节豆包 人工监控: 2026-07-03>14天未核 | — | — | ¥0.80阶梯▲ | ¥8.00 | ¥0.16 | 256K | 16K | — | — | 文本视觉音频 | 多模态上代 | 使用 → | |
| Doubao 1.5 Pro | 🇨🇳字节豆包 人工监控: 2026-07-03>14天未核 | — | — | ¥0.80 | ¥2.00 | ¥0.16 | 256K | 12K | — | — | 文本视觉 | 极便宜上代 | 使用 → | |
| 文心 ERNIE 4.5 Turbo | 🇨🇳百度文心 人工监控: 2026-06-05>14天未核 | — | — | ¥0.80 | ¥3.20 | ¥0.20 | 128K | 16K | — | — | 文本视觉 | 性价比快速 | 使用 → | |
| 混元 TurboS | 🇨🇳腾讯混元 人工监控: 2026-06-05>14天未核 | — | — | ¥0.80 | ¥2.00 | — | 256K | 16K | — | — | 文本 | 性价比快速 | 使用 → | |
| Spark Ultra | 🇨🇳讯飞星火 自动核对: 2026-08-26 | — | — | ¥0.80 | ¥0.80 | — | 128K | 16K | — | — | 文本 | 性价比FunctionCall | 使用 → | |
| 文心 ERNIE X1 Turbo | 🇨🇳百度文心 人工监控: 2026-06-05>14天未核 | — | — | ¥1.00 | ¥4.00 | — | 128K | 16K | — | — | 文本 | 推理深度思考 | 使用 → | |
| 混元 T1 | 🇨🇳腾讯混元 人工监控: 2026-06-05>14天未核 | — | — | ¥1.00 | ¥4.00 | — | 64K | 16K | — | — | 文本 | 推理 | 使用 → | |
| MiMo-V2.5 | 🇨🇳小米 MiMo 人工监控: 2026-07-31>14天未核 | — | #63.79T | ¥1.00 | ¥2.00 | ¥0.02 | 262K | 32K | — | — | 文本 | 高性价比 | 使用 → | |
| 混元 Hy3 | 🇨🇳腾讯混元 人工监控: 2026-06-05>14天未核 | — | #29.95T | ¥1.00 | ¥4.00 | ¥0.25 | 262K | 32K | — | — | 文本 | 高性价比Agent | 使用 → | |
| GPT-5.6 Luna | 🇺🇸OpenAI 人工监控: 2026-08-01>14天未核 | — | #35.31T | ¥1.35$0.20阶梯▲ | ¥8.08$1.20 | ¥0.13 | 1.1M | 128K | 2026-02 | — | 文本视觉 | 快速极便宜 | 使用 → | |
| Step 3.7 Flash | 🇨🇳阶跃星辰 人工监控: 2026-07-31>14天未核 | — | — | ¥1.35 | ¥8.10 | — | 131K | 32K | — | — | 文本 | 高性价比 | 使用 → | |
| Gemini 3.1 Flash-Lite | 🇺🇸Google 人工监控: 2026-08-01>14天未核 | 34 | — | ¥1.68$0.25 | ¥10.11$1.50 | ¥0.17 | 1.0M | 64K | 2025-01 | ★ 58 | 文本视觉 | 极便宜快速 | 使用 → | |
| DeepSeek V3.2 | 🇨🇳DeepSeek 自动核对: 2026-08-21 | — | — | ¥2.00 | ¥8.00 | ¥0.50 | 128K | 8K | — | — | 文本 | 已下线(官方)2026-07-24 已下线 | 使用 → | |
| GLM-4.7 | 🇨🇳智谱 AI 自动核对: 2026-08-26 | — | — | ¥2.00阶梯▲ | ¥8.00 | ¥0.40 | 200K | 16K | — | — | 文本 | 性价比 | 使用 → | |
| Spark X2 | 🇨🇳讯飞星火 自动核对: 2026-08-26 | — | — | ¥2.00 | ¥2.00 | — | 200K | 16K | — | — | 文本 | 旗舰推理 | 使用 → | |
| Spark X2 Flash | 🇨🇳讯飞星火 自动核对: 2026-08-26 | — | — | ¥2.00 | ¥2.00 | — | 200K | 16K | — | — | 文本 | 推理快速性价比 | 使用 → | |
| Baichuan M2 | 🇨🇳百川智能 自动核对: 2026-08-26 | — | — | ¥2.00 | ¥20.00 | — | 192K | 16K | — | — | 文本 | 性价比 | 使用 → | |
| Gemini 2.5 Flash | 🇺🇸Google 人工监控: 2026-08-01>14天未核 | — | — | ¥2.02$0.30 | ¥16.84$2.50 | ¥0.20 | 1.0M | 64K | — | — | 文本视觉音频 | 快速性价比 | 使用 → | |
| MiniMax M3 | 🇨🇳MiniMax 自动核对: 2026-08-26 | 55 | — | ¥2.10阶梯▲ | ¥8.40 | ¥0.42 | 1.0M | 64K | — | ★ 105 | 文本 | Agent代码长上下文旗舰 | 使用 → | |
| MiniMax M2.7 | 🇨🇳MiniMax 自动核对: 2026-08-26 | 50 | — | ¥2.10 | ¥8.40 | ¥0.42 | 1.0M | 64K | — | ★ 95 | 文本 | Agent代码性价比 | 使用 → | |
| Qwen3 Max | 🇨🇳阿里通义 自动核对: 2026-08-26 | — | — | ¥2.50阶梯▲ | ¥10.00 | — | 256K | 32K | — | — | 文本视觉 | 性价比 | 使用 → | |
| DeepSeek V4 Flash | 🇨🇳DeepSeek 自动核对: 2026-08-21 | 47 | — | ¥3.00峰时默认 · 空闲 ¥1.50 | ¥9.00峰时默认 · 空闲 ¥4.50 | ¥0.10峰时默认 · 空闲 ¥0.05 | 1.0M | 384K | — | ★ 78 | 文本 | 国产之光极便宜长上下文 | 使用 → | |
| 混元 2.0 Think | 🇨🇳腾讯混元 人工监控: 2026-06-05>14天未核 | — | — | ¥3.98 | ¥15.90 | — | 128K | 16K | — | — | 文本 | 旗舰推理 | 使用 → | |
| GLM-5 | 🇨🇳智谱 AI 自动核对: 2026-08-26 | — | — | ¥4.00阶梯▲ | ¥18.00 | ¥1.00 | 200K | 16K | — | — | 文本视觉 | 旗舰 | 使用 → | |
| 文心 ERNIE 5.1 | 🇨🇳百度文心 人工监控: 2026-06-05>14天未核 | — | — | ¥4.00阶梯▲ | ¥18.00 | — | 128K | 16K | — | — | 文本视觉 | 旗舰 | 使用 → | |
| Spark Pro | 🇨🇳讯飞星火 自动核对: 2026-08-26 | — | — | ¥5.00 | ¥5.00 | — | 128K | 16K | — | — | 文本 | 强性能 | 使用 → | |
| Baichuan M3 Plus | 🇨🇳百川智能 自动核对: 2026-08-26 | — | — | ¥5.00 | ¥9.00 | — | 192K | 16K | — | — | 文本 | 医疗旗舰 | 使用 → | |
| GLM-5.1 | 🇨🇳智谱 AI 自动核对: 2026-08-26 | 51 | — | ¥6.00阶梯▲ | ¥24.00 | ¥1.30 | 200K | 16K | — | 34 | 文本 | 旗舰推理新发布 | 使用 → | |
| Doubao Seed 2.1 Pro | 🇨🇳字节豆包 人工监控: 2026-07-03>14天未核 | — | — | ¥6.00 | ¥30.00 | ¥1.20 | 256K | 32K | — | — | 文本视觉 | 旗舰推理新发布 | 使用 → | |
| Kimi K2.6 | 🇨🇳Moonshot / Kimi 自动核对: 2026-08-26 | 54 | — | ¥6.50 | ¥27.00 | ¥1.10 | 262K | 32K | — | 32 | 文本视觉 | 旗舰长上下文Agent | 使用 → | |
| Claude Haiku 4.5 | 🇺🇸Anthropic 人工监控: 2026-08-01>14天未核 | 37 | — | ¥6.74$1.00 | ¥33.69$5.00 | ¥0.67 | 200K | 32K | — | 18 | 文本视觉 | 快速 | 使用 → | |
| Grok Build 0.1 | 🇺🇸xAI 人工监控: 2026-08-01>14天未核 | — | — | ¥6.74$1.00阶梯▲ | ¥13.47$2.00 | ¥1.35 | 256K | 64K | — | — | 文本 | 代码快速 | 使用 → | |
| GLM-5.2 | 🇨🇳智谱 AI 自动核对: 2026-08-26 | — | #54.33T | ¥8.00 | ¥28.00 | — | 1.0M | 128K | — | — | 文本 | 旗舰推理 | 使用 → | |
| GPT-5.1 | 🇺🇸OpenAI 人工监控: 2026-08-01>14天未核 | — | — | ¥8.42$1.25 | ¥67.37$10.00 | ¥0.84 | 400K | 128K | 2024-09 | — | 文本视觉 | 快速 | 使用 → | |
| Gemini 2.5 Pro | 🇺🇸Google 人工监控: 2026-08-01>14天未核 | 35 | — | ¥8.42$1.25阶梯▲ | ¥67.37$10.00 | ¥0.84 | 2.0M | 64K | — | 9 | 文本视觉音频 | 长上下文 | 使用 → | |
| Grok 4.3 | 🇺🇸xAI 人工监控: 2026-08-01>14天未核 | 53 | — | ¥8.42$1.25阶梯▲ | ¥16.84$2.50 | ¥1.35 | 1.0M | 64K | 2024-11 | 42 | 文本视觉 | 旗舰推理 | 使用 → | |
| DeepSeek V4 Pro | 🇨🇳DeepSeek 自动核对: 2026-08-21 | 52 | — | ¥9.00峰时默认 · 空闲 ¥4.50 | ¥27.00峰时默认 · 空闲 ¥13.50 | ¥0.30峰时默认 · 空闲 ¥0.15 | 1.0M | 384K | — | 29 | 文本 | 旗舰推理长上下文 | 使用 → | |
| Gemini 3.6 Flash | 🇺🇸Google 人工监控: 2026-08-01>14天未核 | — | #92.28T | ¥10.11$1.50 | ¥50.53$7.50 | ¥1.01 | 1.0M | 66K | 2026-03 | — | 文本视觉音频 | 快速多模态 | 使用 → | |
| Gemini 3.5 Flash | 🇺🇸Google 人工监控: 2026-08-01>14天未核 | 55 | — | ¥10.11$1.50 | ¥60.63$9.00 | ¥1.01 | 1.0M | 64K | — | 16 | 文本视觉音频 | 快速多模态上代 | 使用 → | |
| Qwen3.7 Max | 🇨🇳阿里通义 自动核对: 2026-08-26 | 57 | — | ¥12.00 | ¥36.00 | — | 1.0M | 32K | — | 24 | 文本视觉 | 旗舰Agent长上下文新发布 | 使用 → | |
| GPT-5.6 Terra | 🇺🇸OpenAI 人工监控: 2026-08-01>14天未核 | — | — | ¥13.47$2.00阶梯▲ | ¥80.84$12.00 | ¥1.35 | 1.1M | 128K | 2026-02 | — | 文本视觉 | 性价比 | 使用 → | |
| Claude Sonnet 5 | 🇺🇸Anthropic 人工监控: 2026-08-01>14天未核 | 57 | — | ¥13.47$2.00 | ¥67.37$10.00 | ¥1.35 | 1.0M | 128K | 2026-01 | 14 | 文本视觉 | 性价比代码长上下文 | 使用 → | |
| Gemini 3.1 Pro Preview | 🇺🇸Google 人工监控: 2026-08-01>14天未核 | 57 | — | ¥13.47$2.00阶梯▲ | ¥80.84$12.00 | ¥1.35 | 2.0M | 64K | 2025-01 | 12 | 文本视觉音频 | 旗舰长上下文多模态 | 使用 → | |
| GPT-5.4 | 🇺🇸OpenAI 人工监控: 2026-08-01>14天未核 | — | — | ¥16.84$2.50阶梯▲ | ¥101.06$15.00 | ¥1.68 | 400K | 128K | 2025-08 | — | 文本视觉 | 性价比 | 使用 → | |
| Kimi K3 | 🇨🇳Moonshot / Kimi 自动核对: 2026-08-26 | — | — | ¥20.00 | ¥100.00 | ¥2.00 | 1.0M | 32K | — | — | 文本 | 旗舰长上下文推理 | 使用 → | |
| Claude Sonnet 4.6 | 🇺🇸Anthropic 人工监控: 2026-08-01>14天未核 | 52 | — | ¥20.21$3.00 | ¥101.06$15.00 | ¥2.02 | 1.0M | 64K | — | 9 | 文本视觉 | 性价比长上下文代码 | 使用 → | |
| GPT-5.5 | 🇺🇸OpenAI 人工监控: 2026-08-01>14天未核 | 60 | — | ¥33.69$5.00阶梯▲ | ¥202.11$30.00 | ¥3.37 | 400K | 128K | 2025-12 | 5 | 文本视觉 | 旗舰推理 | 使用 → | |
| GPT-5.6 Sol | 🇺🇸OpenAI 人工监控: 2026-08-01>14天未核 | 59 | — | ¥33.69$5.00阶梯▲ | ¥202.11$30.00 | ¥3.37 | 1.1M | 128K | 2026-02 | 5 | 文本视觉 | 旗舰推理 | 使用 → | |
| Claude Opus 4.8 | 🇺🇸Anthropic 人工监控: 2026-08-01>14天未核 | 61 | — | ¥33.69$5.00 | ¥168.43$25.00 | ¥3.37 | 1.0M | 64K | 2026-01 | 6 | 文本视觉 | 长上下文代码推理上代旗舰 | 使用 → | |
| Claude Opus 5 | 🇺🇸Anthropic 人工监控: 2026-08-01>14天未核 | 61 | #82.67T | ¥33.69$5.00 | ¥168.43$25.00 | ¥3.37 | 1.0M | 128K | 2026-05 | 6 | 文本视觉 | 旗舰推理代码长上下文 | 使用 → | |
| Claude Opus 4.7 | 🇺🇸Anthropic 人工监控: 2026-08-01>14天未核 | 57 | — | ¥33.69$5.00 | ¥168.43$25.00 | ¥3.37 | 1.0M | 64K | 2026-01 | 6 | 文本视觉 | 长上下文代码上代 | 使用 → | |
| Claude Fable 5 | 🇺🇸Anthropic 人工监控: 2026-08-01>14天未核 | 60 | — | ¥67.37$10.00 | ¥336.85$50.00 | ¥6.74 | 1.0M | 128K | 2026-01 | 3 | 文本视觉 | 旗舰推理代码长上下文 | 使用 → |
懒得逐家注册?一个 key 调所有模型
不想各家分别注册、各自充值、各管各的 key?用 AIMLAPI 一个 key 直连数百个模型,按量计费、随时切换。比价完想省事就走它。
含推广 · 通过此链接注册我们可能获得返佣,不影响你的价格
热门对比
两两 PK,用真实价格看清谁更划算。
深度文章
计费机制、省钱实战、避坑与选型,价格全部真实可溯源。
怎么挑一个最划算的大模型?
第一步,分清「输入价」和「输出价」。几乎所有 LLM 厂商都按 token 计费,但输入 token(你发给模型的) 和输出 token(模型生成的)单价不一样,通常输出贵 4–10 倍。所以「短问长答」类任务(写文章、生成代码)成本主要取决于输出价, 而「长问短答」类任务(文档摘要、分类)则看输入价。
第二步,看缓存价。如果你的应用有大量重复的 system prompt 或文档上下文(比如客服机器人、 RAG),缓存命中后输入价能降到 10–20%。DeepSeek、OpenAI、Anthropic、 Google 都支持上下文缓存,但价格差异巨大。
第三步,看任务复杂度。不要默认用旗舰模型。Claude Haiku 4.5、Gemini 2.5 Flash-Lite、Qwen3.5 Flash、 DeepSeek V4 Flash 这些「腰部模型」性价比极高,对话、翻译、简单生成、分类 这些任务完全够用,成本只有旗舰的 1–5%。
第四步,国产 vs 海外。如果用户在中国大陆,访问 DeepSeek、Kimi、通义、豆包延迟低(~50ms vs ~500ms),且不需要科学上网。Qwen3.5 Flash 首档为 ¥0.20/¥2;DeepSeek V4 Flash 按北京时间分时(峰时 ¥3/¥9、空闲 ¥1.5/¥4.5);Gemini 2.5 Flash-Lite 是海外低价选项。实际成本要结合单次输入档位和调用时段。
第五步,用估算器算总账。单价只是 nominal,真实月账单取决于调用次数 × 单次 token 量。 把你典型任务的 prompt 粘到 Token 估算器,瞬间看清各家月成本差距。
常见问题
输入价、输出价、缓存价,一次调用到底按哪个收?
三个一起收,分别算。你发进去的内容按输入价计费(命中缓存的那部分改按更便宜的缓存价),模型生成的内容按输出价计费,最后相加就是这次调用的费用。所以同一个模型对不同任务的实际成本差别很大:长文档摘要主要花在输入,写长文主要花在输出,重复前缀多的应用则靠缓存把输入那块压下来。
为什么输出价普遍比输入价贵好几倍?
因为生成比读取更耗算力。模型读输入是一次性并行处理,而生成输出是一个 token 一个 token 自回归解码出来的,计算量大得多,厂商定价也就随之拉高,常见是输入价的 4 到 10 倍。实际影响是:凡是「让模型多写」的任务,省钱的重点不是换便宜模型,而是先想办法让它少写——限定长度、只要结果不要解释,往往立竿见影。
缓存价那么便宜,是不是我用了缓存就一定省钱?
不一定,要看你的请求结构。缓存通常只对「重复的前缀」生效,且要达到最小 token 门槛、两次请求间隔不能太久,部分厂商首次写入缓存还会单独收一笔。如果你每次 prompt 开头都不一样(比如把用户输入放在最前面),就基本命中不了。想吃到缓存红利,正确做法是把固定不变的内容(system prompt、文档、工具定义)放在最前面,变动的用户输入放最后。
上下文窗口越大越好吗?为什么大窗口反而可能更费钱?
窗口大解决的是「能不能装下」,不解决「该不该装满」。你塞进窗口的每个 token 都按输入价计费,把整本手册一次性丢进去,既增加费用又可能分散模型注意力、降低回答质量。更划算的通常是「精准检索只取相关片段 + 把固定前缀做成缓存」。大窗口的真正价值在于那些确实无法切分的任务,比如通读一份长合同或整个代码库。
推理/思考模型标的输出价看着不贵,为什么账单更高?
因为带「思考」「推理」模式的模型在给出最终答案前,会先生成一大段你通常看不到的思维链,而这些思维 token 一般也按输出价计费。也就是说你为「它在想的过程」也付了钱。所以评估这类模型不能只看挂牌的输出单价,要结合它在你任务上实际产生多少思维 token——同样一道题,思维链越长,隐性成本越高。对不需要复杂推理的任务,直接用非推理模型往往更省。
同一个模型,为什么不同地方报价不一样?算盘列的是哪个价?
因为同一个模型可以通过官方 API、聚合平台(如 OpenRouter)、云厂商托管(如火山方舟、阿里云百炼)等多个渠道调用,各渠道定价、汇率折算、促销策略都不同,价差有时不小。本站价格表默认展示官方定价作为基准,另设了「渠道比价」页专门把同一模型在各渠道的实测价并排列出来,每个价都标了核对日期和来源,方便你找到当下最便宜的调用方式。
算盘上的价格多久更新一次?可靠吗?
国产主力厂商接了每日自动核价,海外(美元计费)厂商按当日实时汇率折算,每个价格都记录了最近核对日期和核对方式。但模型定价变动频繁、各家也常有限时促销,本站只做对比和换算,任何价格最终都以厂商官方文档为准。算盘是独立开发者做的工具站,不隶属也不代表任何厂商;如果你发现某个数字和官方对不上,欢迎指出,会尽快更正。