算盘·LLM Abacus
中文优先的 AI 大模型价格对比。
一张表看清 80 个主流模型,30 秒回答「跑哪个最便宜」。
算盘(LLM Abacus)是 AI 大模型 API 价格对比与 Token 成本估算平台。全量收录 Claude Opus 5、GPT-5.6 Sol、Gemini 3.6 Flash、DeepSeek V4、Kimi K3、Qwen3.7 等 80+ 个主流模型。最新一笔核验为 ,近 14 天已核验 16/16 家厂商,各行另列具体厂商核验日期,全库口径见「关于 & 方法论」。
Anthropic 于 2026-09-22 发布 Opus 5.5:$4/$20/百万tokens(比 Opus 5 降 20%),1M 上下文 + 128K 最大输出,知识截止 2026-06,性能对齐 Fable 5.1,默认速度比 Opus 5 快约 30%,成为 Anthropic 长时任务 Agent 编码新旗舰。
Anthropic 于 2026-09-01 发布 Claude Mythos 5.1,仅限 Project Glasswing 邀请访问,规格与定价与 Fable 5.1 完全一致($10/$50/缓存$0.25)。
xAI 发布 Grok 4.7,成为当前官方定价页横幅主推旗舰:短上下文 $2/$6(缓存$0.5),≥200K 长上下文 $4/$12(缓存$1),500K 上下文窗口。
xAI 发布 Grok 4.6:短上下文 $2/$6(缓存$0.5),≥200K 长上下文 $4/$12(缓存$1),与 4.7 同价位、早一代。
全球用量热度榜
OpenRouter 周 token 用量(2026-10-10 自动核对)——海外开发者真实用量,反映热度而非质量;国产模型走国内端点的用量不计入。 仅显示本站收录且当周在榜的模型,掉出榜单即不再显示名次。
仅展示本站收录的模型在 OpenRouter 周榜中的名次;完整榜单见 openrouter.ai/rankings。榜上多为海外可直连模型,本站收录的国产模型走国内端点、不进此榜。
最便宜的 5 个模型
按输入价排序。卡片里是「单次典型问答(输入 2000 + 输出 500 tokens)」的估算成本。
模型价格表
默认按输入价升序,便宜的在最上面
共 80 / 80 个模型 · 价格单位 ¥/百万 tokens(海外厂商附 $ 美元原价,按 1 USD = 6.7065 换算)· 点击表头列名可排序 · 绿色高亮 = 最便宜 · 性价比↑ = 质量/价格比最高(需有质量评分) · 热度 = OpenRouter 周榜名次(token 用量,反映海外开发者实际用量而非质量;国产模型国内端点用量不经 OR,仅供参考)
| 厂商 | 缓存价 | 最大输出 | 知识截止 | 模态 | 标签 | 去试用 | ||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Flash | 🇨🇳阿里通义 自动核对: 2026-10-10 | — | — | ¥0.20阶梯▲ | ¥2.00 | — | 1.0M | 16K | — | — | 文本 | 极便宜快速 | 使用 → | |
| Gemini 2.5 Flash-Lite | 🇺🇸Google 人工监控: 2026-09-28 | — | — | ¥0.67$0.10 | ¥2.68$0.40 | ¥0.07 | 1.0M | 64K | — | — | 文本视觉 | 极便宜快速 | 使用 → | |
| Qwen3.5 Plus | 🇨🇳阿里通义 自动核对: 2026-10-10 | — | — | ¥0.80阶梯▲ | ¥4.80 | — | 1.0M | 32K | — | — | 文本视觉 | 性价比新发布 | 使用 → | |
| Doubao 1.6 | 🇨🇳字节豆包 人工监控: 2026-09-28 | — | — | ¥0.80阶梯▲ | ¥8.00 | ¥0.16 | 256K | 16K | — | — | 文本视觉音频 | 多模态上代 | 使用 → | |
| Doubao 1.5 Pro | 🇨🇳字节豆包 人工监控: 2026-09-28 | — | — | ¥0.80 | ¥2.00 | ¥0.16 | 256K | 12K | — | — | 文本视觉 | 极便宜上代 | 使用 → | |
| 文心 ERNIE 4.5 Turbo | 🇨🇳百度文心 人工监控: 2026-09-28 | — | — | ¥0.80 | ¥3.20 | ¥0.20 | 128K | 16K | — | — | 文本视觉 | 性价比快速 | 使用 → | |
| 混元 TurboS | 🇨🇳腾讯混元 人工监控: 2026-09-28 | — | — | ¥0.80 | ¥2.00 | — | 256K | 16K | — | — | 文本 | 性价比快速 | 使用 → | |
| Spark Ultra | 🇨🇳讯飞星火 自动核对: 2026-09-28 | — | — | ¥0.80 | ¥0.80 | — | 128K | 16K | — | — | 文本 | 性价比FunctionCall | 使用 → | |
| GLM-5.3-Flash | 🇨🇳智谱 AI 自动核对: 2026-09-28 | — | #311.20T | ¥0.80 | ¥2.80 | ¥0.23 | 1.0M | 128K | — | — | 文本 | 快速性价比 | 使用 → | |
| 文心 ERNIE X1 Turbo | 🇨🇳百度文心 人工监控: 2026-09-28 | — | — | ¥1.00 | ¥4.00 | — | 128K | 16K | — | — | 文本 | 推理深度思考 | 使用 → | |
| 混元 T1 | 🇨🇳腾讯混元 人工监控: 2026-09-28 | — | — | ¥1.00 | ¥4.00 | — | 64K | 16K | — | — | 文本 | 推理 | 使用 → | |
| MiMo-V2.5 | 🇨🇳小米 MiMo 人工监控: 2026-09-28 | — | — | ¥1.00 | ¥2.00 | ¥0.02 | 262K | 32K | — | — | 文本 | 高性价比 | 使用 → | |
| 混元 Hy3 | 🇨🇳腾讯混元 人工监控: 2026-09-28 | — | — | ¥1.00 | ¥4.00 | ¥0.25 | 262K | 32K | — | — | 文本 | 高性价比Agent | 使用 → | |
| MiMo-V2.6 Flash | 🇨🇳小米 MiMo 人工监控: 2026-09-28 | — | #410.90T | ¥1.00 | ¥2.00 | ¥0.02 | 262K | 32K | — | — | 文本 | 高性价比新发布 | 使用 → | |
| GPT-5.6 Luna | 🇺🇸OpenAI 人工监控: 2026-09-28 | — | — | ¥1.34$0.20阶梯▲ | ¥8.05$1.20 | ¥0.13 | 1.1M | 128K | 2026-02 | — | 文本视觉 | 快速极便宜 | 使用 → | |
| Step 3.7 Flash | 🇨🇳阶跃星辰 人工监控: 2026-09-28 | — | — | ¥1.35 | ¥8.10 | ¥0.27 | 131K | 32K | — | — | 文本 | 高性价比 | 使用 → | |
| Spark X2.5 | 🇨🇳讯飞星火 自动核对: 2026-09-28 | — | — | ¥1.60 | ¥6.00 | ¥0.24 | 1.0M | 32K | — | — | 文本 | 旗舰新发布Agent | 使用 → | |
| Gemini 3.1 Flash-Lite | 🇺🇸Google 人工监控: 2026-09-28 | 34 | — | ¥1.68$0.25 | ¥10.06$1.50 | ¥0.17 | 1.0M | 64K | 2025-01 | ★ 58 | 文本视觉 | 极便宜快速 | 使用 → | |
| DeepSeek V4 Flash | 🇨🇳DeepSeek 自动核对: 2026-10-10 | 47 | — | ¥2.00峰时默认 · 空闲 ¥1.00 | ¥8.00峰时默认 · 空闲 ¥4.00 | ¥0.04峰时默认 · 空闲 ¥0.02 | 1.0M | 384K | — | ★ 94 | 文本 | 国产之光极便宜长上下文 | 使用 → | |
| DeepSeek V3.2 | 🇨🇳DeepSeek 自动核对: 2026-10-10 | — | — | ¥2.00 | ¥8.00 | ¥0.50 | 128K | 8K | — | — | 文本 | 已下线(官方)2026-07-24 已下线 | 使用 → | |
| GLM-4.7 | 🇨🇳智谱 AI 自动核对: 2026-09-28 | — | — | ¥2.00阶梯▲ | ¥8.00 | ¥0.40 | 200K | 16K | — | — | 文本 | 性价比 | 使用 → | |
| Spark X2 | 🇨🇳讯飞星火 自动核对: 2026-09-28 | — | — | ¥2.00 | ¥2.00 | — | 200K | 16K | — | — | 文本 | 旗舰推理 | 使用 → | |
| Spark X2 Flash | 🇨🇳讯飞星火 自动核对: 2026-09-28 | — | — | ¥2.00 | ¥2.00 | — | 200K | 16K | — | — | 文本 | 推理快速性价比 | 使用 → | |
| Baichuan M2 | 🇨🇳百川智能 自动核对: 2026-10-10 | — | — | ¥2.00 | ¥20.00 | — | 192K | 16K | — | — | 文本 | 性价比 | 使用 → | |
| GLM-5.3-FlashX | 🇨🇳智谱 AI 自动核对: 2026-09-28 | — | — | ¥2.00 | ¥7.00 | ¥0.57 | 1.0M | 128K | — | — | 文本 | 快速性价比 | 使用 → | |
| Gemini 2.5 Flash | 🇺🇸Google 人工监控: 2026-09-28 | — | — | ¥2.01$0.30 | ¥16.77$2.50 | ¥0.20 | 1.0M | 64K | — | — | 文本视觉音频 | 快速性价比 | 使用 → | |
| MiniMax M3 | 🇨🇳MiniMax 自动核对: 2026-10-10 | 55 | — | ¥2.10阶梯▲ | ¥8.40 | ¥0.42 | 1.0M | 64K | — | ★ 105 | 文本 | Agent代码长上下文旗舰 | 使用 → | |
| MiniMax M2.7 | 🇨🇳MiniMax 自动核对: 2026-10-10 | 50 | — | ¥2.10 | ¥8.40 | ¥0.42 | 1.0M | 64K | — | ★ 95 | 文本 | Agent代码性价比 | 使用 → | |
| Qwen3 Max | 🇨🇳阿里通义 自动核对: 2026-10-10 | — | — | ¥2.50阶梯▲ | ¥10.00 | — | 256K | 32K | — | — | 文本视觉 | 性价比 | 使用 → | |
| MiMo-V2.6 Pro | 🇨🇳小米 MiMo 人工监控: 2026-09-28 | — | — | ¥3.00 | ¥6.00 | ¥0.03 | 262K | 32K | — | — | 文本 | 旗舰新发布 | 使用 → | |
| 混元 2.0 Think | 🇨🇳腾讯混元 人工监控: 2026-09-28 | — | — | ¥3.98 | ¥15.90 | — | 128K | 16K | — | — | 文本 | 旗舰推理 | 使用 → | |
| GLM-5 | 🇨🇳智谱 AI 自动核对: 2026-09-28 | — | — | ¥4.00阶梯▲ | ¥18.00 | ¥1.00 | 200K | 16K | — | — | 文本视觉 | 旗舰 | 使用 → | |
| 文心 ERNIE 5.1 | 🇨🇳百度文心 人工监控: 2026-09-28 | — | — | ¥4.00阶梯▲ | ¥18.00 | — | 128K | 16K | — | — | 文本视觉 | 旗舰 | 使用 → | |
| MiniMax M2.7 Highspeed | 🇨🇳MiniMax 自动核对: 2026-10-10 | — | — | ¥4.20 | ¥16.80 | ¥0.42 | 1.0M | 64K | — | — | 文本 | Agent代码快速 | 使用 → | |
| Spark Pro | 🇨🇳讯飞星火 自动核对: 2026-09-28 | — | — | ¥5.00 | ¥5.00 | — | 128K | 16K | — | — | 文本 | 强性能 | 使用 → | |
| Baichuan M3 Plus | 🇨🇳百川智能 自动核对: 2026-10-10 | — | — | ¥5.00 | ¥9.00 | — | 192K | 16K | — | — | 文本 | 医疗旗舰 | 使用 → | |
| Gemini 3.7 Flash | 🇺🇸Google 人工监控: 2026-09-28 | — | — | ¥5.03$0.75 | ¥25.15$3.75 | ¥0.50 | 1.0M | 64K | — | — | 文本视觉音频 | 快速多模态Agent代码 | 使用 → | |
| Gemini 3.6 Flash | 🇺🇸Google 人工监控: 2026-09-28 | — | — | ¥5.03$0.75 | ¥25.15$3.75 | ¥0.50 | 1.0M | 66K | 2026-03 | — | 文本视觉音频 | 快速多模态上代 | 使用 → | |
| Gemini 3.8 Flash | 🇺🇸Google 人工监控: 2026-09-28 | — | — | ¥5.03$0.75 | ¥25.15$3.75 | ¥0.50 | 1.0M | 66K | — | — | 文本视觉音频 | 快速多模态Agent代码新发布 | 使用 → | |
| GLM-5.1 | 🇨🇳智谱 AI 自动核对: 2026-09-28 | 51 | — | ¥6.00阶梯▲ | ¥24.00 | ¥1.30 | 200K | 16K | — | 34 | 文本 | 旗舰推理新发布 | 使用 → | |
| Doubao Seed 2.1 Pro | 🇨🇳字节豆包 人工监控: 2026-09-28 | — | — | ¥6.00 | ¥30.00 | ¥1.20 | 256K | 32K | — | — | 文本视觉 | 旗舰推理新发布 | 使用 → | |
| 混元 Hy4 Preview | 🇨🇳腾讯混元 人工监控: 2026-09-28 | — | — | ¥6.00 | ¥18.00 | ¥0.30 | 262K | 32K | — | — | 文本 | 旗舰新发布 | 使用 → | |
| Kimi K2.6 | 🇨🇳Moonshot / Kimi 自动核对: 2026-10-10 | 54 | — | ¥6.50 | ¥27.00 | ¥1.10 | 262K | 32K | — | 32 | 文本视觉 | 旗舰长上下文Agent | 使用 → | |
| Kimi K2.7 Code | 🇨🇳Moonshot / Kimi 自动核对: 2026-10-10 | — | — | ¥6.50 | ¥27.00 | ¥1.30 | 262K | 32K | — | — | 文本视觉 | 代码长上下文Agent新发布 | 使用 → | |
| Claude Haiku 4.5 | 🇺🇸Anthropic 人工监控: 2026-09-28 | 37 | — | ¥6.71$1.00 | ¥33.53$5.00 | ¥0.67 | 200K | 32K | — | 18 | 文本视觉 | 快速 | 使用 → | |
| Grok Build 0.1 | 🇺🇸xAI 人工监控: 2026-09-28 | — | — | ¥6.71$1.00阶梯▲ | ¥13.41$2.00 | ¥1.34 | 256K | 64K | — | — | 文本 | 代码快速 | 使用 → | |
| GLM-5.2 | 🇨🇳智谱 AI 自动核对: 2026-09-28 | — | — | ¥8.00 | ¥28.00 | ¥2.00 | 1.0M | 128K | — | — | 文本 | 旗舰推理 | 使用 → | |
| GLM-5.3 | 🇨🇳智谱 AI 自动核对: 2026-09-28 | — | #103.42T | ¥8.00 | ¥28.00 | ¥2.00 | 1.0M | 128K | — | — | 文本 | 旗舰推理新发布 | 使用 → | |
| GPT-5.1 | 🇺🇸OpenAI 人工监控: 2026-09-28 | — | — | ¥8.38$1.25 | ¥67.06$10.00 | ¥0.84 | 400K | 128K | 2024-09 | — | 文本视觉 | 快速 | 使用 → | |
| Gemini 2.5 Pro | 🇺🇸Google 人工监控: 2026-09-28 | 35 | — | ¥8.38$1.25阶梯▲ | ¥67.06$10.00 | ¥0.84 | 2.0M | 64K | — | 9 | 文本视觉音频 | 长上下文 | 使用 → | |
| Grok 4.3 | 🇺🇸xAI 人工监控: 2026-09-28 | 53 | — | ¥8.38$1.25阶梯▲ | ¥16.77$2.50 | ¥1.34 | 1.0M | 64K | 2024-11 | 42 | 文本视觉 | 旗舰推理 | 使用 → | |
| Grok 4.20 Multi-Agent | 🇺🇸xAI 人工监控: 2026-09-28 | — | — | ¥8.38$1.25阶梯▲ | ¥16.77$2.50 | ¥1.34 | 1.0M | 64K | — | — | 文本 | Agent长上下文 | 使用 → | |
| Grok 4.20 Reasoning | 🇺🇸xAI 人工监控: 2026-09-28 | — | — | ¥8.38$1.25阶梯▲ | ¥16.77$2.50 | ¥1.34 | 1.0M | 64K | — | — | 文本 | 推理长上下文 | 使用 → | |
| Grok 4.20 Non-Reasoning | 🇺🇸xAI 人工监控: 2026-09-28 | — | — | ¥8.38$1.25阶梯▲ | ¥16.77$2.50 | ¥1.34 | 1.0M | 64K | — | — | 文本 | 快速长上下文 | 使用 → | |
| DeepSeek V4 Pro | 🇨🇳DeepSeek 自动核对: 2026-10-10 | 52 | — | ¥9.00峰时默认 · 空闲 ¥4.50 | ¥27.00峰时默认 · 空闲 ¥13.50 | ¥0.30峰时默认 · 空闲 ¥0.15 | 1.0M | 384K | — | 29 | 文本 | 旗舰推理长上下文 | 使用 → | |
| Qwen3.6 Max Preview | 🇨🇳阿里通义 自动核对: 2026-10-10 | — | — | ¥9.00阶梯▲ | ¥54.00 | — | 256K | 32K | — | — | 文本视觉 | 旗舰推理 | 使用 → | |
| Gemini 3.5 Flash | 🇺🇸Google 人工监控: 2026-09-28 | 55 | — | ¥10.06$1.50 | ¥60.36$9.00 | ¥1.01 | 1.0M | 64K | — | 16 | 文本视觉音频 | 快速多模态上代 | 使用 → | |
| Qwen3.7 Max | 🇨🇳阿里通义 自动核对: 2026-10-10 | 57 | — | ¥12.00 | ¥36.00 | — | 1.0M | 32K | — | 24 | 文本视觉 | 旗舰Agent长上下文新发布 | 使用 → | |
| Qwen3.8 Max | 🇨🇳阿里通义 自动核对: 2026-10-10 | — | — | ¥12.00 | ¥36.00 | — | 1.0M | 32K | — | — | 文本视觉 | 旗舰Agent长上下文新发布 | 使用 → | |
| Kimi K2.7 Code Highspeed | 🇨🇳Moonshot / Kimi 自动核对: 2026-10-10 | — | — | ¥13.00 | ¥54.00 | ¥2.60 | 262K | 32K | — | — | 文本视觉 | 代码长上下文Agent快速 | 使用 → | |
| GPT-5.6 Terra | 🇺🇸OpenAI 人工监控: 2026-09-28 | — | — | ¥13.41$2.00阶梯▲ | ¥80.48$12.00 | ¥1.34 | 1.1M | 128K | 2026-02 | — | 文本视觉 | 性价比 | 使用 → | |
| Claude Sonnet 5 | 🇺🇸Anthropic 人工监控: 2026-09-28 | 57 | — | ¥13.41$2.00 | ¥67.06$10.00 | ¥1.34 | 1.0M | 128K | 2026-01 | 14 | 文本视觉 | 性价比代码长上下文 | 使用 → | |
| Gemini 3.1 Pro Preview | 🇺🇸Google 人工监控: 2026-09-28 | 57 | — | ¥13.41$2.00阶梯▲ | ¥80.48$12.00 | ¥1.34 | 2.0M | 64K | 2025-01 | 12 | 文本视觉音频 | 旗舰长上下文多模态 | 使用 → | |
| Grok 4.7 | 🇺🇸xAI 人工监控: 2026-09-28 | — | — | ¥13.41$2.00阶梯▲ | ¥40.24$6.00 | ¥3.35 | 500K | 64K | — | — | 文本视觉 | 旗舰推理长上下文新发布 | 使用 → | |
| Grok 4.6 | 🇺🇸xAI 人工监控: 2026-09-28 | — | — | ¥13.41$2.00阶梯▲ | ¥40.24$6.00 | ¥3.35 | 500K | 64K | — | — | 文本视觉 | 旗舰推理长上下文 | 使用 → | |
| Grok 4.5 | 🇺🇸xAI 人工监控: 2026-09-28 | — | — | ¥13.41$2.00阶梯▲ | ¥40.24$6.00 | ¥2.01 | 500K | 64K | — | — | 文本视觉 | 旗舰推理长上下文 | 使用 → | |
| GPT-5.4 | 🇺🇸OpenAI 人工监控: 2026-09-28 | — | — | ¥16.77$2.50阶梯▲ | ¥100.60$15.00 | ¥1.68 | 400K | 128K | 2025-08 | — | 文本视觉 | 性价比 | 使用 → | |
| Kimi K3 | 🇨🇳Moonshot / Kimi 自动核对: 2026-10-10 | — | — | ¥20.00 | ¥100.00 | ¥2.00 | 1.0M | 32K | — | — | 文本 | 旗舰长上下文推理 | 使用 → | |
| Claude Sonnet 4.6 | 🇺🇸Anthropic 人工监控: 2026-09-28 | 52 | — | ¥20.12$3.00 | ¥100.60$15.00 | ¥2.01 | 1.0M | 64K | — | 9 | 文本视觉 | 性价比长上下文代码 | 使用 → | |
| Qwen3.8 Max Prime | 🇨🇳阿里通义 自动核对: 2026-10-10 | — | — | ¥24.00 | ¥72.00 | — | 1.0M | 32K | — | — | 文本视觉 | 旗舰Agent长上下文顶配 | 使用 → | |
| GPT-5.6 Sol | 🇺🇸OpenAI 人工监控: 2026-09-28 | 61 | — | ¥26.83$4.00阶梯▲ | ¥134.13$20.00 | ¥2.68 | 1.1M | 128K | 2026-02 | 8 | 文本视觉 | 旗舰推理 | 使用 → | |
| Claude Opus 5.5 | 🇺🇸Anthropic 人工监控: 2026-09-28 | — | #94.32T | ¥26.83$4.00 | ¥134.13$20.00 | ¥1.34 | 1.0M | 128K | 2026-06 | — | 文本视觉 | 旗舰推理代码长上下文新发布 | 使用 → | |
| MiMo-V2.6 Pro Ultraspeed | 🇨🇳小米 MiMo 人工监控: 2026-09-28 | — | — | ¥30.00 | ¥60.00 | ¥0.25 | 262K | 32K | — | — | 文本 | 旗舰快速新发布 | 使用 → | |
| GPT-5.5 | 🇺🇸OpenAI 人工监控: 2026-09-28 | 60 | — | ¥33.53$5.00阶梯▲ | ¥201.19$30.00 | ¥3.35 | 400K | 128K | 2025-12 | 5 | 文本视觉 | 旗舰推理 | 使用 → | |
| Claude Opus 4.8 | 🇺🇸Anthropic 人工监控: 2026-09-28 | 61 | — | ¥33.53$5.00 | ¥167.66$25.00 | ¥3.35 | 1.0M | 64K | 2026-01 | 6 | 文本视觉 | 长上下文代码推理上代旗舰 | 使用 → | |
| Claude Opus 5 | 🇺🇸Anthropic 人工监控: 2026-09-28 | 63 | — | ¥33.53$5.00 | ¥167.66$25.00 | ¥3.35 | 1.0M | 128K | 2026-05 | 6 | 文本视觉 | 旗舰推理代码长上下文 | 使用 → | |
| Claude Opus 4.7 | 🇺🇸Anthropic 人工监控: 2026-09-28 | 57 | — | ¥33.53$5.00 | ¥167.66$25.00 | ¥3.35 | 1.0M | 64K | 2026-01 | 6 | 文本视觉 | 长上下文代码上代 | 使用 → | |
| Claude Fable 5.1 | 🇺🇸Anthropic 人工监控: 2026-09-28 | 66 | — | ¥67.06$10.00 | ¥335.32$50.00 | ¥1.68 | 1.0M | 128K | 2026-01 | 3 | 文本视觉 | 旗舰推理代码长上下文 | 使用 → | |
| Claude Fable 5 | 🇺🇸Anthropic 人工监控: 2026-09-28 | 60 | — | ¥67.06$10.00 | ¥335.32$50.00 | ¥6.71 | 1.0M | 128K | 2026-01 | 3 | 文本视觉 | 推理代码长上下文上代 | 使用 → | |
| Claude Mythos 5.1 | 🇺🇸Anthropic 人工监控: 2026-09-28 | — | — | ¥67.06$10.00 | ¥335.32$50.00 | ¥1.68 | 1.0M | 128K | 2026-06 | — | 文本视觉 | 旗舰推理邀请制 | 使用 → |
懒得逐家注册?一个 key 调所有模型
不想各家分别注册、各自充值、各管各的 key?用 AIMLAPI 一个 key 直连数百个模型,按量计费、随时切换。比价完想省事就走它。
含推广 · 通过此链接注册我们可能获得返佣,不影响你的价格
热门对比
两两 PK,用真实价格看清谁更划算。
深度文章
计费机制、省钱实战、避坑与选型,价格全部真实可溯源。
怎么挑一个最划算的大模型?
第一步,分清「输入价」和「输出价」。几乎所有 LLM 厂商都按 token 计费,但输入 token(你发给模型的) 和输出 token(模型生成的)单价不一样,通常输出贵 4–10 倍。所以「短问长答」类任务(写文章、生成代码)成本主要取决于输出价, 而「长问短答」类任务(文档摘要、分类)则看输入价。
第二步,看缓存价。如果你的应用有大量重复的 system prompt 或文档上下文(比如客服机器人、 RAG),缓存命中后输入价能降到 10–20%。DeepSeek、OpenAI、Anthropic、 Google 都支持上下文缓存,但价格差异巨大。
第三步,看任务复杂度。不要默认用旗舰模型。Claude Haiku 4.5、Gemini 2.5 Flash-Lite、Qwen3.5 Flash、 DeepSeek V4 Flash 这些「腰部模型」性价比极高,对话、翻译、简单生成、分类 这些任务完全够用,成本只有旗舰的 1–5%。
第四步,国产 vs 海外。如果用户在中国大陆,访问 DeepSeek、Kimi、通义、豆包延迟低(~50ms vs ~500ms),且不需要科学上网。Qwen3.5 Flash 首档为 ¥0.20/¥2;DeepSeek V4 Flash 按北京时间分时(峰时 ¥3/¥9、空闲 ¥1.5/¥4.5);Gemini 2.5 Flash-Lite 是海外低价选项。实际成本要结合单次输入档位和调用时段。
第五步,用估算器算总账。单价只是 nominal,真实月账单取决于调用次数 × 单次 token 量。 把你典型任务的 prompt 粘到 Token 估算器,瞬间看清各家月成本差距。
常见问题
输入价、输出价、缓存价,一次调用到底按哪个收?
三个一起收,分别算。你发进去的内容按输入价计费(命中缓存的那部分改按更便宜的缓存价),模型生成的内容按输出价计费,最后相加就是这次调用的费用。所以同一个模型对不同任务的实际成本差别很大:长文档摘要主要花在输入,写长文主要花在输出,重复前缀多的应用则靠缓存把输入那块压下来。
为什么输出价普遍比输入价贵好几倍?
因为生成比读取更耗算力。模型读输入是一次性并行处理,而生成输出是一个 token 一个 token 自回归解码出来的,计算量大得多,厂商定价也就随之拉高,常见是输入价的 4 到 10 倍。实际影响是:凡是「让模型多写」的任务,省钱的重点不是换便宜模型,而是先想办法让它少写——限定长度、只要结果不要解释,往往立竿见影。
缓存价那么便宜,是不是我用了缓存就一定省钱?
不一定,要看你的请求结构。缓存通常只对「重复的前缀」生效,且要达到最小 token 门槛、两次请求间隔不能太久,部分厂商首次写入缓存还会单独收一笔。如果你每次 prompt 开头都不一样(比如把用户输入放在最前面),就基本命中不了。想吃到缓存红利,正确做法是把固定不变的内容(system prompt、文档、工具定义)放在最前面,变动的用户输入放最后。
上下文窗口越大越好吗?为什么大窗口反而可能更费钱?
窗口大解决的是「能不能装下」,不解决「该不该装满」。你塞进窗口的每个 token 都按输入价计费,把整本手册一次性丢进去,既增加费用又可能分散模型注意力、降低回答质量。更划算的通常是「精准检索只取相关片段 + 把固定前缀做成缓存」。大窗口的真正价值在于那些确实无法切分的任务,比如通读一份长合同或整个代码库。
推理/思考模型标的输出价看着不贵,为什么账单更高?
因为带「思考」「推理」模式的模型在给出最终答案前,会先生成一大段你通常看不到的思维链,而这些思维 token 一般也按输出价计费。也就是说你为「它在想的过程」也付了钱。所以评估这类模型不能只看挂牌的输出单价,要结合它在你任务上实际产生多少思维 token——同样一道题,思维链越长,隐性成本越高。对不需要复杂推理的任务,直接用非推理模型往往更省。
同一个模型,为什么不同地方报价不一样?算盘列的是哪个价?
因为同一个模型可以通过官方 API、聚合平台(如 OpenRouter)、云厂商托管(如火山方舟、阿里云百炼)等多个渠道调用,各渠道定价、汇率折算、促销策略都不同,价差有时不小。本站价格表默认展示官方定价作为基准,另设了「渠道比价」页专门把同一模型在各渠道的实测价并排列出来,每个价都标了核对日期和来源,方便你找到当下最便宜的调用方式。
算盘上的价格多久更新一次?可靠吗?
国产主力厂商接了每日自动核价,海外(美元计费)厂商按当日实时汇率折算,每个价格都记录了最近核对日期和核对方式。但模型定价变动频繁、各家也常有限时促销,本站只做对比和换算,任何价格最终都以厂商官方文档为准。算盘是独立开发者做的工具站,不隶属也不代表任何厂商;如果你发现某个数字和官方对不上,欢迎指出,会尽快更正。