跳到主内容
算盘
最近核验 2026-10-10 · 近 14 天覆盖 16/16 家厂商

算盘·LLM Abacus

中文优先的 AI 大模型价格对比。一张表看清 80 个主流模型,30 秒回答「跑哪个最便宜」。

算盘(LLM Abacus)是 AI 大模型 API 价格对比与 Token 成本估算平台。全量收录 Claude Opus 5、GPT-5.6 Sol、Gemini 3.6 Flash、DeepSeek V4、Kimi K3、Qwen3.7 等 80+ 个主流模型。最新一笔核验为 ,近 14 天已核验 16/16 家厂商,各行另列具体厂商核验日期,全库口径见「关于 & 方法论」。

80个模型
47 / 33国产 / 海外
每日汇率/旗舰核价
¥ + $双币种

最近价格变动

厂商降价/涨价/发布动态,按人民币折算展示。国产价直连官方页自动核对,发现变动即更新。

✦ 新发布2026-09Claude Opus 5.5 →

Anthropic 于 2026-09-22 发布 Opus 5.5:$4/$20/百万tokens(比 Opus 5 降 20%),1M 上下文 + 128K 最大输出,知识截止 2026-06,性能对齐 Fable 5.1,默认速度比 Opus 5 快约 30%,成为 Anthropic 长时任务 Agent 编码新旗舰。

✦ 新发布2026-09Claude Mythos 5.1 →

Anthropic 于 2026-09-01 发布 Claude Mythos 5.1,仅限 Project Glasswing 邀请访问,规格与定价与 Fable 5.1 完全一致($10/$50/缓存$0.25)。

✦ 新发布2026-09Grok 4.7 →

xAI 发布 Grok 4.7,成为当前官方定价页横幅主推旗舰:短上下文 $2/$6(缓存$0.5),≥200K 长上下文 $4/$12(缓存$1),500K 上下文窗口。

✦ 新发布2026-09Grok 4.6 →

xAI 发布 Grok 4.6:短上下文 $2/$6(缓存$0.5),≥200K 长上下文 $4/$12(缓存$1),与 4.7 同价位、早一代。

全球用量热度榜

OpenRouter 周 token 用量(2026-10-10 自动核对)——海外开发者真实用量,反映热度而非质量;国产模型走国内端点的用量不计入。 仅显示本站收录且当周在榜的模型,掉出榜单即不再显示名次。

看渠道比价 →

仅展示本站收录的模型在 OpenRouter 周榜中的名次;完整榜单见 openrouter.ai/rankings。榜上多为海外可直连模型,本站收录的国产模型走国内端点、不进此榜。

模型价格表

默认按输入价升序,便宜的在最上面

共 80 / 80 个模型 · 价格单位 ¥/百万 tokens(海外厂商附 $ 美元原价,按 1 USD = 6.7065 换算)· 点击表头列名可排序 · 绿色高亮 = 最便宜 · 性价比↑ = 质量/价格比最高(需有质量评分) · 热度 = OpenRouter 周榜名次(token 用量,反映海外开发者实际用量而非质量;国产模型国内端点用量不经 OR,仅供参考)

厂商缓存价最大输出知识截止模态标签去试用
Qwen3.5 Flash🇨🇳阿里通义
自动核对: 2026-10-10
——¥0.20阶梯▲¥2.00—1.0M16K——
文本
极便宜快速
使用 →
Gemini 2.5 Flash-Lite🇺🇸Google
人工监控: 2026-09-28
——¥0.67$0.10¥2.68$0.40¥0.071.0M64K——
文本视觉
极便宜快速
使用 →
Qwen3.5 Plus🇨🇳阿里通义
自动核对: 2026-10-10
——¥0.80阶梯▲¥4.80—1.0M32K——
文本视觉
性价比新发布
使用 →
Doubao 1.6🇨🇳字节豆包
人工监控: 2026-09-28
——¥0.80阶梯▲¥8.00¥0.16256K16K——
文本视觉音频
多模态上代
使用 →
Doubao 1.5 Pro🇨🇳字节豆包
人工监控: 2026-09-28
——¥0.80¥2.00¥0.16256K12K——
文本视觉
极便宜上代
使用 →
文心 ERNIE 4.5 Turbo🇨🇳百度文心
人工监控: 2026-09-28
——¥0.80¥3.20¥0.20128K16K——
文本视觉
性价比快速
使用 →
混元 TurboS🇨🇳腾讯混元
人工监控: 2026-09-28
——¥0.80¥2.00—256K16K——
文本
性价比快速
使用 →
Spark Ultra🇨🇳讯飞星火
自动核对: 2026-09-28
——¥0.80¥0.80—128K16K——
文本
性价比FunctionCall
使用 →
GLM-5.3-Flash🇨🇳智谱 AI
自动核对: 2026-09-28
—
#311.20T
¥0.80¥2.80¥0.231.0M128K——
文本
快速性价比
使用 →
文心 ERNIE X1 Turbo🇨🇳百度文心
人工监控: 2026-09-28
——¥1.00¥4.00—128K16K——
文本
推理深度思考
使用 →
混元 T1🇨🇳腾讯混元
人工监控: 2026-09-28
——¥1.00¥4.00—64K16K——
文本
推理
使用 →
MiMo-V2.5🇨🇳小米 MiMo
人工监控: 2026-09-28
——¥1.00¥2.00¥0.02262K32K——
文本
高性价比
使用 →
混元 Hy3🇨🇳腾讯混元
人工监控: 2026-09-28
——¥1.00¥4.00¥0.25262K32K——
文本
高性价比Agent
使用 →
MiMo-V2.6 Flash🇨🇳小米 MiMo
人工监控: 2026-09-28
—
#410.90T
¥1.00¥2.00¥0.02262K32K——
文本
高性价比新发布
使用 →
GPT-5.6 Luna🇺🇸OpenAI
人工监控: 2026-09-28
——¥1.34$0.20阶梯▲¥8.05$1.20¥0.131.1M128K2026-02—
文本视觉
快速极便宜
使用 →
Step 3.7 Flash🇨🇳阶跃星辰
人工监控: 2026-09-28
——¥1.35¥8.10¥0.27131K32K——
文本
高性价比
使用 →
Spark X2.5🇨🇳讯飞星火
自动核对: 2026-09-28
——¥1.60¥6.00¥0.241.0M32K——
文本
旗舰新发布Agent
使用 →
Gemini 3.1 Flash-Lite🇺🇸Google
人工监控: 2026-09-28
34—¥1.68$0.25¥10.06$1.50¥0.171.0M64K2025-01★ 58
文本视觉
极便宜快速
使用 →
DeepSeek V4 Flash🇨🇳DeepSeek
自动核对: 2026-10-10
47—¥2.00峰时默认 · 空闲 ¥1.00¥8.00峰时默认 · 空闲 ¥4.00¥0.04峰时默认 · 空闲 ¥0.021.0M384K—★ 94
文本
国产之光极便宜长上下文
使用 →
DeepSeek V3.2🇨🇳DeepSeek
自动核对: 2026-10-10
——¥2.00¥8.00¥0.50128K8K——
文本
已下线(官方)2026-07-24 已下线
使用 →
GLM-4.7🇨🇳智谱 AI
自动核对: 2026-09-28
——¥2.00阶梯▲¥8.00¥0.40200K16K——
文本
性价比
使用 →
Spark X2🇨🇳讯飞星火
自动核对: 2026-09-28
——¥2.00¥2.00—200K16K——
文本
旗舰推理
使用 →
Spark X2 Flash🇨🇳讯飞星火
自动核对: 2026-09-28
——¥2.00¥2.00—200K16K——
文本
推理快速性价比
使用 →
Baichuan M2🇨🇳百川智能
自动核对: 2026-10-10
——¥2.00¥20.00—192K16K——
文本
性价比
使用 →
GLM-5.3-FlashX🇨🇳智谱 AI
自动核对: 2026-09-28
——¥2.00¥7.00¥0.571.0M128K——
文本
快速性价比
使用 →
Gemini 2.5 Flash🇺🇸Google
人工监控: 2026-09-28
——¥2.01$0.30¥16.77$2.50¥0.201.0M64K——
文本视觉音频
快速性价比
使用 →
MiniMax M3🇨🇳MiniMax
自动核对: 2026-10-10
55—¥2.10阶梯▲¥8.40¥0.421.0M64K—★ 105
文本
Agent代码长上下文旗舰
使用 →
MiniMax M2.7🇨🇳MiniMax
自动核对: 2026-10-10
50—¥2.10¥8.40¥0.421.0M64K—★ 95
文本
Agent代码性价比
使用 →
Qwen3 Max🇨🇳阿里通义
自动核对: 2026-10-10
——¥2.50阶梯▲¥10.00—256K32K——
文本视觉
性价比
使用 →
MiMo-V2.6 Pro🇨🇳小米 MiMo
人工监控: 2026-09-28
——¥3.00¥6.00¥0.03262K32K——
文本
旗舰新发布
使用 →
混元 2.0 Think🇨🇳腾讯混元
人工监控: 2026-09-28
——¥3.98¥15.90—128K16K——
文本
旗舰推理
使用 →
GLM-5🇨🇳智谱 AI
自动核对: 2026-09-28
——¥4.00阶梯▲¥18.00¥1.00200K16K——
文本视觉
旗舰
使用 →
文心 ERNIE 5.1🇨🇳百度文心
人工监控: 2026-09-28
——¥4.00阶梯▲¥18.00—128K16K——
文本视觉
旗舰
使用 →
MiniMax M2.7 Highspeed🇨🇳MiniMax
自动核对: 2026-10-10
——¥4.20¥16.80¥0.421.0M64K——
文本
Agent代码快速
使用 →
Spark Pro🇨🇳讯飞星火
自动核对: 2026-09-28
——¥5.00¥5.00—128K16K——
文本
强性能
使用 →
Baichuan M3 Plus🇨🇳百川智能
自动核对: 2026-10-10
——¥5.00¥9.00—192K16K——
文本
医疗旗舰
使用 →
Gemini 3.7 Flash🇺🇸Google
人工监控: 2026-09-28
——¥5.03$0.75¥25.15$3.75¥0.501.0M64K——
文本视觉音频
快速多模态Agent代码
使用 →
Gemini 3.6 Flash🇺🇸Google
人工监控: 2026-09-28
——¥5.03$0.75¥25.15$3.75¥0.501.0M66K2026-03—
文本视觉音频
快速多模态上代
使用 →
Gemini 3.8 Flash🇺🇸Google
人工监控: 2026-09-28
——¥5.03$0.75¥25.15$3.75¥0.501.0M66K——
文本视觉音频
快速多模态Agent代码新发布
使用 →
GLM-5.1🇨🇳智谱 AI
自动核对: 2026-09-28
51—¥6.00阶梯▲¥24.00¥1.30200K16K—34
文本
旗舰推理新发布
使用 →
Doubao Seed 2.1 Pro🇨🇳字节豆包
人工监控: 2026-09-28
——¥6.00¥30.00¥1.20256K32K——
文本视觉
旗舰推理新发布
使用 →
混元 Hy4 Preview🇨🇳腾讯混元
人工监控: 2026-09-28
——¥6.00¥18.00¥0.30262K32K——
文本
旗舰新发布
使用 →
Kimi K2.6🇨🇳Moonshot / Kimi
自动核对: 2026-10-10
54—¥6.50¥27.00¥1.10262K32K—32
文本视觉
旗舰长上下文Agent
使用 →
Kimi K2.7 Code🇨🇳Moonshot / Kimi
自动核对: 2026-10-10
——¥6.50¥27.00¥1.30262K32K——
文本视觉
代码长上下文Agent新发布
使用 →
Claude Haiku 4.5🇺🇸Anthropic
人工监控: 2026-09-28
37—¥6.71$1.00¥33.53$5.00¥0.67200K32K—18
文本视觉
快速
使用 →
Grok Build 0.1🇺🇸xAI
人工监控: 2026-09-28
——¥6.71$1.00阶梯▲¥13.41$2.00¥1.34256K64K——
文本
代码快速
使用 →
GLM-5.2🇨🇳智谱 AI
自动核对: 2026-09-28
——¥8.00¥28.00¥2.001.0M128K——
文本
旗舰推理
使用 →
GLM-5.3🇨🇳智谱 AI
自动核对: 2026-09-28
—
#103.42T
¥8.00¥28.00¥2.001.0M128K——
文本
旗舰推理新发布
使用 →
GPT-5.1🇺🇸OpenAI
人工监控: 2026-09-28
——¥8.38$1.25¥67.06$10.00¥0.84400K128K2024-09—
文本视觉
快速
使用 →
Gemini 2.5 Pro🇺🇸Google
人工监控: 2026-09-28
35—¥8.38$1.25阶梯▲¥67.06$10.00¥0.842.0M64K—9
文本视觉音频
长上下文
使用 →
Grok 4.3🇺🇸xAI
人工监控: 2026-09-28
53—¥8.38$1.25阶梯▲¥16.77$2.50¥1.341.0M64K2024-1142
文本视觉
旗舰推理
使用 →
Grok 4.20 Multi-Agent🇺🇸xAI
人工监控: 2026-09-28
——¥8.38$1.25阶梯▲¥16.77$2.50¥1.341.0M64K——
文本
Agent长上下文
使用 →
Grok 4.20 Reasoning🇺🇸xAI
人工监控: 2026-09-28
——¥8.38$1.25阶梯▲¥16.77$2.50¥1.341.0M64K——
文本
推理长上下文
使用 →
Grok 4.20 Non-Reasoning🇺🇸xAI
人工监控: 2026-09-28
——¥8.38$1.25阶梯▲¥16.77$2.50¥1.341.0M64K——
文本
快速长上下文
使用 →
DeepSeek V4 Pro🇨🇳DeepSeek
自动核对: 2026-10-10
52—¥9.00峰时默认 · 空闲 ¥4.50¥27.00峰时默认 · 空闲 ¥13.50¥0.30峰时默认 · 空闲 ¥0.151.0M384K—29
文本
旗舰推理长上下文
使用 →
Qwen3.6 Max Preview🇨🇳阿里通义
自动核对: 2026-10-10
——¥9.00阶梯▲¥54.00—256K32K——
文本视觉
旗舰推理
使用 →
Gemini 3.5 Flash🇺🇸Google
人工监控: 2026-09-28
55—¥10.06$1.50¥60.36$9.00¥1.011.0M64K—16
文本视觉音频
快速多模态上代
使用 →
Qwen3.7 Max🇨🇳阿里通义
自动核对: 2026-10-10
57—¥12.00¥36.00—1.0M32K—24
文本视觉
旗舰Agent长上下文新发布
使用 →
Qwen3.8 Max🇨🇳阿里通义
自动核对: 2026-10-10
——¥12.00¥36.00—1.0M32K——
文本视觉
旗舰Agent长上下文新发布
使用 →
Kimi K2.7 Code Highspeed🇨🇳Moonshot / Kimi
自动核对: 2026-10-10
——¥13.00¥54.00¥2.60262K32K——
文本视觉
代码长上下文Agent快速
使用 →
GPT-5.6 Terra🇺🇸OpenAI
人工监控: 2026-09-28
——¥13.41$2.00阶梯▲¥80.48$12.00¥1.341.1M128K2026-02—
文本视觉
性价比
使用 →
Claude Sonnet 5🇺🇸Anthropic
人工监控: 2026-09-28
57—¥13.41$2.00¥67.06$10.00¥1.341.0M128K2026-0114
文本视觉
性价比代码长上下文
使用 →
Gemini 3.1 Pro Preview🇺🇸Google
人工监控: 2026-09-28
57—¥13.41$2.00阶梯▲¥80.48$12.00¥1.342.0M64K2025-0112
文本视觉音频
旗舰长上下文多模态
使用 →
Grok 4.7🇺🇸xAI
人工监控: 2026-09-28
——¥13.41$2.00阶梯▲¥40.24$6.00¥3.35500K64K——
文本视觉
旗舰推理长上下文新发布
使用 →
Grok 4.6🇺🇸xAI
人工监控: 2026-09-28
——¥13.41$2.00阶梯▲¥40.24$6.00¥3.35500K64K——
文本视觉
旗舰推理长上下文
使用 →
Grok 4.5🇺🇸xAI
人工监控: 2026-09-28
——¥13.41$2.00阶梯▲¥40.24$6.00¥2.01500K64K——
文本视觉
旗舰推理长上下文
使用 →
GPT-5.4🇺🇸OpenAI
人工监控: 2026-09-28
——¥16.77$2.50阶梯▲¥100.60$15.00¥1.68400K128K2025-08—
文本视觉
性价比
使用 →
Kimi K3🇨🇳Moonshot / Kimi
自动核对: 2026-10-10
——¥20.00¥100.00¥2.001.0M32K——
文本
旗舰长上下文推理
使用 →
Claude Sonnet 4.6🇺🇸Anthropic
人工监控: 2026-09-28
52—¥20.12$3.00¥100.60$15.00¥2.011.0M64K—9
文本视觉
性价比长上下文代码
使用 →
Qwen3.8 Max Prime🇨🇳阿里通义
自动核对: 2026-10-10
——¥24.00¥72.00—1.0M32K——
文本视觉
旗舰Agent长上下文顶配
使用 →
GPT-5.6 Sol🇺🇸OpenAI
人工监控: 2026-09-28
61—¥26.83$4.00阶梯▲¥134.13$20.00¥2.681.1M128K2026-028
文本视觉
旗舰推理
使用 →
Claude Opus 5.5🇺🇸Anthropic
人工监控: 2026-09-28
—
#94.32T
¥26.83$4.00¥134.13$20.00¥1.341.0M128K2026-06—
文本视觉
旗舰推理代码长上下文新发布
使用 →
MiMo-V2.6 Pro Ultraspeed🇨🇳小米 MiMo
人工监控: 2026-09-28
——¥30.00¥60.00¥0.25262K32K——
文本
旗舰快速新发布
使用 →
GPT-5.5🇺🇸OpenAI
人工监控: 2026-09-28
60—¥33.53$5.00阶梯▲¥201.19$30.00¥3.35400K128K2025-125
文本视觉
旗舰推理
使用 →
Claude Opus 4.8🇺🇸Anthropic
人工监控: 2026-09-28
61—¥33.53$5.00¥167.66$25.00¥3.351.0M64K2026-016
文本视觉
长上下文代码推理上代旗舰
使用 →
Claude Opus 5🇺🇸Anthropic
人工监控: 2026-09-28
63—¥33.53$5.00¥167.66$25.00¥3.351.0M128K2026-056
文本视觉
旗舰推理代码长上下文
使用 →
Claude Opus 4.7🇺🇸Anthropic
人工监控: 2026-09-28
57—¥33.53$5.00¥167.66$25.00¥3.351.0M64K2026-016
文本视觉
长上下文代码上代
使用 →
Claude Fable 5.1🇺🇸Anthropic
人工监控: 2026-09-28
66—¥67.06$10.00¥335.32$50.00¥1.681.0M128K2026-013
文本视觉
旗舰推理代码长上下文
使用 →
Claude Fable 5🇺🇸Anthropic
人工监控: 2026-09-28
60—¥67.06$10.00¥335.32$50.00¥6.711.0M128K2026-013
文本视觉
推理代码长上下文上代
使用 →
Claude Mythos 5.1🇺🇸Anthropic
人工监控: 2026-09-28
——¥67.06$10.00¥335.32$50.00¥1.681.0M128K2026-06—
文本视觉
旗舰推理邀请制
使用 →
省心之选

懒得逐家注册?一个 key 调所有模型

不想各家分别注册、各自充值、各管各的 key?用 AIMLAPI 一个 key 直连数百个模型,按量计费、随时切换。比价完想省事就走它。

了解 AIMLAPI →

含推广 · 通过此链接注册我们可能获得返佣,不影响你的价格

怎么挑一个最划算的大模型?

第一步,分清「输入价」和「输出价」。几乎所有 LLM 厂商都按 token 计费,但输入 token(你发给模型的) 和输出 token(模型生成的)单价不一样,通常输出贵 4–10 倍。所以「短问长答」类任务(写文章、生成代码)成本主要取决于输出价, 而「长问短答」类任务(文档摘要、分类)则看输入价。

第二步,看缓存价。如果你的应用有大量重复的 system prompt 或文档上下文(比如客服机器人、 RAG),缓存命中后输入价能降到 10–20%。DeepSeek、OpenAI、Anthropic、 Google 都支持上下文缓存,但价格差异巨大。

第三步,看任务复杂度。不要默认用旗舰模型。Claude Haiku 4.5、Gemini 2.5 Flash-Lite、Qwen3.5 Flash、 DeepSeek V4 Flash 这些「腰部模型」性价比极高,对话、翻译、简单生成、分类 这些任务完全够用,成本只有旗舰的 1–5%。

第四步,国产 vs 海外。如果用户在中国大陆,访问 DeepSeek、Kimi、通义、豆包延迟低(~50ms vs ~500ms),且不需要科学上网。Qwen3.5 Flash 首档为 ¥0.20/¥2;DeepSeek V4 Flash 按北京时间分时(峰时 ¥3/¥9、空闲 ¥1.5/¥4.5);Gemini 2.5 Flash-Lite 是海外低价选项。实际成本要结合单次输入档位和调用时段。

第五步,用估算器算总账。单价只是 nominal,真实月账单取决于调用次数 × 单次 token 量。 把你典型任务的 prompt 粘到 Token 估算器,瞬间看清各家月成本差距。

常见问题

输入价、输出价、缓存价,一次调用到底按哪个收?

三个一起收,分别算。你发进去的内容按输入价计费(命中缓存的那部分改按更便宜的缓存价),模型生成的内容按输出价计费,最后相加就是这次调用的费用。所以同一个模型对不同任务的实际成本差别很大:长文档摘要主要花在输入,写长文主要花在输出,重复前缀多的应用则靠缓存把输入那块压下来。

为什么输出价普遍比输入价贵好几倍?

因为生成比读取更耗算力。模型读输入是一次性并行处理,而生成输出是一个 token 一个 token 自回归解码出来的,计算量大得多,厂商定价也就随之拉高,常见是输入价的 4 到 10 倍。实际影响是:凡是「让模型多写」的任务,省钱的重点不是换便宜模型,而是先想办法让它少写——限定长度、只要结果不要解释,往往立竿见影。

缓存价那么便宜,是不是我用了缓存就一定省钱?

不一定,要看你的请求结构。缓存通常只对「重复的前缀」生效,且要达到最小 token 门槛、两次请求间隔不能太久,部分厂商首次写入缓存还会单独收一笔。如果你每次 prompt 开头都不一样(比如把用户输入放在最前面),就基本命中不了。想吃到缓存红利,正确做法是把固定不变的内容(system prompt、文档、工具定义)放在最前面,变动的用户输入放最后。

上下文窗口越大越好吗?为什么大窗口反而可能更费钱?

窗口大解决的是「能不能装下」,不解决「该不该装满」。你塞进窗口的每个 token 都按输入价计费,把整本手册一次性丢进去,既增加费用又可能分散模型注意力、降低回答质量。更划算的通常是「精准检索只取相关片段 + 把固定前缀做成缓存」。大窗口的真正价值在于那些确实无法切分的任务,比如通读一份长合同或整个代码库。

推理/思考模型标的输出价看着不贵,为什么账单更高?

因为带「思考」「推理」模式的模型在给出最终答案前,会先生成一大段你通常看不到的思维链,而这些思维 token 一般也按输出价计费。也就是说你为「它在想的过程」也付了钱。所以评估这类模型不能只看挂牌的输出单价,要结合它在你任务上实际产生多少思维 token——同样一道题,思维链越长,隐性成本越高。对不需要复杂推理的任务,直接用非推理模型往往更省。

同一个模型,为什么不同地方报价不一样?算盘列的是哪个价?

因为同一个模型可以通过官方 API、聚合平台(如 OpenRouter)、云厂商托管(如火山方舟、阿里云百炼)等多个渠道调用,各渠道定价、汇率折算、促销策略都不同,价差有时不小。本站价格表默认展示官方定价作为基准,另设了「渠道比价」页专门把同一模型在各渠道的实测价并排列出来,每个价都标了核对日期和来源,方便你找到当下最便宜的调用方式。

算盘上的价格多久更新一次?可靠吗?

国产主力厂商接了每日自动核价,海外(美元计费)厂商按当日实时汇率折算,每个价格都记录了最近核对日期和核对方式。但模型定价变动频繁、各家也常有限时促销,本站只做对比和换算,任何价格最终都以厂商官方文档为准。算盘是独立开发者做的工具站,不隶属也不代表任何厂商;如果你发现某个数字和官方对不上,欢迎指出,会尽快更正。