跳到主内容
算盘
价格最近核对 2026-08-03 · 旗舰厂商每日核对

算盘·LLM Abacus

中文优先的 AI 大模型价格对比。一张表看清 55 个主流模型,30 秒回答「跑哪个最便宜」。

算盘(LLM Abacus)是一个每日核对的 AI 大模型 API 价格对比与 Token 成本估算平台。全量收录 Claude Opus 5、GPT-5.6 Sol、Gemini 3.6 Flash、DeepSeek V4、Kimi K3、Qwen3.7 等 55+ 主流模型的最新输入、输出及提示词缓存单价,价格数据每日核对,最近更新:

55个模型
33 / 22国产 / 海外
每日汇率/旗舰核价
¥ + $双币种

最近价格变动

厂商降价/涨价/发布动态,按人民币折算展示。国产价直连官方页自动核对,发现变动即更新。

已下线2026-07DeepSeek V3.2

DeepSeek 旧模型名 deepseek-chat / deepseek-reasoner 已按官方公告于北京时间 2026-07-24 23:59 下线,官方价格页现仅列 deepseek-v4-flash(¥0.02 缓存命中 / ¥1 输入 / ¥2 输出)与 deepseek-v4-pro(¥0.025 / ¥3 / ¥6),不再提供 V3.2 的计费入口(2026-07-25 复核官方页;页面脚注文案尚未改写,仍为下线前的措辞)。V3.2 权重开源,OpenRouter 等第三方渠道仍在售,站内条目保留作历史存档与迁移对照,新项目请直接用 V4 显式模型名。

新发布2026-07GPT-5.6 Sol

OpenAI 发布 GPT-5.6 系列三档(2026-07-09):Sol $5/$30、Terra $2.50/$15、Luna $1/$6(均含 1.05M 上下文 / 128K 最大输出,知识截止 2026-02)。Sol 为旗舰档,AA 智能指数 59 分,阶梯价在 272K 输入阈值以上翻倍至 $10/$45。

降价2026-07GPT-5.6 Terra
输入 ¥16.90¥13.52-20%输出 ¥101¥81.12-20%

OpenAI 于 2026-07-30 对 GPT-5.6 Terra 永久降价 20%($2.50→$2 输入,$15→$12 输出),缓存读取随之降至 $0.20/M。

降价2026-07GPT-5.6 Luna
输入 ¥6.76¥1.35-80%输出 ¥40.56¥8.11-80%

OpenAI 于 2026-07-30 对 GPT-5.6 Luna 永久降价 80%($1→$0.20 输入,$6→$1.20 输出),缓存读取降至 $0.02/M,长上下文性价比直逼 DeepSeek V4 Flash。

全球用量热度榜

OpenRouter 周 token 用量(2026-07-31 自动核对)——海外开发者真实用量,反映热度而非质量;国产模型走国内端点的用量不计入。 仅显示本站收录且当周在榜的模型,掉出榜单即不再显示名次。

看渠道比价 →

仅展示本站收录的模型在 OpenRouter 周榜中的名次;完整榜单见 openrouter.ai/rankings。榜上多为海外可直连模型,本站收录的国产模型走国内端点、不进此榜。

模型价格表

默认按输入价升序,便宜的在最上面

55 / 55 个模型 · 价格单位 ¥/百万 tokens(海外厂商附 $ 美元原价,按 1 USD = 6.7598 换算)· 点击表头列名可排序 · 绿色高亮 = 最便宜 · 性价比↑ = 质量/价格比最高(需有质量评分) · 热度 = OpenRouter 周榜名次(token 用量,反映海外开发者实际用量而非质量;国产模型国内端点用量不经 OR,仅供参考)

模型 厂商质量 热度 输入价 输出价 缓存价上下文 最大输出知识截止性价比 模态标签去试用
Qwen3.5 Flash🇨🇳阿里通义
自动核对: 2026-08-03
¥0.20阶梯▲¥2.001.0M16K
文本
极便宜快速
使用 →
Gemini 2.5 Flash-Lite🇺🇸Google
人工监控: 2026-08-01
¥0.68$0.10¥2.70$0.40¥0.071.0M64K
文本视觉
极便宜快速
使用 →
Qwen3.5 Plus🇨🇳阿里通义
自动核对: 2026-08-03
¥0.80阶梯▲¥4.801.0M32K
文本视觉
性价比新发布
使用 →
Doubao 1.6🇨🇳字节豆包
人工监控: 2026-07-03>14天未核
¥0.80阶梯▲¥8.00¥0.16256K16K
文本视觉音频
多模态上代
使用 →
Doubao 1.5 Pro🇨🇳字节豆包
人工监控: 2026-07-03>14天未核
¥0.80¥2.00¥0.16256K12K
文本视觉
极便宜上代
使用 →
文心 ERNIE 4.5 Turbo🇨🇳百度文心
人工监控: 2026-06-05>14天未核
¥0.80¥3.20¥0.20128K16K
文本视觉
性价比快速
使用 →
混元 TurboS🇨🇳腾讯混元
人工监控: 2026-06-05>14天未核
¥0.80¥2.00256K16K
文本
性价比快速
使用 →
DeepSeek V4 Flash🇨🇳DeepSeek
自动核对: 2026-08-03
47
#27.57T
¥1.00¥2.00¥0.021.0M384K313
文本
国产之光极便宜长上下文
使用 →
文心 ERNIE X1 Turbo🇨🇳百度文心
人工监控: 2026-06-05>14天未核
¥1.00¥4.00128K16K
文本
推理深度思考
使用 →
混元 T1🇨🇳腾讯混元
人工监控: 2026-06-05>14天未核
¥1.00¥4.0064K16K
文本
推理
使用 →
MiMo-V2.5🇨🇳小米 MiMo
人工监控: 2026-07-31
#18.90T
¥1.00¥2.00¥0.02262K32K
文本
高性价比
使用 →
混元 Hy3🇨🇳腾讯混元
人工监控: 2026-06-05>14天未核
#34.79T
¥1.00¥4.00¥0.25262K32K
文本
高性价比Agent
使用 →
Step 3.7 Flash🇨🇳阶跃星辰
人工监控: 2026-07-31
#81.74T
¥1.35¥8.10131K32K
文本
高性价比
使用 →
GPT-5.6 Luna🇺🇸OpenAI
人工监控: 2026-08-01
¥1.35$0.20阶梯▲¥8.11$1.20¥0.141.1M128K2026-02
文本视觉
快速极便宜
使用 →
Gemini 3.1 Flash-Lite🇺🇸Google
人工监控: 2026-08-01
34¥1.69$0.25¥10.14$1.50¥0.171.0M64K2025-0157
文本视觉
极便宜快速
使用 →
DeepSeek V3.2🇨🇳DeepSeek
自动核对: 2026-08-03
¥2.00¥8.00¥0.50128K8K
文本
已下线(官方)2026-07-24 已下线
使用 →
GLM-4.7🇨🇳智谱 AI
自动核对: 2026-08-01
¥2.00阶梯▲¥8.00¥0.40200K16K
文本
性价比
使用 →
Spark X2 Flash🇨🇳讯飞星火
人工监控: 2026-06-05>14天未核
¥2.00¥2.00200K16K
文本
推理快速性价比
使用 →
Spark Ultra🇨🇳讯飞星火
人工监控: 2026-06-05>14天未核
¥2.00¥2.00128K16K
文本
性价比FunctionCall
使用 →
Baichuan M2🇨🇳百川智能
人工监控: 2026-06-05>14天未核
¥2.00¥20.00192K16K
文本
性价比
使用 →
Gemini 2.5 Flash🇺🇸Google
人工监控: 2026-08-01
¥2.03$0.30¥16.90$2.50¥0.201.0M64K
文本视觉音频
快速性价比
使用 →
MiniMax M2.7🇨🇳MiniMax
人工监控: 2026-06-05>14天未核
50¥2.10¥8.40¥0.421.0M64K95
文本
Agent代码性价比
使用 →
Qwen3 Max🇨🇳阿里通义
自动核对: 2026-08-03
¥2.50阶梯▲¥10.00256K32K
文本视觉
性价比
使用 →
DeepSeek V4 Pro🇨🇳DeepSeek
自动核对: 2026-08-03
52
#43.59T
¥3.00¥6.00¥0.031.0M384K116
文本
旗舰推理长上下文
使用 →
Spark X2🇨🇳讯飞星火
人工监控: 2026-06-05>14天未核
¥3.00¥3.00200K16K
文本
旗舰推理
使用 →
混元 2.0 Think🇨🇳腾讯混元
人工监控: 2026-06-05>14天未核
¥3.98¥15.90128K16K
文本
旗舰推理
使用 →
GLM-5🇨🇳智谱 AI
自动核对: 2026-08-01
¥4.00阶梯▲¥18.00¥1.00200K16K
文本视觉
旗舰
使用 →
文心 ERNIE 5.1🇨🇳百度文心
人工监控: 2026-06-05>14天未核
¥4.00阶梯▲¥18.00128K16K
文本视觉
旗舰
使用 →
MiniMax M3🇨🇳MiniMax
人工监控: 2026-06-05>14天未核
55
#72.02T
¥4.20阶梯▲¥16.80¥0.841.0M64K52
文本
Agent代码长上下文旗舰
使用 →
Baichuan M3 Plus🇨🇳百川智能
人工监控: 2026-06-05>14天未核
¥5.00¥9.00192K16K
文本
医疗旗舰
使用 →
GLM-5.1🇨🇳智谱 AI
自动核对: 2026-08-01
51¥6.00阶梯▲¥24.00¥1.30200K16K34
文本
旗舰推理新发布
使用 →
Doubao Seed 2.1 Pro🇨🇳字节豆包
人工监控: 2026-07-03>14天未核
¥6.00¥30.00¥1.20256K32K
文本视觉
旗舰推理新发布
使用 →
Kimi K2.6🇨🇳Moonshot / Kimi
自动核对: 2026-08-01
54¥6.50¥27.00¥1.10262K32K32
文本视觉
旗舰长上下文Agent
使用 →
Claude Haiku 4.5🇺🇸Anthropic
人工监控: 2026-08-01
37¥6.76$1.00¥33.80$5.00¥0.68200K32K18
文本视觉
快速
使用 →
Grok Build 0.1🇺🇸xAI
人工监控: 2026-08-01
¥6.76$1.00阶梯▲¥13.52$2.00¥1.35256K64K
文本
代码快速
使用 →
Spark Pro🇨🇳讯飞星火
人工监控: 2026-06-05>14天未核
¥7.00¥7.00128K16K
文本
强性能
使用 →
GLM-5.2🇨🇳智谱 AI
自动核对: 2026-08-01
#53.24T
¥8.00¥28.001.0M128K
文本
旗舰推理
使用 →
GPT-5.1🇺🇸OpenAI
人工监控: 2026-08-01
¥8.45$1.25¥67.60$10.00¥0.84400K128K2024-09
文本视觉
快速
使用 →
Gemini 2.5 Pro🇺🇸Google
人工监控: 2026-08-01
35¥8.45$1.25阶梯▲¥67.60$10.00¥0.842.0M64K9
文本视觉音频
长上下文
使用 →
Grok 4.3🇺🇸xAI
人工监控: 2026-08-01
53¥8.45$1.25阶梯▲¥16.90$2.50¥1.351.0M64K2024-1142
文本视觉
旗舰推理
使用 →
Gemini 3.6 Flash🇺🇸Google
人工监控: 2026-08-01
¥10.14$1.50¥50.70$7.50¥1.011.0M66K2026-03
文本视觉音频
快速多模态
使用 →
Gemini 3.5 Flash🇺🇸Google
人工监控: 2026-08-01
55¥10.14$1.50¥60.84$9.00¥1.011.0M64K15
文本视觉音频
快速多模态上代
使用 →
Qwen3.7 Max🇨🇳阿里通义
自动核对: 2026-08-03
57¥12.00¥36.001.0M32K24
文本视觉
旗舰Agent长上下文新发布
使用 →
GPT-5.6 Terra🇺🇸OpenAI
人工监控: 2026-08-01
¥13.52$2.00阶梯▲¥81.12$12.00¥1.351.1M128K2026-02
文本视觉
性价比
使用 →
Claude Sonnet 5🇺🇸Anthropic
人工监控: 2026-08-01
57¥13.52$2.00¥67.60$10.00¥1.351.0M128K2026-0114
文本视觉
性价比代码长上下文
使用 →
Gemini 3.1 Pro Preview🇺🇸Google
人工监控: 2026-08-01
57¥13.52$2.00阶梯▲¥81.12$12.00¥1.352.0M64K2025-0112
文本视觉音频
旗舰长上下文多模态
使用 →
GPT-5.4🇺🇸OpenAI
人工监控: 2026-08-01
¥16.90$2.50阶梯▲¥101.40$15.00¥1.69400K128K2025-08
文本视觉
性价比
使用 →
Kimi K3🇨🇳Moonshot / Kimi
自动核对: 2026-08-01
#91.34T
¥20.00¥100.00¥2.001.0M32K
文本
旗舰长上下文推理
使用 →
Claude Sonnet 4.6🇺🇸Anthropic
人工监控: 2026-08-01
52¥20.28$3.00¥101.40$15.00¥2.031.0M64K9
文本视觉
性价比长上下文代码
使用 →
GPT-5.5🇺🇸OpenAI
人工监控: 2026-08-01
60¥33.80$5.00阶梯▲¥202.79$30.00¥3.38400K128K2025-125
文本视觉
旗舰推理
使用 →
GPT-5.6 Sol🇺🇸OpenAI
人工监控: 2026-08-01
59¥33.80$5.00阶梯▲¥202.79$30.00¥3.381.1M128K2026-025
文本视觉
旗舰推理
使用 →
Claude Opus 4.8🇺🇸Anthropic
人工监控: 2026-08-01
61¥33.80$5.00¥169.00$25.00¥3.381.0M64K2026-016
文本视觉
长上下文代码推理上代旗舰
使用 →
Claude Opus 5🇺🇸Anthropic
人工监控: 2026-08-01
61¥33.80$5.00¥169.00$25.00¥3.381.0M128K2026-056
文本视觉
旗舰推理代码长上下文
使用 →
Claude Opus 4.7🇺🇸Anthropic
人工监控: 2026-08-01
57¥33.80$5.00¥169.00$25.00¥3.381.0M64K2026-016
文本视觉
长上下文代码上代
使用 →
Claude Fable 5🇺🇸Anthropic
人工监控: 2026-08-01
60¥67.60$10.00¥337.99$50.00¥6.761.0M128K2026-013
文本视觉
旗舰推理代码长上下文
使用 →

价格单位:人民币 / 百万 tokens。USD 计费厂商(currency=USD,含 OpenAI/Anthropic/Google/xAI/MiniMax)按官方美元原价存储,加载时乘 usdToCny(每日核对实时汇率、变动即更新,最近校准日期见 usdToCnyUpdated 字段)换算成 CNY;CNY 计费厂商按中国区官方人民币定价存储(不随汇率浮动)。最终以各厂商官方文档为准。2026-08 版:新增 GPT-5.6 系列三档(Sol $5/$30、Terra $2/$12、Luna $0.20/$1.20;三档共享 1.05M 上下文 / 128K 最大输出;2026-07-09 发布,Terra / Luna 于 2026-07-30 永久降价);新增 Claude Sonnet 5($2/$10,1M 上下文 / 128K 最大输出,2026-06-30 发布,现行优惠价至 2026-08-31);新增 Claude Opus 5($5/$25,1M 上下文 / 128K 最大输出,2026-07-24 发布,当前 Anthropic 旗舰,AA 智能指数 61 分);新增 Gemini 3.6 Flash($1.50/$7.50,1M 上下文,知识截止 2026-03,2026-07-21 发布);Fable 5 补全 AA 智能指数 60 分;汇率更新 6.7649(2026-08-01);2026-08-02 按 OpenAI 官方定价页补录 GPT-5.6 三档的 Fast 加速档(标准价 2 倍,能力不变,取代原 Priority Processing)与 Terra / Luna 此前缺失的 272K 长上下文阶梯价。 加速档口径:fastMode 为可选加速服务档,不参与默认显示价与排序,表格与详情页顶部一律显示标准价;OpenAI 官方 Fast 档未列长上下文分档,Anthropic Fast 档则明确覆盖全上下文窗口。 2026-08-02 全库分档普查(覆盖 OpenAI / Anthropic / Google / xAI / DeepSeek / 阿里通义 / Kimi 七家官方定价页):补 Grok Build 0.1 的 200K 分档(xAI 全线长上下文计价)与 Claude Opus 5 / 4.8 的 Fast 档;移除 Claude Sonnet 4.6 依据第三方数据集误录的 >200K 翻倍档(官方两处文档明确 Claude 4.6+ 的 1M 窗口按标准价结算);核实确认为单一价的有 Gemini Flash 全系、GPT-5.1、Claude 其余各档、DeepSeek V4 双档、Kimi K3、Qwen3.7 Max。同日续查国产九家官方页:补录 GLM-5.1 / GLM-5 / GLM-4.7 的 32K 分档、文心 ERNIE 5.1 的 32K 分档、MiniMax M3 的 512K 分档,并修正 Doubao 1.6 误将最高档(128K-256K)当默认价的问题(2.4/24 → 首档 0.8/8);核实为单一价的有 GLM-5.2、Doubao Seed 2.1 Pro、Doubao 1.5 Pro、ERNIE 4.5 Turbo、MiniMax M2.7、百川双档、小米 MiMo-V2.5。腾讯混元四档(TurboS / T1 / 2.0 Think / Hy3)、讯飞星火四档、阶跃 Step 3.7 Flash 的分档情况仍未核实——腾讯官方计费页未列这四个型号,讯飞与阶跃定价页本次不可达。 阶梯价口径:tiers 按单次请求输入 tokens 所在档对整单计价(百炼计费规则页原文:「单价取决于单次请求的输入 Token 总量,该请求的所有 Token 均按对应阶梯的单价结算」);档位阈值中的 K=1000、M=1000000(非 1024 进制,官方明示),首档=表格默认显示价;无 tiers 字段=该模型单一价或分档待核。

省心之选

懒得逐家注册?一个 key 调所有模型

不想各家分别注册、各自充值、各管各的 key?用 AIMLAPI 一个 key 直连数百个模型,按量计费、随时切换。比价完想省事就走它。

了解 AIMLAPI →

含推广 · 通过此链接注册我们可能获得返佣,不影响你的价格

怎么挑一个最划算的大模型?

第一步,分清「输入价」和「输出价」。几乎所有 LLM 厂商都按 token 计费,但输入 token(你发给模型的) 和输出 token(模型生成的)单价不一样,通常输出贵 4–10 倍。所以「短问长答」类任务(写文章、生成代码)成本主要取决于输出价, 而「长问短答」类任务(文档摘要、分类)则看输入价

第二步,看缓存价。如果你的应用有大量重复的 system prompt 或文档上下文(比如客服机器人、 RAG),缓存命中后输入价能降到 10–20%。DeepSeek、OpenAI、Anthropic、 Google 都支持上下文缓存,但价格差异巨大。

第三步,看任务复杂度。不要默认用旗舰模型。Claude Haiku 4.5、Gemini 2.5 Flash-Lite、Qwen3.5 Flash、 DeepSeek V4 Flash 这些「腰部模型」性价比极高,对话、翻译、简单生成、分类 这些任务完全够用,成本只有旗舰的 1–5%。

第四步,国产 vs 海外。如果用户在中国大陆,访问 DeepSeek、Kimi、通义、豆包延迟低(~50ms vs ~500ms),且不需要科学上网。Qwen3.5 Flash(¥0.20/¥2)和 DeepSeek V4 Flash (¥1/¥2)是当前最便宜的两个,Gemini 2.5 Flash-Lite 则是海外最便宜的选项。

第五步,用估算器算总账。单价只是 nominal,真实月账单取决于调用次数 × 单次 token 量。 把你典型任务的 prompt 粘到 Token 估算器,瞬间看清各家月成本差距。

常见问题

输入价、输出价、缓存价,一次调用到底按哪个收?

三个一起收,分别算。你发进去的内容按输入价计费(命中缓存的那部分改按更便宜的缓存价),模型生成的内容按输出价计费,最后相加就是这次调用的费用。所以同一个模型对不同任务的实际成本差别很大:长文档摘要主要花在输入,写长文主要花在输出,重复前缀多的应用则靠缓存把输入那块压下来。

为什么输出价普遍比输入价贵好几倍?

因为生成比读取更耗算力。模型读输入是一次性并行处理,而生成输出是一个 token 一个 token 自回归解码出来的,计算量大得多,厂商定价也就随之拉高,常见是输入价的 4 到 10 倍。实际影响是:凡是「让模型多写」的任务,省钱的重点不是换便宜模型,而是先想办法让它少写——限定长度、只要结果不要解释,往往立竿见影。

缓存价那么便宜,是不是我用了缓存就一定省钱?

不一定,要看你的请求结构。缓存通常只对「重复的前缀」生效,且要达到最小 token 门槛、两次请求间隔不能太久,部分厂商首次写入缓存还会单独收一笔。如果你每次 prompt 开头都不一样(比如把用户输入放在最前面),就基本命中不了。想吃到缓存红利,正确做法是把固定不变的内容(system prompt、文档、工具定义)放在最前面,变动的用户输入放最后。

上下文窗口越大越好吗?为什么大窗口反而可能更费钱?

窗口大解决的是「能不能装下」,不解决「该不该装满」。你塞进窗口的每个 token 都按输入价计费,把整本手册一次性丢进去,既增加费用又可能分散模型注意力、降低回答质量。更划算的通常是「精准检索只取相关片段 + 把固定前缀做成缓存」。大窗口的真正价值在于那些确实无法切分的任务,比如通读一份长合同或整个代码库。

推理/思考模型标的输出价看着不贵,为什么账单更高?

因为带「思考」「推理」模式的模型在给出最终答案前,会先生成一大段你通常看不到的思维链,而这些思维 token 一般也按输出价计费。也就是说你为「它在想的过程」也付了钱。所以评估这类模型不能只看挂牌的输出单价,要结合它在你任务上实际产生多少思维 token——同样一道题,思维链越长,隐性成本越高。对不需要复杂推理的任务,直接用非推理模型往往更省。

同一个模型,为什么不同地方报价不一样?算盘列的是哪个价?

因为同一个模型可以通过官方 API、聚合平台(如 OpenRouter)、云厂商托管(如火山方舟、阿里云百炼)等多个渠道调用,各渠道定价、汇率折算、促销策略都不同,价差有时不小。本站价格表默认展示官方定价作为基准,另设了「渠道比价」页专门把同一模型在各渠道的实测价并排列出来,每个价都标了核对日期和来源,方便你找到当下最便宜的调用方式。

算盘上的价格多久更新一次?可靠吗?

国产主力厂商接了每日自动核价,海外(美元计费)厂商按当日实时汇率折算,每个价格都记录了最近核对日期和核对方式。但模型定价变动频繁、各家也常有限时促销,本站只做对比和换算,任何价格最终都以厂商官方文档为准。算盘是独立开发者做的工具站,不隶属也不代表任何厂商;如果你发现某个数字和官方对不上,欢迎指出,会尽快更正。