大模型 API 价格历史变动时间线
主流国产大模型当前 API 价格
单位:元 / 百万 tokens。分时计价的模型先列峰时价,括号里是空闲时段价;按输入长度分档的模型列首档价并标「起」。点模型名看缓存价、分档和完整调价记录。
| 模型 | 输入 | 输出 |
|---|---|---|
| DeepSeek V4 FlashDeepSeek | ¥2(空闲 ¥1) | ¥8(空闲 ¥4) |
| DeepSeek V4 ProDeepSeek | ¥9(空闲 ¥4.5) | ¥27(空闲 ¥13.5) |
| Kimi K2.6Moonshot / Kimi | ¥6.5 | ¥27 |
| Qwen3.5 Plus阿里通义 | ¥0.8 起 | ¥4.8 起 |
| Doubao 1.6字节豆包 | ¥0.8 起 | ¥8 起 |
| GLM-5智谱 AI | ¥4 起 | ¥18 起 |
📊 2026 调价走势盘点
2026 年的大模型定价有降有涨。DeepSeek V4 Pro 在 5 月把 2.5 折限时优惠转为永久价,输入降到 ¥3/百万 tokens(降 75%);8 月又先涨到 ¥4.5,再改为分时计价,现在高峰时段输入 ¥9、输出 ¥27,空闲时段输入 ¥4.5、输出 ¥13.5(元/百万 tokens)。智谱 GLM-5 在 2 月上调接口计费和 Coding Plan,累计涨幅 30% 至 83%。海外方面,Anthropic 在 5 月把 Claude Opus 4.7 降价约 67%($15/$75 降到 $5/$25)。看价格一定要看日期:同一个模型,几个月内可能先降后涨。
Anthropic 于 2026-09-22 发布 Opus 5.5:$4/$20/百万tokens(比 Opus 5 降 20%),1M 上下文 + 128K 最大输出,知识截止 2026-06,性能对齐 Fable 5.1,默认速度比 Opus 5 快约 30%,成为 Anthropic 长时任务 Agent 编码新旗舰。
Anthropic 于 2026-09-01 发布 Claude Mythos 5.1,仅限 Project Glasswing 邀请访问,规格与定价与 Fable 5.1 完全一致($10/$50/缓存$0.25)。
xAI 发布 Grok 4.7,成为当前官方定价页横幅主推旗舰:短上下文 $2/$6(缓存$0.5),≥200K 长上下文 $4/$12(缓存$1),500K 上下文窗口。
xAI 发布 Grok 4.6:短上下文 $2/$6(缓存$0.5),≥200K 长上下文 $4/$12(缓存$1),与 4.7 同价位、早一代。
xAI 发布 Grok 4.5:短上下文 $2/$6(缓存$0.3),≥200K 长上下文 $4/$12(缓存$0.6),缓存价低于 4.6/4.7。
Google 发布 Gemini 3.8 Flash,取代 3.7 Flash 成为旗舰 Flash 模型,面向长程软件工程/自主 Agent/复杂企业工作流。1,048,576 输入/65,536 输出 token。当前促销价 $0.75/$3.75(有效至 2026-12-31,与 3.6/3.7 Flash 同款上市促销结构),届时升至标准价 $1.50/$7.50。
智谱发布 GLM-5.3,取代 GLM-5.2 成为旗舰模型表格位,价格与 5.2 持平:¥8/¥28/缓存¥2,1M 上下文。同批还发布了 GLM-5.3-Flash(¥0.8/¥2.8/缓存¥0.23)与 GLM-5.3-FlashX(¥2/¥7/缓存¥0.57)。
阿里通义发布 Qwen3.8 Max,取代 Qwen3.7 Max 成为旗舰主推,价格持平:¥12/¥36。另有无免费额度的优速档 Qwen3.8 Max Prime(¥24/¥72)。
小米发布 MiMo-V2.6 系列(Pro ¥3/¥6/缓存¥0.025、Flash ¥1/¥2/缓存¥0.02、Pro Ultraspeed ¥30/¥60/缓存¥0.25),接替即将于 2026-10-21 10:00 下线的 V2.5 系列。
讯飞星火发布 Spark-X2.5,新一代通用旗舰,293B-A30B MoE 架构,全国产化算力训练。限时 5 折促销价 ¥1.6/¥6/缓存¥0.24,无公开截止日。
DeepSeek V4 Flash 价格调整:输入单价由 CNY 3/M 变动 -33%(现 2),输出单价由 CNY 9/M 变动 -11%(现 8)。
Anthropic 于 2026-09-01 发布 Claude Fable 5.1,标准价与 Fable 5 持平($10/$50),但缓存命中价降 75%($1.00→$0.25/M),AA 智能指数 66 分(当前全球最高),重度 Agent 和长缓存场景总成本可降约 45%。
腾讯混元于 2026-08-28 在 TokenHub 新计费平台上线 Hy4 Preview:¥6/¥18/缓存¥0.3。
Spark Pro 价格调整:输入单价由 CNY 7/M 变动 -29%(现 5),输出单价由 CNY 7/M 变动 -29%(现 5)。
Spark Ultra 价格调整:输入单价由 CNY 2/M 变动 -60%(现 0.8),输出单价由 CNY 2/M 变动 -60%(现 0.8)。
Spark X2 价格调整:输入单价由 CNY 3/M 变动 -33%(现 2),输出单价由 CNY 3/M 变动 -33%(现 2)。
MiniMax M3 价格调整:输入单价由 CNY 4.2/M 变动 -50%(现 2.1),输出单价由 CNY 16.8/M 变动 -50%(现 8.4)。
DeepSeek V4 Pro 改为分时定价:峰时输入/输出为 ¥9/¥27,空闲时段维持原统一价 ¥4.5/¥13.5 不变。本站主表与默认预算取峰时保守价,计算器可手动选择空闲时段。
DeepSeek V4 Pro 价格调整:输入单价由 CNY 3/M 变动 50%(现 4.5),输出单价由 CNY 6/M 变动 125%(现 13.5)。
DeepSeek V4 Flash 改为分时定价:峰时输入/输出为 ¥3/¥9,空闲时段维持原统一价 ¥1.5/¥4.5 不变。本站主表与默认预算取峰时保守价,计算器可手动选择空闲时段。
DeepSeek V4 Flash 价格调整:输入单价由 CNY 1/M 变动 50%(现 1.5),输出单价由 CNY 2/M 变动 125%(现 4.5)。
OpenAI 于 2026-08-24 对 Sol 降价 20%($5/$30→$4/$20,缓存 $0.5→$0.4),促销价保证维持至少到 2026-11-21。09-28 站内核价时才发现这次降价,此前一直误挂旧价。
Google 于 2026-08-13 发布 Gemini 3.7 Flash,当前旗舰 Flash 系列,定价 $0.75/$3.75(优惠至 2026-12-31,届时升至 $1.50/$7.50),1M 上下文 + 64K 最大输出,支持 text/vision/audio 多模态,DeepSWE v1.1 评分 65.3%,主打 coding 与 Agent 工作流。
Google 随 Gemini 3.7 Flash 发布(2026-08-13)同步将 Gemini 3.6 Flash 降价 50%:输入 $1.50→$0.75,输出 $7.50→$3.75,该优惠价有效至 2026-12-31,届时恢复原价。
Anthropic 于 2026-08-10 宣布将 Claude Sonnet 5 的优惠定价永久化:$2/$10 即为标准价,此前公告的 2026-09-01 涨至 $3/$15 计划取消。此条记录的 inputFrom/outputFrom 未填——$3/$15 从未实际生效,不属于「确知的真实旧价」。
2026-07-25 下线确认:DeepSeek 旧模型名 deepseek-chat / deepseek-reasoner 已按官方公告于北京时间 2026-07-24 23:59 下线,当日官方价格页仅保留 V4 Flash 与 V4 Pro,不再提供 V3.2 计费入口。V3.2 权重开源,OpenRouter 等第三方渠道仍在售,站内条目保留作历史存档与迁移对照;V4 当前分时价请以模型页为准。
OpenAI 发布 GPT-5.6 系列三档(2026-07-09):Sol $5/$30、Terra $2.50/$15、Luna $1/$6(均含 1.05M 上下文 / 128K 最大输出,知识截止 2026-02)。Sol 为旗舰档,AA 智能指数 59 分,阶梯价在 272K 输入阈值以上翻倍至 $10/$45。
OpenAI 于 2026-07-30 对 GPT-5.6 Terra 永久降价 20%($2.50→$2 输入,$15→$12 输出),缓存读取随之降至 $0.20/M。
OpenAI 于 2026-07-30 对 GPT-5.6 Luna 永久降价 80%($1→$0.20 输入,$6→$1.20 输出),缓存读取降至 $0.02/M,长上下文性价比直逼 DeepSeek V4 Flash。
GPT-5.6 系列随 2026-07-30 调价同步新增 Fast 加速档,取代原 Priority Processing:单价为各档标准价的 2 倍,模型能力不变——Sol $10/$60、Terra $4/$24、Luna $0.40/$2.40。官方仅对 Sol 公布速度口径(最高 2.5 倍于标准处理),Terra / Luna 未给具体倍数。官方定价页的 Fast 档未列长上下文分档。另据同页核对补录 Terra / Luna 的 272K 长上下文阶梯价(Terra $4/$18、Luna $0.40/$1.80),此前仅 Sol 有分档数据。
Google 发布 Gemini 3.6 Flash(2026-07-21),定价 $1.50/$7.50 / 百万 tokens(缓存 $0.15/M,输出较 3.5 Flash 降约 17%),1M 上下文 + 65536 最大输出,知识截止 2026-03,支持文本 / 图片 / 语音 / 视频多模态输入。
Anthropic 发布 Claude Opus 5(2026-07-24),定价 $5/$25 / 百万 tokens(缓存 $0.50/M),与 Opus 4.8 持平,1M 上下文 + 128K 最大输出,AA 智能指数 61 分(当前全球最高),知识截止 2026-05,成为 Anthropic 当前旗舰并替代 Fable 5 为 Claude Max 默认模型。
月之暗面于 2026-06-12 发布 Kimi K2.7 Code,K2 系列第三代代码专项迭代版本:¥6.5/¥27/缓存¥1.3。同期还有 2 倍价的高速版 K2.7 Code Highspeed(¥13/¥54/缓存¥2.6)。
Anthropic 发布 Claude Fable 5(2026-06-09),定价 $10/$50 / 百万 tokens(缓存命中 $1/M),是 Opus 4.8 的两倍价位,1M 上下文 + 128K 最大输出,知识截止 2026-01。因美国出口管控于 2026-06-12 临时暂停全球访问,2026-06-30 管制解除后恢复,现已全球可用。
字节跳动在火山引擎 FORCE 大会(2026-06-24)发布 Doubao Seed 2.1 Pro,定价 ¥6/¥30 / 百万 tokens(缓存命中 ¥1.2/M),256K 上下文,是豆包当前最高端旗舰推理模型。
Anthropic 发布 Claude Sonnet 5(2026-06-30),现行优惠价 $2/$10 / 百万 tokens(有效至 2026-08-31),届时升至标准价 $3/$15,1M 上下文 + 128K 最大输出,AA 智能指数 57 分,与 Free/Pro 计划默认模型齐平。
Anthropic 罕见大降价:Opus 4.7 输入输出均砍约 67%,从 $15/$75 降到 $5/$25,直接逼平 GPT-5.5 价位。
DeepSeek V4 系列发布,V4 Flash 仅 ¥1/¥2,带 1M 上下文 + 384K 最大输出 + 缓存命中 ¥0.02/M(业界最低),旧 V3.2/R1 转入弃用。
Kimi 升级到 K2.6,单价较上代上调约 58%(现 ¥6.50/¥27.00),对应 Agent 自主运行能力大幅升级(支持长达数天的持续运行)。
DeepSeek V3.2 标记弃用,调用统一路由到 V4 Flash 的非思考/思考模式,新项目请直接用 V4。官方定档:旧模型名 deepseek-chat / deepseek-reasoner 于北京时间 2026-07-24 23:59 下线(2026-06-13 自官方价格页脚注核实;下线完成情况见 2026-07 事件)。
Anthropic 发布 Claude Opus 4.8(2026-05-28),定价与 Opus 4.7 持平($5/$25),AA 智能指数升至 61 分,引入快速模式($10/$50) and 更低缓存阈值(1024 tokens),是当前 Anthropic 旗舰。
阿里云发布 Qwen3.7 Max(2026-05-19),定位 Agent 时代旗舰,1M 上下文,官方标准价 ¥12/¥36(含限时5折优惠期间为 ¥6/¥18),是通义系目前最高端模型。
DeepSeek 宣布将 V4 Pro 旗舰大模型原定于5月31日结束的限时 2.5 折优惠转为永久标准价,即非缓存输入价 ¥3/M tokens(直降 75%)、输出价 ¥6/M tokens,拉开2026大模型价格战永久化序幕。
xAI 发布 Grok 4.20 系列三个变体(multi-agent-0309 / reasoning / non-reasoning),价格与 Grok 4.3 相同:短上下文 $1.25/$2.5(缓存$0.2),≥200K 长上下文 $2.5/$5(缓存$0.4),1M 上下文,支持 Batch API 20% 折扣。
智谱 AI 对旗舰模型 GLM-5 接口计费及 Coding Plan 进行调整,受算力供需关系紧张影响,API 计费及订阅包累计涨幅达 30% 至 83% 不等,率先宣告行业从价格战回归价值定价。
常见问题
2026年大模型 API 价格大趋势如何?
有降有涨,同一个模型几个月内可能先降后涨。DeepSeek V4 Pro 5 月把限时 2.5 折优惠转为永久价(输入 ¥3/百万 tokens,降 75%),8 月又上调并改为分时计价,现在高峰时段输入 ¥9、输出 ¥27,空闲时段输入 ¥4.5、输出 ¥13.5(元/百万 tokens)。智谱 GLM-5 在 2 月累计上调 30% 至 83%;Anthropic 在 5 月把 Claude Opus 4.7 降价约 67%。
DeepSeek V4 Pro 的价格变动历史和现价是多少?
5 月:限时 2.5 折优惠转为永久价,输入从 ¥12 降到 ¥3/百万 tokens,输出从 ¥24 降到 ¥6。8 月:先上调到输入 ¥4.5、输出 ¥13.5,随后改为分时计价。现在高峰时段输入 ¥9、输出 ¥27,空闲时段输入 ¥4.5、输出 ¥13.5(元/百万 tokens)。
智谱 GLM-5 API 价格涨了多少?
智谱 AI 在 2026 年 2 月上调了 GLM-5 的接口计费和 Coding Plan,受算力供需紧张影响,相比发布初期累计涨幅在 30% 至 83% 不等。
🛡️ 宁缺毋假与核验说明
算盘价格历史页面坚持「宁缺毋假」原则。所有的调价幅度和发布事件必须由官方通告、价格文档或直连爬虫监控证实,并提供当时有效的官方来源 URL 备查。对于核实不到源头的传言,我们坚决不予收录。
如果您在开发中发现有未被本时间线收录的调价事件,欢迎发送邮件至 szpwqq@gmail.com 补充订正。