大模型 API 价格历史变动时间线
📊 2026 调价走势盘点
2026年全球大模型定价呈现出极强的**K型两极分化**特征:以 **DeepSeek V4 Pro** 为代表的厂商选择将 2.5 折限时折扣永久化,实现 **75% 的降价幅度**(输入单价降至 ¥3/百万 tokens);与之相反,**智谱 GLM-5** 因面临极高算力供需瓶颈,在第一季度通过多次微调使得 API 计费与订阅累计**大幅上涨 30% 至 83%**。国际大厂中,Anthropic 对 **Claude Opus 4.7** 实施了高达 **67% 的降幅**,重塑了旗舰模型的性价比格局。调价背后正体现出 AI 从恶性低价倾销回归至算力稀缺度定价的深层逻辑。
Spark Pro 价格调整:输入单价由 CNY 7/M 变动 -29%(现 5),输出单价由 CNY 7/M 变动 -29%(现 5)。
Spark Ultra 价格调整:输入单价由 CNY 2/M 变动 -60%(现 0.8),输出单价由 CNY 2/M 变动 -60%(现 0.8)。
Spark X2 价格调整:输入单价由 CNY 3/M 变动 -33%(现 2),输出单价由 CNY 3/M 变动 -33%(现 2)。
MiniMax M3 价格调整:输入单价由 CNY 4.2/M 变动 -50%(现 2.1),输出单价由 CNY 16.8/M 变动 -50%(现 8.4)。
DeepSeek V4 Pro 改为分时定价:峰时输入/输出为 ¥9/¥27,空闲时段为 ¥4.5/¥13.5。本站主表与默认预算取峰时保守价,计算器可手动选择空闲时段。
DeepSeek V4 Flash 改为分时定价:峰时输入/输出为 ¥3/¥9,空闲时段为 ¥1.5/¥4.5。本站主表与默认预算取峰时保守价,计算器可手动选择空闲时段。
2026-07-25 下线确认:DeepSeek 旧模型名 deepseek-chat / deepseek-reasoner 已按官方公告于北京时间 2026-07-24 23:59 下线,当日官方价格页仅保留 V4 Flash 与 V4 Pro,不再提供 V3.2 计费入口。V3.2 权重开源,OpenRouter 等第三方渠道仍在售,站内条目保留作历史存档与迁移对照;V4 当前分时价请以模型页为准。
OpenAI 发布 GPT-5.6 系列三档(2026-07-09):Sol $5/$30、Terra $2.50/$15、Luna $1/$6(均含 1.05M 上下文 / 128K 最大输出,知识截止 2026-02)。Sol 为旗舰档,AA 智能指数 59 分,阶梯价在 272K 输入阈值以上翻倍至 $10/$45。
OpenAI 于 2026-07-30 对 GPT-5.6 Terra 永久降价 20%($2.50→$2 输入,$15→$12 输出),缓存读取随之降至 $0.20/M。
OpenAI 于 2026-07-30 对 GPT-5.6 Luna 永久降价 80%($1→$0.20 输入,$6→$1.20 输出),缓存读取降至 $0.02/M,长上下文性价比直逼 DeepSeek V4 Flash。
GPT-5.6 系列随 2026-07-30 调价同步新增 Fast 加速档,取代原 Priority Processing:单价为各档标准价的 2 倍,模型能力不变——Sol $10/$60、Terra $4/$24、Luna $0.40/$2.40。官方仅对 Sol 公布速度口径(最高 2.5 倍于标准处理),Terra / Luna 未给具体倍数。官方定价页的 Fast 档未列长上下文分档。另据同页核对补录 Terra / Luna 的 272K 长上下文阶梯价(Terra $4/$18、Luna $0.40/$1.80),此前仅 Sol 有分档数据。
Google 发布 Gemini 3.6 Flash(2026-07-21),定价 $1.50/$7.50 / 百万 tokens(缓存 $0.15/M,输出较 3.5 Flash 降约 17%),1M 上下文 + 65536 最大输出,知识截止 2026-03,支持文本 / 图片 / 语音 / 视频多模态输入。
Anthropic 发布 Claude Opus 5(2026-07-24),定价 $5/$25 / 百万 tokens(缓存 $0.50/M),与 Opus 4.8 持平,1M 上下文 + 128K 最大输出,AA 智能指数 61 分(当前全球最高),知识截止 2026-05,成为 Anthropic 当前旗舰并替代 Fable 5 为 Claude Max 默认模型。
Anthropic 发布 Claude Fable 5(2026-06-09),定价 $10/$50 / 百万 tokens(缓存命中 $1/M),是 Opus 4.8 的两倍价位,1M 上下文 + 128K 最大输出,知识截止 2026-01。因美国出口管控于 2026-06-12 临时暂停全球访问,2026-06-30 管制解除后恢复,现已全球可用。
字节跳动在火山引擎 FORCE 大会(2026-06-24)发布 Doubao Seed 2.1 Pro,定价 ¥6/¥30 / 百万 tokens(缓存命中 ¥1.2/M),256K 上下文,是豆包当前最高端旗舰推理模型。
Anthropic 发布 Claude Sonnet 5(2026-06-30),现行优惠价 $2/$10 / 百万 tokens(有效至 2026-08-31),届时升至标准价 $3/$15,1M 上下文 + 128K 最大输出,AA 智能指数 57 分,与 Free/Pro 计划默认模型齐平。
Anthropic 罕见大降价:Opus 4.7 输入输出均砍约 67%,从 $15/$75 降到 $5/$25,直接逼平 GPT-5.5 价位。
DeepSeek V4 系列发布,V4 Flash 仅 ¥1/¥2,带 1M 上下文 + 384K 最大输出 + 缓存命中 ¥0.02/M(业界最低),旧 V3.2/R1 转入弃用。
Kimi 升级到 K2.6,单价较上代上调约 58%(现 ¥6.50/¥27.00),对应 Agent 自主运行能力大幅升级(支持长达数天的持续运行)。
DeepSeek V3.2 标记弃用,调用统一路由到 V4 Flash 的非思考/思考模式,新项目请直接用 V4。官方定档:旧模型名 deepseek-chat / deepseek-reasoner 于北京时间 2026-07-24 23:59 下线(2026-06-13 自官方价格页脚注核实;下线完成情况见 2026-07 事件)。
Anthropic 发布 Claude Opus 4.8(2026-05-28),定价与 Opus 4.7 持平($5/$25),AA 智能指数升至 61 分,引入快速模式($10/$50) and 更低缓存阈值(1024 tokens),是当前 Anthropic 旗舰。
阿里云发布 Qwen3.7 Max(2026-05-19),定位 Agent 时代旗舰,1M 上下文,官方标准价 ¥12/¥36(含限时5折优惠期间为 ¥6/¥18),是通义系目前最高端模型。
DeepSeek 宣布将 V4 Pro 旗舰大模型原定于5月31日结束的限时 2.5 折优惠转为永久标准价,即非缓存输入价 ¥3/M tokens(直降 75%)、输出价 ¥6/M tokens,拉开2026大模型价格战永久化序幕。
智谱 AI 对旗舰模型 GLM-5 接口计费及 Coding Plan 进行调整,受算力供需关系紧张影响,API 计费及订阅包累计涨幅达 30% 至 83% 不等,率先宣告行业从价格战回归价值定价。
🛡️ 宁缺毋假与核验说明
算盘价格历史页面坚持「宁缺毋假」原则。所有的调价幅度和发布事件必须由官方通告、价格文档或直连爬虫监控证实,并提供当时有效的官方来源 URL 备查。对于核实不到源头的传言,我们坚决不予收录。
如果您在开发中发现有未被本时间线收录的调价事件,欢迎发送邮件至 [email protected] 补充订正。