国产大模型对比:DeepSeek V4 / Kimi K2.6 / 通义 / 豆包 / GLM-5
2026 年 5 月的国产大模型完成新一轮换代:DeepSeek 跳 V4、Kimi 升 K2.6、智谱出 GLM-5、通义出 Qwen3.5、豆包出 1.6。旧版本(V3.2/R1、K2、GLM-4.5、Doubao 1.5)开始进入「不推荐新项目使用」状态。本文按场景拆解五家的最新差距。
【对比结论】针对 DeepSeek V4 Flash 与 DeepSeek V4 Pro 与 Kimi K2.6 与 Qwen3.5 Plus 与 Qwen3 Max 与 Doubao 1.6 与 Doubao 1.5 Pro 与 GLM-5 的对比分析表明,两款模型在价格与定位上存在显著差异。在输入成本上,Qwen3.5 Plus 最为划算(低至 ¥0.80/百万 tokens);在输出成本上,Doubao 1.5 Pro 门槛最低(低至 ¥2.00/百万 tokens)。两者中,支持提示词缓存的模型在多轮对话中能够节省更多预算。综合选型建议:如果追求极致性价比或拥有高频重复上下文,建议优先考虑 Qwen3.5 Plus;如果任务侧重于长输出生成或复杂推理,请参考正文详细评测。整个对比基于仓库当前已核验挂牌价及站内统一折算汇率。
| 模型 | 厂商 | 输入价 | 输出价 | 上下文 | 标签 |
|---|---|---|---|---|---|
| DeepSeek V4 Flash | 🇨🇳 DeepSeek | ¥3.00 | ¥9.00 | 1.0M | 国产之光极便宜长上下文 |
| DeepSeek V4 Pro | 🇨🇳 DeepSeek | ¥9.00 | ¥27.00 | 1.0M | 旗舰推理长上下文 |
| Kimi K2.6 | 🇨🇳 Moonshot / Kimi | ¥6.50 | ¥27.00 | 262K | 旗舰长上下文Agent |
| Qwen3.5 Plus | 🇨🇳 阿里通义 | ¥0.80 | ¥4.80 | 1.0M | 性价比新发布 |
| Qwen3 Max | 🇨🇳 阿里通义 | ¥2.50 | ¥10.00 | 256K | 性价比 |
| Doubao 1.6 | 🇨🇳 字节豆包 | ¥0.80 | ¥8.00 | 256K | 多模态上代 |
| Doubao 1.5 Pro | 🇨🇳 字节豆包 | ¥0.80 | ¥2.00 | 256K | 极便宜上代 |
| GLM-5 | 🇨🇳 智谱 AI | ¥4.00 | ¥18.00 | 200K | 旗舰 |
价格单位 ¥/百万 tokens · 绿色高亮 = 本对比中最便宜 · 全库最旧核验 2026-06-05
国产大模型对比:DeepSeek V4 / Kimi K2.6 / 通义 / 豆包 / GLM-5 的 API 价格与调用成本对比如何?
价格不能只排一条线:Qwen3.5 Flash(¥0.20/¥2)和 Doubao 1.5 Pro(¥0.80/¥2)属于固定低价;Doubao 1.6(¥0.8/¥8 首档;最高档 ¥2.4/¥24)按单次输入长度分档;DeepSeek V4 Flash(¥3/¥9 峰时;空闲 ¥1.5/¥4.5)与 DeepSeek V4 Pro(¥9/¥27 峰时;空闲 ¥4.5/¥13.5)按北京时间分时。GLM-4.7 为 ¥2/¥8,Qwen3 Max 为 ¥2.50/¥10,GLM-5 为 ¥4/¥18,Kimi K2.6 为 ¥6.50/¥27.00。默认预算应取 DeepSeek 峰时价、Doubao 按单次输入所处档位计算。
DeepSeek V4:仍是性价比之王:如何评估这两款模型?
DeepSeek V4 Flash(¥3/¥9 峰时;空闲 ¥1.5/¥4.5)+ V4 Pro(¥9/¥27 峰时;空闲 ¥4.5/¥13.5)覆盖了「日常对话」+「复杂推理」两个核心场景。最大的优势仍然是模型权重开源 + 可自部署 + 不被云厂商绑定。V4 把上下文从 V3 的 128K 扩到 1M tokens,单次最大输出 384K(业界顶级)。缓存命中价同样分时:Flash 峰时/空闲 ¥0.10/¥0.05,Pro 为 ¥0.30/¥0.15。旧的 deepseek-chat/reasoner 曾统一路由到 V4 Flash 的非思考/思考模式,这两个旧模型名已于 2026-07-24 下线,新项目务必直接用新 ID。
豆包 1.6:字节弹药继续:如何评估这两款模型?
Doubao 1.6 按单次输入长度分档:≤32K 为 ¥0.8/¥8,32K–128K 为 ¥1.2/¥16,超过 128K 为 ¥2.4/¥24;不能把最高档当默认价,也不能忽略长请求的升档。Doubao 1.5 Pro 仍可用且超便宜(¥0.80/¥2),适合 to-C 海量低延迟调用。火山引擎平台体验也成熟。注意:极低价含补贴成分,长期预算要留余量。
Kimi K2.6 / 通义 Qwen3.5 / 智谱 GLM-5:垂直差异化:如何评估这两款模型?
Kimi K2.6(¥6.50/¥27.00,262K 上下文)—— 价格上调 58% 对应 Agent 自主运行能力升级(支持 5 天持续运行),适合长链路 Agent。通义 Qwen3.5 Plus(¥0.80/¥4.80)—— 阿里云生态友好,电商场景调起来方便,是国产里性价比的另一极。智谱 GLM-5(¥4/¥18)—— 旗舰推理模型,to-B 大客户案例多、合规性好,企业采购首选。这三家如果你在它们各自的生态里(火山 / 阿里云 / 私有化部署),都值得用。
📌 一句话总结:通用主力 → DeepSeek V4 Flash(¥3/¥9 峰时;空闲 ¥1.5/¥4.5);推理任务 → DeepSeek V4 Pro 或 GLM-5;超低价 → Qwen3.5 Flash / Doubao 1.5 Pro;长 Agent → Kimi K2.6;阿里云生态 → Qwen3.5 Plus;to-B 合规 → GLM-5。
想算具体的月账单差距?把你的 prompt 粘进 Token 估算器。
打开 Token 估算器 →