本地硬件 vs 云 API 回本计算器
算清买 Mac Studio 或 GPU 显卡本地部署大模型,到底需要多大的月 Token 调用量才能回本。想算 Agent 多轮 Prompt Cache 成本?用 Agent 多轮成本计算器;想查询模型单价?看 全部模型价格表。
硬件与云 API 参数设置
对比本地硬件采购折旧及运营电费与云端 API 调用的经济回本点
🖥️ 本地硬件部署
¥
个月
¥
¥
t/s
%
☁️ 云端 API 参照
:
¥
月固定开销 (F = H/D + E_fixed)
¥3633.33
单机月产能上限 (M_max)
51.84 M tokens/月
回本门槛用量 (M*)
永不回本
⚠️
云 API 的综合单价等于或低于本地边际电费 (c ≤ m),云端更划算,本地永远无法回本。
成本-用量直线交点图
本地硬件总成本线云 API 成本线单机产能上限
* 免责声明与说明:
本地开源模型与云端旗舰模型能力不等价,本计算器只算钱不算质量。计算采用简化财务逻辑,不替代具体工程压测评估。
常见问题
Q. 为什么说「增加硬件无法改变无法回本的结论」?
因为单台硬件具有确定的产能上限(由 TPS 和利用率决定)。如果单台硬件的最大月产能 M_max 小于回本门槛 M*,意味着该硬件在整个生命周期内产出的 Token 按云端价格折算都无法覆盖其自身采购与固定运维成本。增加机器会使总固定成本与总产能同倍线性增长,综合回本点保持不变。
Q. 本地硬件部署有哪些容易忽视的隐性成本?
除了硬件采购价(H),还要算:1)机房/机柜托管与网络带宽开销;2)基础散热与空载电费(E_fixed);3)运维人力与故障备件成本;4)硬件更新换代快,折旧建议按 24 个月从紧计提。
Q. 如何评估本地开源模型与云端 API 的能力等价性?
开源权重模型(Llama、Qwen、DeepSeek 各家的开源版本)在代码、垂直领域问答等任务上可以接近旗舰云端 API,但在复杂推理与长上下文指令遵循上仍有差距。本计算器只算财务账,实际选型请结合 Benchmark 与工程实测。