算盘·LLM Abacus
中文优先的 AI 大模型价格对比。
一张表看清 55 个主流模型,30 秒回答「跑哪个最便宜」。
算盘(LLM Abacus)是一个每日核对的 AI 大模型 API 价格对比与 Token 成本估算平台。全量收录 Claude Opus 5、GPT-5.6 Sol、Gemini 3.6 Flash、DeepSeek V4、Kimi K3、Qwen3.7 等 55+ 主流模型的最新输入、输出及提示词缓存单价,价格数据每日核对,最近更新:。
DeepSeek 旧模型名 deepseek-chat / deepseek-reasoner 已按官方公告于北京时间 2026-07-24 23:59 下线,官方价格页现仅列 deepseek-v4-flash(¥0.02 缓存命中 / ¥1 输入 / ¥2 输出)与 deepseek-v4-pro(¥0.025 / ¥3 / ¥6),不再提供 V3.2 的计费入口(2026-07-25 复核官方页;页面脚注文案尚未改写,仍为下线前的措辞)。V3.2 权重开源,OpenRouter 等第三方渠道仍在售,站内条目保留作历史存档与迁移对照,新项目请直接用 V4 显式模型名。
OpenAI 发布 GPT-5.6 系列三档(2026-07-09):Sol $5/$30、Terra $2.50/$15、Luna $1/$6(均含 1.05M 上下文 / 128K 最大输出,知识截止 2026-02)。Sol 为旗舰档,AA 智能指数 59 分,阶梯价在 272K 输入阈值以上翻倍至 $10/$45。
OpenAI 于 2026-07-30 对 GPT-5.6 Terra 永久降价 20%($2.50→$2 输入,$15→$12 输出),缓存读取随之降至 $0.20/M。
OpenAI 于 2026-07-30 对 GPT-5.6 Luna 永久降价 80%($1→$0.20 输入,$6→$1.20 输出),缓存读取降至 $0.02/M,长上下文性价比直逼 DeepSeek V4 Flash。
全球用量热度榜
OpenRouter 周 token 用量(2026-07-31 自动核对)——海外开发者真实用量,反映热度而非质量;国产模型走国内端点的用量不计入。 仅显示本站收录且当周在榜的模型,掉出榜单即不再显示名次。
仅展示本站收录的模型在 OpenRouter 周榜中的名次;完整榜单见 openrouter.ai/rankings。榜上多为海外可直连模型,本站收录的国产模型走国内端点、不进此榜。
最便宜的 5 个模型
按输入价排序。卡片里是「单次典型问答(输入 2000 + 输出 500 tokens)」的估算成本。
模型价格表
默认按输入价升序,便宜的在最上面
共 55 / 55 个模型 · 价格单位 ¥/百万 tokens(海外厂商附 $ 美元原价,按 1 USD = 6.7598 换算)· 点击表头列名可排序 · 绿色高亮 = 最便宜 · 性价比↑ = 质量/价格比最高(需有质量评分) · 热度 = OpenRouter 周榜名次(token 用量,反映海外开发者实际用量而非质量;国产模型国内端点用量不经 OR,仅供参考)
| 模型 | 厂商 | 质量 | 热度 | 输入价 ▲ | 输出价 | 缓存价 | 上下文 | 最大输出 | 知识截止 | 性价比 | 模态 | 标签 | 去试用 | |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Flash | 🇨🇳阿里通义 自动核对: 2026-08-03 | — | — | ¥0.20阶梯▲ | ¥2.00 | — | 1.0M | 16K | — | — | 文本 | 极便宜快速 | 使用 → | |
| Gemini 2.5 Flash-Lite | 🇺🇸Google 人工监控: 2026-08-01 | — | — | ¥0.68$0.10 | ¥2.70$0.40 | ¥0.07 | 1.0M | 64K | — | — | 文本视觉 | 极便宜快速 | 使用 → | |
| Qwen3.5 Plus | 🇨🇳阿里通义 自动核对: 2026-08-03 | — | — | ¥0.80阶梯▲ | ¥4.80 | — | 1.0M | 32K | — | — | 文本视觉 | 性价比新发布 | 使用 → | |
| Doubao 1.6 | 🇨🇳字节豆包 人工监控: 2026-07-03>14天未核 | — | — | ¥0.80阶梯▲ | ¥8.00 | ¥0.16 | 256K | 16K | — | — | 文本视觉音频 | 多模态上代 | 使用 → | |
| Doubao 1.5 Pro | 🇨🇳字节豆包 人工监控: 2026-07-03>14天未核 | — | — | ¥0.80 | ¥2.00 | ¥0.16 | 256K | 12K | — | — | 文本视觉 | 极便宜上代 | 使用 → | |
| 文心 ERNIE 4.5 Turbo | 🇨🇳百度文心 人工监控: 2026-06-05>14天未核 | — | — | ¥0.80 | ¥3.20 | ¥0.20 | 128K | 16K | — | — | 文本视觉 | 性价比快速 | 使用 → | |
| 混元 TurboS | 🇨🇳腾讯混元 人工监控: 2026-06-05>14天未核 | — | — | ¥0.80 | ¥2.00 | — | 256K | 16K | — | — | 文本 | 性价比快速 | 使用 → | |
| DeepSeek V4 Flash | 🇨🇳DeepSeek 自动核对: 2026-08-03 | 47 | #27.57T | ¥1.00 | ¥2.00 | ¥0.02 | 1.0M | 384K | — | ★ 313 | 文本 | 国产之光极便宜长上下文 | 使用 → | |
| 文心 ERNIE X1 Turbo | 🇨🇳百度文心 人工监控: 2026-06-05>14天未核 | — | — | ¥1.00 | ¥4.00 | — | 128K | 16K | — | — | 文本 | 推理深度思考 | 使用 → | |
| 混元 T1 | 🇨🇳腾讯混元 人工监控: 2026-06-05>14天未核 | — | — | ¥1.00 | ¥4.00 | — | 64K | 16K | — | — | 文本 | 推理 | 使用 → | |
| MiMo-V2.5 | 🇨🇳小米 MiMo 人工监控: 2026-07-31 | — | #18.90T | ¥1.00 | ¥2.00 | ¥0.02 | 262K | 32K | — | — | 文本 | 高性价比 | 使用 → | |
| 混元 Hy3 | 🇨🇳腾讯混元 人工监控: 2026-06-05>14天未核 | — | #34.79T | ¥1.00 | ¥4.00 | ¥0.25 | 262K | 32K | — | — | 文本 | 高性价比Agent | 使用 → | |
| Step 3.7 Flash | 🇨🇳阶跃星辰 人工监控: 2026-07-31 | — | #81.74T | ¥1.35 | ¥8.10 | — | 131K | 32K | — | — | 文本 | 高性价比 | 使用 → | |
| GPT-5.6 Luna | 🇺🇸OpenAI 人工监控: 2026-08-01 | — | — | ¥1.35$0.20阶梯▲ | ¥8.11$1.20 | ¥0.14 | 1.1M | 128K | 2026-02 | — | 文本视觉 | 快速极便宜 | 使用 → | |
| Gemini 3.1 Flash-Lite | 🇺🇸Google 人工监控: 2026-08-01 | 34 | — | ¥1.69$0.25 | ¥10.14$1.50 | ¥0.17 | 1.0M | 64K | 2025-01 | ★ 57 | 文本视觉 | 极便宜快速 | 使用 → | |
| DeepSeek V3.2 | 🇨🇳DeepSeek 自动核对: 2026-08-03 | — | — | ¥2.00 | ¥8.00 | ¥0.50 | 128K | 8K | — | — | 文本 | 已下线(官方)2026-07-24 已下线 | 使用 → | |
| GLM-4.7 | 🇨🇳智谱 AI 自动核对: 2026-08-01 | — | — | ¥2.00阶梯▲ | ¥8.00 | ¥0.40 | 200K | 16K | — | — | 文本 | 性价比 | 使用 → | |
| Spark X2 Flash | 🇨🇳讯飞星火 人工监控: 2026-06-05>14天未核 | — | — | ¥2.00 | ¥2.00 | — | 200K | 16K | — | — | 文本 | 推理快速性价比 | 使用 → | |
| Spark Ultra | 🇨🇳讯飞星火 人工监控: 2026-06-05>14天未核 | — | — | ¥2.00 | ¥2.00 | — | 128K | 16K | — | — | 文本 | 性价比FunctionCall | 使用 → | |
| Baichuan M2 | 🇨🇳百川智能 人工监控: 2026-06-05>14天未核 | — | — | ¥2.00 | ¥20.00 | — | 192K | 16K | — | — | 文本 | 性价比 | 使用 → | |
| Gemini 2.5 Flash | 🇺🇸Google 人工监控: 2026-08-01 | — | — | ¥2.03$0.30 | ¥16.90$2.50 | ¥0.20 | 1.0M | 64K | — | — | 文本视觉音频 | 快速性价比 | 使用 → | |
| MiniMax M2.7 | 🇨🇳MiniMax 人工监控: 2026-06-05>14天未核 | 50 | — | ¥2.10 | ¥8.40 | ¥0.42 | 1.0M | 64K | — | ★ 95 | 文本 | Agent代码性价比 | 使用 → | |
| Qwen3 Max | 🇨🇳阿里通义 自动核对: 2026-08-03 | — | — | ¥2.50阶梯▲ | ¥10.00 | — | 256K | 32K | — | — | 文本视觉 | 性价比 | 使用 → | |
| DeepSeek V4 Pro | 🇨🇳DeepSeek 自动核对: 2026-08-03 | 52 | #43.59T | ¥3.00 | ¥6.00 | ¥0.03 | 1.0M | 384K | — | ★ 116 | 文本 | 旗舰推理长上下文 | 使用 → | |
| Spark X2 | 🇨🇳讯飞星火 人工监控: 2026-06-05>14天未核 | — | — | ¥3.00 | ¥3.00 | — | 200K | 16K | — | — | 文本 | 旗舰推理 | 使用 → | |
| 混元 2.0 Think | 🇨🇳腾讯混元 人工监控: 2026-06-05>14天未核 | — | — | ¥3.98 | ¥15.90 | — | 128K | 16K | — | — | 文本 | 旗舰推理 | 使用 → | |
| GLM-5 | 🇨🇳智谱 AI 自动核对: 2026-08-01 | — | — | ¥4.00阶梯▲ | ¥18.00 | ¥1.00 | 200K | 16K | — | — | 文本视觉 | 旗舰 | 使用 → | |
| 文心 ERNIE 5.1 | 🇨🇳百度文心 人工监控: 2026-06-05>14天未核 | — | — | ¥4.00阶梯▲ | ¥18.00 | — | 128K | 16K | — | — | 文本视觉 | 旗舰 | 使用 → | |
| MiniMax M3 | 🇨🇳MiniMax 人工监控: 2026-06-05>14天未核 | 55 | #72.02T | ¥4.20阶梯▲ | ¥16.80 | ¥0.84 | 1.0M | 64K | — | ★ 52 | 文本 | Agent代码长上下文旗舰 | 使用 → | |
| Baichuan M3 Plus | 🇨🇳百川智能 人工监控: 2026-06-05>14天未核 | — | — | ¥5.00 | ¥9.00 | — | 192K | 16K | — | — | 文本 | 医疗旗舰 | 使用 → | |
| GLM-5.1 | 🇨🇳智谱 AI 自动核对: 2026-08-01 | 51 | — | ¥6.00阶梯▲ | ¥24.00 | ¥1.30 | 200K | 16K | — | 34 | 文本 | 旗舰推理新发布 | 使用 → | |
| Doubao Seed 2.1 Pro | 🇨🇳字节豆包 人工监控: 2026-07-03>14天未核 | — | — | ¥6.00 | ¥30.00 | ¥1.20 | 256K | 32K | — | — | 文本视觉 | 旗舰推理新发布 | 使用 → | |
| Kimi K2.6 | 🇨🇳Moonshot / Kimi 自动核对: 2026-08-01 | 54 | — | ¥6.50 | ¥27.00 | ¥1.10 | 262K | 32K | — | 32 | 文本视觉 | 旗舰长上下文Agent | 使用 → | |
| Claude Haiku 4.5 | 🇺🇸Anthropic 人工监控: 2026-08-01 | 37 | — | ¥6.76$1.00 | ¥33.80$5.00 | ¥0.68 | 200K | 32K | — | 18 | 文本视觉 | 快速 | 使用 → | |
| Grok Build 0.1 | 🇺🇸xAI 人工监控: 2026-08-01 | — | — | ¥6.76$1.00阶梯▲ | ¥13.52$2.00 | ¥1.35 | 256K | 64K | — | — | 文本 | 代码快速 | 使用 → | |
| Spark Pro | 🇨🇳讯飞星火 人工监控: 2026-06-05>14天未核 | — | — | ¥7.00 | ¥7.00 | — | 128K | 16K | — | — | 文本 | 强性能 | 使用 → | |
| GLM-5.2 | 🇨🇳智谱 AI 自动核对: 2026-08-01 | — | #53.24T | ¥8.00 | ¥28.00 | — | 1.0M | 128K | — | — | 文本 | 旗舰推理 | 使用 → | |
| GPT-5.1 | 🇺🇸OpenAI 人工监控: 2026-08-01 | — | — | ¥8.45$1.25 | ¥67.60$10.00 | ¥0.84 | 400K | 128K | 2024-09 | — | 文本视觉 | 快速 | 使用 → | |
| Gemini 2.5 Pro | 🇺🇸Google 人工监控: 2026-08-01 | 35 | — | ¥8.45$1.25阶梯▲ | ¥67.60$10.00 | ¥0.84 | 2.0M | 64K | — | 9 | 文本视觉音频 | 长上下文 | 使用 → | |
| Grok 4.3 | 🇺🇸xAI 人工监控: 2026-08-01 | 53 | — | ¥8.45$1.25阶梯▲ | ¥16.90$2.50 | ¥1.35 | 1.0M | 64K | 2024-11 | 42 | 文本视觉 | 旗舰推理 | 使用 → | |
| Gemini 3.6 Flash | 🇺🇸Google 人工监控: 2026-08-01 | — | — | ¥10.14$1.50 | ¥50.70$7.50 | ¥1.01 | 1.0M | 66K | 2026-03 | — | 文本视觉音频 | 快速多模态 | 使用 → | |
| Gemini 3.5 Flash | 🇺🇸Google 人工监控: 2026-08-01 | 55 | — | ¥10.14$1.50 | ¥60.84$9.00 | ¥1.01 | 1.0M | 64K | — | 15 | 文本视觉音频 | 快速多模态上代 | 使用 → | |
| Qwen3.7 Max | 🇨🇳阿里通义 自动核对: 2026-08-03 | 57 | — | ¥12.00 | ¥36.00 | — | 1.0M | 32K | — | 24 | 文本视觉 | 旗舰Agent长上下文新发布 | 使用 → | |
| GPT-5.6 Terra | 🇺🇸OpenAI 人工监控: 2026-08-01 | — | — | ¥13.52$2.00阶梯▲ | ¥81.12$12.00 | ¥1.35 | 1.1M | 128K | 2026-02 | — | 文本视觉 | 性价比 | 使用 → | |
| Claude Sonnet 5 | 🇺🇸Anthropic 人工监控: 2026-08-01 | 57 | — | ¥13.52$2.00 | ¥67.60$10.00 | ¥1.35 | 1.0M | 128K | 2026-01 | 14 | 文本视觉 | 性价比代码长上下文 | 使用 → | |
| Gemini 3.1 Pro Preview | 🇺🇸Google 人工监控: 2026-08-01 | 57 | — | ¥13.52$2.00阶梯▲ | ¥81.12$12.00 | ¥1.35 | 2.0M | 64K | 2025-01 | 12 | 文本视觉音频 | 旗舰长上下文多模态 | 使用 → | |
| GPT-5.4 | 🇺🇸OpenAI 人工监控: 2026-08-01 | — | — | ¥16.90$2.50阶梯▲ | ¥101.40$15.00 | ¥1.69 | 400K | 128K | 2025-08 | — | 文本视觉 | 性价比 | 使用 → | |
| Kimi K3 | 🇨🇳Moonshot / Kimi 自动核对: 2026-08-01 | — | #91.34T | ¥20.00 | ¥100.00 | ¥2.00 | 1.0M | 32K | — | — | 文本 | 旗舰长上下文推理 | 使用 → | |
| Claude Sonnet 4.6 | 🇺🇸Anthropic 人工监控: 2026-08-01 | 52 | — | ¥20.28$3.00 | ¥101.40$15.00 | ¥2.03 | 1.0M | 64K | — | 9 | 文本视觉 | 性价比长上下文代码 | 使用 → | |
| GPT-5.5 | 🇺🇸OpenAI 人工监控: 2026-08-01 | 60 | — | ¥33.80$5.00阶梯▲ | ¥202.79$30.00 | ¥3.38 | 400K | 128K | 2025-12 | 5 | 文本视觉 | 旗舰推理 | 使用 → | |
| GPT-5.6 Sol | 🇺🇸OpenAI 人工监控: 2026-08-01 | 59 | — | ¥33.80$5.00阶梯▲ | ¥202.79$30.00 | ¥3.38 | 1.1M | 128K | 2026-02 | 5 | 文本视觉 | 旗舰推理 | 使用 → | |
| Claude Opus 4.8 | 🇺🇸Anthropic 人工监控: 2026-08-01 | 61 | — | ¥33.80$5.00 | ¥169.00$25.00 | ¥3.38 | 1.0M | 64K | 2026-01 | 6 | 文本视觉 | 长上下文代码推理上代旗舰 | 使用 → | |
| Claude Opus 5 | 🇺🇸Anthropic 人工监控: 2026-08-01 | 61 | — | ¥33.80$5.00 | ¥169.00$25.00 | ¥3.38 | 1.0M | 128K | 2026-05 | 6 | 文本视觉 | 旗舰推理代码长上下文 | 使用 → | |
| Claude Opus 4.7 | 🇺🇸Anthropic 人工监控: 2026-08-01 | 57 | — | ¥33.80$5.00 | ¥169.00$25.00 | ¥3.38 | 1.0M | 64K | 2026-01 | 6 | 文本视觉 | 长上下文代码上代 | 使用 → | |
| Claude Fable 5 | 🇺🇸Anthropic 人工监控: 2026-08-01 | 60 | — | ¥67.60$10.00 | ¥337.99$50.00 | ¥6.76 | 1.0M | 128K | 2026-01 | 3 | 文本视觉 | 旗舰推理代码长上下文 | 使用 → |
价格单位:人民币 / 百万 tokens。USD 计费厂商(currency=USD,含 OpenAI/Anthropic/Google/xAI/MiniMax)按官方美元原价存储,加载时乘 usdToCny(每日核对实时汇率、变动即更新,最近校准日期见 usdToCnyUpdated 字段)换算成 CNY;CNY 计费厂商按中国区官方人民币定价存储(不随汇率浮动)。最终以各厂商官方文档为准。2026-08 版:新增 GPT-5.6 系列三档(Sol $5/$30、Terra $2/$12、Luna $0.20/$1.20;三档共享 1.05M 上下文 / 128K 最大输出;2026-07-09 发布,Terra / Luna 于 2026-07-30 永久降价);新增 Claude Sonnet 5($2/$10,1M 上下文 / 128K 最大输出,2026-06-30 发布,现行优惠价至 2026-08-31);新增 Claude Opus 5($5/$25,1M 上下文 / 128K 最大输出,2026-07-24 发布,当前 Anthropic 旗舰,AA 智能指数 61 分);新增 Gemini 3.6 Flash($1.50/$7.50,1M 上下文,知识截止 2026-03,2026-07-21 发布);Fable 5 补全 AA 智能指数 60 分;汇率更新 6.7649(2026-08-01);2026-08-02 按 OpenAI 官方定价页补录 GPT-5.6 三档的 Fast 加速档(标准价 2 倍,能力不变,取代原 Priority Processing)与 Terra / Luna 此前缺失的 272K 长上下文阶梯价。 加速档口径:fastMode 为可选加速服务档,不参与默认显示价与排序,表格与详情页顶部一律显示标准价;OpenAI 官方 Fast 档未列长上下文分档,Anthropic Fast 档则明确覆盖全上下文窗口。 2026-08-02 全库分档普查(覆盖 OpenAI / Anthropic / Google / xAI / DeepSeek / 阿里通义 / Kimi 七家官方定价页):补 Grok Build 0.1 的 200K 分档(xAI 全线长上下文计价)与 Claude Opus 5 / 4.8 的 Fast 档;移除 Claude Sonnet 4.6 依据第三方数据集误录的 >200K 翻倍档(官方两处文档明确 Claude 4.6+ 的 1M 窗口按标准价结算);核实确认为单一价的有 Gemini Flash 全系、GPT-5.1、Claude 其余各档、DeepSeek V4 双档、Kimi K3、Qwen3.7 Max。同日续查国产九家官方页:补录 GLM-5.1 / GLM-5 / GLM-4.7 的 32K 分档、文心 ERNIE 5.1 的 32K 分档、MiniMax M3 的 512K 分档,并修正 Doubao 1.6 误将最高档(128K-256K)当默认价的问题(2.4/24 → 首档 0.8/8);核实为单一价的有 GLM-5.2、Doubao Seed 2.1 Pro、Doubao 1.5 Pro、ERNIE 4.5 Turbo、MiniMax M2.7、百川双档、小米 MiMo-V2.5。腾讯混元四档(TurboS / T1 / 2.0 Think / Hy3)、讯飞星火四档、阶跃 Step 3.7 Flash 的分档情况仍未核实——腾讯官方计费页未列这四个型号,讯飞与阶跃定价页本次不可达。 阶梯价口径:tiers 按单次请求输入 tokens 所在档对整单计价(百炼计费规则页原文:「单价取决于单次请求的输入 Token 总量,该请求的所有 Token 均按对应阶梯的单价结算」);档位阈值中的 K=1000、M=1000000(非 1024 进制,官方明示),首档=表格默认显示价;无 tiers 字段=该模型单一价或分档待核。
懒得逐家注册?一个 key 调所有模型
不想各家分别注册、各自充值、各管各的 key?用 AIMLAPI 一个 key 直连数百个模型,按量计费、随时切换。比价完想省事就走它。
含推广 · 通过此链接注册我们可能获得返佣,不影响你的价格
热门对比
两两 PK,用真实价格看清谁更划算。
深度文章
计费机制、省钱实战、避坑与选型,价格全部真实可溯源。
怎么挑一个最划算的大模型?
第一步,分清「输入价」和「输出价」。几乎所有 LLM 厂商都按 token 计费,但输入 token(你发给模型的) 和输出 token(模型生成的)单价不一样,通常输出贵 4–10 倍。所以「短问长答」类任务(写文章、生成代码)成本主要取决于输出价, 而「长问短答」类任务(文档摘要、分类)则看输入价。
第二步,看缓存价。如果你的应用有大量重复的 system prompt 或文档上下文(比如客服机器人、 RAG),缓存命中后输入价能降到 10–20%。DeepSeek、OpenAI、Anthropic、 Google 都支持上下文缓存,但价格差异巨大。
第三步,看任务复杂度。不要默认用旗舰模型。Claude Haiku 4.5、Gemini 2.5 Flash-Lite、Qwen3.5 Flash、 DeepSeek V4 Flash 这些「腰部模型」性价比极高,对话、翻译、简单生成、分类 这些任务完全够用,成本只有旗舰的 1–5%。
第四步,国产 vs 海外。如果用户在中国大陆,访问 DeepSeek、Kimi、通义、豆包延迟低(~50ms vs ~500ms),且不需要科学上网。Qwen3.5 Flash(¥0.20/¥2)和 DeepSeek V4 Flash (¥1/¥2)是当前最便宜的两个,Gemini 2.5 Flash-Lite 则是海外最便宜的选项。
第五步,用估算器算总账。单价只是 nominal,真实月账单取决于调用次数 × 单次 token 量。 把你典型任务的 prompt 粘到 Token 估算器,瞬间看清各家月成本差距。
常见问题
输入价、输出价、缓存价,一次调用到底按哪个收?
三个一起收,分别算。你发进去的内容按输入价计费(命中缓存的那部分改按更便宜的缓存价),模型生成的内容按输出价计费,最后相加就是这次调用的费用。所以同一个模型对不同任务的实际成本差别很大:长文档摘要主要花在输入,写长文主要花在输出,重复前缀多的应用则靠缓存把输入那块压下来。
为什么输出价普遍比输入价贵好几倍?
因为生成比读取更耗算力。模型读输入是一次性并行处理,而生成输出是一个 token 一个 token 自回归解码出来的,计算量大得多,厂商定价也就随之拉高,常见是输入价的 4 到 10 倍。实际影响是:凡是「让模型多写」的任务,省钱的重点不是换便宜模型,而是先想办法让它少写——限定长度、只要结果不要解释,往往立竿见影。
缓存价那么便宜,是不是我用了缓存就一定省钱?
不一定,要看你的请求结构。缓存通常只对「重复的前缀」生效,且要达到最小 token 门槛、两次请求间隔不能太久,部分厂商首次写入缓存还会单独收一笔。如果你每次 prompt 开头都不一样(比如把用户输入放在最前面),就基本命中不了。想吃到缓存红利,正确做法是把固定不变的内容(system prompt、文档、工具定义)放在最前面,变动的用户输入放最后。
上下文窗口越大越好吗?为什么大窗口反而可能更费钱?
窗口大解决的是「能不能装下」,不解决「该不该装满」。你塞进窗口的每个 token 都按输入价计费,把整本手册一次性丢进去,既增加费用又可能分散模型注意力、降低回答质量。更划算的通常是「精准检索只取相关片段 + 把固定前缀做成缓存」。大窗口的真正价值在于那些确实无法切分的任务,比如通读一份长合同或整个代码库。
推理/思考模型标的输出价看着不贵,为什么账单更高?
因为带「思考」「推理」模式的模型在给出最终答案前,会先生成一大段你通常看不到的思维链,而这些思维 token 一般也按输出价计费。也就是说你为「它在想的过程」也付了钱。所以评估这类模型不能只看挂牌的输出单价,要结合它在你任务上实际产生多少思维 token——同样一道题,思维链越长,隐性成本越高。对不需要复杂推理的任务,直接用非推理模型往往更省。
同一个模型,为什么不同地方报价不一样?算盘列的是哪个价?
因为同一个模型可以通过官方 API、聚合平台(如 OpenRouter)、云厂商托管(如火山方舟、阿里云百炼)等多个渠道调用,各渠道定价、汇率折算、促销策略都不同,价差有时不小。本站价格表默认展示官方定价作为基准,另设了「渠道比价」页专门把同一模型在各渠道的实测价并排列出来,每个价都标了核对日期和来源,方便你找到当下最便宜的调用方式。
算盘上的价格多久更新一次?可靠吗?
国产主力厂商接了每日自动核价,海外(美元计费)厂商按当日实时汇率折算,每个价格都记录了最近核对日期和核对方式。但模型定价变动频繁、各家也常有限时促销,本站只做对比和换算,任何价格最终都以厂商官方文档为准。算盘是独立开发者做的工具站,不隶属也不代表任何厂商;如果你发现某个数字和官方对不上,欢迎指出,会尽快更正。