大模型 API 定价页面看着都一样,但同一个模型在不同厂商、不同套餐下的实际账单能差十几倍。差异到底在哪?拿我一次真实的 Agent 编码任务账单算一遍就明白了。
先看用量:这个账单长什么样
| 指标 | 数值 | 占比 |
|---|---|---|
| 总 token | 55,474,539 | 100% |
| 输入(缓存命中) | 55,084,928 | 99.30% |
| 输入(未命中) | 212,119 | 0.38% |
| 输出 | 177,492 | 0.32% |
这个分布很典型:99.3% 是缓存命中。原因是 Agent 编码场景里,系统提示词和项目文件每一轮都要重新读进去,但因为前缀完全相同,被缓存命中了。缓存命中价和未命中价差 50 倍,这一项直接决定账单。
第一站:DeepSeek 官方按量(基准)
| 时段 | 输入未命中 | 输入缓存命中 | 输出 |
|---|---|---|---|
| 空闲 | ¥1 | ¥0.02 | ¥4 |
| 高峰 | ¥2 | ¥0.04 | ¥8 |

单位都是元/百万 token。代入本次用量(空闲时段):
空闲:55,084,928×0.02/1e6 + 212,119×1/1e6 + 177,492×4/1e6 = ¥2.02
高峰:55,084,928×0.04/1e6 + 212,119×2/1e6 + 177,492×8/1e6 = ¥4.05
官方价区间 = ¥2.02 ~ ¥4.05
第二站:火山方舟 Agent Plan(套餐反而不划算)
火山方舟的计费单位叫 AFP,公式是 AFP = (输入token×0.5 + 输出token×0.5) / 10000。关键点:AFP 不区分缓存命中,全按同一个系数算。
AFP = 55,474,539 × 0.5 / 10000 = 2,773.73 AFP
各档位对比
| 档位 | 月费 | AFP 额度 | 本次占额度 |
|---|---|---|---|
| Small | ¥40 | 20,000 | 13.87% |
| Medium | ¥200 | 100,000 | 2.77% |
| Large | ¥500 | 250,000 | 1.11% |
| Max | ¥1,000 | 500,000 | 0.55% |
如果用满套餐呢?20,000 AFP = 4 亿 token,按本次的 99.3% 命中率折算成官方价:
| 档位 | 套餐价 | 满额官方等价 | 倍数 |
|---|---|---|---|
| Small | ¥40 | ¥14.59 ~ ¥29.19 | 2.74 ~ 1.37× |
| Medium | ¥200 | ¥72.9 ~ ¥145.9 | 2.74 ~ 1.37× |
| Large | ¥500 | ¥182.4 ~ ¥364.8 | 2.74 ~ 1.37× |
| Max | ¥1,000 | ¥364.8 ~ ¥729.6 | 2.74 ~ 1.37× |
结论有点反直觉:用满套餐时,套餐价是官方按量的 1.37~2.74 倍。原因是官方缓存命中价只有 ¥0.02/M,低到离谱;而套餐的 AFP 不区分缓存,全按一个系数算。套餐的价值不在便宜,在于多模型切换 + 预算固定不超支。
第三站:阿里百炼(明显更贵)
| 版本 | 输入/输出/缓存 | 本次用量价格 |
|---|---|---|
| 当前版 deepseek-v4-flash | 1 / 2 / 0.2 | ¥11.58 |
| 0731 快照(闲时) | 1.5 / 4.5 / 0.15 | ¥9.38 |
| 0731 快照(忙时) | 3 / 9 / 0.3 | ¥18.76 |
单位是元/百万 token。百炼当前版比 DeepSeek 官方贵 2.9~5.7 倍——因为百炼没同步 DeepSeek 9 月 10 日那次降价,缓存价 0.2 vs 官方 0.02,差整整 10 倍。
遇到「官方不公开系数」怎么办
百炼的 Token Plan 用 Credits 抵扣,但官方文档明确写:"单次消耗的 Credits 由模型类型、Token 用量、思考模式及工具调用等动态决定",不提供系数表。我一开始想反推一个系数,后来发现那是不可靠的推测,直接删掉了。
第四站:智谱 GLM Coding Plan(不支持 DeepSeek)
智谱的套餐不支持 deepseek 模型,所以只能用 GLM-5.3-Flash 做同量级对照。智谱的积分区分缓存,公式是 积分 = (未命中输入×2.3 + 命中输入×0.56 + 输出×8) / 10000:
积分 = 212,119×2.3 + 55,084,928×0.56 + 177,492×8
= 487,874 + 30,847,560 + 1,419,936
= 32,755,370 → /10000 = 3,275.54 积分
智谱的缓存系数是 0.56 而火山是全量 0.5(不区分),所以同样 5547 万 token,智谱算出 3,275 积分,火山只有 2,773 AFP。不过这两个数不能直接比——积分和 AFP 的兑换汇率不同,要比得折算成钱。
四条线路横向对比
| 线路 | 本次用量成本 | 相对官方 |
|---|---|---|
| DeepSeek 官方(空闲) | ¥2.02 | 基准 |
| DeepSeek 官方(高峰) | ¥4.05 | 基准 |
| 火山方舟 Small 档 | ¥40(占 13.87%) | 20 倍(未用满) |
| 百炼当前版 | ¥11.58 | 5.7 倍 |
| 百炼 0731 闲时快照 | ¥9.38 | 4.6 倍 |
四条实用结论
- 先看缓存命中价,再看总价。缓存命中价能差 50 倍(0.02 vs 1+),这个系数比输入输出价加起来更重要。
- 套餐不总是更便宜。火山用满时是官方按量的 1.37~2.74 倍,因为它不区分缓存。买之前先用你的真实命中率算一遍。
- 关注厂商的降价节奏。百炼没跟上 DeepSeek 9/10 的降价,同一个模型就贵了 5.7 倍。锁定模型的话,官方直营通常更稳。
- Agent 场景要主动利用缓存。把稳定的系统提示词和项目文件放在最前面,别在中间插变化内容——前缀一变,后面全部缓存失效。这一条能把账单砍掉 99%。
价格与倍数计算/ 目录,含各厂商价格表 OCR 原文)。官方价格会变,本文数字仅代表该时点。想估算自己项目的 token 数可以用 Token 计数器,但精确计费务必看 API 返回的 usage。