快速回答
DeepSeek 官方从 2026-08-16 16:00 UTC 起,把 V4 系列从平价改为峰谷定价:峰值时段更贵,非峰值(off-peak)为峰值的一半。对重度用户影响最大的是——缓存命中的输入价涨了约 12 倍(峰值时段),而「缓存命中便宜」原本是长 agent 会话省钱的命根子。
不想被峰谷牵着走、也不想盯着时钟用模型的话,TeamoRouter 保持平价:deepseek-v4-flash $0.14/$0.28、deepseek-v4-pro $1.74/$3.48,无峰谷,另外还有每天 200 次的免费档。
峰谷机制是什么
官方把一天划成峰值和非峰值两段:
- 峰值时段:01:00–04:00 UTC 和 06:00–10:00 UTC(对应北京时间的工作日白天时段)。
- 非峰值:其余时间,价格约为峰值的一半。
换句话说,在你最可能用模型的时间段,价格翻倍;想省钱就得把重负载挪到非峰值跑——这对手动调用还好,对「全天跑」的 agent 场景很不友好。
涨了多少:V4 Pro 每百万 token
以官方公布的口径(每百万 token,deepseek-v4-pro):
| 计费项 | 旧平价 | 新非峰值 | 新峰值 |
|---|---|---|---|
| 输入·缓存命中 | $0.003625 | $0.022 | $0.044(约 12.1×) |
| 输入·缓存未命中 | $0.435 | $0.66 | $1.32 |
| 输出 | $0.87 | $1.98 | $3.96 |
deepseek-v4-flash 的输出同样从 $0.28 涨到 $0.66 / $1.32(峰谷)。
最扎眼的两个变化:
- 缓存命中输入涨约 12 倍——这是长 agent 会话里最依赖的省钱项。稳定的系统提示词 + 长会话,原本缓存命中近乎免费,峰值时段成本直接放大一个数量级。
- 输出峰值翻倍——agent 产出大段 diff、测试、报告,正好是输出密集场景,峰值时段成本倍增。
一个月会差多少
算例:一个月 30M 输入(其中 80% 缓存命中)+ 3M 输出,用 V4 Pro:
| 口径 | 月成本 |
|---|---|
| 旧平价 | ≈ $5.31 |
| 新非峰值 | ≈ $10.43 |
| 新峰值 | ≈ $20.86 |
同一份用量,峰值时段的成本接近旧价的 4 倍。对个人是几美元到十几美元的差距;对「多 agent 全天跑」的团队,这是成百上千美元的量级差。
平价替代:TeamoRouter 无峰谷
TeamoRouter 保持平价、无峰谷,你不用看时钟:
| 模型 | 输入 | 输出 | 免费档 |
|---|---|---|---|
deepseek-v4-flash |
$0.14 | $0.28 | 200 次/天(-free) |
deepseek-v4-pro |
$1.74 | $3.48 | 200 次/天(-free) |
配一个 OpenAI 兼容端点即可:
Base URL : https://api.teamorouter.com/v1
API Key : sk-teamo-你的Key
模型 ID : deepseek-v4-pro-free # 免费档;付费用 deepseek-v4-pro
再加上 deepseek-v4-pro-free / deepseek-v4-flash-free 每天各 200 次,很多轻度用户的「调价焦虑」直接被免费额度消化掉了。
常见疑问
Q:峰谷对「偶尔用用」的人有影响吗? 影响小。峰谷主要伤的是「全天跑 agent」「大批量输出」这类重度场景;偶尔调用多付的绝对金额不高。
Q:免费档也受峰谷影响吗? 免费档按请求数计(每天 200 次),不按 token 峰谷计价,不受调价影响。
Q:付费怎么选? 不想盯时钟、要可预测成本,用 TeamoRouter 平价;追求官方原价且能接受峰谷,走官方。两者模型 ID 不同,注意区分。
Q:调价后价格会再变吗? 价格会动态调整。以官方 pricing 页 和 TeamoRouter pricing 的实时数据为准。
Q:缓存的 12 倍涨幅能避开吗? 把重负载挪到非峰值、或改用平价端点都能缓解。对长 agent 会话,选一个缓存命中仍便宜的端点,价值尤其大。
到 TeamoRouter 看平价方案,把调价的影响降到最低。