DeepSeek 的非高峰时段定价能节省多少?
DeepSeek 是唯一一家按一天中不同时间收费的主要模型供应商。工作日的 01:00 至 04:00 和 06:00 至 10:00 UTC 是高峰时段,其他所有时间段的价格均为一半。
这意味着每个工作日有七个小时是高峰时段,一周 168 小时中有 35 小时。日历的大约 79% 已经是处于非高峰时段(根据公布的时间窗口计算)。大多数团队在部分流量上支付全额费用,却从未注意到这一点。
此折扣并非促销或承诺使用套餐。它会根据请求到达时的时钟自动应用。AI Perks 会跟踪 194 家公司的供应商定价和信用计划,这是其中最容易被忽视的成本杠杆。

您的时区 DeepSeek 高峰时段是何时?
高峰时段以 UTC 为固定标准,因此它们在您的工作日中的位置完全取决于您所处的地理位置。对于北美团队来说,整个工作日都已经是处于非高峰时段。
根据公布的 UTC 时间窗口转换:
| 地点 | 高峰时段 1 | 高峰时段 2 |
|---|---|---|
| UTC | 01:00-04:00 | 06:00-10:00 |
| 中国 (UTC+8) | 09:00-12:00 | 14:00-18:00 |
| 印度 (UTC+5:30) | 06:30-09:30 | 11:30-15:30 |
| 中欧 (UTC+2) | 03:00-06:00 | 08:00-12:00 |
| 英国 (UTC+1) | 02:00-05:00 | 07:00-11:00 |
| 美国东部 (UTC-4) | 21:00-00:00 | 02:00-06:00 |
| 美国太平洋 (UTC-7) | 18:00-21:00 | 23:00-03:00 |
中国列解释了整个设计。两个高峰时段都对应着中国的工作日,上午和下午,午餐时间段位于它们之间,属于非高峰时段。高峰定价是 DeepSeek 本土市场的拥堵定价。
两个实际后果:
如果您在美国,您很可能已经意外地处于非高峰时段。 您的 9 点到 5 点的流量都位于这两个时间窗口之外。让您付出代价的是夜间的 cron 作业,而这正是高峰时段的开始。
如果您在欧洲,您的上午时段费用昂贵,而下午时段则半价。 当地时间 08:00 至 12:00 的时间窗口涵盖了欧洲工作日中最繁忙的时段。
时间窗口以 UTC 为固定,因此当地时间会随着夏令时而变化,而美洲的周日晚上可能落在周一的第一个高峰时段内。
叠加的缓存乘数
非高峰时段可以将您的账单减半。缓存命中可以将输入成本降低约 30 倍。两者相乘,共同构成了不同团队为相同工作支付 DeepSeek 费用的巨大差异。
当前的公布费率,美元/百万 tokens:
| 模型 | Token 类型 | 非高峰 | 高峰 |
|---|---|---|---|
| DeepSeek-V4-Pro-0813 | 输入,缓存命中 | $0.022 | $0.044 |
| DeepSeek-V4-Pro-0813 | 输入,缓存未命中 | $0.66 | $1.32 |
| DeepSeek-V4-Pro-0813 | 输出 | $1.98 | $3.96 |
| DeepSeek-V4.1-Flash | 输入,缓存命中 | $0.003 | $0.006 |
| DeepSeek-V4.1-Flash | 输入,缓存未命中 | $0.15 | $0.30 |
一个缓存的非高峰输入 token 价格为 $0.022,而一个高峰缓存未命中价格为 $1.32,这意味着相同的模型存在 60 倍的差价。请求本身没有变化,唯一改变的是运行时间以及前缀是否已存在。
以下是 V4-Pro 上一个实际的月度工作量(5000 万输入 tokens 和 1000 万输出 tokens)的成本情况(算术推导自上表):
| 配置 | 输入 | 输出 | 月度总计 |
|---|---|---|---|
| 高峰,无缓存 | $66.00 | $39.60 | $105.60 |
| 高峰,80% 缓存命中 | $14.96 | $39.60 | $54.56 |
| 非高峰,无缓存 | $33.00 | $19.80 | $52.80 |
| 非高峰,80% 缓存命中 | $7.48 | $19.80 | $27.28 |
对于相同的 tokens 和相同的模型,成本降低了 74%。 中间两行决定了先拉动哪个杠杆:仅移动时钟($52.80)略优于仅缓存($54.56),并且这只需要一行 cron 配置,而不是重构提示。
然后注意几乎没有人指出的细节:在 $27.28 的总费用中,输出 tokens 占了 $19.80,约 73%。一旦您缓存并转移到非高峰时段,DeepSeek 就完全不再是输入成本问题,而变成了输出长度问题。因此,削减冗长的响应比任何进一步的提示优化都更有价值。

上一个 DeepSeek 定价指南以来发生了什么变化
DeepSeek-V4-Pro-0813 于 2026 年 8 月 13 日正式发布,而按时段定价则于 2026 年 8 月 16 日生效。在此日期之前的任何 DeepSeek 成本指南描述的都是一个不再存在的定价模型。
重要的时间线:
- 2026 年 4 月 24 日: V4-Pro 和 V4-Flash 预览版,拥有 1M tokens 的上下文窗口,最多 384K 输出,以及可切换的思考和非思考模式(置信度:中)。
- 2026 年 7 月 31 日: DeepSeek-V4-Flash-0731,稳定的 Flash 版本。更改前的最后已知价格是每个百万缓存未命中输入 tokens $0.14,每个百万输出 $0.28(置信度:中,仅历史数据)。
- 2026 年 8 月 13 日: V4-Pro-0813 正式发布。
- 2026 年 8 月 16 日: 高峰和非高峰定价生效。
- 约 2026 年 9 月 10 日: DeepSeek-V4.1-Flash,在文档中称为 DeepSeek-Flash。
比较旧的 Flash 输入固定价格 $0.14 与新的非高峰 $0.15 和高峰 $0.30。8 月份的变动并非降价,而是价格拆分。 在非高峰时段运行 Flash,您的费用大致与以前相同。在高峰时段内运行,您的费用将接近旧费率的两倍。那些从不关注时钟的团队悄悄地承受了价格上涨。
DeepSeek V4.1-Flash 中的重大变更
DeepSeek-V4.1-Flash 弃用了 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 这两个终端节点名称。基于它们编写的代码将失败,而大多数在线教程仍然引用它们。
这次更新没有引起任何轰动,这是最糟糕的重大变更方式:那些在 DeepSeek 查询中排名靠前的教程、Stack Overflow 回答和入门仓库都是在此之前编写的,并且尚未更新。如果您正在调试上个月还能正常工作的集成,请在检查其他任何东西之前,先检查您的模型字符串。
这个教训具有普遍性:DeepSeek 在 API 文档中记录更改,而不是提前宣布。因此,应明确固定模型标识符,并每季度重新阅读一次定价页面。

DeepSeek 是否提供免费积分或创业计划?
DeepSeek 聊天应用程序可以免费使用。官方定价页面上没有列出 API 免费套餐,DeepSeek 也没有运行任何专门的创业公司积分计划。
请谨慎对待您在此处看到的其他信息。关于新 API 账户接收免费积分的说法报道不一致,并且未在 DeepSeek 官方定价页面上得到证实。许多文章仍然重复某个数字。在从 DeepSeek 直接获得信息之前,请将您看到的任何具体数字视为未经核实。
这种缺失才是对创始人来说真正重要的事情。几乎所有主要供应商现在都运行某种形式的积分计划,而 DeepSeek 没有。它的成本策略是低列表价格加上上述非高峰和缓存机制,这是一种截然不同的策略,但这意味着没有可以申请的免费试用期。
实际的做法是将 DeepSeek 视为您始终可用的廉价层,并使用那些提供计划的供应商的积分来资助昂贵的层。**AI Perks 跟踪了 194 家公司的 770 万美元的积分,这才是真正的免费试用期来源。
对于第三方托管,Baseten 将 DeepSeek V4.1 Flash 的输入价格列为每百万 $0.30,并提供一个标准的 30 美元新工作空间试用积分(预算前请核实)。OpenRouter、Together 和 Fireworks 也托管 DeepSeek 模型。它们的价格变动频繁,因此路由决策应基于延迟、区域和可靠性,然后在您承诺时重新定价。
如何围绕非高峰时段重构工作负载
第一步:优先资助您的高级套餐。 从 getaiperks.com 开始,收集您将重度任务路由到的供应商的积分,这样 DeepSeek 就可以只承担批量工作。
第二步:将所有批处理作业移出高峰时段。 回填、嵌入运行、评估扫描和夜间总结都没有截止日期。将 cron 作业移动两个小时可以为一行配置带来 50% 的折扣。
第三步:稳定您的提示前缀。 缓存命中依赖于相同的前缀,因此将提示的易变部分放在最后。这就是 30 倍差异的来源。
第四步:衡量您的实际缓存命中率。 大多数团队都假设缓存正在工作,但从未检查过。假设的 80% 与实际的 30% 之间的差距构成了您账单的大部分。
第五步:关注输出长度。 完成第二步和第三步后,输出 tokens 将占据主导地位。更短的响应是您当前最大的剩余杠杆。

常见问题解答
DeepSeek 的非高峰时段是何时?
非高峰时段是指工作日 01:00 至 04:00 和 06:00 至 10:00 UTC 之外的所有时间,这大致占全周的 79%,包括周六和周日。非高峰请求的输入和输出 tokens 价格均为高峰时段的一半,并自动应用,无需任何配置。
DeepSeek 有免费 API 套餐吗?
没有。DeepSeek 聊天应用程序可以免费使用,但官方定价页面上没有列出 API 免费套餐。关于新 API 账户免费积分的报告不一致且未经证实。有关实际的免费 API 试用期,请参阅 AI Perks 跟踪的计划。
DeepSeek 缓存命中便宜多少?
在 DeepSeek-V4-Pro-0813 上,非高峰时段的缓存命中输入 tokens 价格为每百万 $0.022,而缓存未命中为 $0.66,便宜 30 倍。与高峰时段的缓存未命中价格 $1.32 相比,对于相同的模型和相同的请求,差价高达 60 倍。
我的 DeepSeek API 调用为什么停止工作了?
DeepSeek-V4.1-Flash 弃用了 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 这两个终端节点名称。旧的教程和代码示例仍然引用它们,现在已经失败。请首先检查您的模型标识符字符串,因为此更改是悄悄发布的,大多数已发布的指南尚未更新。请在您的配置中明确固定当前名称。
DeepSeek 有创业公司积分计划吗?
没有。与大多数主要模型供应商不同,DeepSeek 不运行任何专门的创业公司积分计划。它的成本策略是低列表价格加上非高峰和缓存折扣。对于提供创业公司积分的供应商,AI Perks 跟踪了 194 家公司的 770 万美元积分。
我应该通过 OpenRouter 还是直接运行 DeepSeek?
直接访问会应用公布的非高峰和缓存定价。转售商会设定自己的费率,并且可能不会将时段折扣传递下去。Baseten、OpenRouter、Together 和 Fireworks 都托管 DeepSeek 模型,因此请根据延迟和区域进行比较,然后在承诺前验证当前价格。
DeepSeek 不会提供积分。但许多其他公司会提供,它们都在 getaiperks.com 上。