DeepSeek 上下文缓存 2026:30 倍输入折扣

DeepSeek 的缓存输入费用比未命中缓存的费用低 30 倍,并在非高峰时段将所有价格减半。V4-Pro 和 V4.1-Flash 的费率,解释如下。

DeepSeekContext CachingLLM PricingAI API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
11,666

Quick Answer

DeepSeek-V4-Pro 的缓存命中,在非高峰时段每百万输入 token 成本为 0.022 美元,而缓存未命中为 0.66 美元,同一模型的折扣高达 30 倍。DeepSeek 在高峰时段之外还将所有价格减半,因此非高峰时段缓存的 token 价格比高峰时段缓存未命中的 token 便宜 60 倍。提供创业公司计划的提供商的积分可在 getaiperks.com 跟踪。

DeepSeek 缓存命中实际成本

在 DeepSeek-V4-Pro 上,从缓存提供的输入 token 价格为每百万个 token 0.022 美元(非高峰时段),而缓存未命中则为 0.66 美元。这意味着第二次发送相同的前缀可享受 30 倍的折扣。

大多数定价页面只提供一个输入数字然后就结束了。DeepSeek 有四个,因为每次调用都应用两个独立的乘数:前缀是否命中缓存,以及您发送的时间。

模型和窗口缓存命中输入缓存未命中输入输出
DeepSeek-V4-Pro-0813,非高峰时段$0.022$0.66$1.98
DeepSeek-V4-Pro-0813,高峰时段$0.044$1.32$3.96
DeepSeek-V4.1-Flash,非高峰时段$0.003$0.15未经验证
DeepSeek-V4.1-Flash,高峰时段$0.006$0.30未经验证

所有数据均为每百万 token 美元,来自 2026 年 9 月的官方 API 文档。V4.1-Flash 的输出定价在此处未经验证,因此在对其进行预算之前,请查看官方页面。

Flash 的比例甚至比旗舰模型还要大:0.003 美元对 0.15 美元是 50 倍的差距(根据上述费率得出)。AI Perks 会跟踪此类供应商机制以及抵消它的积分计划。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

高峰和非高峰时段:唯一按时计费的供应商

DeepSeek 高峰时段是工作日 UTC 时间的 01:00-04:00 和 06:00-10:00。其他所有时间,包括整个周六和周日,价格均为一半。

没有其他主要的模型供应商按一天中的时间收费,这使得它成为 LLM 成本工作中被忽视最多的杠杆。为 OpenAI 或 Anthropic 编写的优化指南没有任何理由提及它。

根据这些时间窗口推断:高峰时段是每天 7 小时,共 5 个工作日,即一周 168 小时中的 35 小时。大约79% 的日历时间已是非高峰时段,因此大多数团队会意外地获得折扣,并且可以更有意地获得更多折扣。

您的位置决定了您的工作日有多少时间受到影响:

团队位置高峰时段(当地时间)工作日曝光
美国东部(UTC-4)21:00-00:00,02:00-06:00无,整个工作日均为非高峰时段
美国太平洋(UTC-7)18:00-21:00,23:00-03:00
中欧(UTC+2)03:00-06:00,08:00-12:00整个上午
印度(UTC+5:30)06:30-09:30,11:30-15:30大部分工作日
中国(UTC+8)09:00-12:00,14:00-18:00几乎全部

当地时间根据所示偏移量从发布的 UTC 时间窗口转换而来,夏令时会将其移动一小时。这种模式并非偶然:高峰时段与中国工作日相吻合,因此美国团队的交互式流量将免费落在一天中便宜的一半时间内。


叠加两种折扣:同一模型的 60 倍价差

非高峰时段缓存的输入 token 价格为 0.022 美元,而高峰时段未缓存的输入 token 价格为 1.32 美元,对于来自同一模型的相同输出,价差为 60 倍。

在实际的代理工作负载中,这看起来是这样的:一个 200,000 token 的上下文每天重新发送 1,000 次,即 V4-Pro 每天 2 亿个输入 token。

场景每百万 token 费率每日输入成本
高峰时段,每次调用缓存未命中$1.32$264.00
非高峰时段,每次调用缓存未命中$0.66$132.00
高峰时段,每次调用缓存命中$0.044$8.80
非高峰时段,每次调用缓存命中$0.022$4.40
所有四行均通过将公布的费率乘以 200 得出。第一行和最后一行之间的差距每天约 260 美元,或每年约 95,000 美元,而工作负载根本没有改变。

大多数成本分析都会遗漏两个要点:

缓存的旗舰模型优于未缓存的小型模型。 V4-Pro 非高峰时段缓存输入价格为 0.022 美元,比 V4.1-Flash 未缓存输入价格 0.15 美元便宜约 7 倍(推算)。如果真正的问题是您从未预热过的缓存,那么降级模型以节省成本是错误的做法。

输出永远不会被缓存。 以 1.98 美元(非高峰时段)计算,一个输出 token 的成本大约是缓存输入 token 的 90 倍(推算)。一旦缓存生效,您将不再有输入账单,而是输出账单,而任何进一步的节省都来自更短的响应或有限的思考预算。使用供应商积分资助输出账单的团队可以在 getaiperks.com 上比较可用的选项。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

自从我们之前的 DeepSeek 定价指南以来发生了什么变化

2026 年发生了三件事:V4-Pro-0813 于 8 月 13 日正式上市,非高峰和高峰时段定价取代了 8 月中旬的固定费率,V4.1-Flash 于 9 月 10 日左右发布。

我们之前的 DeepSeek 定价页面引用了固定的每 token 费率,没有时间段的组成部分。那些内容已过时,应视为历史。

时间线(置信度已诚实标注):

  • 2026 年 4 月 24 日(中等置信度):V4-Pro 和 V4-Flash 预览版,具有 1M token 的上下文窗口,最多 384K 输出 token,以及可切换的思考和非思考模式。
  • 2026 年 7 月 31 日(中等置信度):DeepSeek-V4-Flash-0731,稳定的 Flash 版本。更改前最后一个已知价格为每百万 token 缓存未命中输入 0.14 美元,每百万 token 输出 0.28 美元,均为固定费率。仅供参考。
  • 2026 年 8 月 13 日:DeepSeek-V4-Pro-0813 正式上市,当前的旗舰推理和代理模型。
  • 2026 年 9 月 10 日左右:DeepSeek-V4.1-Flash,在文档中列为“DeepSeek-Flash”。

如果您使用的是 2026 年 8 月之前的教程或成本模型,其中所有的输入数字都是错误的:缓存命中时过高,高峰时段缓存未命中时过低。


导致旧代码崩溃的终端节点重命名

DeepSeek-V4.1-Flash 已悄然停用 deepseek-v4-flashdeepseek-v4-flash-vision-exp 模型名称。仍使用这些字符串的请求将失败。

这种变化会以生产事故的形式出现,而不是迁移工单,因为模型名称通常位于一个配置文件中,而该文件已经几个月没人打开过了。旧的代码示例、SDK 包装器和第三方教程仍然引用已停用的名称。

在下次部署之前,值得做以下工作:

  • 在整个代码库中搜索这两个已停用的字符串,包括基础设施配置和笔记本
  • 检查任何硬编码了默认 DeepSeek 模型的第三方 SDK 或代理框架
  • 单独确认视觉路径,因为实验性视觉终端节点也已重命名
  • 之后重新运行成本模型,因为替换项采用了新的高峰和非高峰时段计划

Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

DeepSeek 免费层和积分:事实真相

DeepSeek 聊天应用程序可免费使用。API 不免费,官方定价页面上没有声明免费层。

这就是大多数文章出错的地方。关于新 API 账户获得免费积分的说法流传甚广,报告不一致,并且在官方定价页面上未得到确认。如果您需要初始余额,请假设您需要为此付费。

对创始人来说更重要的是:DeepSeek 不提供专门的初创公司积分计划。 没有申请,没有分阶段的层级,也没有合作伙伴通道。低廉的每 token 定价是唯一的优惠,如果您正在构建积分组合,这确实是一个空白。

这个空白正是路由决策至关重要的原因。许多供应商确实运行初创公司计划,AI Perks 跟踪了194 家公司总计 770 万美元的积分,涵盖了那些运行计划的供应商。实际模式是将高流量、缓存友好的流量路由到 DeepSeek(每百万 token 0.022 美元),并将获得的积分用于更昂贵的供应商,在那里一个免费 token 的价值要大得多。


从其他人那里购买 DeepSeek

第三方托管方不复制 DeepSeek 的高峰和非高峰时段计划,这意味着它们可以在高峰时段以低于第一方 API 的价格提供服务,而在非高峰时段则会输得很惨。

Baseten 列出的 DeepSeek V4.1 Flash 输入价格为每百万 token 0.30 美元(中等置信度,请在预算前核实),输出价格未可靠确认。Baseten 还提供30 美元的新的工作区试用积分

请注意 0.30 美元等于什么:它恰好等于 DeepSeek 自己的高峰缓存未命中率,是其非高峰率的两倍(推算)。对于主要在非高峰时段产生流量的美国或欧洲团队来说,固定的第三方费率并不明显是节省。

OpenRouter、Together 和 Fireworks 也托管 DeepSeek 模型。我们在此不列出它们的价格,因为我们尚未核实它们,您阅读的任何内容也不应如此。然而,定性的权衡是一致的:

  • 第一方 API:唯一可以应用完整的缓存命中和非高峰时段组合的地方,并且在两者同时生效时是最便宜的途径。
  • 第三方托管方:固定费率,不同区域,统一账单,通常不涉及 DeepSeek 的缓存命中层级。
  • 聚合器:适用于故障转移,价格会稍高,您应该衡量而不是假设。

请自行将您的流量与两者进行比价,然后将结果与 getaiperks.com 上其他提供商可用的积分进行比较。免费 token 优于便宜的 token。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

常见问题解答

DeepSeek 缓存命中便宜多少?

在 DeepSeek-V4-Pro 上,非高峰时段缓存命中的输入 token 为每百万 token 0.022 美元,而缓存未命中为 0.66 美元,相差 30 倍。在 V4.1-Flash 上,差距更大,0.003 美元对 0.15 美元,相差 50 倍(推算)。费率来自 2026 年 9 月的官方 API 文档。

DeepSeek 的高峰时段是何时?

高峰时段仅限于工作日的 01:00-04:00 和 06:00-10:00 UTC。其他所有时间,包括周末两天,价格均为高峰时段的一半。这意味着一周约 79% 的时间是非高峰时段(推算),因此美国团队无需更改任何设置即可在整个工作日享受折扣。

DeepSeek 是否有免费 API 层?

官方定价页面未声明免费 API 层。消费者聊天应用程序是免费的,但 API 从第一个 token 开始收费。关于新账户免费积分的报告不一致且未经证实。提供积分的供应商可在 getaiperks.com 找到。

DeepSeek 是否提供初创公司积分?

DeepSeek 不提供专门的初创公司积分计划。低廉的每 token 定价是唯一的优惠。对于创建积分组合的创始人来说,这是一个值得在其他地方填补的空白:AI Perks 涵盖了 194 家公司从提供计划的供应商那里获得的 770 万美元积分。

为什么我的 DeepSeek API 调用停止工作了?

最可能的原因是模型名称。DeepSeek-V4.1-Flash 已停用 deepseek-v4-flashdeepseek-v4-flash-vision-exp 终端节点名称,而旧的教程和配置文件仍引用它们。请在您的代码库中搜索这两个字符串,包括第三方 SDK 和笔记本,然后根据当前费率重新检查您的成本模型。

我应该使用 DeepSeek V4-Pro 还是 V4.1-Flash?

在假设 Flash 更便宜之前,请先进行计算。V4-Pro 非高峰时段缓存输入的输入价格为 0.022 美元,比 Flash 未缓存输入的 0.15 美元便宜约 7 倍(推算),因此一个缓存良好的旗舰模型可以在输入成本上完全优于一个未缓存的小型模型。输出量,而不是模型大小,通常决定了账单。


在 getaiperks.com 订阅 →

缓存前缀,在非高峰时段发货,然后让别人的积分覆盖其余部分。

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.