2026年DeepSeek API的成本是多少?
DeepSeek-V4-Pro-0813在缓存未命中时每百万输入Token收费0.66美元,非高峰时段每百万输出Token收费1.98美元,高峰时段则翻倍。 DeepSeek是唯一一家根据请求发送时间收取不同价格的主要模型供应商。
有两个乘数决定了您的全部DeepSeek账单:时钟,以及输入是否命中缓存。关于DeepSeek的所有其他定价问题都源于这两点。
| 模型和窗口 | 输入,缓存命中 | 输入,缓存未命中 | 输出 |
|---|---|---|---|
| V4-Pro-0813,非高峰 | $0.022 | $0.66 | $1.98 |
| V4-Pro-0813,高峰 | $0.044 | $1.32 | $3.96 |
| V4.1-Flash,非高峰 | $0.003 | $0.15 | DeepSeek尚未公布 |
| V4.1-Flash,高峰 | $0.006 | $0.30 | DeepSeek尚未公布 |
所有数字均为每百万Token的美元价格,取自DeepSeek自身在2026年9月的API文档。DeepSeek定价激进,同时也是唯一一家没有为初创公司提供支持的主要供应商,AI Perks 的存在就是为了填补这一空白。

DeepSeek高峰和非高峰定价如何运作
工作日的01:00至04:00以及06:00至10:00 UTC是高峰时段。其他所有时间,包括整个周六和周日,均为非高峰时段,收费减半。
这意味着每天有七个小时的高峰时段,每周有五天,或者说每周168小时中有35小时。根据公布的窗口推算,每周有79%的时间是非高峰。 高价率是狭窄的例外,而不是默认,这与大多数人理解公告的方式相反。
转换窗口后,设计就显而易见了。UTC时间01:00至04:00是北京时间09:00至12:00,UTC时间06:00至10:00是北京时间14:00至18:00。DeepSeek的高峰定价就是中国的工作时间,午间休息时间按非高峰收费。 没有人这样描述,这也是唯一能告诉你这个划分是否会影响你的事实。
对于服务美洲的团队来说,这几乎相当于免费的折扣。美国东部时间上午9点至下午6点的工作日大约对应UTC时间下午1点至晚上10点,这完全落在非高峰时段内。如果你的流量遵循美国的工作时间,你已经在使用较低的费率,而且不需要做任何事情来获得它。
真正支付高峰费率的是那些服务亚洲白天流量的团队,以及任何在06:00至10:00 UTC窗口内运行的夜间批处理作业。将该批处理作业移出06:00至10:00 UTC窗口,移至04:00至06:00的间隙或10:00之后,可以使账单减半,无需更改代码。
为什么缓存命中优于时钟
在V4-Pro上,缓存输入的成本为每百万Token 0.022美元,而缓存未命中则为0.66美元。这是30倍的折扣,而按时收费的折扣是2倍。 非高峰时段使您的账单减半。缓存将账单除以三十。
将两者叠加,一个模型的差价变得非常悬殊。高峰缓存未命中(1.32美元)对比非高峰缓存命中(0.022美元)是同一Token、同一模型上60倍的差异。在V4.1-Flash上,这种差价更大:0.30美元的高峰缓存未命中对比0.003美元的非高峰缓存命中是100倍。这两个比率均根据公布的费率得出。
根据上述费率,这对一个每天1000万输入Token和200万输出Token的实际代理工作负载意味着:
| 每日成本明细 | 高峰,无缓存 | 非高峰,90%缓存命中 |
|---|---|---|
| 1000万输入Token | $13.20 | $0.86 |
| 200万输出Token | $7.92 | $3.96 |
| 每日总计 | $21.12 | $4.82 |
| 30日总计 | $633.60 | $144.54 |
有趣的部分不是4.4倍的节省。而是第二列的构成:一旦输入被缓存,输出就占账单的82%。 输出Token在任何层级都没有缓存折扣,因此在达到一定的缓存质量后,DeepSeek支出上唯一剩余的杠杆就是您的请求到达的时间。那些努力优化缓存但就此停止的团队,没有触及第二个乘数。
如果模型支出是您试图彻底消除而非缩减的项目,那么提供商发放的信用额度是更快的途径,AI Perks 追踪了194家公司总计770万美元的信用额度。

今年DeepSeek定价的变化
2026年8月的变更不是降价。而是价格分割。 任何在2026年8月16日之前发布的DeepSeek指南,包括本网站上更早的DeepSeek定价页面,都显示了每个模型的统一费率,而DeepSeek模型不再按照该模型所描述的成本来计费。
| 日期 | 发布 | 定价影响 |
|---|---|---|
| 2026年4月24日 | V4-Pro和V4-Flash预览 | 100万Token上下文,高达384K输出,可切换思考模式 |
| 2026年7月31日 | DeepSeek-V4-Flash-0731 | 统一费率:缓存未命中输入0.14美元,输出0.28美元 |
| 2026年8月13日 | DeepSeek-V4-Pro-0813正式上市 | 旗舰级推理和代理模型 |
| 2026年8月16日 | 引入高峰和非高峰分割 | 一天的时间成为价格乘数 |
| 约2026年9月10日 | DeepSeek-V4.1-Flash | 新的输入费率,旧的端点名称停用 |
比较Flash线之前和之后。旧的统一费率为每百万缓存未命中输入Token 0.14美元。新的非高峰费率为0.15美元,高峰费率为0.30美元。非高峰费率大致与之前的统一费率相当,而高峰费率则翻倍以上(推算)。如果您的流量集中在亚洲的商务时间,尽管主打数字没有变差,但您的Flash账单在8月份却增加了。
4月的预览数据和7月的统一费率是中等置信度的历史背景,而非当前定价。请根据实际发货情况,按照实时文档进行定价。
DeepSeek悄然停用的端点名称
DeepSeek-V4.1-Flash停用了deepseek-v4-flash和deepseek-v4-flash-vision-exp模型名称。任何仍然发送其中任何一个字符串的请求都将失败。
这是耗费团队一下午时间更改的变更,因为它没有出现在定价表中,也没有优雅地降级。调用要么解析为当前模型名称,要么出错。
2026年9月之前发布的大多数教程、Stack Overflow回答和入门仓库仍然硬编码了已停用的名称。如果在8月份正常工作的DeepSeek集成在9月份停止工作,而其他任何方面都没有改变,请在检查其他任何内容之前先检查模型标识符。

DeepSeek是否提供免费API信用额度或初创公司信用额度?
DeepSeek聊天应用可免费使用。DeepSeek官方定价页面没有明确的API免费层级,DeepSeek也不运行专门的初创公司信用额度计划。
请谨慎对待二手信息。一些网站声称新的DeepSeek API账户会收到免费的入门信用额度。这一说法报告不一致,且在DeepSeek官方定价页面上未得到证实,因此请将其视为未经核实,而非预算。诚实的回答是,DeepSeek在标价上竞争,而不是在赠品上。
第三方托管是另一种途径。Baseten列出了DeepSeek V4.1 Flash输入的费率为每百万0.30美元,并提供30美元的新工作区试用信用额度,这是最接近免费DeepSeek容量且有实际数字支持的。OpenRouter、Together和Fireworks也托管DeepSeek模型;它们的费率经常变动,您应该自己查看,而不是信任文章中的数字。通过托管路由还可以消除高峰和非高峰的问题,因为托管方会制定自己的费率表。
这对创始人来说留下了一个真正的空白。DeepSeek在2026年是运行推理最便宜的方式之一,也是唯一一家不会资助您第一年的主要模型供应商。您候选名单上的几乎所有其他供应商都会这样做,这就是为什么实际的栈是DeepSeek按标价进行大规模工作,以及在其他地方使用已资助的信用额度。AI Perks 追踪了目前哪些项目是开放的。
常见问题解答
DeepSeek的高峰时段是何时?
工作日的01:00至04:00以及06:00至10:00 UTC是高峰时段。除这些窗口外的时间,包括整个周末,均为非高峰时段,收费减半。这意味着168小时的周中有35小时是高峰时段,所以大约79%的时间您支付的是较低的费率。
DeepSeek API每百万Token的收费是多少?
DeepSeek-V4-Pro-0813在缓存未命中时每百万输入Token收费0.66美元,非高峰时段每百万输出Token收费1.98美元。高峰时段的费率是其两倍:1.32美元和3.96美元。缓存输入的非高峰费率降至0.022美元。相关提供商的免费信用额度可在AI Perks追踪。
DeepSeek有免费API层级吗?
DeepSeek聊天应用可免费使用。DeepSeek官方定价页面没有明确的API免费层级。关于新API账户收到免费入门信用额度的说法不一致且未得到官方证实,因此不要以此为预算。其他提供商的已验证信用额度计划可在AI Perks列出。
DeepSeek是否提供初创公司信用额度?
不。DeepSeek不运行专门的初创公司信用额度计划,这在主要模型提供商中很不寻常。托管DeepSeek模型的Baseten提供30美元的新工作区试用信用额度。对于确实运行创始人计划的提供商,AI Perks在getaiperks.com追踪了194家公司总计770万美元的信用额度。
为什么我的DeepSeek API调用停止工作了?
最有可能的原因是模型名称。DeepSeek-V4.1-Flash停用了deepseek-v4-flash和deepseek-v4-flash-vision-exp端点名称,任何仍然发送其中任何一个字符串的请求都将失败。旧的教程和代码示例是在更改之前编写的,从未更新过。将模型标识符替换为当前模型,调用就能再次工作。
2026年DeepSeek仍然是最便宜的API吗?
按标价计算,非高峰缓存输入的0.022美元/百万Token是很难匹配的。但是,8月份的价格分割意味着与供应商进行统一比较不再有意义:您的实际DeepSeek费率取决于您的流量到达时间以及您的缓存效果。请与您自己的流量模式进行比较,而不是与表格进行比较。
DeepSeek按时计费。其他所有人都只给您信用额度。