DeepSeek 没有每 Token 单一价格
DeepSeek-V4-Pro 有四种输入价格,而非一种:每百万 Token $0.022、$0.044、$0.66 和 $1.32。您支付哪种价格取决于一天中的时间以及 Prompt 是否命中缓存。 同一个模型、同一个 Prompt、同一天,价格会相差 60 倍。
任何只为每个模型打印一个数字的“DeepSeek vs ChatGPT”表格,都在比较一个不存在的数字。DeepSeek 是唯一按一天中的时间收费的主要模型供应商。高峰时间是每周一至周五 UTC 时间 01:00 至 04:00 和 06:00 至 10:00,而其他所有时间段(包括周末)的账单价格正好减半。
以下是每百万 Token 的公布标价,包含两个价格区间。
| 模型 | 缓存输入 | 新鲜输入 | 输出 |
|---|---|---|---|
| DeepSeek-V4-Pro,非高峰时段 | $0.022 | $0.66 | $1.98 |
| DeepSeek-V4-Pro,高峰时段 | $0.044 | $1.32 | $3.96 |
| DeepSeek-Flash,非高峰时段 | $0.003 | $0.15 | 未公布 |
| DeepSeek-Flash,高峰时段 | $0.006 | $0.30 | 未公布 |
最后一列并非我们遗漏。DeepSeek 公布了 V4.1 Flash 系列的缓存命中和缓存未命中输入费率,但没有输出费率,因此任何引用 Flash 输出数据的指南都是引用 DeepSeek 未声明的内容。我们不会重复,您的预算电子表格也不应重复。
同样的原则也适用于其他方面。我们不会重印我们未在 OpenAI 自己的定价页面上验证过的 OpenAI 标价,因为这些费率会变动,而比较表中的陈旧数字比没有数字更糟糕。阅读本文了解 DeepSeek 的计费结构,然后从源头查询 ChatGPT 的价格。AI Perks 会追踪第三个变量:积分,这在任何标价中都不包含。

谁实际支付 DeepSeek 的高峰费率
高峰定价覆盖了工作日的七小时,即一周 168 小时中的 35 小时,因此大约 79% 的时间段以半价计费(推导)。非高峰时段并非折扣时段。这是地球上大部分地区正常费率。
转换为 UTC+8,高峰时段为 09:00 至 12:00 和 14:00 至 18:00,中间的间隙正好是午餐时间。这是 DeepSeek 本土市场工作日的时间安排。DeepSeek 未说明这是原因,因此请将此视为观察而非事实,但它准确地预测了谁会支付更多费用。
| 团队地点 | UTC 工作日 | 高峰时段 |
|---|---|---|
| 旧金山 (UTC-7) | 16:00 至 00:00 | 8 小时中的 0 小时 |
| 纽约 (UTC-4) | 13:00 至 21:00 | 8 小时中的 0 小时 |
| 伦敦 (UTC+1) | 08:00 至 16:00 | 8 小时中的 2 小时 |
| 柏林 (UTC+2) | 07:00 至 15:00 | 8 小时中的 3 小时 |
| 班加罗尔 (UTC+5:30) | 03:30 至 11:30 | 8 小时中的 4.5 小时 |
| 深圳 (UTC+8) | 01:00 至 09:00 | 8 小时中的 6 小时 |
在美国时区工作的团队在业务时间内进行交互式流量,几乎不会遇到高峰费率。欧洲团队在每天早上头两个或三个小时会支付高峰费率,这为将批处理和评估作业安排在午餐后而不是站会前提供了一个有力的论据。
缓存命中比时钟更重要
将工作负载移至非高峰时段会将账单减半。将其放入缓存则将其降低 30 倍。 在 DeepSeek-V4-Pro 上,非高峰时段的缓存输入 Token 成本为每百万 $0.022,而新鲜 Token 成本为 $0.66,正好是 30 倍(推导)。非高峰时段的杠杆效应价值 2 倍。大多数团队会调整 2 倍的杠杆,而忽略 30 倍的杠杆。
两个推导出的比较使顺序一目了然:
- 在旗舰 V4-Pro 非高峰时段的缓存 Token ($0.022) 比在预算型 Flash 模型非高峰时段的新鲜 Token ($0.15) 便宜 6.8 倍。缓存优于降级。
- 即使是高峰时段的 V4-Pro 缓存 Token ($0.044) 也比非高峰时段的 Flash 新鲜 Token 便宜 3.4 倍。缓存优于降级,并结合了等待廉价时段的优势。
将 V4-Pro 的缓存命中率从 50% 提高到 90%,将混合输入成本从每百万 $0.341 降低到 $0.0858,降低了 4.0 倍(推导),这是任何调度都无法比拟的。
三个实际后果:
前缀稳定性优于 Prompt 简洁性。 一个永远不变的长系统 Prompt 比一个您每次请求都重写的短 Prompt 更便宜,因为只有稳定的前缀会被缓存。
将可变部分放在最后。 任何插入到检索上下文之前的内容都会使之后的所有内容失效缓存。
缓存深度是一个定价决定,而非技术决定。 DeepSeek 将 V4-Pro 缓存命中定价为新鲜 Token 的 3.3%,Flash 命中定价为 2.0%(均为推导)。以比新鲜输入更浅的比例定价缓存命中的供应商,会给您更少的优化空间。该比例,而非头部费率,是跨提供商进行比较的对象。

实际任务的真实成本
以一个实际的检索增强型代理调用为例:40,000 个输入 Token,80% 的缓存命中率,外加 2,000 个输出 Token。以下所有数字均根据上述公布的费率推导得出。
| 情景 | 输入成本 | 输出成本 | 总计 |
|---|---|---|---|
| V4-Pro,非高峰时段 | $0.00598 | $0.00396 | $0.00994 |
| V4-Pro,高峰时段 | $0.01197 | $0.00792 | $0.01989 |
| Flash,非高峰时段 | $0.00130 | 未公布 | 无法报价 |
| Flash,高峰时段 | $0.00259 | 未公布 | 无法报价 |
有两个结果。首先,此任务上的 V4-Pro 输入成本比 Flash 输入成本高 4.6 倍(推导),这个差距远小于模型级别所示的差距,因为 80% 的缓存命中率在两者上都起到了大部分作用。其次,Flash 的完整任务成本无法从公布的数据中计算。如果比较文章给出了一个数字,请询问输出费率来自哪里。
廉价声誉在哪里破灭
将 DeepSeek 通过第三方主机路由,会将高峰和非高峰时段的划分变为单一固定费率,因此您几乎 100% 的时间都支付接近高峰价格。 例如,Baseten 将 DeepSeek V4.1 Flash 输入列为每百万 $0.30,这与 DeepSeek 自有的峰值缓存未命中费率相同,并且是 $0.15 非高峰费率的两倍(Baseten 的公布数据,在您据此进行预算之前值得确认;其输出费率并未可靠确认)。Baseten 确实提供 30 美元的开业工作空间试用积分。
OpenRouter、Together 和 Fireworks 也托管 DeepSeek 模型。他们的费率由他们设定并且会变动,因此请亲自验证每个费率,而不是依赖博客文章中的数字,包括本文。定性权衡是稳定的:您获得了路由便利性、故障转移和单一发票,但永久放弃了 50% 的非高峰折扣。对于大部分在非高峰时段运行的流量,这种权衡是负面的。

旧版 DeepSeek 定价指南发布后发生了什么变化
2026 年 8 月 16 日之前的任何 DeepSeek 指南都引用了单一固定价格。该价格已不再存在。 如果一篇文章为每个模型提供一个数字,且未提及高峰时段,则说明它早于当前结构。
- 2026 年 4 月 24 日:DeepSeek V4-Pro 和 V4-Flash 以预览版发布,具有 1M Token 上下文窗口,最多 384K 输出 Token,以及可切换的思考和非思考模式。
- 2026 年 7 月 31 日:DeepSeek-V4-Flash-0731 成为稳定的 Flash 版本。当时的价格是每百万缓存未命中输入 $0.14,每百万输出 $0.28,不包含时段因素。这是历史,不是您今天能买到的费率。
- 2026 年 8 月 13 日:DeepSeek-V4-Pro-0813 作为旗舰推理和代理模型正式上市。
- 2026 年 8 月 16 日:引入高峰和非高峰定价。
- 约 2026 年 9 月 10 日:DeepSeek-V4.1-Flash 发布,在文档中简称为 DeepSeek-Flash。
一项重大变更值得单独说明,因为它会悄无声息地导致现有代码失效。DeepSeek-V4.1-Flash 淘汰了 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 端点名称。 教程、论坛答案和复制的代码示例仍然引用这些字符串,并且将无法在实时 API 上运行。请查阅 DeepSeek 自身文档中的当前模型标识符,而不是代码示例,因为在五个月内名称已更改两次。
DeepSeek 没有启动积分计划
DeepSeek 聊天应用是免费的。API 则不是,DeepSeek 在其官方定价页面上未提及免费套餐。 关于为新的 DeepSeek 账户提供免费 API 积分的说法广泛流传,报告不一致且未得到证实,请将其视为未经核实。
对创始人来说更重要的是:DeepSeek 不运行专门的初创公司积分计划。 没有拨款,没有分阶段的分配,没有补贴层。您充值余额,然后花费。每 Token 便宜,零补贴。
这是成本优势反转的地方。一家每 Token 收费数倍但为一家年轻公司提供五位数积分的供应商,在第一年比一家提供零补贴的廉价供应商更便宜。每 Token 成本只有在有人实际支付现金时才是正确的指标。
DeepSeek 竞争的大多数供应商确实运行积分计划。AI Perks 追踪了194 家公司共计 770 万美元的积分,这是价格表比较完全忽略的层面。
实际的栈:提供积分的供应商提供的信用额度,DeepSeek-Flash 非高峰作为付费默认选项,对所有在高峰时段运行的内容进行严格的前缀缓存,以及在无法转移的时间段的已验证备用方案。从积分开始,因为它们是账单中唯一可能降至零的部分。查看当前可用内容。

常见问题解答
DeepSeek 比 ChatGPT 便宜吗?
仅 DeepSeek 一方就有四个答案。DeepSeek-V4-Pro 的新鲜输入非高峰时段为每百万 $0.66,高峰时段为 $1.32,缓存 Token 非高峰时段为 $0.022。将您自己的流量与 OpenAI 当前公布的费率进行比较,并根据实际发生的调用比例对每个 DeepSeek 费率进行加权。答案取决于您的时钟和缓存命中率,而不是供应商。
DeepSeek 的高峰时段是何时?
高峰时段是每周一至周五 UTC 时间 01:00 至 04:00 和 06:00 至 10:00。其他所有时间,包括周末,按高峰费率的一半计费。这使得一周中约 79% 的时间是非高峰时段。美国时区的团队在正常工作时间内几乎不会遇到高峰定价。
DeepSeek 是否提供免费 API 积分或初创公司计划?
否。DeepSeek 的聊天应用是免费使用的,但其官方定价页面未提及免费 API 套餐,并且关于注册积分的报告不一致且未经证实。与 AI Perks 追踪的许多提供商不同,DeepSeek 也不运行初创公司积分计划。
我的 DeepSeek API 调用为何停止工作?
DeepSeek-V4.1-Flash 淘汰了 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 模型标识符,悄无声息且没有弃用期。旧的教程和复制的示例仍引用它们,并将失败。在调试其他任何问题之前,请从 DeepSeek 的实时文档中获取当前模型标识符。
DeepSeek-Flash 的输出 Token 费用是多少?
DeepSeek 未公布此项。V4.1 Flash 系列仅列出了缓存命中和缓存未命中的输入费率。您看到的任何 Flash 的总任务成本都基于假设的输出费率,因此请将其视为估计值而非价格。
通过第三方主机运行 DeepSeek 更便宜吗?
通常不是,如果您的流量在非高峰时段运行。主机收取固定费率,没有高峰和非高峰时段之分,因此您将永久放弃 50% 的非高峰折扣,以换取路由便利性和故障转移。在切换之前,请自行验证每个主机的当前费率,因为利润率各不相同且经常变化。
免费 AI 积分实际能为初创公司节省多少?
足以扭转比较。一家每 Token 收费数倍但提供五位数积分的供应商,在第一年比一家提供零补贴的廉价供应商更便宜。AI Perks 追踪了 194 家公司共计 770 万美元的积分,这是价格表比较完全忽略的层面。
每 Token 价格是简单的数字。每任务价格,在扣除积分后,才是实际出现在账单上的数字。