DeepSeek V4.1 Flash 每百万 Token 的费用
DeepSeek V4.1 Flash 在非高峰时段每百万个缓存未命中输入 Token 的费用为 0.15 美元,在高峰时段为 0.30 美元。缓存输入 Token 的费用为每百万个 0.003 美元(非高峰时段),比 Flash 自身的缓存未命中率(估算值)低 50 倍。
Flash 于 2026 年 9 月 10 日左右推出,在官方文档中显示为 DeepSeek-Flash。旗舰模型 DeepSeek-V4-Pro-0813 自 2026 年 8 月 13 日起已普遍可用。
下面的所有数字均以美元/百万 Token 为单位,摘自 api-docs.deepseek.com 并于 2026 年 9 月确认。
| 模型和窗口 | 输入,缓存命中 | 输入,缓存未命中 | 输出 |
|---|---|---|---|
| DeepSeek-V4-Pro-0813,非高峰时段 | $0.022 | $0.66 | $1.98 |
| DeepSeek-V4-Pro-0813,高峰时段 | $0.044 | $1.32 | $3.96 |
| DeepSeek-V4.1-Flash,非高峰时段 | $0.003 | $0.15 | 未发布 |
| DeepSeek-V4.1-Flash,高峰时段 | $0.006 | $0.30 | 未发布 |
DeepSeek 未发布 V4.1 Flash 的输出价格,且该价格未在官方页面上确认。如果您在其他地方看到引用的价格,请将其视为未经证实,直到它出现在官方表格中。
DeepSeek 在另一个对创始人比每 Token 数量更重要的方面也很不寻常:它根本不运行任何启动信贷计划。这个空白将在下面介绍,这也是 AI Perks 跟踪运行此类计划的提供商的原因。

为什么 DeepSeek 对同一个 Token 收取两种不同的价格
DeepSeek 是唯一按一天的时间收费的主要模型供应商。高峰时段为工作日 UTC 时间的 01:00 至 04:00 以及 06:00 至 10:00,而在这些时间窗口之外的所有时间收费都减半。
请仔细阅读这个时间窗口列表两次,因为中间有一个空档。UTC 时间 04:00 至 06:00 之间的时间段位于两个高峰时段之间,按非高峰时段费率计费。它不是一个连续的九小时高峰期。
根据公布的时间窗口推算:高峰时段每天覆盖七小时,仅限工作日,即每周 168 小时中的 35 小时。日历的大约 79% 已经是“非高峰时段”。
这重新定义了问题。您不是在寻找便宜的时间窗口,而是在试图避开昂贵的时间窗口。有三种工作负载几乎可以免费做到这一点:
- **夜间批处理作业。**在 UTC 08:00 调度的作业属于高峰时段。将其移至 UTC 12:00 可将账单减半,而不会改变其他任何事情。
- **评估和回归运行。**这些没有用户等待,因此默认属于高峰时段之外。
- **嵌入和重新索引传递。**大量的单次输入消耗是大多数团队运行的最为受高峰时段影响的因素。
交互式流量是您无法移动的部分,在您构建的任何预测中都应按高峰时段价格收费。
缓存命中是更大的乘数
在 DeepSeek-V4-Pro 上,每百万个缓存输入 Token 的成本为 0.022 美元,而缓存未命中则为 0.66 美元。这是 30 倍的差价(根据上表估算),它远远超过了您从时间获得的 2 倍收益。
两个乘数叠加,这种叠加是 DeepSeek 成本状况的全部内容。一个高峰时段缓存未命中输入 Token 的价格为 1.32 美元,而一个非高峰时段缓存命中 Token 的价格为 0.022 美元,在同一模型上的价格差为 60 倍(估算值)。
在 V4.1 Flash 上,缓存比例甚至更宽:未命中为 0.15 美元,命中为 0.003 美元,差值为 50 倍(估算值)。
实际上,这意味着提示结构比模型选择更重要。从 V4-Pro 切换到 Flash 可将缓存未命中输入降低 4.4 倍(估算值,0.66 美元对 0.15 美元)。让缓存命中 V4-Pro 可将其降低 30 倍。更便宜的模型是影响较小的杠杆。
缓存命中来自稳定的前缀,因此实用的规则是枯燥但有效的:保持系统提示在调用之间字节相同,将工具定义和检索到的上下文放在用户特定内容之前,并且切勿在提示顶部附近插入时间戳或会话 ID。

DeepSeek V4.1 Flash 停用的终端节点名称
DeepSeek-V4.1-Flash 停用了 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 模型名称。仍发送任一字符串的代码将失败。
| 停用的模型名称 | 状态 |
|---|---|
deepseek-v4-flash | 随 V4.1 Flash 停用 |
deepseek-v4-flash-vision-exp | 随 V4.1 Flash 停用 |
这是一个悄无声息的更改,而不是一个引人注目的弃用,这正是它变得昂贵的原因。模型字符串通常是 AI 集成中审查最少的行:它位于环境变量、配置文件、Terraform 模板或供应商的 SDK 包装器中,并且在发布之间没人会触动它。
更广泛的问题是长尾内容的遗留。2026 年 9 月之前的教程、YouTube 教程、论坛答案和生成的代码示例都仍然引用旧名称,并且它们都不会被更正。从这些页面学习的助手将继续建议它们。
如果您在生产环境中运行 DeepSeek,请在您的存储库中搜索这两个字符串,然后分别检查您的基础设施配置和任何密钥管理器。在部署变量中六个月前设置的模型名称不会出现在代码搜索中。
自早期 DeepSeek 定价指南以来发生了什么变化
三件事使 2026 年 8 月中旬之前编写的所有 DeepSeek 定价页面的部分内容失效:高峰和非高峰分时、V4-Pro 和 Flash 分时以及停用的终端节点名称。
| 日期 | 发布或更改 | 置信度 |
|---|---|---|
| 2026 年 4 月 24 日 | V4-Pro 和 V4-Flash 预览:100 万 Token 上下文,最多 384K 输出,可切换的思考和非思考模式 | 中等 |
| 2026 年 7 月 31 日 | DeepSeek-V4-Flash-0731,Flash 系列的稳定发布 | 中等 |
| 2026 年 8 月 13 日 | DeepSeek-V4-Pro-0813 通用可用性 | 高 |
| 2026 年 8 月 16 日 | 引入高峰和非高峰定价 | 中等 |
| 约 2026 年 9 月 10 日 | DeepSeek-V4.1-Flash,旧的 Flash 终端节点名称停用 | 高 |
值得了解的历史数据是 8 月 16 日更改前的最后一个已知 Flash 定价:每百万个缓存未命中输入 0.14 美元,每百万个输出 0.28 美元。这是大多数第三方比较表仍然显示的数量。它不是当前定价,并且完全早于高峰乘数,因此任何基于它的预测都会低估高峰负载的工作量约 2 倍(估算值:0.14 美元对比当前 0.30 美元的高峰缓存未命中率是 2.1 倍)。
对于 DeepSeek,一个单一的固定输入价格现在毫无意义,除非附带两个限定词:缓存的哪一侧,以及时钟的哪一侧。

DeepSeek 没有免费 API 层级和启动信贷计划
DeepSeek 聊天应用程序可免费使用。API 不免费,官方定价页面上没有声明的免费层级。DeepSeek 也不运行任何专门的启动信贷计划。
关于新 API 账户获得免费积分的说法广泛流传且报告不一致。官方定价页面未确认这些说法,因此请按不存在的情况计划您的第一个月支出。
第三方托管是绕过此问题的一个部分途径,但通常的警告是它们的定价和条款是它们自己的。Baseten 列出了 DeepSeek V4.1 Flash 输入的价格为每百万 0.30 美元,并提供30 美元的永久新工作区试用积分(在根据其进行预算之前请验证两者)。OpenRouter、Together 和 Fireworks 也托管 DeepSeek 模型,它们之间的选择通常是关于路由、区域和速率限制,而不是主要价格。
对创始人而言,真正的差距是结构性的。初创公司运行的大多数模型和基础设施供应商都运行某种形式的信贷计划,而 AI Perks 跟踪的是它们各自当前的金额和条款。DeepSeek 没有任何此类计划,这意味着 DeepSeek 是您 AI 账单中始终需要现金支付的一项。
这就是为什么将其视为堆栈中的廉价默认层级而不是整个堆栈的原因。将高容量、缓存友好、非高峰时段的工作路由到 DeepSeek,并将需要前沿推理的工作路由到由他人付费的提供商。 AI Perks 跟踪194 家公司共计 770 万美元的信贷,第二部分就是来源于此。
在 getaiperks.com 查看哪些提供商运行信贷计划 →
常见问题解答
DeepSeek V4.1 Flash 的费用是多少?
DeepSeek V4.1 Flash 在非高峰时段每百万个缓存未命中输入 Token 的费用为 0.15 美元,高峰时段为 0.30 美元。缓存输入非高峰时段为 0.003 美元,高峰时段为 0.006 美元。DeepSeek 未发布 Flash 的可确认输出价格,因此请将您在其他地方找到的任何输出数字视为未经证实。
DeepSeek 的高峰和非高峰时段是什么时候?
高峰时段为工作日 UTC 时间的 01:00 至 04:00 以及 06:00 至 10:00。所有其他时间,包括两个高峰时段之间的 UTC 04:00 至 06:00 的空档以及所有周末流量,都属于非高峰时段,价格减半。根据这些时间窗口推算,大约 79% 的时间都是非高峰时段。
为什么我的 deepseek-v4-flash API 调用突然失败?
DeepSeek-V4.1-Flash 停用了 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 模型名称。任何仍发送这些字符串的代码、教程或配置都将失败。请检查您的环境变量和部署配置以及您的源代码,因为模型名称通常存在于存储库之外。此更改已于 2026 年 9 月 10 日左右悄无声息地推出。
DeepSeek 是否为新账户提供免费 API 积分?
DeepSeek 的官方定价页面上没有声明的 API 免费层级。关于新账户积分的报告不一致且未经确认,因此请按不存在的情况进行预算。聊天应用程序是免费的。有关确实发布了信贷计划的提供商,请参阅 AI Perks。
DeepSeek 是否有启动信贷计划?
没有。DeepSeek 不运行任何专门的启动信贷计划,这使其成为为数不多的您始终需要现金支付的顶级模型 API 之一。大多数其他提供商确实运行此类计划,而 AI Perks 跟踪 194 家公司共计 770 万美元的信贷,涵盖了这些计划。
DeepSeek V4-Pro 还是 V4.1 Flash 更便宜?
在所有已发布的比较中,Flash 都更便宜:非高峰时段每百万个缓存未命中输入 Token 0.15 美元对 0.66 美元,差距为 4.4 倍(估算值)。但是,修复 V4-Pro 的提示缓存是一个 30 倍的杠杆,因此提示结构比模型选择更重要。两者都没有背后的信贷计划,这也是 AI Perks 为提供商跟踪的部分。
DeepSeek 是您 AI 账单中最便宜的一项。在 getaiperks.com 覆盖其他项目。