DeepSeek-V4-Pro 每百万 Token 多少钱?
DeepSeek-V4-Pro-0813 在非高峰时段,每百万缓存未命中输入 Token 的费用为 0.66 美元,高峰时段为 1.32 美元。输出费用在非高峰时段为 1.98 美元,高峰时段为 3.96 美元。缓存命中时,输入费用降至非高峰时段的 0.022 美元。
DeepSeek-V4-Pro-0813 于 2026 年 8 月 13 日全面上市,是 V4 系列的旗舰产品,专为工具使用、代码执行和多步自主工作流而构建。其定价按时段计费:高峰时段为工作日的 UTC 时间 01:00 至 04:00 以及 06:00 至 10:00,其余时间费用减半。
DeepSeek API 文档中发布的费率,以美元/百万 Token 为单位:
| 模型 | Token 类型 | 非高峰 | 高峰 |
|---|---|---|---|
| DeepSeek-V4-Pro-0813 | 输入,缓存命中 | $0.022 | $0.044 |
| DeepSeek-V4-Pro-0813 | 输入,缓存未命中 | $0.66 | $1.32 |
| DeepSeek-V4-Pro-0813 | 输出 | $1.98 | $3.96 |
| DeepSeek-V4.1-Flash | 输入,缓存命中 | $0.003 | $0.006 |
| DeepSeek-V4.1-Flash | 输入,缓存未命中 | $0.15 | $0.30 |
| DeepSeek-V4.1-Flash | 输出 | $0.60 | $1.20 |
在 2026 年 4 月的预览版中,V4 系列据报道拥有100 万 Token 的上下文窗口,最多可输出 384K Token,以及可切换的思考模式,并以 MIT 许可证开源权重。这些信息来自发布报道,而非 DeepSeek 当前的定价页面,请以您调用的具体模型字符串为准进行确认。AI Perks 跟踪 194 家公司的定价和积分计划,DeepSeek 在后一方面脱颖而出:它没有发布任何创业公司积分计划。

高峰时段仅占一周的 21%
大多数报道将非高峰时段视为一种您可以获得的折扣。但计算表明事实恰恰相反:高峰时段是工作日 7 小时,每周 168 小时中的 35 小时,所以 79% 的时间已经按较低费率计费。
非高峰时段是默认的。高峰时段是您意外支付的额外费用,窗口期恰好落在欧洲的早晨。您不是在寻找折扣,而是在避免一个 35 小时的惩罚期,解决方法是检查是否有 cron 作业落入了该时段。交互式流量是例外,因为时钟由用户设定。
V4.1-Flash 为何在价格上优于 V4-Pro
将一个任务移至非高峰时段会将账单减半,正好是 2 倍。将其从 V4-Pro 移至 V4.1-Flash 会将缓存未命中输入的费用降低 4.4 倍,输出费用降低 3.3 倍。模型选择是更大的杠杆,两者会叠加。
每百万缓存未命中输入 Token 加上每百万输出 Token,在一天的两个时段:
| 模型和时段 | 输入 | 输出 | 总计 |
|---|---|---|---|
| V4-Pro 高峰时段 | $1.32 | $3.96 | $5.28 |
| V4-Pro 非高峰时段 | $0.66 | $1.98 | $2.64 |
| V4.1-Flash 高峰时段 | $0.30 | $1.20 | $1.50 |
| V4.1-Flash 非高峰时段 | $0.15 | $0.60 | $0.75 |
V4-Pro 在其最便宜的时段,其价格仍是 V4.1-Flash 在其最昂贵时段的 1.76 倍。 没有任何调度技巧能弥补这个差距。
堆叠两个杠杆,差距会再次扩大:V4-Pro 高峰时段对 V4.1-Flash 非高峰时段的比率是相同 Token 数量的 7 倍,而这两个决定中只有一个是由时钟设定的。通常建议将批量工作推入廉价时段,这假设模型是固定的。但事实很少如此,即使无法重新安排流量,降级模型也能带来收益。
Flash 在一天中的每个时段都具有价格优势,包括高峰时段。V4-Pro 的优势在于其能力,因此它必须根据任务难度来证明其价值。

为什么 V4-Pro Agent 运行的成本高于表格所示
在 V4-Pro 上,输出的成本是缓存未命中输入的 3 倍,而 DeepSeek 构建 V4-Pro 所需的工作负载——agentic 循环、工具调用、多步执行——每单位工作产生的输出最多。
一个月的实际使用量:100M 输入 Token,缓存命中率为 70%,加上 20M 输出 Token,按上述费率:
| 配置 | 输入 | 输出 | 每月总计 |
|---|---|---|---|
| V4-Pro,高峰时段 | $42.68 | $79.20 | $121.88 |
| V4-Pro,非高峰时段 | $21.34 | $39.60 | $60.94 |
| V4.1-Flash,高峰时段 | $9.42 | $24.00 | $33.42 |
| V4.1-Flash,非高峰时段 | $4.71 | $12.00 | $16.71 |
由此得出三点。
在 V4-Pro 非高峰时段的账单中,输出占 65%。 一旦缓存工作正常且任务避开高峰时段,DeepSeek 就从输入问题转变为响应长度问题。
完整价差为 7.3 倍。 相同的 Token 数、相同的供应商、相同的月份。从顶行到底行是两个决定。
Flash 的缓存折扣更优惠。 V4-Pro 的缓存命中比未命中便宜 30 倍;在 V4.1-Flash 上,则便宜 50 倍。提示前缀的纪律在廉价模型上收益更多,这与团队的假设相反。
DeepSeek 已发布和未发布的内容
DeepSeek 发布按 Token 计价,而买家希望了解的其他信息则很少。官方定价页面没有注明 API 免费套餐,也没有创业公司积分计划,并且没有为 4 月份预览模型单独发布定价。
任何在 8 月中旬之前编写的指南都描述了已不再存在的定价模型:
| 日期 | 发布内容 | 定价状态 |
|---|---|---|
| 2026 年 4 月 24 日 | V4-Pro 和 V4-Flash 预览 | 预览时未单独发布 |
| 2026 年 7 月 31 日 | DeepSeek-V4-Flash-0731,稳定版 | 报告价格为输入 0.14 美元/输出 0.28 美元,固定费率 |
| 2026 年 8 月 13 日 | DeepSeek-V4-Pro-0813,全面上市 | 被以下拆分取代 |
| 2026 年 8 月中旬 | 引入高峰和非高峰定价 | 当前结构 |
| 约 2026 年 9 月 10 日 | DeepSeek-V4.1-Flash | 当前 Flash 费率 |
4 月份预览详情、7 月份 Flash 数据以及价格变动的确切日期均已报道,但未在 DeepSeek 当前定价页面上确认:请将它们视为历史信息,而非预算输入。以上 V4-Pro 和 V4.1-Flash 费率直接来自 DeepSeek。
据报道,8 月份的变动将 Flash 从固定的 0.14 美元缓存未命中输入价格调整为当前的非高峰 0.15 美元和高峰 0.30 美元。这不是带有星号的价格下调,而是价格拆分:非高峰时段运行的价格大致与旧费率相同,高峰时段运行的价格则翻倍。
关于免费访问:DeepSeek 聊天应用程序是免费的。新 API 账户获得免费积分的说法不一致且未在官方定价页面上得到确认,因此请将您在其他地方看到的任何数字视为未经证实。DeepSeek 也没有创业公司积分计划,根本没有免费试用期。AI Perks 跟踪了 194 家公司总计 770 万美元的积分,这些公司确实提供积分计划。
在 getaiperks.com 上查找真正提供积分的供应商 →

部分情况下,非高峰折扣不适用
时间段定价是 DeepSeek 的第一方机制。第三方托管商和路由器会设定自己的费率,并且纸面上看起来便宜的固定费率可能全天候都处于 DeepSeek 的高峰价格水平。
据报道,Baseten 于 2026 年 9 月 10 日在其模型 API 中添加了 DeepSeek V4.1 Flash,输入价格为每百万 Token 0.30 美元。该数字和相应的输出数字均未在此处确认(检查时输出数字无法可靠读取),因此在预算之前请与供应商核实两者。按字面意思,0.30 美元正好是 DeepSeek 的高峰输入费率,是其非高峰费率的两倍,且全天候收费。Baseten 的标准新工作区试用积分据报告为 30 美元,既非 DeepSeek 特有也非新。
然而,交易仍然可能是正确的:您购买的是延迟、区域和简单性,而固定费率比计划更容易预测。但请诚实定价,因为以高峰价格设定的费率永远无法获得每周 79% 的时间,而这些时间本应按半价计费。免费试用期来自于提供此服务的供应商,该列表可在 getaiperks.com 找到。
如何降低 DeepSeek-V4-Pro 的账单,按影响顺序排列
杠杆 1:在其他地方为昂贵层级提供资金。 DeepSeek 不提供积分,因此请使用 getaiperks.com 来覆盖您将高难度任务路由到的高级提供商,并让 DeepSeek 处理批量工作。
杠杆 2:降级所有不需要旗舰产品的任务。 在上述工作负载中,相同设置下,V4-Pro 到 V4.1-Flash 的成本降低了 3.6 倍。此处没有其他方法能与之媲美。
杠杆 3:审核您的时间表,避免意外的高峰使用。 高峰时段每周有 35 小时,因此请检查工作日的 01:00 至 04:00 或 06:00 至 10:00 UTC 是否有 cron 作业落入其中。
杠杆 4:稳定您的提示前缀。 缓存命中需要完全相同的前导前缀,因此将易变内容放在最后。V4-Pro 的 30 倍和 Flash 的 50 倍就在这里。
杠杆 5:控制响应长度。 在执行以上四点后,输出约占账单的三分之二,是剩余的最大部分。

常见问题解答
DeepSeek-V4-Pro 每百万 Token 多少钱?
缓存未命中输入非高峰时段为 0.66 美元,高峰时段为 1.32 美元。输出非高峰时段为 1.98 美元,高峰时段为 3.96 美元。缓存命中非高峰时段为 0.022 美元,高峰时段为 0.044 美元。高峰时段为工作日的 UTC 时间 01:00 至 04:00 以及 06:00 至 10:00。
DeepSeek 的高峰时段是何时?占一周的多少比例?
高峰时段为周一至周五 UTC 时间 01:00 至 04:00 以及 06:00 至 10:00。这相当于工作日 7 小时,每周 168 小时中的 35 小时,约占 21%。其余 79% 的时间,包括所有周末,都按高峰时段费率的一半计费。
DeepSeek-V4-Pro 是否比 V4.1-Flash 值得?
仅当工作确实需要旗舰产品时。V4-Pro 的缓存未命中输入费用是 V4.1-Flash 的 4.4 倍,输出费用是 V4.1-Flash 的 3.3 倍,混合月度工作负载的费用大约是 V4.1-Flash 的 3.6 倍。首先按任务难度路由,然后优化调度。
DeepSeek 是否为 V4-Pro 提供免费积分?
否。DeepSeek 聊天应用程序是免费的,但官方定价页面未注明 API 免费套餐,且没有创业公司积分计划。关于新 API 账户获得免费积分的报道未经证实。如需真实的免费试用期,AI Perks 跟踪了 194 家公司总计 770 万美元的积分。
第三方托管商是否会转嫁 DeepSeek 的非高峰定价?
通常不会。时间段定价是第一方机制,托管商会设定自己的费率。据报道,Baseten 将 DeepSeek V4.1 Flash 输入价格列为每百万 Token 0.30 美元,这相当于 DeepSeek 的高峰价格全天收费,但这一点未经证实。在您确定之前,请与托管商核实当前费率。
deepseek-v4-flash 端点名称发生了什么?
DeepSeek-V4.1-Flash 停用了 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 模型名称,现在请求将路由到当前 Flash 模型,并按 Flash 定价。使用旧标识符编写的代码需要更新,因此请固定当前模型字符串,而不是依赖别名。
DeepSeek 定价低廉,但没有任何资金支持。提供资金支持的供应商可在 getaiperks.com 找到。