哪里可以最便宜地运行 DeepSeek:直接 vs 托管 API

DeepSeek 是最便宜的直连。openai和Together无法转售 OpenAI 的按时计费和 30 倍缓存折扣等一等功能。

DeepSeekOpenRouterLLM API PricingModel RoutingAI Perks
Author Avatar
Andrew
AI Perks Team
14,058

Quick Answer

直接运行 DeepSeek 几乎总是更便宜,因为使其便宜的两个折扣——非高峰时段半价以及缓存命中率大约比缓存未命中低 30 倍——是第一方机制,而转售商却以统一费率收取费用。托管方从路由和合规性中赚取加价,而不是从价格中。运行它们的提供商的信用计划可在 getaiperks.com 上找到。

DeepSeek 是直接购买更便宜还是通过托管商购买更便宜?

在几乎所有情况下,都是直接购买更便宜,原因在于结构性因素,而非加价问题。 DeepSeek 的低价来自于仅在第一方 API 上存在的两个乘数:半价的非高峰时段窗口,以及成本约为 V4-Pro 缓存未命中成本的 30 倍的缓存命中。转售商按每 token 的固定费率计费,因此这两个乘数在到达他们那里时就消失了。

这便是用一句话概括的全部路由决策。托管商并非在相同价格上收取适度的溢价,而是针对本可以只有一小部分的账单收取固定价格。

这个差距比任何在排行榜上进行路由的人所猜测的都要大。追求这种单位经济效益的团队通常也在追求免费积分,AI Perks 会追踪 194 家公司和 770 万美元的积分


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

DeepSeek 对同一 Token 收取的四种价格

DeepSeek-V4-Pro 的输入价格有四种,取决于一天中的时间和您的提示前缀是否被缓存。 没有其他主要供应商以这种方式定价。

高峰时段是工作日 UTC 时间的 01:00 至 04:00 以及 06:00 至 10:00。除这些窗口之外的所有时间,包括整个周末,均按半价的非高峰时段计费。

DeepSeek-V4-Pro-0813非高峰时段 (每百万)高峰时段 (每百万)
输入,缓存命中$0.022$0.044
输入,缓存未命中$0.66$1.32
输出$1.98$3.96
DeepSeek-V4.1-Flash非高峰时段 (每百万)高峰时段 (每百万)
输入,缓存命中$0.003$0.006
输入,缓存未命中$0.15$0.30

这两个乘数会叠加。非高峰缓存的输入 token 价格为 $0.022,而高峰缓存未命中的价格为 $1.32同一模型的价差为 60 倍(根据上表计算)。在 Flash 模型上,价差更大:$0.003 对 $0.30 是 100 倍,这也是计算得出的。

每天高峰时段共计 7 小时,持续 5 个工作日,因此默认情况下,每周约 79% 的时间按非高峰费率计费(计算得出)。您无需做任何巧妙的操作即可享受非高峰费率。您需要避免做一些粗心的事。


2026 年 8 月 DeepSeek 定价的变化

定价模型本身在 2026 年 8 月 16 日发生了变化,当时固定的每 token 费率被高峰和非高峰的分拆所取代。 在该日期之前撰写的任何成本比较都描述了不再存在的费率表。

重要的时间线:

  • 2026 年 4 月 24 日:V4-Pro 和 V4-Flash 预览版发布,具有 100 万 token 的上下文和可切换的思考模式(置信度:中)。
  • 2026 年 7 月 31 日:DeepSeek-V4-Flash-0731 作为稳定的 Flash 版本发布。已知最后一次固定的定价是每 100 万缓存未命中输入 $0.14,输出 $0.28(置信度:中,仅限历史数据)。
  • 2026 年 8 月 13 日:DeepSeek-V4-Pro-0813 正式发布。
  • 约 2026 年 9 月 10 日:DeepSeek-V4.1-Flash 发布,在文档中列为 DeepSeek-Flash。

将旧的 $0.14 固定费率与当前的 Flash 价格进行比较,价格变化的设计就显而易见了。非高峰缓存未命中输入的 $0.15 价格几乎与旧的固定费率相同,而高峰时段价格为 $0.30,略高于一倍(计算得出)。DeepSeek 并非提高了价格,而是实施了拥堵费


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

第三方托管商的价格以及为何无法匹敌

托管商购买容量并销售 token,因此它必须报价一个数字,该数字要能覆盖其最糟糕的时段。 这个数字高于 DeepSeek 的非高峰费率,并远远高于其缓存的非高峰费率。

转售中会遇到两种问题:

时不时计价无法保留。 服务于所有时区的托管商,如果不想产生套利或无法销售的定价页面,就无法传递基于 UTC 的折扣。

缓存状态是按租户划分的。 当同一个系统提示反复命中同一个后端时,前缀缓存会带来收益。将该提示通过一个在多个提供商之间进行负载均衡的聚合器路由,那么对于您已经发送过一千次的提示,您将支付缓存未命中的价格。

在承诺之前自行验证任何托管商的价格,因为公布的价格会变动,而且大多数比较文章引用的费率已经过时数周。一个数字可以清晰地勾勒出差距。Baseten 列出了 DeepSeek V4.1 Flash 输入每百万 token 价格为 $0.30(置信度:中,引用前请验证),以及 30 美元的全新工作区试用积分。输出价格未得到可靠确认,因此此处未引用。

路由时段计价前缀缓存折扣已验证价格信号
DeepSeek 第一方,V4-Pro是,2 倍波动是,30 倍$0.66 输入 / $1.98 输出,非高峰时段
DeepSeek 第一方,V4.1-Flash是,2 倍波动是,50 倍(计算得出)$0.15 输入,非高峰时段
Baseten未公布未公布$0.30 输入,V4.1 Flash
OpenRouter, Together AI, Fireworks未公布因提供商而异在源头验证

与 Baseten 列出的 $0.30 相比,DeepSeek 自家的非高峰缓存未命中输入价格为 $0.15,是其一半,而缓存的非高峰输入价格为 $0.003便宜 100 倍(计算得出)。这并非是转售商贪婪。而是一个固定费率遇上了一个四级费率。

OpenRouter、Together AI 和 Fireworks 都托管 DeepSeek 模型。此处未引用它们的价格,因为它们未经验证,而在成本比较中过时的价格比没有价格更糟糕。


何时支付托管商的加价是正确的选择

当您购买的东西不是 token 时,请通过托管商进行路由。 在四种情况下,溢价是合理的。

采购阻止中国节点。 如果您的安全审查不允许直接调用 DeepSeek,那么托管商不是加价,而是您发货的唯一途径。这是团队通过美国提供商路由 DeepSeek 最常见的原因。

您需要一个适用于多种模型的发票和密钥。 当某个节点出现故障时,可以从 DeepSeek 故障转移到 Llama 或 Qwen 节点的聚合器,它销售的是可用性,而非价格。

您的流量总是高峰时段且缓存未命中。 服务于欧洲早晨的低流量交互式产品,其高峰时段短而独特的提示。该工作负载会放弃所有折扣,从而大大缩小了第一方优势。

您仍在评估。 像 Baseten 提供的 30 美元试用积分是免费的,可以在您连接第二个供应商之前回答质量问题。免费评估积分是成本最低的尽职调查方式,AI Perks 旨在 catalog 哪里可以获得这些积分。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

终端节点重命名导致路由配置失败

DeepSeek-V4.1-Flash 悄悄地弃用了 deepseek-v4-flashdeepseek-v4-flash-vision-exp 模型名称。 2026 年 9 月之前的代码示例和教程仍然引用它们,现在这些调用会失败。

这最严重地影响了本文所讨论的设置。路由器的配置在一个文件中保存了多个提供商的模型标识符,这些标识符通常保持稳定数年,因此一个被悄悄弃用的名称只会作为一个路由上的间歇性故障出现,而不是明显的服务中断。

两个实际后果:

  • 在调试任何其他问题之前,请在您的代码库和提示模板中搜索旧名称。
  • 托管方模型标识符的命名空间与 DeepSeek 自家的不同,因此请确认您的提供商暴露的确切字符串,而不是假设第一方名称有效。

DeepSeek 没有启动信贷计划。其他公司有。

DeepSeek 的聊天应用是免费使用的,官方定价页面上没有声明的 API 免费套餐,并且 DeepSeek 不运行专门的初创公司信贷计划。 关于新账户 API 免费积分的说法广泛流传,但报告不一致且未在官方页面上得到证实。请将其视为未经证实。

这是一个真正的差距。定价如此低的 API 是少数几个不会为初创公司提供一美元启动资金的模型之一,这使得 DeepSeek 成为一个成本底线而非积分的玩法。

提供这些计划的公司是值得申请的,而且它们的数量比大多数创始人所知的要多得多。AI Perks 追踪了194 家公司总计 770 万美元的积分,这笔预算 DeepSeek 本身永远无法覆盖。

在 getaiperks.com 上查看哪些提供商提供积分 →


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

常见问题解答

OpenRouter 上的 DeepSeek 还是直接购买更便宜?

结构上来说,直接购买更便宜。DeepSeek 的非高峰时段半价以及 V4-Pro 约 30 倍的缓存命中折扣是第一方机制,而转售商将其视为单一固定费率进行计费。托管商通过合规性、故障转移和跨模型的单一发票来赚取其价格。就原始 token 成本而言,第一方胜出。来自提供提供积分计划的提供商的积分可在 AI Perks 上找到。

DeepSeek 的高峰时段是何时?

高峰时段是工作日 UTC 时间的 01:00 至 04:00 以及 06:00 至 10:00。其余所有时间,包括周六和周日,均按半价计费。这意味着默认情况下,每周约 79% 的时间以非高峰费率计费(计算得出),因此批处理和排队的工作几乎总是在那里完成,无需任何调度工作。

DeepSeek 缓存命中节省多少?

在 DeepSeek-V4-Pro 上,非高峰时段的缓存命中成本为每百万输入 token $0.022,而未命中的成本为 $0.66,约为 30 倍。在 V4.1-Flash 上,相同的比较是 $0.003 对 $0.15,约为 50 倍(计算得出)。将缓存折扣与非高峰时段叠加,在 V4-Pro 上,与高峰未命中的价差达到 60 倍。

为什么我的 deepseek-v4-flash API 调用停止工作了?

DeepSeek-V4.1-Flash 弃用了 deepseek-v4-flashdeepseek-v4-flash-vision-exp 终端节点名称。任何写于 2026 年 9 月之前的教程或代码示例仍然使用它们,现在会失败。更新模型标识符,并注意第三方托管商的命名空间标识符与 DeepSeek 自家的不同。

DeepSeek 是否向新账户提供免费 API 积分?

DeepSeek 聊天应用是免费的,但官方定价页面上没有声明的 API 免费套餐,并且新账户积分的说法报告不一致且未经证实。DeepSeek 也不运行初创公司信贷计划。提供这些计划的公司可在 AI Perks 上追踪,覆盖 194 家公司。

DeepSeek V4-Pro 每百万 token 的成本是多少?

DeepSeek-V4-Pro-0813 的非高峰时段每百万缓存未命中输入 token 成本为 $0.66,输出成本为 $1.98,高峰时段翻倍至 $1.32 和 $3.96。缓存输入的非高峰时段成本为 $0.022。一个模型上的这种分级定价是固定转售费率很少具有竞争力的原因。在 AI Perks 上抵消您其他模型的账单。


在 getaiperks.com 订阅 →

DeepSeek 设定了价格底线。其他所有公司的免费积分覆盖其余部分。

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.