新的 Baseten 工作区从何开始?
据报道,新的 Baseten 工作区会附带 30 美元的试用积分,这是一种常设优惠,而非限时促销活动。
这句话带有大多数报道中都没有的谨慎。30 美元的数字来自对 Baseten 定价和变更日志的报道,而不是在一个显眼的位置重申的头条优惠。而且定价页面在多次检查时并未一致渲染。因此:据报道,而非供应商确认。请检查您的工作区实际显示的余额。
该积分适用于哪些方面比数字更清楚。它适用于 Baseten 模型 API,这是一个托管 Kimi K3、GLM-5.3 和 DeepSeek V4.1 Flash 等开源模型的共享端点层,与生产工作负载调用的相同接口。此积分可进行真实测试,而非沙盒。 AI Perks 会追踪当前条款以及Across 194 companies 的 770 万美元积分。

Baseten 在 2026 年 7 月至 9 月期间发布了什么
Baseten 在本季度同时做了两件事:为其模型 API 添加了前沿开源模型,并为制造这些模型的实验室构建了产品。
| 日期 | 发布内容 | 适用对象 |
|---|---|---|
| 2026 年 7 月 27 日 | Kimi K3 首发 API | 开发者 |
| 2026 年 7 月 29 日 | Baseten for Model Labs | 模型实验室 |
| 2026 年 8 月 28 日 | 模型 API 上的 GLM-5.3 | 开发者 |
| 2026 年 8 月 29 日 | Frontier Gateway | 模型实验室 |
| 2026 年 9 月 3 日 | 快速容量上的 GLM-5.3-Flash | 开发者 |
| 2026 年 9 月 10 日 | DeepSeek V4.1 Flash | 开发者 |
| 2026 年 9 月 13 日 | 宣布弃用六个模型 | 所有用户 |
Kimi K3 的发布是值得理解的。Moonshot AI 发布了一个开源专家混合模型,据报道参数量在 2.8 万亿到 3 万亿之间,原生支持视觉,并拥有 100 万个 token 的上下文窗口。Fireworks AI、Modal 和 Baseten 在同一天都发布了托管 API。Fireworks 和 Baseten 同时发布了训练 API 和推理 API。三方首发竞争意味着同一权重来自三个供应商,三种计费模式,因此供应商选择是一个定价问题,而不是能力问题。
Baseten 模型 API 定价:仅一半的表格清晰可见
Baseten 为每个模型 API 发布每百万 token 的输入价格。输出端不是此页面能自信引用的。
| 模型 | 每百万 token 输入 | 每百万 token 输出 | 备注 |
|---|---|---|---|
| Kimi K3 | $3.00 | 无法可靠读取 | 开源,原生视觉,1M 上下文 |
| GLM-5.3 | $1.40 | 无法可靠读取 | 100 万 token 上下文 |
| DeepSeek V4.1 Flash | $0.30 | 无法可靠读取 | 5520 亿参数,多模态 |
| GLM-5.3-Flash | 未确认 | 未确认 | 专用快速服务容量 |
这些输入费率是 Baseten 的定价表在检查时列出的。输出列在提取时并未一致渲染,因此上面没有显示 Baseten 的输出费率。
要了解缺失部分的大致规模,请查看唯一发布了所有内容的供应商。Fireworks AI 在其标准套餐中将 Kimi K3 列为每百万 token $3.00 的输入,$0.30 的缓存输入和 $15.00 的输出。输出成本是输入的五倍。任何基于 $3.00 输入费率建立的 Baseten 成本模型都是错误的,其倍数未知,而且在生成密集型工作负载下,这个倍数占了账单的大部分。将任何打印 Baseten 输出价格的文章视为猜测,除非有免责声明。 AI Perks 会追踪供应商的价格变动。

六个模型将于 2026 年 9 月 25 日从 Baseten 模型 API 中移除
Baseten 于 2026 年 9 月 13 日宣布,GLM-4.7、Kimi K2.7、Kimi K2.6、Inkling、Inkling-Small 和 DeepSeek V4 Pro 将于 2026 年 9 月 25 日从模型 API 中淘汰。
这是悄悄破坏东西的部分。三类读者会受到影响。
任何在生产环境中硬编码了模型 slug 的用户。 兼容 OpenAI 的端点,无论是模型重命名还是移除,都会以相同的方式失败。在 25 日之前固定一个替代项,而不是之后。
任何维护比较帖子的用户。 任何列出 Baseten 上 DeepSeek V4 Pro 或 Kimi K2.x 系列定价的列表文章,将在 9 月 25 日后变得不准确,而且大多数文章将永远不会更新。假设 9 月份之前的汇总文章有无效行。
任何基于旧基准进行评估的用户。 如果您的测试工具以 Kimi K2.7 或 K2.6 为目标,那么目录中的后续版本是 Kimi K3,价格不同,因此上个月的比较不再适用。
将这些配对视为编辑判断,而不是供应商发布的迁移路径:GLM-4.7 到 GLM-5.3,Kimi K2.x 系列到 Kimi K3,DeepSeek V4 Pro 到 DeepSeek V4.1 Flash。价格在这两个跨越式升级中会双向变动,这正是试用积分发挥作用的时候。请查看 AI Perks 上当前可用的内容。
在哪里运行 Kimi K3:Baseten、Fireworks 或 Modal
三家供应商在发布日都发布了 Kimi K3,只有一家发布了完整的每 token 价格,您可以据此进行规划。
| 供应商 | Kimi K3 每百万 token 输入 | 是否发布完整的 token 定价 | 免费入门点 |
|---|---|---|---|
| Fireworks AI | 标准版 $3.00,快速版 $4.50 | 是 | Fire Pass 免费套餐,精选 Kimi K3 快速版 |
| Baseten | $3.00 | 否,输出无法读取 | 试用积分,据报道为 30 美元,一次性 |
| Modal | 未发布 | 否 | 新工作区的每月 30 美元通用计算 |
Fireworks 发布了完整信息:标准版每百万 token $3.00 输入,$0.30 缓存输入和 $15.00 输出,快速版套餐为 $4.50,$0.45 和 $22.50,以及一个美国托管版本,价格大约高 10%。其免费套餐 Fire Pass 将 Kimi K3 Fast 作为其特色免费模型,并提供完整的 100 万 token 上下文,这是学习模型是否适合您的任务的最便宜方式。Baseten 的输入价格与其匹配,均为 $3.00。Modal 在其发布帖中确认了基于 token 的定价,但未发布每百万 token 的费率。
两个 30 美元的数字是巧合,值得仔细阅读:它们不是同一个优惠。Modal 的是每月一次的计算额度,涵盖通用计算而不是单个模型 API。Baseten 的是一次性的工作区试用积分。三个月的评估期内,前者为 90 美元,后者为 30 美元。两者都值得保留:AI Perks 之所以存在,是因为多个层级的积分比在一个供应商那里获得一个大额积分更有价值。

Baseten for Model Labs 和 Frontier Gateway 解释
2026 年发布的这两个产品,大多数开发者会觉得不相关,了解原因可以节省一周的评估时间。
Baseten for Model Labs,于 2026 年 7 月 29 日宣布,这是一个面向希望通过 Baseten 基础设施分发和变现其模型的闭源模型实验室的产品线。它颠倒了通常的关系:Baseten 不再为开发者托管开源模型,而是实验室成为客户,实验室的用户成为流量。
Frontier Gateway,于 2026 年 8 月 29 日宣布,这是一个托管的多租户 API 网关,允许实验室在 Baseten 的堆栈上建立生产级别的推理 API,而无需自行构建服务层。
两者都没有公布价格,都面向实验室而非开发者,试用积分不适用于任何一个。关于这两者的报道都很零散且中等可信度,因此在供应商确认之前,将其他地方找到的详细功能列表或延迟基准视为未经确认。对于调用模型的开发者来说,后果是间接的:如果实验室采用这条路线,更多的闭源模型将可以通过类似于您已调用的端点的接口访问。值得在 AI Perks 上关注。
如何让入门积分用得更久
在推断任何内容之前,请确认输出定价。 仅输入费率会低估实际成本,尤其是在生成密集型工作负载下,而 Baseten 的输出列是此页面无法提供给您的一个数字。基于 Kimi K3 每百万 token 3.00 美元的预算,实际上是基于账单的一半。
在 Flash 级别模型上进行调试。 GLM-5.3-Flash 和 DeepSeek Flash 系列是为了降低延迟和成本,而不是为了最高质量。提示工程、重试逻辑和模式错误不需要前沿模型来暴露,事后更换 slug 只需要一行代码。
固定您的模型版本。 六个模型将于 2026 年 9 月 25 日淘汰。带有日期的 slug 可以防止弃用变成中断,而在重新评估替代项时,试用积分是最有用的。
持有多个层级的积分。 推理、通用计算和前沿模型访问是分开计费的。Baseten 涵盖第一层,Modal 或超大规模云服务商涵盖第二层,前沿实验室涵盖第三层。

常见问题解答
Baseten 的免费积分值多少钱?
据报道,新的工作区会附带 30 美元的试用积分,这被描述为一种常设优惠,而非促销活动。该数字来自报道,而非供应商明确声明的头条信息,因此请将 30 美元视为据报道的数字,并确认您的工作区实际显示的余额。当前条款可在 getaiperks.com 上追踪。
Baseten 每个 token 收费多少?
输入费率清晰可见:Kimi K3 每百万 token $3.00,GLM-5.3 为 $1.40,DeepSeek V4.1 Flash 为 $0.30。输出费率从公共定价表中无法可靠读取,此页面不会猜测。在估算月度账单之前,请在控制台中确认输出定价。
Baseten 将于 2026 年 9 月弃用哪些模型?
GLM-4.7、Kimi K2.7、Kimi K2.6、Inkling、Inkling-Small 和 DeepSeek V4 Pro 将于 2026 年 9 月 25 日从 Baseten 模型 API 中淘汰,该消息于 9 月 13 日公布。目录中最近的替代品是 GLM-5.3、Kimi K3 和 DeepSeek V4.1 Flash,尽管这种配对是编辑判断,而非供应商发布的迁移路径。
Baseten 的 Kimi K3 比 Fireworks 便宜吗?
在输入 token 方面,两家都列为每百万 token 3.00 美元,因此在唯一可以清晰比较的数字上是持平的。Fireworks 在其标准套餐中还公布了每百万 token $0.30 的缓存输入和 $15.00 的输出。在 Baseten 的输出费率得到确认之前,无法进行任何方向的完整成本比较。
Kimi K3 是什么,为什么三家供应商同时发布它?
Kimi K3 是 Moonshot AI 的开源专家混合模型,据报道参数量在 2.8 万亿到 3 万亿之间,原生支持视觉,并拥有 100 万个 token 的上下文窗口,于 2026 年 7 月 27 日发布。Fireworks AI、Modal 和 Baseten 在同一天都发布了托管 API。开源权重使得这一切成为可能:任何供应商都不需要许可,因此发布日成为价格竞赛,而不是独占。
我可以将 Baseten 积分与其他 AI 积分结合使用吗?
是的,这是常规做法。推理、通用计算和前沿模型积分是三个不同供应商的三个独立账单,拥有一个积分不会阻止另一个。Baseten 涵盖推理层,Modal 或超大规模云服务商涵盖计算,前沿实验室涵盖直接模型调用。AI Perks 在 getaiperks.com 上追踪 194 家公司的 770 万美元积分。
固定您的模型版本。让别人为您支付 token 费用。