SWE-2 定价 2026:Cognition 编码模型的成本

SWE-2 是 Cognition 的 Kimi K3 预训练代码模型。报告的基准测试、Devin 订阅中的成本以及尚未公布的内容。

SWE-2CognitionDevinAI Coding ModelsAI Perks
Author Avatar
Andrew
AI Perks Team
8,733

Quick Answer

SWE-2 没有单独的 API 定价。Cognition 将其包含在 Devin 订阅中,初步报道称 Devin Pro 的价格为每月 20 美元,Devin Teams 的价格为每月 80 美元,外加每位开发者座位 40 美元。同一份报道称,在推出时,SWE-2 在 Pro、Max 和 Teams 订阅中免费提供了一个月。没有公布每 token 的费率或信用额度。更广泛的 AI 堆栈的信用额度可在 getaiperks.com 上追踪。

SWE-2 的成本是多少?

Cognition 未公布 SWE-2 的独立每 token 定价。该模型通过 Devin 订阅销售,根据发布报告,最便宜的付费套餐是 Devin Pro,每月 20 美元。

这是大多数发布报道忽略的答案,转而关注基准测试图表。SWE-2 于 2026 年 9 月 10 日发布,基于 Moonshot AI 的 Kimi K3 进行后训练,发布重点在于成本而非原始能力。

下表是发布报告的内容。请将所有数字都视为报告值而非已确认值,因为报告值是现有信息来源的优势。

Devin 套餐报告价格发布时的 SWE-2
Pro每月 20 美元报告称自发布之日起免费一个月
Max我无法核实的定价报告称自发布之日起免费一个月
Teams每月 80 美元,外加每位开发者席位 40 美元报告称自发布之日起免费一个月

将一款前沿类编码模型以每月 20 美元的订阅价格免费提供一个月,这是一个非常直接的优惠,但它会过期。AI Perks 追踪覆盖编码代理背后模型和基础设施账单的积分计划。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

SWE-2 的实际得分

SWE-2 在 FrontierCode 1.1 Main 上报告得分为 50.0%,比 Claude Fable 5.1 低一分,Cognition 声称其成本比同类前沿模型低约 64%。

下方所有数字均为供应商报告,通过发布报道获得,而非独立评估,且未被 Cognition 以外的任何人复现。这是一款发布一周的模型正常情况,也是此处任何内容都不应被视为已确定的原因。

基准测试SWE-2 报告得分可比项
FrontierCode 1.1 Main50.0%比 Claude Fable 5.1 低一分
DeepSWE 1.173.0%我无法核实的竞争对手数据
Terminal-Bench 2.192.8%我无法核实的竞争对手数据

有两个值得单独区分的声明。第一是绝对得分:FrontierCode 1.1 Main 上的 50.0% 将 SWE-2 置于与前沿编码模型相同的对话范围内。第二是成本描述,这才是真正的新闻。声称实现同等水平的成本低廉,而实现则成本高昂;在接近同等水平时存在巨大的成本差距,这会改变构建决策。

本页面无法为您提供剩余的表格。GPT 类模型、Grok、Kimi K3 基础模型以及 Cognition 自家之前的 SWE 版本的得分,在现有信息来源中均未提及,因此表中也未包含。填补这些单元格的图表,其断言超出了公开记录的支持范围。


“便宜 64%”的说法有多大程度是真的

64% 的数字是发布时提出的相对成本声明,针对的是未具名的同类前沿模型。在此之下没有费率表,因为不存在独立的 SWE-2 定价。

这比听起来更重要。按 token 比较需要两个费率,而 Cognition 既没有公布 SWE-2 的费率,也没有公布 64% 是基于哪个基准。该声明无法从公开数字中重建,只能通过您自己的工作负载进行测试。

对于任何围绕此进行预算的人来说,有三个后果:

  • 节省是方向性的,而非合同性的。 Devin 订阅中的任何内容都没有以这 64% 来计价。
  • 基准未说明。 同类前沿模型是一个类别,而非一个模型,该类别内部的成本差异很大,足以显著影响该数字。
  • 基准测试的同等水平不代表任务的同等水平。 三行强劲的基准测试并不能告诉你模型在冗长、非结构化的代理工作中的表现,目前尚无此类公开比较。

明智的配置是同时使用两种模型。默认使用廉价模型,当任务两次失败时升级到前沿模型,这样您就可以在不将工作流押注于您无法审计的声明的情况下,获得大部分节省。AI Perks 追踪这条路线两端提供商的积分。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

免费一个月是什么,之后会怎样

发布报道称 SWE-2 在 Devin Pro、Max 和 Teams 订阅中提供免费一个月。这是一个付费套餐内的促销窗口,而不是免费产品。

有三个机制比头条新闻更重要。

它有时限。 一个月,从 9 月 10 日发布开始。没有我能核实的公开声明说明窗口结束后会是什么,是否会延长,或者关闭后模型消耗什么。

这不是免费套餐。 该优惠依赖于人们已经付费的订阅。对于没有 Devin 套餐的人来说,没有公开的途径可以免费获得 SWE-2。

可用界面不同。 SWE-2 在发布时可在 Devin Desktop 和 Devin CLI 中使用,Devin Web 和 Fusion 被描述为即将推出。这两者都没有公布日期。

如果您正在评估 Devin Pro,一个包含供应商最新模型且有促销条款的一个月,与窗口关闭后您将购买的一个月,是截然不同的测试。请相应地安排评估时间,并从 AI Perks 而非收入中为周边堆栈提供资金。


Cognition 未公布的内容

截至 2026 年 9 月 17 日,人们最常询问的关于 SWE-2 的数字是没有公开答案的。明确指出差距,能区分一篇始终正确的信息页面和一篇悄然过时的信息页面。

独立的 API 定价。 在我能核实的任何来源中,SWE-2 都没有每百万 token 的费率。64% 的数字是相对声明,而非费率表。引用整齐的每 token SWE-2 定价的文章,是在填充供应商留下的空白。

上下文窗口。 在可用的信息来源中没有 SWE-2 的数字,并且基础模型的规格并不自动适用于在其上后训练的模型。

积分额度和配额消耗。 没有公开关于 SWE-2 任务消耗计划多少额度、额度如何刷新,或超出额度的使用成本。

Max 套餐的价格。 Max 套餐在免费月度优惠中被提及,但该套餐的价格并非我在此可以核实的。

变体系列。 SWE-2 是否有多个尺寸版本,以及它们之间的相对成本如何,均未以我能确认的任何形式发布。

免费月结束后会发生什么。 没有发布任何内容,无论哪个方向。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

如何削减编码代理背后的实际账单

从积分层开始。 getaiperks.com 筛选 AI 工具、开发人员工具和云基础设施类别。编码订阅是小额账单。模型 API、计算和围绕它的基础设施是昂贵的部分。

将促销月用于艰巨的工作。 免费的窗口最适合处理您通常不会冒险使用配额的任务。执行棘手的重构,而不是自动完成。

根据您自己的证据进行路由,而不是根据品牌。 供应商基准测试和供应商的成本声明只是一个假设。将相同的二十个实际工单分别通过两种模型进行测试,记录重试次数,然后让您自己的数字来选择默认模型。

单独为 API 层融资。 积分很少能直接支付编码订阅费用,但它们可以覆盖代理工作流生成的模型调用、推理和托管,而这对于大多数团队来说是随着使用量而增长的账单。

窗口关闭时重新检查。 关于一个发布一周的版本的条款变化很快,这里的信息是报告值而非确认值。任何基于促销月进行的预算都应在促销月结束后重新审视。


常见问题解答

SWE-2 每 token 多少钱?

Cognition 未公布 SWE-2 的每 token 定价。它通过 Devin 订阅而非独立的 API 定价卡消耗。发布报告称 Devin Pro 每月 20 美元,Devin Teams 每月 80 美元,外加每位开发者席位 40 美元;其他套餐的价格并非我能核实的。周边堆栈的积分可在 getaiperks.com 处追踪。

SWE-2 现在真的免费吗?

发布报道称,自 9 月 10 日发布起,SWE-2 在 Devin Pro、Max 和 Teams 订阅中提供免费一个月。这是一个付费套餐内的促销活动,而不是一个免费产品,并且没有我能核实的公开声明描述了该月结束后的条款。

SWE-2 比 Claude Fable 5.1 更好吗?

唯一可用的比较是 FrontierCode 1.1 Main,SWE-2 报告的 50.0% 比 Claude Fable 5.1 低一分。这表明两者持平,而非一方胜出。SWE-2 在 DeepSWE 1.1 上报告的 73.0% 和在 Terminal-Bench 2.1 上报告的 92.8% 没有可核实的竞争对手数据,因此更广泛的排名将是臆造。

SWE-2 基于什么模型构建?

SWE-2 是基于 Moonshot AI 的 Kimi K3 模型进行后训练的,Kimi K3 的参数据报道为 2.8 万亿。后训练在其基础上增加了多少内容,在我能核实的任何数字中均未公布。Moonshot 和更广泛堆栈的积分可在 getaiperks.com 处获取。

我在哪里可以使用 SWE-2?

SWE-2 在发布时可在 Devin Desktop 和 Devin CLI 中使用。Devin Web 和 Fusion 被描述为即将推出,这两者都没有公布日期,因此将那里的可用性视为待定而非实时。

免费 AI 积分可以抵消编码代理订阅吗?

提供商的积分通常仅限于该提供商自己的使用范围,因此它们很少能直接支付 Devin 订阅费用。它们可以覆盖代理工作流消耗的模型 API、计算和托管,而这对于大多数团队来说是更大且增长更快的账单。AI Perks 在 getaiperks.com 处追踪这些层面的积分计划。


在 getaiperks.com 订阅 →

廉价模型,昂贵的重试。了解两者的区别,并让其他人来资助堆栈,请访问 getaiperks.com

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.