Confluent 初创企业计划:20,000 美元的流处理积分

Confluent 为 Confluent Cloud 的初创公司提供高达 20,000 美元的积分。Kafka 的用途、流式传输成本在扩展时的表现以及它与其他服务的组合。

ConfluentStartup CreditsApache KafkaData StreamingAI Perks
Author Avatar
Andrew
AI Perks Team
5,198

Quick Answer

Confluent 初创公司计划为 Confluent Cloud(完全托管的 Apache Kafka 服务)提供高达 20,000 美元的积分,涵盖集群使用、数据传输、保留存储和流处理。集群运行在 Confluent 运营的云账户内,因此积分涵盖流处理账单,但不包括您针对它运行的服务。当前条款列在 getaiperks.com 上。

Confluent 创业计划为您带来什么

Confluent 提供高达 $20,000 的 Confluent Cloud 积分,用于其全托管的 Apache Kafka 服务,涵盖集群使用、数据传输、已保留存储以及其之上的流处理层。

AI Perks 将其与 194 家公司总计 770 万美元的积分 一起追踪。

结构性细节比头部数字更重要。Confluent Cloud 集群运行在 Confluent 自己的云账户中,而不是您的账户中。因此,积分可以清晰地覆盖流处理账单,没有共享仪表来争论,并且不包含您运行生产者和消费者的任何计算,也不包含您在它们之间设置的任何私有网络。当前条款列于 getaiperks.com


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Confluent 实际用途

Kafka 是一个持久、有序、可重放的日志,它允许许多独立的消费者以自己的节奏读取相同的事件流。Confluent 就是为您运营的这个日志,再加上模式、连接器和流处理层,而这些通常是其他团队自己组装的。

决定您是否需要它的区别在于日志与队列。队列一次向一个工作进程传递一条消息,然后就忘记它。日志保留事件,而您在六个月后添加的消费者可以从头开始读取整个历史记录。

三个问题区分了这两种情况:

  • 是否需要多个系统接收同一事件? 一个生产者,四个消费者,他们之间无需相互了解。这就是 Kafka 最初的设计用途。
  • 是否希望重放? 重建派生表、回填新功能存储、在出现错误后重新处理。队列无法做到这一点。日志可以使其常规化。
  • 消费者是否会独立失败? 如果您的分析接收器宕机不能阻止结账,您就需要日志提供的解耦。

如果对所有三个问题的诚实回答都是否定的,那么 Postgres 配合作业表、Redis streams 或 SQS 将以更低的成本和更小的运营开销满足您的需求。 许多成功的产品从未超越过这个阶段。此时积分的价值更高。

决策的另一半是自建还是购买。Kafka 是免费软件,许可费用从来都不是昂贵的部分。分区重新平衡、保留调优、代理升级、凌晨 3 点的磁盘压力以及理解这一切的人,才是昂贵的部分。KRaft 移除了 ZooKeeper 依赖,并使得自托管显著简化,但它并未消除随叫随到的轮班。


Confluent Cloud 定价如何随规模变化

Confluent Cloud 主要根据字节数计费:流入的数据、流出的数据以及保留的数据。让创始人感到意外的仪表是出口流量,因为它乘以读取同一主题的消费者组的数量。

仪表驱动因素导致峰值的原因
入口流量生产者写入的 GB冗余事件、无压缩、日志作为事件处理
出口流量消费者读取的 GB每个额外的消费者组都会重新读取整个流
存储GB 保留 x 保留窗口未经审查的无限或默认保留
集群基础集群类型和配置容量在吞吐量证明其合理性之前购买的专用容量
连接器运行的任务加上吞吐量在迁移完成后仍运行的空闲连接器
流处理Flink 用量,单独计费计划批处理即可完成的连续作业
网络私有网络和跨区域路径出于合规性添加的 PrivateLink 或对等互连,未纳入预算

费率因集群类型、云提供商和区域而异,并且会发生变化。在进行任何建模之前,请对照 Confluent 自己的定价页面验证当前数据。

实际重要的计算是扇出乘数。以每月写入 50GB 事件数据的产品为例。四个消费者组读取该主题:应用程序、搜索索引器、数据仓库接收器和欺诈检查。这相当于 50GB 的入口流量和 200GB 的出口流量,因此您的计费量约为 250GB,实际数据为 50GB,乘数为 5x。

将其扩展,形状保持不变。每月 1TB 的入口流量,加上相同的四个消费者,您的计费量约为 5TB。将您自己的数字输入定价计算器,而不是入口流量。仅从入口流量进行预算的团队,会因其扇出情况而产生错误,这也是为什么 20,000 美元的赠款对某些产品而言比其他产品持续时间更长。 AI Perks 列出了信用条款,扇出由您负责。

有两个杠杆比其他任何因素更能影响账单。生产者端压缩 减少了通过线路传输的字节数,JSON 负载上的 zstd 或 lz4 通常可以通过一行配置更改大幅减少。保留 是存储的纯乘数,默认值很少是您会故意选择的数字。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Confluent 积分可与其他什么叠加

Confluent 积分仅涵盖流处理层。运行生产者和消费者的计算、流数据落入的数据仓库以及它们喂养的模型都是单独的账单,这使得流处理积分异常容易叠加。

一个有效的事件管道会接触四个不同的供应商,并且每种都有相应的赠款:

  • 云积分 涵盖您的生产者和消费者运行的机器,以及您这边线路上的存储和出口流量。
  • Confluent 积分 涵盖中间的传输、模式注册表和流处理。
  • 数据平台积分 涵盖流数据落入的数据仓库或数据湖屋。
  • 模型和 API 积分 涵盖消费者在运行时调用的任何推理。

拥有这四者中三者的团队,在相同窗口内已覆盖了大部分实时数据堆栈。了解哪些赠款兼容,哪些悄悄地互相排斥,AI Perks 被维护为一个列表而不是书签文件夹的原因。


创始人关于流处理积分的常见误解

最昂贵的错误是将 Kafka 用作任务队列,因为您承担了日志的操作和成本模型,而并未需要日志提供的任何东西。

五种故障模式,按成本大致排序:

将 Kafka 用作作业队列。 如果一个工作进程消耗每条消息,并且没有人重放任何内容,那么您就购买了分区管理和消费者组重新平衡,以完成数据库表和 cron 作业已经完成的任务。

扇出盲点。 每个新的消费者组都意味着对该主题的一次完整额外读取。三个团队在一个季度内各添加一个消费者,可以将账单增加两倍,而没有人更改任何配置。在添加消费者之前,请询问现有消费者是否可以发布一个派生主题。

流式日志。 应用程序日志是高容量、低每字节价值的,它们应该在为这种形状定价的日志平台中。将它们通过 Kafka 是消耗积分的最快方式,而这些积分消耗在无人会重放的数据上。

早期过度分区。 分区是并行性的单位,它们并非免费。团队为了安全起见选择一个大的数字,然后发现分区数量很容易增加但很难减少。

过晚规划退出。 Kafka 协议确实是可移植的;您围绕它构建的东西则不是。在 消耗 70% 积分时 决定您的非补贴架构的样子,而不是在 100% 时。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

如何围绕 Confluent 和其他数据平台积分进行规划

流处理积分的价值取决于您的架构允许它有多大价值,而这些决策是在第一个主题上线之前做出的。

五项值得尽早确定的内容,按成本影响大致排序:

绘制整个账单,而不仅仅是 Confluent 那一项。 getaiperks.com 上的目录并列列出了流处理、数据仓库和管道程序,该视图显示了实时堆栈的哪些部分已被覆盖,哪些仍归您所有。

单独预算云账单。 生产者、消费者和私有网络由 AWS、Azure 或 Google Cloud 计费,无论 Confluent 覆盖了什么,而且这条线路不会因为流处理线路的缩短而缩小。

在消费者存在之前设置保留和压缩。 两者都是改变一行代码的决定,它们在积分的整个生命周期内都会累积,一旦下游系统依赖它们,就很难更改。

将每个新的消费者组视为一个成本决策。 扇出是那个增长的仪表,而无需任何人编辑配置,因此请询问现有消费者是否可以发布一个派生主题。

决定您的可移植边界在哪里。 纯 Kafka 协议使用是可移植的。托管的 Flink 作业、Confluent 连接器和治理配置则不是,因此从一开始就保持可移动部分的清洁。


常见问题解答

Confluent 创业计划值多少钱?

高达 20,000 美元的 Confluent Cloud 积分,涵盖集群使用、入口流量、出口流量、保留存储和流处理。对于每月流式传输数十 GB 的产品来说,这在流处理账单方面是一个很长的跑道。当前金额和资格在 getaiperks.com 上进行追踪。

Confluent 积分是否包含我的 AWS 或 Google Cloud 账单?

不。Confluent Cloud 集群运行在 Confluent 自己的云账户中,因此积分仅抵消 Confluent 发票。运行您的生产者和消费者的计算、您自己的存储以及您配置的任何私有网络都由您的云提供商计费。计划同时持有云赠款和 Confluent 赠款。

Kafka 是否对初创公司来说是过度设计?

通常是。如果一个工作进程消耗每条消息,并且您从不重放历史记录,那么 Postgres、Redis streams 或 SQS 更便宜、更简单。当多个独立系统读取同一事件、重放很重要,或者一个慢速的消费者不能阻止产品其余部分的运行时,Kafka 的成本才得以体现。

为什么我的 Confluent 出口流量账单高于入口流量?

因为每个消费者组都会读取完整的流。一个主题上的四个消费者意味着您的出口流量大约是入口流量的四倍。请根据您扇出相乘后的数字进行预算,而不是根据入口流量,并考虑让一个消费者发布一个派生主题,而不是添加第五个读取者。

我可以将 Confluent 积分与其他创业公司积分结合使用吗?

是的,而且流处理积分叠加得异常干净,因为账单不会重叠。云积分涵盖机器,Confluent 涵盖传输,数据平台积分涵盖数据落入的数据仓库,模型积分涵盖推理。哪些计划兼容,在 getaiperks.com 上有 194 家公司的数据。

当 Confluent 积分用完时会发生什么?

您将继承一个账单,其规模由在使用免费额度期间选择的保留、压缩和扇出默认值决定。在开始时有意识地设置它们,将您的集成保持在 Kafka 协议级别(使其保持可移植),并在消耗 70% 积分时决定您将削减什么,而不是在发票到达后才决定。


在 getaiperks.com 订阅 →

移动事件。让别人资助传输,而您在此之上进行构建。

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.