Kostenlose Feuerwerks-KI-Credits 2026: Fire Pass und reale Kosten

Fireworks AI hostet Kimi K3 zu $3,00 bzw. $15,00 pro 1 Mio. Tokens. Was der Fire Pass abdeckt, welche Zahlen nur berichtet werden und wie Sie die Rechnung kürzen können.

Fireworks AIKimi K3Free AI CreditsLLM API PricingServerless TrainingAI Perks
Author Avatar
Andrew
AI Perks Team
10,143

Quick Answer

Fireworks AI betreibt Fire Pass, eine kostenlose Stufe, deren vorgestelltes Modell Kimi K3 Fast mit einem 1-Million-Token-Kontextfenster ist. Die veröffentlichten Nutzungsgrenzen für den Pass sind nicht bestätigt, daher sollten Sie jeden Plan gegen den bezahlten Preis abschätzen: Kimi K3 kostet 3,00 $ pro Million Eingabetoken, 0,30 $ im Cache und 15,00 $ Ausgabe auf der Standard-Serverless-Stufe. Gutschriften, die reale Rechnungen abdecken, werden unter getaiperks.com verfolgt.

Was kostet Fireworks AI im Jahr 2026 tatsächlich?

Fireworks AI bietet Kimi K3 für 3,00 $ pro Million Eingabetoken, 0,30 $ pro Million gecachter Eingabetoken und 15,00 $ pro Million Ausgabetoken in der Standard-Serverless-Stufe an.

Dies sind die veröffentlichten Startpreise von Fireworks, die mit den Preisen von Moonshot AI auf den Cent genau übereinstimmen, was bei einem Drittanbieter selten vorkommt.

Fireworks lieferte Kimi K3 am 27. Juli 2026 aus, dem Tag, an dem Moonshot die Gewichte, Inferenz und das Training zusammen veröffentlichte. Modal und Baseten lieferten es am selben Tag aus, was den Start zu einem Dreikampf machte. Moonshot hatte K3 bereits am 16. Juli für Chat- und API-Benutzer geöffnet. Es handelt sich um ein Mixture-of-Experts-Modell mit 2,8 Billionen Parametern, die größte bisher veröffentlichte Open-Weights-Version, und es debütierte auf Platz drei der Artificial Analysis Rangliste.

Modell und HostInput / 1 Mio.Gecachter Input / 1 Mio.Output / 1 Mio.Kontext
Kimi K3, Fireworks Standard3,00 $0,30 $15,00 $1 Mio.
Kimi K3, Fireworks Fast4,50 $0,45 $22,50 $1 Mio.
Kimi K3, Moonshot direkt3,00 $0,30 $15,00 $1.048.576
Kimi K2.7-Code, Moonshot direkt0,95 $0,19 $4,00 $262.144
Kimi K2.7-Code Highspeed, Moonshot1,90 $0,38 $8,00 $262.144
Kimi K2.6, Moonshot direkt0,95 $0,16 $4,00 $262.144

Input ist die Cache-Miss-Rate, gecachter Input die Cache-Hit-Rate. Gecachter Input kostet bei Kimi K3 10 % des ungecachten Inputs, daher ist Prompt-Caching hier mehr wert als bei fast jeder anderen Optimierung. Der Generationssprung ist ebenfalls steil: K3-Ausgabe kostet das 3,75-fache der K2.7-Code-Ausgabe für 2,8 Billionen Parameter gegenüber den 1 Billion bei K2.6 mit 32 Milliarden aktiven.

Niemand finanziert eine Spitzen-Inferenzrechnung im ersten Jahr aus den Einnahmen. AI Perks verfolgt, welche Modell- und Compute-Anbieter Gutschriften gewähren.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Ist Fire Pass eine echte kostenlose Stufe?

Fire Pass ist die kostenlose Stufe von Fireworks, und das vorgestellte kostenlose Modell ist jetzt Kimi K3 Fast mit dem vollen 1-Million-Token-Kontext. Was fehlt, ist eine veröffentlichte Reihe von Limits, um die Sie ein Produkt planen können.

Eine kostenlose Stufe mit einem Spitzenmodell ist ungewöhnlich, und der Kontrast zum Labor ist scharf: Moonshot betreibt keine permanente kostenlose Stufe für ein Kimi-Modell, und das Konto muss Berichten zufolge vorab aufgeladen werden, wobei mindestens etwa 1,00 $ erforderlich sind, bevor die API überhaupt antwortet. Dass Fireworks dieselben Gewichte hinter einer kostenlosen Stufe anbietet, ist der günstigste legitime Weg, einem Coding-Agenten ein 1-Million-Kontext-Modell zuzuweisen.

Die Vorsicht ist symmetrisch. Berichte über Fire Pass zirkulieren sehr spezifische Bedingungen: Einladungscodes, verbotene Produktionsworkloads, Widerrufsklauseln, tägliche Obergrenzen. Nichts davon ist in den eigenen Launch-Materialien von Fireworks bestätigt, wie hier geprüft, behandeln Sie also jede Einschränkung und jede Zahl als unbestätigt, bis sie in Ihrer eigenen Konsole erscheint.

Diese Lücke zwischen einer Entwickler-Testversion und einem finanzierten Budget schließen Startup-Kreditprogramme. AI Perks verfolgt, welche gerade geöffnet sind.


Das US-Hosting-Premium: Zwei Zahlen, die sich widersprechen

Fireworks verkauft eine US-gehostete Variante von Kimi K3 über dem globalen Preis. Das Premium wird auf zwei Arten berichtet, und die Lücke zwischen ihnen beträgt das Fünffache.

Das eigene Launch-Material von Fireworks für Kimi K3 gibt die US-gehostete Variante mit 10 % über dem Standard-Serverless-Tarif an. Eine spätere Zusammenfassung der Serverless-Preisdokumentation von Fireworks berichtet stattdessen von einer Richtlinie: Ab dem 1. September 2026 werden neu gestartete US-only-Modelle zum 1,5-fachen des Grundtarifs bepreist, mit einer Ausnahme: GLM-5.2 Fast US soll zum globalen Preis passen. Diese zweite Angabe ist eine Sekundärzusammenfassung und wurde hier nicht mit der Dokumentation von Fireworks abgeglichen.

Beide können gleichzeitig gelten: Die eine beschreibt ein Modell, das vor diesem Datum bepreist wurde, die andere Modelle, die danach gestartet wurden. Lesen Sie den US-Preis in Ihrer eigenen Konsole ab, bevor Sie sich zu einer Datenresidenzklausel verpflichten, denn bei einem Spitzenmodell ist 10 % gegenüber 50 % der Unterschied zwischen einem Rundungsfehler und einem einzelnen Posten.

Die Geschwindigkeitsstufe ist dagegen unbestritten. Bei einem einzigen Lauf mit 1 Million Eingabe- und 100.000 Ausgabetoken ohne Cache-Treffer:

RouteEingangskostenAusgangskostenLaufzeit insgesamt
Kimi K3, Fireworks Standard3,00 $1,50 $4,50 $
Kimi K3, Fireworks Fast4,50 $2,25 $6,75 $

Fast kostet genau das 1,5-fache von Standard für alle drei Token-Typen, 2,25 $ mehr bei diesem Lauf: günstig für die Latenz, die Sie benötigen, teuer als Standard.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Serverless Training: Gemeldet, nicht bestätigt

Es wird berichtet, dass Fireworks eine Serverless Training API parallel zu Kimi K3 gestartet hat, die LoRA-Feinabstimmung pro Token statt pro reservierter GPU-Stunde berechnet. Fast alles daran ist aus zweiter Hand.

Die Designänderung ist der interessante Teil und hängt nicht von einer Preisliste ab. Reserved Training berechnet GPU-Stunden, unabhängig davon, ob Sie etwas lernen oder nicht. Per-Token-Training berechnet die geleistete Arbeit, was den LoRA-großen Experimenten entgegenkommt, die die meisten Teams tatsächlich durchführen. Die gemeldete Abdeckung beim Start umfasste Qwen 3.5 9B, Qwen 3.6 27B und Kimi K3.

Alles unten ist von einer Sekundärquelle gemeldet und wurde bei dieser Prüfung nicht in den eigenen Dokumenten von Fireworks bestätigt. Behandeln Sie es als eine Form, nicht als einen Preis:

  • Die Abrechnung soll zwischen den Phasen Vorabfüllung (Prefill), gecachte Vorabfüllung (Cached Prefill), Stichprobe (Sample) und Training (Train) aufgeteilt werden, anstatt eines einzigen Pauschalpreises pro Token.
  • Die gemeldete Spanne über diese Phasen liegt zwischen 0,66 $ und 32,55 $ pro 1 Million Token. Eine 49-fache Spanne macht jede einzelne Schlagzeilenzahl bedeutungslos: ein Angebot, das auf der falschen Phase basiert, ist um eine Größenordnung falsch.
  • Pro-Modell-LoRA-Tarife, Kosten für Beispiel-Läufe und Vorschau-Status werden in der Launch-Berichterstattung verbreitet, keines davon wurde hier bestätigt.

Budgetieren Sie ein Feinabstimmungsprogramm aus der Ausgabe Ihrer eigenen Konsole, nicht aus der Launch-Berichterstattung. Credits sind die günstigere Variable zur Lösung, und AI Perks verfolgt Compute- und Modell-Credits nebeneinander.


Fireworks, Modal, Baseten oder Moonshot Direkt?

Bei den veröffentlichten Zahlen ist Fireworks Standard und Moonshot Direkt ein Unentschieden, und die anderen beiden Tag-Null-Hosts haben nicht genug veröffentlicht, um einen Vergleich zu ermöglichen.

Die Standard-Stufe von Fireworks und die Plattform von Moonshot listen beide 3,00 $ für Input, 0,30 $ für gecachten Input und 15,00 $ für Output pro Million Tokens bei einem 1-Million-Token-Kontext. Diese Parität nimmt den Preis vollständig aus der Argumentation.

Der Rest des Feldes ist dünner, als die Launch-Berichterstattung vermuten lässt:

  • Baseten listet Kimi K3 Input mit 3,00 $ pro 1 Million auf. Seine veröffentlichte Output-Zahl ist unklar genug, um sie von der eigenen Preisgestaltungsseite von Baseten ablesen zu müssen.
  • Modal bestätigte eine tokenbasierte Preisgestaltung für Kimi K3, veröffentlichte jedoch in seinem eigenen Launch-Post keine Rate pro 1 Million. Modal bietet neuen Workspaces 30 $ monatlich an allgemeinen Compute-Credits an, ein stehendes Angebot und kein Kimi-Launch-Perk.
  • Moonshot direkt betreibt keine permanente kostenlose Stufe für ein Kimi-Modell und bepreist K2.6-Batch-Jobs mit 60 % des Standardtarifs, der einzige hier genannte Rabatt, der First-Party und eindeutig ist.

Eine Vorsichtsmaßnahme bezüglich der Gewichte: Die benutzerdefinierte Lizenz von Kimi K3 verlangt von Unternehmen mit einem Umsatz über 20 Millionen US-Dollar, dass sie einen kommerziellen Vertrag mit Moonshot aushandeln, bevor sie den Zugang weiterverkaufen. Das schränkt eine selbst gehostete Kopie ein, nicht das, was Sie über die API eines anderen aufrufen.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Was die Fireworks-Rechnung tatsächlich reduziert

Fire Pass deckt einen Entwickler-Laptop ab. Kreditprogramme decken ein Produkt ab. Es sind unterschiedliche Instrumente, und Sie wollen beides.

Inferenz-Credits und Compute-Credits erreichen von unterschiedlichen Richtungen dasselbe Ziel. Fireworks berechnet Token; die zugrunde liegende GPU-Schicht betreibt eigene Startup-Programme. Zuerst wissenswert: Es wurde kein dediziertes Startup-Kreditprogramm auf der eigenen Kimi-Plattform von Moonshot für K2.6, K2.7-Code oder K3 gefunden, daher liegt die Kreditschicht für diese Familie bei den Hosts, nicht beim Labor.

Die Hebel, die einer Überprüfung standhalten, beginnend mit dem größten:

  • Zuerst cachen. Mit 10 % des ungecachten Tarifs ist Prompt-Caching auf Kimi K3 ein größerer Hebel als der Wechsel des Anbieters, und der einzige, der nichts kostet, um ihn auszuprobieren.
  • Die richtige Modellgröße wählen. K2.7-Code für 0,95 $ Input und 4,00 $ Output liegt preislich bei etwa einem Viertel der Output-Kosten von K3, und Moonshot berichtet, dass er bei den eigenen Kimi Code Bench v2 des Labors 21,8 % besser abschneidet und dabei 30 % weniger Reasoning-Token verwendet. Interne Benchmarks sind Marketing, aber weniger Reasoning-Token tauchen unabhängig davon auf der Rechnung auf.
  • Batch-Verarbeitung für nicht latenzempfindliche Aufgaben. Moonshot bepreist K2.6-Batch-Jobs mit 60 % des Standardtarifs.
  • Quartalsweise erneut prüfen. Die US-Preispolitik von Fireworks hat sich Berichten zufolge am 1. September 2026 geändert, ohne dass ein Modellstart damit verbunden war. Preislisten ändern sich schneller als Artikel über Preislisten, einschließlich dieses.

Häufig gestellte Fragen

Bietet Fireworks AI eine kostenlose Stufe an?

Ja. Fire Pass ist die kostenlose Stufe von Fireworks, und das vorgestellte kostenlose Modell ist Kimi K3 Fast mit einem 1-Million-Token-Kontext. Obergrenzen, Einladungsbedingungen und Arbeitslastbeschränkungen zirkulieren weit, sind aber in den hier geprüften Materialien nicht bestätigt, verifizieren Sie sie daher in Ihrer eigenen Konsole. Für Budgets über die persönliche Entwicklung hinaus werden Credits unter getaiperks.com verfolgt.

Wie viel kostet Kimi K3 auf Fireworks AI?

Kimi K3 kostet 3,00 $ pro Million Eingabetoken, 0,30 $ pro Million gecachter Eingabetoken und 15,00 $ pro Million Ausgabetoken in der Standard-Serverless-Stufe. Die Fast-Stufe listet sich bei 4,50 $/0,45 $/22,50 $, genau das 1,5-fache von Standard. Eine US-gehostete Variante trägt ein Premium, dessen Größe inkonsistent berichtet wird.

Ist Fireworks AI günstiger als die direkte Nutzung von Kimi?

Nein, und auch nicht teurer. Die Standard-Stufe von Fireworks stimmt auf allen drei Token-Typen mit dem veröffentlichten Preis von Moonshot AI auf den Cent genau überein, beide bei einem 1-Million-Token-Kontext. Wählen Sie nach Region, Latenz und Modellbreite, und reduzieren Sie dann die Rechnung, die Sie am Ende erhalten, mit Credits von getaiperks.com.

Was ist das Fireworks US-Hosting-Premium?

Es wird auf zwei Arten berichtet. Das Launch-Material von Fireworks für Kimi K3 platziert die US-gehostete Variante 10 % über dem Standard-Serverless-Preis. Eine sekundäre Zusammenfassung der Preisdokumentation von Fireworks berichtet stattdessen vom 1,5-fachen des Grundtarifs für US-only-Modelle, die ab dem 1. September 2026 gestartet werden, wobei GLM-5.2 Fast US eine Ausnahme zum globalen Preis darstellt. Prüfen Sie das Modell, das Sie tatsächlich aufrufen möchten, bevor Sie eine der beiden Zahlen budgetieren.

Ist die Fireworks Serverless Training API allgemein verfügbar?

Fireworks hat keine vollständige öffentliche Preisliste für Serverless Training veröffentlicht, und Zahlen aus Sekundärquellen, einschließlich einer gemeldeten Spanne von 0,66 $ bis 32,55 $ pro 1 Million Token über die Abrechnungsphasen hinweg, sind unbestätigt. Bepreisen Sie jedes Feinabstimmungsprogramm in Ihrer eigenen Konsole und gleichen Sie es mit Credits von getaiperks.com aus.

Gibt es Startup-Credits für Kimi K3?

Für K2.6, K2.7-Code oder K3 wurde kein dediziertes Startup-Kreditprogramm auf der Seite von Moonshot gefunden. Auf der Host-Seite bietet Modal neuen Workspaces 30 $ monatlich an allgemeinen Compute-Credits an, die nicht Kimi-spezifisch sind. Aktuelle Konditionen über die Inferenz- und Compute-Schichten hinweg werden unter getaiperks.com verfolgt.


Abonnieren Sie auf getaiperks.com →

Führen Sie das Spitzenmodell aus. Lassen Sie jemand anderen für die Token bezahlen.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.