Womit beginnt ein neuer Baseten-Arbeitsbereich?
Neue Baseten-Arbeitsbereiche beginnen Berichten zufolge mit einem Testguthaben von 30 US-Dollar, das eher als stehendes Angebot denn als befristete Einführungsaktion zu verstehen ist.
Dieser Satz enthält eine Einschränkung, die in den meisten Berichterstattungen fehlt. Die 30-Dollar-Zahl stammt aus Berichten über die Preisgestaltung und die Changelog-Oberflächen von Baseten und nicht aus einem eindeutig platzierten Kopfangebot, und die Preisseite wurde bei wiederholten Überprüfungen nicht konsistent gerendert. Daher: berichtet, aber nicht vom Anbieter bestätigt. Überprüfen Sie den Saldo, den Ihr Arbeitsbereich tatsächlich anzeigt.
Wofür das Guthaben gilt, ist klarer als die Zahl. Es wird auf Baseten Model APIs angewendet, der gemeinsam genutzten Endpunkt-Schicht, die Open-Weight-Modelle wie Kimi K3, GLM-5.3 und DeepSeek V4.1 Flash hostet, derselben Oberfläche, die auch eine Produktions-Workload aufrufen würde. Das Guthaben ermöglicht einen echten Test, keine Sandbox. AI Perks verfolgt die aktuellen Bedingungen neben 7,7 Mio. US-Dollar an Guthaben bei 194 Unternehmen.

Was Baseten zwischen Juli und September 2026 ausgeliefert hat
Baseten hat das Quartal mit zwei Dingen gleichzeitig verbracht: Hinzufügen von Frontier Open-Weight-Modellen zu seinen Model APIs und Aufbau von Produkten für die Labs, die diese Modelle erstellen.
| Datum | Was wurde gestartet | Für wen ist es gedacht |
|---|---|---|
| 27. Juli 2026 | Kimi K3 Tag-Null-API | Entwickler |
| 29. Juli 2026 | Baseten für Model Labs | Model Labs |
| 28. August 2026 | GLM-5.3 auf Model APIs | Entwickler |
| 29. August 2026 | Frontier Gateway | Model Labs |
| 3. September 2026 | GLM-5.3-Flash auf schneller Kapazität | Entwickler |
| 10. September 2026 | DeepSeek V4.1 Flash | Entwickler |
| 13. September 2026 | Sechs Modell-Deprekationen angekündigt | Alle |
Der Start von Kimi K3 ist derjenige, der es wert ist, verstanden zu werden. Moonshot AI hat ein Open-Weight Mixture-of-Experts-Modell veröffentlicht, das Berichten zufolge 2,8 bis 3 Billionen Parameter mit nativer Vision und einem 1-Millionen-Token-Kontextfenster hat. Fireworks AI, Modal und Baseten haben alle am selben Tag eine gehostete API bereitgestellt. Fireworks und Baseten haben neben der Inferenz auch Trainings-APIs bereitgestellt. Ein Wettlauf zu dritt am Tag der Veröffentlichung bedeutet, dass dieselben Gewichte von drei Anbietern zu drei Abrechnungsmodellen stammen, sodass die Wahl des Anbieters eine Preisfrage und keine Fähigkeitsfrage ist.
Baseten Model APIs Preise: Nur die Hälfte der Tabelle ist sauber lesbar
Baseten veröffentlicht einen Eingabepreis pro Million Token für jede Model API. Die Ausgabeseite ist nichts, was diese Seite mit Zuversicht zitieren kann.
| Modell | Eingabe pro 1 Mio. Token | Ausgabe pro 1 Mio. Token | Hinweise |
|---|---|---|---|
| Kimi K3 | 3,00 $ | Nicht zuverlässig lesbar | Open-Weight, native Vision, 1 Mio. Kontext |
| GLM-5.3 | 1,40 $ | Nicht zuverlässig lesbar | 1 Mio. Token-Kontext |
| DeepSeek V4.1 Flash | 0,30 $ | Nicht zuverlässig lesbar | 552B Parameter, multimodal |
| GLM-5.3-Flash | Nicht bestätigt | Nicht bestätigt | Dedizierte schnelle Servicekapazität |
Diese Eingaberaten sind das, was die Preistabelle von Baseten bei der Überprüfung angezeigt hat. Die Ausgabespalte wurde bei verschiedenen Abrufen nicht konsistent gerendert, weshalb hier keine Baseten-Ausgaberate aufgeführt ist.
Um das Ausmaß der fehlenden Hälfte zu verstehen, schauen Sie sich den einzigen Anbieter an, der alles veröffentlicht. Fireworks AI listet Kimi K3 mit 3,00 $ Eingabe, 0,30 $ zwischengespeicherter Eingabe und 15,00 $ Ausgabe pro Million Token auf seiner Standardstufe auf. Ausgabe kostet dort das Fünffache der Eingabe. Jedes Baseten-Kostenmodell, das nur auf der Eingaberate von 3,00 $ basiert, ist um ein unbekanntes Vielfaches falsch, und bei generierungsintensiven Workloads ist dieses Vielfache der größte Teil der Rechnung. Betrachten Sie jeden Artikel, der einen Baseten-Ausgabepreis ohne Vorbehalt druckt, als eine Vermutung. AI Perks verfolgt die Preise der Anbieter, während sie sich ändern.

Sechs Modelle verlassen Baseten Model APIs am 25. September 2026
Baseten kündigte am 13. September 2026 an, dass GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small und DeepSeek V4 Pro am 25. September 2026 aus den Model APIs ausscheiden.
Das ist der Teil, der leise Dinge kaputt macht. Drei Arten von Lesern sind betroffen.
Jeder mit einem fest kodierten Model-Slug in der Produktion. Ein OpenAI-kompatibler Endpunkt schlägt genauso fehl, egal ob das Modell umbenannt oder entfernt wurde. Setzen Sie vor dem 25. einen Ersatz fest, nicht danach.
Jeder, der einen Vergleichsposten pflegt. Jede Liste, die DeepSeek V4 Pro oder die Kimi K2.x-Reihe auf Baseten auflistet, ist ab dem 25. September falsch, und die meisten werden nie aktualisiert. Gehen Sie davon aus, dass eine Zusammenfassung vor September tote Zeilen enthält.
Jeder, der anhand alter Benchmarks evaluiert. Wenn Ihr Harness auf Kimi K2.7 oder K2.6 abzielt, ist der Nachfolger im Katalog Kimi K3 zu einem anderen Preis, sodass der Vergleich vom letzten Monat nicht mehr gilt.
Betrachten Sie diese Paarungen als redaktionelles Urteil und nicht als einen vom Anbieter veröffentlichten Migrationspfad: GLM-4.7 zu GLM-5.3, die Kimi K2.x-Reihe zu Kimi K3, DeepSeek V4 Pro zu DeepSeek V4.1 Flash. Die Preise bewegen sich bei diesen Sprüngen in beide Richtungen, und genau hier zahlt sich ein Testguthaben aus. Sehen Sie, was derzeit bei AI Perks verfügbar ist.
Wo man Kimi K3 ausführen kann: Baseten, Fireworks oder Modal
Drei Anbieter haben Kimi K3 am Starttag bereitgestellt, und nur einer veröffentlicht einen vollständigen Preis pro Token, mit dem man planen kann.
| Anbieter | Kimi K3 Eingabe pro 1 Mio. | Vollständige Token-Preise veröffentlicht | Kostenloser Einstiegspunkt |
|---|---|---|---|
| Fireworks AI | 3,00 $ Standard, 4,50 $ Fast | Ja | Fire Pass kostenlose Stufe, mit Kimi K3 Fast |
| Baseten | 3,00 $ | Nein, Ausgabe nicht lesbar | Testguthaben, berichtet auf 30 $, einmalig |
| Modal | Nicht veröffentlicht | Nein | 30 $ pro Monat allgemeine Rechenleistung für neue Arbeitsbereiche |
Fireworks veröffentlicht das Gesamtbild: 3,00 $ Eingabe, 0,45 $ zwischengespeicherte Eingabe und 15,00 $ Ausgabe pro Million auf Standard, die Fast-Stufe für 4,50 $, 0,45 $ und 22,50 $, und eine in den USA gehostete Variante für etwa 10 % Aufpreis. Seine kostenlose Stufe, Fire Pass, hat Kimi K3 Fast als sein bevorzugtes kostenloses Modell mit dem vollen 1-Millionen-Token-Kontext umgestellt, der günstigste Weg, um herauszufinden, ob das Modell für Ihre Aufgabe geeignet ist. Der Eingabepreis von Baseten stimmt mit 3,00 $ überein. Modal bestätigte tokenbasierte Preise in seinem Startbeitrag, ohne einen Preis pro Million zu veröffentlichen.
Die beiden 30-Dollar-Beträge sind ein Zufall, der sorgfältig gelesen werden sollte: Es handelt sich nicht um dasselbe Angebot. Modals ist eine wiederkehrende monatliche Rechenleistung, die die allgemeine Rechenleistung abdeckt und nicht nur eine Model-API. Basetens ist ein einmaliges Testguthaben für einen Arbeitsbereich. Über eine dreimonatige Bewertung hinweg sind das 90 $ gegenüber 30 $. Beide sind es wert, aufbewahrt zu werden: AI Perks existiert, weil Guthaben auf mehreren Ebenen besser sind als ein großes Guthaben bei einem einzigen Anbieter.

Baseten für Model Labs und Frontier Gateway erklärt
Diese beiden Starts von 2026 sind für die meisten Entwickler irrelevant, und zu wissen, warum, spart eine Evaluationswoche.
Baseten für Model Labs, angekündigt am 29. Juli 2026, ist eine Produktlinie für geschlossene Model Labs, die ihre Modelle über die Infrastruktur von Baseten vertreiben und monetarisieren möchten. Es kehrt die übliche Beziehung um: Anstatt dass Baseten Open-Weight-Modelle für Entwickler hostet, ist das Lab der Kunde und die Benutzer des Labs sind der Traffic.
Frontier Gateway, angekündigt am 29. August 2026, ist ein verwaltetes, mandantenfähiges API-Gateway, das es einem Lab ermöglicht, eine Produktions-Inferenz-API auf dem Stack von Baseten einzurichten, anstatt selbst eine Serving-Schicht zu erstellen.
Keines davon hat veröffentlichte Preise, beide sind eher für Labs als für Entwickler gedacht, und ein Testguthaben gilt für keines von beiden. Die Berichterstattung über beide ist dünn und von mittlerer Zuverlässigkeit. Betrachten Sie daher jede detaillierte Feature-Liste oder jeden Latenz-Benchmark, der anderswo gefunden wird, als unbestätigt, bis der Anbieter dies erklärt. Für einen Entwickler, der Modelle aufruft, sind die Folgen indirekt: Wenn Labs diesen Weg einschlagen, werden mehr geschlossene Modelle über Endpunkte erreichbar sein, die den bereits aufgerufenen ähneln. Es lohnt sich, bei AI Perks darauf zu achten.
So lässt man ein Startguthaben ausreichen
Bestätigen Sie die Ausgabe-Preise, bevor Sie etwas extrapolieren. Eingaberaten allein unterschätzen die tatsächlichen Kosten bei generierungsintensiven Workloads, und die Ausgabespalte von Baseten ist die einzige Zahl, die diese Seite Ihnen nicht liefern kann. Ein Budget, das auf 3,00 $ pro Million für Kimi K3 basiert, ist ein Budget, das auf der Hälfte der Rechnung basiert.
Debuggen Sie mit den Flash-Tier-Modellen. GLM-5.3-Flash und die DeepSeek Flash-Reihe existieren für Latenz und Kosten und nicht für Spitzenqualität. Prompt-Plumbing, Retry-Logik und Schema-Fehler müssen kein Frontier-Modell aufweisen, und das Austauschen des Slugs danach ist eine Einzeilen-Änderung.
Fixieren Sie Ihre Modellversionen. Sechs Modelle scheiden am 25. September 2026 aus. Datierte Slugs verhindern, dass eine Deprekation zu einem Ausfall wird, und ein Testguthaben ist am nützlichsten, während Sie Ersatz neu benchmarken.
Halten Sie Guthaben auf mehr als einer Ebene. Inferenz, allgemeine Rechenleistung und Frontier-Modellzugriff werden separat abgerechnet. Baseten deckt die erste ab, Modal oder ein Hyperscaler die zweite, ein Frontier-Lab die dritte.

Häufig gestellte Fragen
Wie viel sind kostenlose Baseten-Credits wert?
Neue Arbeitsbereiche beginnen Berichten zufolge mit einem Testguthaben von 30 US-Dollar, das als stehendes Angebot und nicht als Werbeaktion beschrieben wird. Die Zahl stammt aus Berichten und nicht aus einer klar formulierten Schlagzeile des Anbieters, daher sollten Sie 30 US-Dollar als berichtet betrachten und den Saldo Ihres Arbeitsbereichs bestätigen. Aktuelle Bedingungen werden unter getaiperks.com verfolgt.
Wie viel berechnet Baseten pro Token?
Die Eingaberaten sind klar lesbar: Kimi K3 für 3,00 $ pro Million Token, GLM-5.3 für 1,40 $ und DeepSeek V4.1 Flash für 0,30 $. Die Ausgaberaten sind aus der öffentlichen Preistabelle nicht zuverlässig lesbar, und diese Seite wird keine Vermutungen anstellen. Bestätigen Sie die Ausgabepreise in der Konsole, bevor Sie eine monatliche Rechnung modellieren.
Welche Modelle stellt Baseten im September 2026 ein?
GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small und DeepSeek V4 Pro werden am 25. September 2026 aus den Baseten Model APIs auslaufen, angekündigt am 13. September. Die nächsten Ersatzmodelle im Katalog sind GLM-5.3, Kimi K3 und DeepSeek V4.1 Flash, obwohl diese Paarung redaktionell und nicht ein vom Anbieter veröffentlichter Migrationspfad ist.
Ist Baseten günstiger als Fireworks für Kimi K3?
Bei Eingabe-Token listen beide 3,00 $ pro Million auf, sodass sie beim einzigen Wert, der sauber verglichen werden kann, gleichauf liegen. Fireworks veröffentlicht außerdem 0,30 $ zwischengespeicherte Eingaben und 15,00 $ Ausgabe pro Million auf seiner Standardstufe. Solange der Ausgabepreis von Baseten nicht bestätigt ist, ist ein vollständiger Kostenvergleich in keiner Richtung möglich.
Was ist Kimi K3 und warum haben drei Anbieter es gleichzeitig gestartet?
Kimi K3 ist Moonshot AIs Open-Weight Mixture-of-Experts-Modell, das Berichten zufolge 2,8 bis 3 Billionen Parameter mit nativer Vision und einem 1-Millionen-Token-Kontextfenster hat und am 27. Juli 2026 veröffentlicht wurde. Fireworks AI, Modal und Baseten haben alle am selben Tag eine gehostete API bereitgestellt. Open Weights machen das möglich: Kein Anbieter benötigt eine Genehmigung, sodass der Launch-Tag zu einem Preisrennen anstelle eines Exklusivangebots wird.
Kann ich Baseten-Credits mit anderen KI-Credits kombinieren?
Ja, und das ist der übliche Ansatz. Guthaben für Inferenz, allgemeine Rechenleistung und Frontier-Modelle sind drei separate Rechnungen von drei verschiedenen Anbietern, und das Halten eines Guthabens blockiert nicht das andere. Baseten deckt die Inferenzschicht ab, Modal oder ein Hyperscaler die Rechenleistung und ein Frontier-Lab die direkten Modellaufrufe. AI Perks verfolgt 7,7 Mio. US-Dollar bei 194 Unternehmen unter getaiperks.com.
Abonnieren Sie auf getaiperks.com →
Fixieren Sie Ihre Modellversionen. Lassen Sie jemand anderen für die Token bezahlen.