Apa yang Dimulai dengan Workspace Baseten Baru?
Workspace Baseten baru dilaporkan dimulai dengan kredit uji coba $30, dan ini dianggap sebagai penawaran permanen daripada promosi peluncuran terbatas.
Kalimat tersebut memuat kehati-hatian yang sering diabaikan oleh banyak pemberitaan. Angka $30 berasal dari pelaporan pada permukaan harga dan log perubahan Baseten daripada tawaran utama yang dinyatakan ulang di satu tempat yang jelas, dan halaman harga tidak ditampilkan secara konsisten di berbagai pemeriksaan ulang. Jadi: dilaporkan, bukan dikonfirmasi oleh vendor. Periksa saldo yang sebenarnya ditampilkan oleh workspace Anda.
Kredit tersebut berlaku untuk apa lebih jelas daripada jumlahnya. Kredit ini berada di API Model Baseten, lapisan endpoint bersama yang menghosting model open-weight seperti Kimi K3, GLM-5.3, dan DeepSeek V4.1 Flash, yaitu permukaan yang sama yang akan dipanggil oleh beban kerja produksi. Kredit ini memungkinkan pengujian nyata, bukan sandbox. AI Perks melacak persyaratan saat ini bersama dengan $7,7 juta kredit di 194 perusahaan.

Apa yang Dirilis Baseten Antara Juli dan September 2026
Baseten menghabiskan kuartal tersebut melakukan dua hal sekaligus: menambahkan model open-weight frontier ke API Modelnya, dan membangun produk untuk lab yang membuat model-model tersebut.
| Tanggal | Apa yang diluncurkan | Untuk siapa |
|---|---|---|
| 27 Juli 2026 | API hari pertama Kimi K3 | Pengembang |
| 29 Juli 2026 | Baseten untuk Model Labs | Lab Model |
| 28 Agustus 2026 | GLM-5.3 di API Model | Pengembang |
| 29 Agustus 2026 | Frontier Gateway | Lab Model |
| 3 September 2026 | GLM-5.3-Flash pada kapasitas cepat | Pengembang |
| 10 September 2026 | DeepSeek V4.1 Flash | Pengembang |
| 13 September 2026 | Pengumuman enam model yang dihentikan | Semua orang |
Peluncuran Kimi K3 adalah yang patut dipahami. Moonshot AI merilis model mixture-of-experts open-weight, dilaporkan memiliki 2,8 triliun hingga 3 triliun parameter dengan visi native dan jendela konteks 1 juta token, dan Fireworks AI, Modal, serta Baseten masing-masing merilis API yang di-host pada hari yang sama. Fireworks dan Baseten merilis API pelatihan bersama dengan inferensi. Perlombaan hari pertama antar tiga penyedia berarti bobot yang sama berasal dari tiga vendor pada tiga model penagihan, sehingga pilihan penyedia adalah pertanyaan harga, bukan kapabilitas.
Harga API Model Baseten: Hanya Setengah Tabel yang Jelas
Baseten menerbitkan harga input per juta token untuk setiap API Model. Sisi output bukanlah sesuatu yang dapat dikutip halaman ini dengan percaya diri.
| Model | Input per 1 juta token | Output per 1 juta token | Catatan |
|---|---|---|---|
| Kimi K3 | $3.00 | Tidak dapat dibaca secara andal | Open-weight, visi native, konteks 1 juta |
| GLM-5.3 | $1.40 | Tidak dapat dibaca secara andal | Konteks 1 juta token |
| DeepSeek V4.1 Flash | $0.30 | Tidak dapat dibaca secara andal | 552 miliar parameter, multimodal |
| GLM-5.3-Flash | Belum dikonfirmasi | Belum dikonfirmasi | Kapasitas serving cepat khusus |
Tarif input tersebut adalah yang tertera di tabel harga Baseten saat diperiksa. Kolom output tidak ditampilkan secara konsisten di berbagai pengambilan, itulah sebabnya tidak ada tarif output Baseten yang muncul di atas.
Untuk skala pada separuh yang hilang, lihat satu-satunya penyedia yang menerbitkan semuanya. Fireworks AI mencantumkan Kimi K3 dengan input $3.00, input cache $0.30, dan output $15.00 per juta token pada tingkatan Standar mereka. Output berharga lima kali input di sana. Model biaya Baseten apa pun yang dibangun hanya berdasarkan tarif input $3.00 adalah salah dengan kelipatan yang tidak diketahui, dan pada beban kerja yang padat generasi, kelipatan itu adalah sebagian besar tagihan. Anggap setiap artikel yang mencetak harga output Baseten tanpa catatan peringatan sebagai tebakan. AI Perks melacak harga penyedia seiring perubahannya.

Enam Model Keluar dari API Model Baseten pada 25 September 2026
Baseten mengumumkan pada 13 September 2026 bahwa GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small, dan DeepSeek V4 Pro akan pensiun dari API Model pada 25 September 2026.
Inilah bagian yang secara diam-diam merusak segalanya. Tiga jenis pembaca terkena dampaknya.
Siapa pun yang memiliki model slug yang disematkan secara permanen dalam produksi. Endpoint yang kompatibel dengan OpenAI gagal dengan cara yang sama, baik model tersebut diganti namanya maupun dihapus. Sematkan pengganti sebelum tanggal 25, bukan setelahnya.
Siapa pun yang memelihara posting perbandingan. Setiap daftar yang mencantumkan harga DeepSeek V4 Pro atau jajaran Kimi K2.x di Baseten akan menjadi salah pada 25 September, dan sebagian besar tidak akan pernah diperbarui. Anggap ringkasan pra-September memiliki baris yang sudah usang.
Siapa pun yang mengevaluasi pada benchmark lama. Jika harness Anda menargetkan Kimi K2.7 atau K2.6, penerusnya di katalog adalah Kimi K3 dengan titik harga yang berbeda, sehingga perbandingan bulan lalu tidak terbawa.
Anggap pasangan ini sebagai penilaian editorial daripada jalur migrasi yang diterbitkan oleh vendor: GLM-4.7 ke GLM-5.3, jajaran Kimi K2.x ke Kimi K3, DeepSeek V4 Pro ke DeepSeek V4.1 Flash. Harga bergerak ke kedua arah di seluruh lompatan tersebut, itulah saatnya kredit uji coba berguna. Lihat apa yang saat ini tersedia di AI Perks.
Tempat Menjalankan Kimi K3: Baseten, Fireworks, atau Modal
Tiga penyedia merilis Kimi K3 pada hari peluncuran, dan hanya satu yang menerbitkan harga per token lengkap yang dapat Anda rencanakan.
| Penyedia | Kimi K3 input per 1 juta | Harga token lengkap diterbitkan | Titik masuk gratis |
|---|---|---|---|
| Fireworks AI | $3.00 Standar, $4.50 Cepat | Ya | Tingkat gratis Fire Pass, menampilkan Kimi K3 Cepat |
| Baseten | $3.00 | Tidak, output tidak terbaca | Kredit uji coba, dilaporkan $30, sekali pakai |
| Modal | Tidak diterbitkan | Tidak | Komputasi umum $30 per bulan untuk workspace baru |
Fireworks menerbitkan gambaran lengkap: $3.00 input, $0.30 input cache, dan $15.00 output per juta pada Standar, tingkatan Cepat seharga $4.50, $0.45, dan $22.50, serta varian yang di-host di AS dengan premi sekitar 10%. Tingkat gratisnya, Fire Pass, beralih ke Kimi K3 Cepat sebagai model gratis unggulannya dengan jendela konteks 1 juta token penuh, cara termurah untuk mengetahui apakah model tersebut sesuai dengan tugas Anda. Harga input Baseten sama di $3.00. Modal mengonfirmasi harga berbasis token dalam posting peluncurannya tanpa menerbitkan tarif per juta.
Dua angka $30 adalah kebetulan yang patut dibaca dengan cermat: itu bukan penawaran yang sama. Modal adalah alokasi komputasi bulanan berulang yang mencakup komputasi secara umum daripada API model tunggal. Baseten adalah kredit uji coba sekali pakai pada workspace. Selama evaluasi tiga bulan, itu adalah $90 dibandingkan dengan $30. Keduanya patut dipertahankan: AI Perks ada karena kredit di berbagai tingkatan lebih baik daripada satu kredit besar di satu vendor tunggal.

Baseten untuk Model Labs dan Frontier Gateway Dijelaskan
Kedua peluncuran 2026 ini adalah yang paling tidak relevan bagi banyak pengembang, dan mengetahui alasannya menghemat satu minggu evaluasi.
Baseten untuk Model Labs, diumumkan pada 29 Juli 2026, adalah lini produk untuk lab model closed-weight yang ingin mendistribusikan dan memonetisasi model mereka melalui infrastruktur Baseten. Ini membalikkan hubungan yang biasa: alih-alih Baseten menghosting model open-weight untuk pengembang, lab adalah pelanggannya dan pengguna lab adalah lalu lintasnya.
Frontier Gateway, diumumkan pada 29 Agustus 2026, adalah gateway API terkelola multi-tenant yang memungkinkan lab mendirikan API inferensi kelas produksi pada tumpukan Baseten daripada membangun lapisan serving sendiri.
Tidak keduanya memiliki harga yang dipublikasikan, keduanya menghadap lab daripada pengembang, dan kredit uji coba tidak berlaku untuk keduanya. Pelaporan tentang keduanya tipis dan tingkat kepercayaan sedang, jadi anggap daftar fitur rinci atau benchmark latensi apa pun yang ditemukan di tempat lain sebagai belum dikonfirmasi sampai vendor menyatakannya. Bagi pengembang yang memanggil model, konsekuensinya tidak langsung: jika lab mengadopsi rute ini, lebih banyak model closed-weight akan dapat diakses melalui endpoint yang menyerupai yang sudah Anda panggil. Layak untuk diamati di AI Perks.
Cara Membuat Kredit Awal Bertahan Lama
Konfirmasikan harga output sebelum mengekstrapolasi apa pun. Tarif input saja meremehkan biaya sebenarnya pada beban kerja yang padat generasi, dan kolom output Baseten adalah satu-satunya angka yang tidak dapat diberikan oleh halaman ini. Anggaran yang dibangun di atas $3.00 per juta untuk Kimi K3 adalah anggaran yang dibangun di atas setengah tagihan.
Debug pada model tingkatan Flash. GLM-5.3-Flash dan jajaran DeepSeek Flash ada untuk latensi dan biaya daripada kualitas puncak. Prompt plumbing, logika coba lagi, dan bug skema tidak memerlukan model frontier untuk muncul, dan mengganti slug sesudahnya adalah perubahan satu baris.
Sematkan versi model Anda. Enam model akan pensiun pada 25 September 2026. Slug yang bertanggal mencegah penghentian menjadi gangguan, dan kredit uji coba paling berguna saat Anda mengukur ulang pengganti.
Pertahankan kredit di lebih dari satu tingkatan. Inferensi, komputasi umum, dan akses model frontier ditagih secara terpisah. Baseten mencakup yang pertama, Modal atau penyedia hyperscale yang kedua, lab frontier yang ketiga.

Pertanyaan yang Sering Diajukan
Berapa nilai kredit Baseten gratis?
Workspace baru dilaporkan dimulai dengan kredit uji coba $30, digambarkan sebagai penawaran permanen daripada promosi. Angka tersebut berasal dari pelaporan daripada judul vendor yang jelas dinyatakan, jadi anggap $30 sebagai yang dilaporkan dan konfirmasikan saldo yang ditampilkan oleh workspace Anda. Persyaratan saat ini dilacak di getaiperks.com.
Berapa biaya Baseten per token?
Tarif input terbaca jelas: Kimi K3 sebesar $3.00 per juta token, GLM-5.3 sebesar $1.40, dan DeepSeek V4.1 Flash sebesar $0.30. Tarif output tidak dapat dibaca secara andal dari tabel harga publik, dan halaman ini tidak akan menebaknya. Konfirmasikan harga output di konsol sebelum memodelkan tagihan bulanan.
Model mana yang dihentikan Baseten pada September 2026?
GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small, dan DeepSeek V4 Pro akan pensiun dari API Model Baseten pada 25 September 2026, diumumkan pada 13 September. Pengganti terdekat di katalog adalah GLM-5.3, Kimi K3, dan DeepSeek V4.1 Flash, meskipun pasangan itu adalah penilaian editorial daripada jalur migrasi yang diterbitkan oleh vendor.
Apakah Baseten lebih murah dari Fireworks untuk Kimi K3?
Pada token input, keduanya mencantumkan $3.00 per juta, jadi mereka setara pada satu-satunya angka yang dapat dibandingkan dengan jelas. Fireworks juga menerbitkan input cache $0.30 dan output $15.00 per juta pada tingkatan Standarnya. Sampai tarif output Baseten dikonfirmasi, perbandingan biaya penuh tidak mungkin dilakukan ke arah mana pun.
Apa itu Kimi K3 dan mengapa tiga penyedia meluncurkannya sekaligus?
Kimi K3 adalah model mixture-of-experts open-weight dari Moonshot AI, dilaporkan memiliki 2,8 triliun hingga 3 triliun parameter dengan visi native dan jendela konteks 1 juta token, dirilis pada 27 Juli 2026. Fireworks AI, Modal, dan Baseten masing-masing merilis API yang di-host pada hari yang sama. Bobot terbuka memungkinkan hal itu: tidak ada penyedia yang memerlukan izin, sehingga hari peluncuran menjadi perlombaan harga daripada eksklusif.
Bisakah saya menggabungkan kredit Baseten dengan kredit AI lainnya?
Ya, dan itu adalah pendekatan yang normal. Kredit inferensi, komputasi umum, dan model frontier adalah tiga tagihan terpisah dengan tiga vendor terpisah, dan mempertahankan satu tidak memblokir yang lain. Baseten mencakup lapisan inferensi, Modal atau penyedia hyperscale mencakup komputasi, dan lab frontier mencakup panggilan model langsung. AI Perks melacak $7,7 juta di 194 perusahaan di getaiperks.com.
Berlangganan di getaiperks.com →
Sematkan versi model Anda. Biarkan orang lain membayar tokennya.