Berapa Biaya DeepSeek V4.1 Flash per Juta Token
DeepSeek V4.1 Flash berharga $0,15 per juta token input cache-miss di luar jam sibuk dan $0,30 pada jam sibuk. Token input yang di-cache berharga $0,003 di luar jam sibuk, yang merupakan 50x di bawah tarif cache-miss Flash sendiri (diturunkan).
Flash tiba sekitar tanggal 10 September 2026 dan muncul dalam dokumentasi resmi sebagai DeepSeek-Flash. Produk unggulan DeepSeek-V4-Pro-0813 telah tersedia secara umum sejak 13 Agustus 2026.
Setiap angka di bawah ini adalah USD per juta token, diambil dari api-docs.deepseek.com dan dikonfirmasi pada September 2026.
| Model dan jendela | Input, cache hit | Input, cache miss | Output |
|---|---|---|---|
| DeepSeek-V4-Pro-0813, di luar jam sibuk | $0,022 | $0,66 | $1,98 |
| DeepSeek-V4-Pro-0813, jam sibuk | $0,044 | $1,32 | $3,96 |
| DeepSeek-V4.1-Flash, di luar jam sibuk | $0,003 | $0,15 | Tidak dipublikasikan |
| DeepSeek-V4.1-Flash, jam sibuk | $0,006 | $0,30 | Tidak dipublikasikan |
DeepSeek belum mempublikasikan harga output untuk V4.1 Flash yang dapat dikonfirmasi di halaman resmi. Jika Anda melihatnya dikutip di tempat lain, perlakukan sebagai belum terverifikasi sampai muncul di tabel resmi.
DeepSeek tidak biasa dalam cara kedua yang lebih penting bagi para pendiri daripada jumlah per token: ia sama sekali tidak menjalankan program kredit startup. Kesenjangan itu tercakup di bawah ini, dan itulah sebabnya AI Perks melacak penyedia yang menjalankannya.

Mengapa DeepSeek Menetapkan Dua Harga Berbeda untuk Token yang Sama
DeepSeek adalah satu-satunya vendor model besar yang menagih berdasarkan waktu. Jam sibuk adalah pukul 01:00 hingga 04:00 dan 06:00 hingga 10:00 UTC pada hari kerja, dan segala sesuatu di luar jendela tersebut berharga setengahnya.
Baca daftar jendela itu dua kali, karena ada celah di tengahnya. Rentang waktu dari pukul 04:00 hingga 06:00 UTC berada di antara dua blok jam sibuk dan ditagih dengan tarif di luar jam sibuk. Ini bukan satu blok sembilan jam sibuk yang berkelanjutan.
Diturunkan dari jendela yang dipublikasikan: jam sibuk mencakup tujuh jam sehari, hanya pada hari kerja, yaitu 35 jam dari 168 jam dalam seminggu. Sekitar 79 persen kalender sudah di luar jam sibuk.
Itu membingkai ulang masalahnya. Anda tidak mencoba menemukan jendela yang murah, Anda mencoba menghindari yang mahal. Tiga beban kerja di mana hal itu hampir gratis dilakukan:
- Pekerjaan batch mingguan. Pekerjaan yang dijadwalkan pada pukul 08:00 UTC masuk dalam jam sibuk. Memindahkannya ke pukul 12:00 UTC akan mengurangi tagihan hingga setengahnya dan tidak mengubah apa pun.
- Jalankan evaluasi dan regresi. Ini tidak ada pengguna yang menunggu, jadi secara default mereka berada di luar blok jam sibuk.
- Melewati penyematan dan pengindeksan ulang. Pembakaran input besar sekali jalan adalah hal yang paling sensitif terhadap jam sibuk yang dijalankan sebagian besar tim.
Lalu lintas interaktif adalah bagian yang tidak dapat Anda pindahkan, dan itu harus diberi harga pada tarif jam sibuk dalam perkiraan apa pun yang Anda buat.
Cache Hit Adalah Pengganda yang Lebih Besar
Pada DeepSeek-V4-Pro, token input yang di-cache berharga $0,022 per juta dibandingkan dengan $0,66 untuk cache miss. Itu adalah perbedaan 30x (diturunkan dari tabel di atas), dan itu mengerdilkan 2x yang Anda dapatkan dari penentuan waktu.
Kedua pengganda itu menumpuk, dan penumpukan itu adalah keseluruhan cerita profil biaya DeepSeek. Token input cache-miss jam sibuk seharga $1,32 dibandingkan dengan token cache-hit di luar jam sibuk seharga $0,022 adalah selisih 60x pada model yang sama (diturunkan).
Pada V4.1 Flash, rasio cache bahkan lebih lebar: $0,15 untuk cache miss dibandingkan dengan $0,003 untuk cache hit adalah 50x (diturunkan).
Apa artinya ini dalam praktik adalah bahwa struktur prompt mengalahkan pilihan model. Beralih dari V4-Pro ke Flash memotong input cache-miss sebesar 4,4x (diturunkan, $0,66 dibandingkan dengan $0,15). Membuat cache Anda mengenai V4-Pro memotongnya sebesar 30x. Model yang lebih murah adalah tuas yang lebih kecil.
Cache hit berasal dari awalan yang stabil, sehingga aturan praktisnya membosankan dan efektif: jaga agar prompt sistem byte-identik di seluruh panggilan, letakkan definisi alat dan konteks yang diambil sebelum apa pun yang spesifik untuk pengguna, dan jangan pernah menyisipkan stempel waktu atau ID sesi di dekat bagian atas prompt.

Nama Endpoint yang Dipensiunkan oleh DeepSeek V4.1 Flash
DeepSeek-V4.1-Flash memensiunkan nama model deepseek-v4-flash dan deepseek-v4-flash-vision-exp. Kode yang masih mengirimkan salah satu string tersebut akan gagal.
| Nama model yang dipensiunkan | Status |
|---|---|
deepseek-v4-flash | Dipensiunkan dengan V4.1 Flash |
deepseek-v4-flash-vision-exp | Dipensiunkan dengan V4.1 Flash |
Ini adalah perubahan yang senyap daripada pengabaian utama, itulah yang membuatnya mahal. String model biasanya merupakan baris yang paling sedikit ditinjau dalam integrasi AI: ia berada dalam variabel lingkungan, file konfigurasi, template Terraform, atau pembungkus SDK yang dijual, dan tidak ada yang menyentuhnya di antara rilis.
Masalah yang lebih luas adalah ekor panjang konten. Tutorial, walkthrough YouTube, jawaban forum, dan contoh kode yang dihasilkan yang ditulis sebelum September 2026 semuanya masih merujuk pada nama lama, dan tidak ada yang akan dikoreksi. Asisten yang belajar dari halaman-halaman tersebut akan terus menyarankannya.
Jika Anda menjalankan DeepSeek dalam produksi, cari kedua string di repositori Anda, lalu periksa konfigurasi infrastruktur Anda dan manajer rahasia secara terpisah. Nama model yang diatur enam bulan lalu dalam variabel deployment tidak akan muncul dalam pencarian kode.
Apa yang Berubah Sejak Panduan Harga DeepSeek Sebelumnya
Tiga hal telah membatalkan sebagian dari setiap halaman harga DeepSeek yang ditulis sebelum pertengahan Agustus 2026: pemisahan jam sibuk dan di luar jam sibuk, pemisahan V4-Pro dan Flash, dan nama endpoint yang dipensiunkan.
| Tanggal | Rilis atau perubahan | Keyakinan |
|---|---|---|
| 24 April 2026 | Pratinjau V4-Pro dan V4-Flash: konteks 1 juta token, output hingga 384K, mode berpikir dan non-berpikir yang dapat dialihkan | Sedang |
| 31 Juli 2026 | DeepSeek-V4-Flash-0731, rilis stabil lini Flash | Sedang |
| 13 Agustus 2026 | Ketersediaan umum DeepSeek-V4-Pro-0813 | Tinggi |
| 16 Agustus 2026 | Harga jam sibuk dan di luar jam sibuk diperkenalkan | Sedang |
| Sekitar 10 September 2026 | DeepSeek-V4.1-Flash, nama endpoint Flash lama dipensiunkan | Tinggi |
Angka historis yang layak diketahui adalah harga Flash terakhir yang diketahui sebelum perubahan 16 Agustus: $0,14 per juta input cache-miss dan $0,28 per juta output. Itulah angka yang masih ditampilkan oleh sebagian besar tabel perbandingan pihak ketiga. Itu bukan harga saat ini, dan mendahului pengganda jam sibuk sama sekali, jadi perkiraan apa pun yang dibangun di atasnya meremehkan beban kerja yang padat jam sibuk sekitar 2x (diturunkan: $0,14 dibandingkan dengan tarif cache-miss jam sibuk saat ini $0,30 adalah 2,1x).
Satu harga input datar untuk DeepSeek sekarang tidak berarti tanpa dua kualifikasi: sisi cache mana, dan sisi jam mana.

DeepSeek Tidak Memiliki Tingkat API Gratis dan Program Kredit Startup
Aplikasi obrolan DeepSeek gratis digunakan. API tidak gratis, dan tidak ada tingkat gratis yang dinyatakan di halaman harga resmi. DeepSeek juga tidak menjalankan program kredit startup khusus.
Klaim bahwa akun API baru menerima kredit gratis beredar luas dan dilaporkan secara tidak konsisten. Ini tidak dikonfirmasi di halaman harga resmi, jadi rencanakan pengeluaran bulan pertama Anda seolah-olah itu tidak ada.
Host pihak ketiga adalah rute parsial untuk mengatasinya, dengan peringatan biasa bahwa harga dan ketentuan mereka adalah milik mereka sendiri. Baseten mencantumkan input DeepSeek V4.1 Flash seharga $0,30 per juta dan memiliki kredit uji coba ruang kerja baru $30 (verifikasi keduanya sebelum Anda menganggarkannya). OpenRouter, Together, dan Fireworks juga meng-host model DeepSeek, dan pilihan di antara mereka biasanya tentang perutean, wilayah, dan batas tarif daripada harga utama.
Kesenjangan nyata bagi para pendiri adalah struktural. Sebagian besar vendor model dan infrastruktur yang dijalankan startup beroperasi dalam beberapa bentuk program kredit, dan jumlah serta ketentuan saat ini untuk masing-masing adalah apa yang dilacak AI Perks. DeepSeek tidak mengoperasikan apa pun, yang berarti DeepSeek adalah satu-satunya baris dalam tagihan AI Anda yang selalu Anda bayar tunai.
Itulah argumen untuk memperlakukannya sebagai tingkat default yang murah di dalam tumpukan daripada seluruh tumpukan. Arahkan pekerjaan bervolume tinggi, ramah cache, di luar jam sibuk ke DeepSeek, dan arahkan pekerjaan yang membutuhkan penalaran terdepan ke penyedia yang tagihannya ditanggung orang lain. AI Perks melacak $7,7 juta dalam kredit di 194 perusahaan, yaitu dari mana bagian kedua itu berasal.
Lihat penyedia mana yang menjalankan program kredit di getaiperks.com →
Pertanyaan yang Sering Diajukan
Berapa biaya DeepSeek V4.1 Flash?
DeepSeek V4.1 Flash berharga $0,15 per juta token input cache-miss di luar jam sibuk dan $0,30 pada jam sibuk. Input yang di-cache adalah $0,003 di luar jam sibuk dan $0,006 pada jam sibuk. DeepSeek belum mempublikasikan harga output yang dapat dikonfirmasi untuk Flash, jadi perlakukan angka output apa pun yang Anda temukan di tempat lain sebagai belum terverifikasi.
Berapa jam sibuk dan di luar jam sibuk DeepSeek?
Jam sibuk adalah pukul 01:00 hingga 04:00 dan 06:00 hingga 10:00 UTC pada hari kerja. Segala sesuatu yang lain, termasuk celah pukul 04:00 hingga 06:00 UTC antara dua blok dan semua lalu lintas akhir pekan, adalah di luar jam sibuk dengan setengah harga. Diturunkan dari jendela tersebut, sekitar 79 persen seminggu sudah di luar jam sibuk.
Mengapa panggilan API deepseek-v4-flash saya tiba-tiba gagal?
DeepSeek-V4.1-Flash memensiunkan nama model deepseek-v4-flash dan deepseek-v4-flash-vision-exp. Kode, tutorial, atau konfigurasi apa pun yang masih mengirimkan string tersebut akan gagal. Periksa variabel lingkungan dan konfigurasi deployment Anda serta sumber Anda, karena nama model sering kali berada di luar repositori. Perubahan tersebut dikirimkan secara senyap sekitar tanggal 10 September 2026.
Apakah DeepSeek memberikan kredit API gratis untuk akun baru?
Tidak ada tingkat gratis API yang dinyatakan di halaman harga resmi DeepSeek. Laporan kredit akun baru tidak konsisten dan tidak terkonfirmasi, jadi anggarkan seolah-olah tidak ada. Aplikasi obrolan gratis. Untuk penyedia yang menerbitkan program kredit, lihat AI Perks.
Apakah DeepSeek memiliki program kredit startup?
Tidak. DeepSeek tidak menjalankan program kredit startup khusus, yang menjadikannya salah satu dari sedikit API model besar yang selalu Anda bayar tunai. Sebagian besar penyedia lain memang menjalankan satu, dan AI Perks melacak $7,7 juta dalam kredit di 194 perusahaan yang menanggungnya.
Apakah DeepSeek V4-Pro atau V4.1 Flash lebih murah?
Flash lebih murah pada setiap perbandingan yang diterbitkan: $0,15 dibandingkan dengan $0,66 per juta token input cache-miss di luar jam sibuk, selisih 4,4x (diturunkan). Tetapi memperbaiki caching prompt Anda pada V4-Pro adalah tuas 30x, jadi struktur prompt lebih penting daripada pilihan model. Keduanya tidak memiliki program kredit di baliknya, yang merupakan bagian yang dilacak oleh AI Perks untuk penyedia yang melakukannya.
Berlangganan di getaiperks.com →
DeepSeek adalah baris termurah dalam tagihan AI Anda. Dapatkan baris lain yang ditanggung di getaiperks.com.