DeepSeek Tidak Memiliki Satu Harga per Token
DeepSeek-V4-Pro memiliki empat harga input, bukan satu: $0,022, $0,044, $0,66, dan $1,32 per juta token. Mana yang Anda bayar tergantung pada jam berapa hari itu dan apakah prompt mengenai cache. Itu adalah selisih 60x untuk model yang sama, prompt yang sama, dan hari yang sama.
Setiap tabel "DeepSeek vs ChatGPT" yang mencetak satu angka per model membandingkan angka yang tidak ada. DeepSeek adalah satu-satunya vendor model besar yang mengenakan biaya berdasarkan waktu hari. Jam sibuk adalah 01:00 hingga 04:00 dan 06:00 hingga 10:00 UTC, Senin hingga Jumat, dan segala sesuatu di luar jendela itu, termasuk akhir pekan, ditagih dengan setengah harga persis.
Berikut adalah daftar harga yang dipublikasikan per juta token, kedua bagian disertakan.
| Model | Input yang di-cache | Input segar | Output |
|---|---|---|---|
| DeepSeek-V4-Pro, di luar jam sibuk | $0,022 | $0,66 | $1,98 |
| DeepSeek-V4-Pro, jam sibuk | $0,044 | $1,32 | $3,96 |
| DeepSeek-Flash, di luar jam sibuk | $0,003 | $0,15 | tidak dipublikasikan |
| DeepSeek-Flash, jam sibuk | $0,006 | $0,30 | tidak dipublikasikan |
Kolom terakhir itu bukan kelalaian dari pihak kami. DeepSeek mempublikasikan tarif input cache-hit dan cache-miss untuk lini V4.1 Flash tetapi tidak ada tarif output, jadi panduan apa pun yang mengutip angka output Flash mengutip sesuatu yang tidak dinyatakan oleh DeepSeek. Kami tidak akan mengulanginya, begitu juga spreadsheet anggaran Anda.
Disiplin yang sama berlaku di arah lain. Kami tidak mempublikasikan ulang harga daftar OpenAI yang belum kami verifikasi terhadap halaman harga OpenAI sendiri, karena tarif tersebut bergerak dan angka yang basi dalam tabel perbandingan lebih buruk daripada tidak ada angka sama sekali. Baca artikel ini untuk struktur tagihan DeepSeek, lalu harga ChatGPT dari sumbernya. AI Perks melacak variabel ketiga, kredit, yang tidak termasuk dalam daftar harga mana pun.

Siapa yang Sebenarnya Membayar Tarif Puncak DeepSeek
Penetapan harga puncak mencakup tujuh jam per hari kerja, atau 35 dari 168 jam dalam seminggu, jadi sekitar 79% dari semua waktu jam ditagih dengan harga setengah (turunan). Di luar jam sibuk bukanlah jendela diskon. Ini adalah tarif normal untuk sebagian besar planet ini.
Dikonversi ke UTC+8, jendela jam sibuk berjalan 09:00 hingga 12:00 dan 14:00 hingga 18:00, dengan jeda melintasi jam makan siang. Itu adalah bentuk hari kerja di pasar rumah DeepSeek. DeepSeek belum menyatakan ini sebagai alasannya, jadi perlakukan kecocokan sebagai pengamatan daripada fakta, tetapi itu memprediksi secara tepat siapa yang membayar lebih.
| Lokasi Tim | Hari kerja dalam UTC | Jam sibuk |
|---|---|---|
| San Francisco (UTC-7) | 16:00 hingga 00:00 | 0 dari 8 |
| New York (UTC-4) | 13:00 hingga 21:00 | 0 dari 8 |
| London (UTC+1) | 08:00 hingga 16:00 | 2 dari 8 |
| Berlin (UTC+2) | 07:00 hingga 15:00 | 3 dari 8 |
| Bengaluru (UTC+5:30) | 03:30 hingga 11:30 | 4,5 dari 8 |
| Shenzhen (UTC+8) | 01:00 hingga 09:00 | 6 dari 8 |
Tim AS yang menjalankan lalu lintas interaktif selama jam kerja tidak pernah menyentuh tarif puncak. Tim Eropa membayarnya selama dua atau tiga jam pertama setiap pagi, yang merupakan argumen konkret untuk menjadwalkan pekerjaan batch dan evaluasi setelah makan siang daripada sebelum rapat harian.
Cache Hit Lebih Penting daripada Jam
Memindahkan beban kerja di luar jam sibuk memotong tagihan menjadi setengahnya. Mendaratkannya di cache membaginya dengan 30. Pada DeepSeek-V4-Pro, token input yang di-cache berharga $0,022 per juta di luar jam sibuk sementara yang segar berharga $0,66, tepat 30x lebih mahal (turunan). Pengungkit di luar jam sibuk bernilai 2x. Sebagian besar tim menyetel pengungkit 2x dan mengabaikan pengungkit 30x.
Dua perbandingan turunan membuat urutannya jelas:
- Token yang di-cache pada V4-Pro andalan di luar jam sibuk ($0,022) 6,8x lebih murah daripada token segar pada model Flash anggaran di luar jam sibuk ($0,15). Caching mengalahkan penurunan tingkatan.
- Bahkan token V4-Pro yang di-cache pada tarif puncak ($0,044) 3,4x lebih murah daripada token Flash segar di luar jam sibuk. Caching mengalahkan penurunan tingkatan dan mengalahkan menunggu jam murah secara bersamaan.
Meningkatkan tingkat cache hit dari 50% menjadi 90% pada V4-Pro memotong biaya input gabungan dari $0,341 menjadi $0,0858 per juta token, pengurangan 4,0x (turunan) yang tidak dapat ditandingi oleh penjadwalan berapa pun.
Tiga konsekuensi praktis:
Stabilitas awalan mengalahkan keringkasan prompt. Prompt sistem yang panjang yang tidak pernah berubah lebih murah daripada yang pendek yang Anda tulis ulang per permintaan, karena hanya awalan yang stabil yang di-cache.
Letakkan bagian yang bervariasi terakhir. Apa pun yang dimasukkan sebelum konteks yang diambil akan membatalkan cache untuk semua yang mengikutinya.
Kedalaman cache adalah keputusan penetapan harga, bukan teknis. DeepSeek menetapkan harga cache hit V4-Pro sebesar 3,3% dari token segar dan cache hit Flash sebesar 2,0% (keduanya turunan). Vendor yang menetapkan harga cache hit pada sebagian kecil dari input segar memberi Anda lebih sedikit untuk dioptimalkan. Rasio itu, bukan tarif utama, adalah apa yang harus dibandingkan antar penyedia.

Berapa Biaya Tugas Nyata Sebenarnya
Ambil panggilan agen yang diperkaya pengambilan data yang realistis: 40.000 token input dengan tingkat cache hit 80%, ditambah 2.000 token output. Semua angka di bawah ini diturunkan dari tarif yang dipublikasikan di atas.
| Skenario | Biaya input | Biaya output | Total |
|---|---|---|---|
| V4-Pro, di luar jam sibuk | $0,00598 | $0,00396 | $0,00994 |
| V4-Pro, jam sibuk | $0,01197 | $0,00792 | $0,01989 |
| Flash, di luar jam sibuk | $0,00130 | tidak dipublikasikan | tidak dapat dikutip |
| Flash, jam sibuk | $0,00259 | tidak dipublikasikan | tidak dapat dikutip |
Dua hal muncul. Pertama, input V4-Pro pada tugas ini berharga 4,6x lebih mahal daripada input Flash (turunan), yang merupakan celah jauh lebih kecil daripada yang disarankan oleh tingkatan model, karena cache hit 80% melakukan sebagian besar pekerjaan pada keduanya. Kedua, biaya tugas penuh untuk Flash tidak dapat dihitung dari data yang dipublikasikan. Jika artikel perbandingan memberi Anda satu, tanyakan dari mana tarif outputnya berasal.
Di Mana Reputasi Murah Itu Runtuh
Meneruskan DeepSeek melalui host pihak ketiga meratakan pemisahan jam sibuk dan di luar jam sibuk menjadi satu tarif datar, sehingga Anda membayar sesuatu yang mendekati harga puncak 100% waktu. Baseten, misalnya, mencantumkan input DeepSeek V4.1 Flash sebesar $0,30 per juta, yang identik dengan tarif cache-miss puncak DeepSeek sendiri dan dua kali lipat tarif $0,15 di luar jam sibuk (angka yang dipublikasikan Baseten, layak dikonfirmasi sebelum Anda menganggarkannya; tarif outputnya tidak dikonfirmasi secara andal). Baseten memang membawa kredit uji coba ruang kerja baru senilai $30.
OpenRouter, Together, dan Fireworks juga menjadi host model DeepSeek. Tarif mereka adalah milik mereka untuk ditetapkan dan bergerak, jadi verifikasi masing-masing sendiri daripada mempercayai angka dalam posting blog, termasuk yang ini. Perdagangan kualitatif bersifat stabil: Anda mendapatkan kenyamanan routing, failover, dan satu tagihan, dan Anda secara permanen kehilangan diskon 50% di luar jam sibuk. Untuk lalu lintas yang berjalan sebagian besar di luar jam sibuk, perdagangan itu negatif.

Apa yang Berubah Sejak Panduan Harga DeepSeek yang Lebih Lama
Setiap panduan DeepSeek yang ditulis sebelum 16 Agustus 2026 mengutip satu harga tetap. Harga itu tidak ada lagi. Jika artikel memberikan satu angka per model tanpa menyebutkan jam sibuk, itu mendahului struktur saat ini.
- 24 April 2026: DeepSeek V4-Pro dan V4-Flash dikirimkan dalam pratinjau dengan jendela konteks 1 juta token, hingga 384K token output, dan mode berpikir serta non-berpikir yang dapat dialihkan.
- 31 Juli 2026: DeepSeek-V4-Flash-0731 menjadi rilis Flash yang stabil. Penetapan harga pada saat itu adalah $0,14 tetap per juta input cache-miss dan $0,28 per juta output, tanpa komponen waktu hari. Itu adalah sejarah, bukan tarif yang dapat Anda beli hari ini.
- 13 Agustus 2026: DeepSeek-V4-Pro-0813 mencapai ketersediaan umum sebagai model penalaran dan agen andalan.
- 16 Agustus 2026: penetapan harga puncak dan di luar jam sibuk tiba.
- Sekitar 10 September 2026: DeepSeek-V4.1-Flash mendarat, terdaftar dalam dokumentasi hanya sebagai DeepSeek-Flash.
Satu perubahan yang merusak layak mendapatkan catatannya sendiri, karena secara diam-diam merusak kode yang berfungsi. DeepSeek-V4.1-Flash menghentikan nama endpoint deepseek-v4-flash dan deepseek-v4-flash-vision-exp. Tutorial, jawaban forum, dan contoh kode yang disalin masih merujuk pada string tersebut dan akan gagal terhadap API langsung. Periksa pengenal model saat ini di dokumentasi DeepSeek sendiri daripada contoh kode, karena penamaan kini telah berubah dua kali dalam lima bulan.
DeepSeek Tidak Memiliki Program Kredit Startup
Aplikasi obrolan DeepSeek gratis. API tidak, dan DeepSeek menyatakan tidak ada tingkatan gratis di halaman penetapan harga resminya. Klaim kredit API gratis untuk akun DeepSeek baru beredar luas, dilaporkan secara tidak konsisten, dan tidak dikonfirmasi di halaman resmi. Perlakukan sebagai belum diverifikasi.
Yang lebih penting bagi para pendiri: DeepSeek tidak menjalankan program kredit startup khusus. Tidak ada hibah, tidak ada alokasi berdasarkan tahap, tidak ada tingkatan yang disubsidi. Anda mengisi saldo dan Anda membelanjakannya. Murah per token, nol subsidi.
Itu adalah satu tempat di mana keunggulan biaya berbalik. Penyedia yang mengenakan biaya beberapa kali lebih mahal per token sambil memberikan kredit lima digit kepada perusahaan muda lebih murah di tahun pertama daripada penyedia murah tanpa subsidi sama sekali. Biaya per token hanya metrik yang tepat begitu seseorang benar-benar membayar tunai.
Sebagian besar penyedia yang bersaing dengan DeepSeek memang menjalankan program kredit. AI Perks melacak $7,7 juta dalam kredit di 194 perusahaan, yang merupakan seluruh lapisan yang dilewatkan oleh perbandingan daftar harga.
Tumpukan praktis: kapasitas kredit dari penyedia yang memberikannya, DeepSeek-Flash di luar jam sibuk sebagai default berbayar, caching awalan agresif pada apa pun yang berjalan pada jam sibuk, dan fallback terverifikasi untuk jam-jam yang tidak dapat Anda geser. Mulailah dengan kredit, karena itu adalah satu-satunya bagian dari tagihan yang bisa menjadi nol. Lihat apa yang tersedia saat ini.

Pertanyaan yang Sering Diajukan
Apakah DeepSeek lebih murah daripada ChatGPT?
Pertanyaan itu memiliki empat jawaban di sisi DeepSeek saja. Input segar DeepSeek-V4-Pro berjalan $0,66 per juta di luar jam sibuk dan $1,32 pada jam sibuk, dan token yang di-cache berharga $0,022 di luar jam sibuk. Harga lalu lintas Anda sendiri terhadap tarif yang dipublikasikan OpenAI saat ini, menimbang setiap tarif DeepSeek berdasarkan pangsa panggilan yang benar-benar mendarat di sana. Jawabannya tergantung pada jam Anda dan tingkat cache hit Anda, bukan pada vendor.
Apa jam sibuk DeepSeek?
Jam sibuk adalah 01:00 hingga 04:00 dan 06:00 hingga 10:00 UTC, Senin hingga Jumat. Segala sesuatu yang lain, termasuk akhir pekan, ditagih dengan setengah tarif puncak. Itu membuat sekitar 79% minggu di luar jam sibuk. Tim di zona waktu AS jarang menyentuh penetapan harga puncak selama jam kerja normal sama sekali.
Apakah DeepSeek menawarkan kredit API gratis atau program startup?
Tidak. Aplikasi obrolan DeepSeek gratis untuk digunakan, tetapi tidak ada tingkatan API gratis yang dinyatakan di halaman penetapan harga resminya, dan laporan kredit pendaftaran tidak konsisten dan tidak dikonfirmasi. DeepSeek juga tidak menjalankan program kredit startup, tidak seperti banyak penyedia yang dilacak di AI Perks.
Mengapa panggilan API DeepSeek saya berhenti berfungsi?
DeepSeek-V4.1-Flash menghentikan pengenal model deepseek-v4-flash dan deepseek-v4-flash-vision-exp, secara diam-diam dan tanpa jendela penghentian. Tutorial lama dan sampel yang disalin masih merujuk pada mereka dan akan gagal. Tarik pengenal saat ini dari dokumentasi langsung DeepSeek sebelum memperbaiki hal lain.
Berapa biaya DeepSeek-Flash untuk token output?
DeepSeek belum mempublikasikannya. Lini V4.1 Flash hanya mencantumkan tarif input cache-hit dan cache-miss. Angka biaya-per-tugas penuh apa pun yang Anda lihat untuk Flash dibangun berdasarkan tarif output yang diasumsikan, jadi perlakukan itu sebagai perkiraan daripada harga.
Apakah lebih murah menjalankan DeepSeek melalui host pihak ketiga?
Biasanya tidak, jika lalu lintas Anda berjalan di luar jam sibuk. Host mengenakan tarif tetap tanpa pemisahan jam sibuk dan di luar jam sibuk, sehingga Anda kehilangan diskon 50% di luar jam sibuk secara permanen sebagai imbalan atas kenyamanan routing dan failover. Verifikasi tarif host saat ini sendiri sebelum beralih, karena margin bervariasi dan sering berubah.
Berapa banyak kredit AI gratis yang benar-benar menghemat startup?
Cukup untuk membalikkan perbandingan. Penyedia yang mengenakan biaya beberapa kali lebih mahal per token tetapi memberikan kredit lima digit lebih murah di tahun pertama daripada penyedia murah tanpa subsidi. AI Perks melacak $7,7 juta dalam kredit di 194 perusahaan, yang merupakan lapisan yang sepenuhnya diabaikan oleh perbandingan daftar harga.
Berlangganan untuk penurunan kredit mingguan
Harga per token adalah angka yang mudah. Harga per tugas, setelah kredit, adalah yang muncul di kartu.