Apakah DeepSeek Lebih Murah Langsung atau Melalui Host?
Langsung, dalam hampir setiap kasus, dan alasannya bersifat struktural daripada masalah markup. Harga murah DeepSeek berasal dari dua pengganda yang hanya ada di API pihak pertama: jendela di luar jam sibuk dengan diskon setengah harga, dan cache hit yang biayanya sekitar 30x lebih murah daripada cache miss pada V4-Pro. Reseller menagih satu tarif tetap per token, sehingga kedua pengganda tersebut hilang saat melewati mereka.
Itulah keseluruhan keputusan perutean dalam satu baris. Host tidak mengenakan biaya premium yang sederhana atas harga yang sama, tetapi mengenakan biaya tetap terhadap tagihan yang bisa jadi hanya sebagian kecil darinya.
Kesenjangannya lebih besar daripada yang diperkirakan oleh siapa pun yang melakukan perutean di papan peringkat. Tim yang mengejar ekonomi unit semacam ini biasanya juga mengejar kredit gratis, yang dilacak oleh AI Perks di 194 perusahaan dan $7,7 juta dalam kredit.

Empat Harga yang Dikenakan DeepSeek untuk Token yang Sama
DeepSeek-V4-Pro memiliki empat harga input yang berbeda tergantung pada jam berapa dan apakah awalan prompt Anda telah di-cache. Tidak ada vendor besar lain yang menetapkan harga seperti ini.
Jam sibuk adalah pukul 01:00 hingga 04:00 dan 06:00 hingga 10:00 UTC pada hari kerja. Segala sesuatu di luar jendela tersebut, termasuk seluruh akhir pekan, adalah di luar jam sibuk dengan setengah harga.
| DeepSeek-V4-Pro-0813 | Di Luar Jam Sibuk (per 1 Juta) | Jam Sibuk (per 1 Juta) |
|---|---|---|
| Input, cache hit | $0,022 | $0,044 |
| Input, cache miss | $0,66 | $1,32 |
| Output | $1,98 | $3,96 |
| DeepSeek-V4.1-Flash | Di Luar Jam Sibuk (per 1 Juta) | Jam Sibuk (per 1 Juta) |
|---|---|---|
| Input, cache hit | $0,003 | $0,006 |
| Input, cache miss | $0,15 | $0,30 |
Kedua pengganda tersebut bertumpuk. Token input di luar jam sibuk yang di-cache seharga $0,022 dibandingkan dengan input jam sibuk yang cache miss seharga $1,32 adalah perbedaan 60x pada model yang sama (diambil dari tabel di atas). Pada Flash, perbedaannya lebih lebar lagi: $0,003 terhadap $0,30 adalah 100x, juga diambil.
Jam sibuk total 7 jam sehari selama 5 hari kerja, jadi sekitar 79% minggu ditagih dengan tarif di luar jam sibuk secara default (diambil). Anda tidak perlu melakukan sesuatu yang cerdas untuk mencapainya. Anda harus menghindari melakukan sesuatu yang ceroboh.
Apa yang Berubah pada Harga DeepSeek pada Agustus 2026
Model penetapan harga itu sendiri berubah pada 16 Agustus 2026, ketika tarif tetap per token digantikan oleh pembagian jam sibuk dan di luar jam sibuk. Perbandingan biaya apa pun yang ditulis sebelum tanggal tersebut menjelaskan kartu tarif yang tidak ada lagi.
Garis waktu yang penting:
- 24 April 2026: V4-Pro dan V4-Flash pratinjau, dengan konteks 1 juta token dan mode berpikir yang dapat dialihkan (keyakinan: sedang).
- 31 Juli 2026: DeepSeek-V4-Flash-0731 dirilis sebagai rilis Flash stabil. Harga tetap terakhir yang diketahui adalah $0,14 per 1 juta input cache-miss dan $0,28 output (keyakinan: sedang, hanya historis).
- 13 Agustus 2026: DeepSeek-V4-Pro-0813 tersedia secara umum.
- Sekitar 10 September 2026: DeepSeek-V4.1-Flash tiba, terdaftar di dokumentasi sebagai DeepSeek-Flash.
Letakkan tarif tetap lama $0,14 di samping harga Flash saat ini, dan desain perubahannya menjadi jelas. Input cache-miss di luar jam sibuk seharga $0,15 hampir sama persis dengan tarif tetap lama, sementara jam sibuk berharga $0,30, sedikit lebih dari dua kali lipat (diambil). DeepSeek tidak menaikkan harga, melainkan memasang biaya kemacetan.

Berapa Biaya Host Pihak Ketiga dan Mengapa Mereka Tidak Bisa Menandingi
Host membeli kapasitas dan menjual token, jadi ia harus mengutip satu angka yang mencakup jam terburuknya. Angka tersebut berada di atas tarif di luar jam sibuk DeepSeek dan astronomis di atas tarif di luar jam sibuk yang di-cache.
Dua hal rusak dalam penjualan kembali:
Penetapan harga waktu-hari tidak bertahan. Host yang melayani setiap zona waktu tidak dapat meneruskan diskon yang berpusat pada UTC tanpa arbitrase atau halaman harga yang tidak dapat dijual.
Status cache bersifat per penyewa. Peng-cachean awalan memberikan keuntungan ketika prompt sistem yang sama berulang kali mencapai backend yang sama. Arahkan prompt tersebut melalui agregator yang menyeimbangkan beban di berbagai penyedia dan Anda membayar harga cache-miss pada prompt yang telah Anda kirim seribu kali.
Verifikasi sendiri setiap harga host sebelum berkomitmen, karena angka yang dipublikasikan bergerak dan sebagian besar posting perbandingan mengutip tarif yang kedaluwarsa berminggu-minggu yang lalu. Satu angka membingkai kesenjangan dengan jelas. Baseten mencantumkan input DeepSeek V4.1 Flash seharga $0,30 per 1 juta (keyakinan: sedang, verifikasi sebelum mengutip), di samping kredit uji coba workspace baru senilai $30. Angka output tidak dikonfirmasi secara andal, jadi tidak dikutip di sini.
| Rute | Penetapan harga waktu-hari | Diskon cache awalan | Sinyal harga terverifikasi |
|---|---|---|---|
| DeepSeek pihak pertama, V4-Pro | Ya, perbedaan 2x | Ya, 30x | $0,66 input / $1,98 output, di luar jam sibuk |
| DeepSeek pihak pertama, V4.1-Flash | Ya, perbedaan 2x | Ya, 50x (diambil) | $0,15 input, di luar jam sibuk |
| Baseten | Tidak dipublikasikan | Tidak dipublikasikan | $0,30 input, V4.1 Flash |
| OpenRouter, Together AI, Fireworks | Tidak dipublikasikan | Bervariasi menurut penyedia | Verifikasi di sumber |
Dibandingkan dengan Baseten yang terdaftar seharga $0,30, input cache-miss di luar jam sibuk DeepSeek sendiri seharga $0,15 adalah setengah harga, dan input cache-nya di luar jam sibuk seharga $0,003 adalah 100x lebih murah (diambil). Itu bukan reseller yang serakah. Itu adalah tarif tetap yang bertemu dengan tarif empat tingkatan.
OpenRouter, Together AI, dan Fireworks semuanya menjadi host model DeepSeek. Harga mereka tidak dikutip di sini karena tidak terverifikasi, dan harga yang sudah usang dalam perbandingan biaya lebih buruk daripada tidak ada harga sama sekali.
Kapan Membayar Markup Host adalah Pilihan yang Tepat
Rute melalui host ketika barang yang Anda beli bukanlah token. Ada empat situasi di mana premi tersebut masuk akal.
Pengadaan memblokir endpoint China. Jika tinjauan keamanan Anda tidak menyetujui pemanggilan DeepSeek secara langsung, host bukanlah markup, itu adalah satu-satunya cara Anda dapat meluncurkan. Ini adalah alasan paling umum mengapa tim merutekan DeepSeek melalui penyedia AS.
Anda memerlukan satu faktur dan satu kunci di banyak model. Agregator yang beralih dari DeepSeek ke endpoint Llama atau Qwen ketika ada masalah menjual waktu kerja, bukan harga.
Lalu lintas Anda berada di jam sibuk dan selalu dalam kondisi cache-cold. Produk interaktif bervolume rendah yang melayani pagi hari Eropa berada dalam jendela jam sibuk dengan prompt yang singkat dan unik. Beban kerja tersebut kehilangan kedua diskon, yang secara signifikan mempersempit keuntungan pihak pertama.
Anda masih mengevaluasi. Kredit uji coba seperti $30 dari Baseten tidak memerlukan biaya dan menjawab pertanyaan kualitas sebelum Anda menghubungkan vendor kedua. Kredit evaluasi gratis adalah bentuk uji tuntas termurah, dan AI Perks ada untuk mengkatalogkan di mana kredit tersebut tersedia.

Penggantian Nama Endpoint yang Merusak Konfigurasi Perutean
DeepSeek-V4.1-Flash secara diam-diam menghentikan nama model deepseek-v4-flash dan deepseek-v4-flash-vision-exp. Sampel kode dan tutorial yang ditulis sebelum September 2026 masih merujuk padanya, dan panggilan tersebut sekarang gagal.
Hal ini paling berdampak pada pengaturan yang dibahas dalam artikel ini. Konfigurasi router menyimpan pengidentifikasi model untuk beberapa penyedia dalam satu file, yang paling stabil selama bertahun-tahun, sehingga nama yang diam-diam dihentikan muncul sebagai kegagalan intermiten pada satu rute daripada pemadaman yang jelas.
Dua konsekuensi praktis:
- Gunakan grep pada basis kode dan templat prompt Anda untuk nama lama sebelum Anda memperbaiki masalah lain.
- Pengidentifikasi model sisi host dinamai berbeda dari milik DeepSeek, jadi konfirmasikan string mana yang tepat yang diekspos oleh penyedia Anda alih-alih berasumsi nama pihak pertama berfungsi.
DeepSeek Tidak Memiliki Program Kredit Startup. Yang Lain Punya.
Aplikasi obrolan DeepSeek gratis untuk digunakan, tidak ada tingkatan gratis API yang disebutkan di halaman harga resmi, dan DeepSeek tidak menjalankan program kredit startup khusus. Klaim kredit gratis API untuk akun baru beredar luas tetapi dilaporkan tidak konsisten dan tidak dikonfirmasi di halaman resmi. Anggap saja sebagai belum terverifikasi.
Itu adalah celah yang nyata. API yang dihargai serendah ini adalah salah satu dari sedikit yang tidak akan memberikan dolar operasional kepada startup, yang menjadikan DeepSeek sebagai dasar biaya daripada permainan kredit.
Penyedia yang menjalankan program adalah yang layak untuk dilamar, dan jumlahnya jauh lebih banyak daripada yang diketahui kebanyakan pendiri. AI Perks melacak $7,7 juta dalam kredit di 194 perusahaan, yang merupakan baris anggaran yang tidak akan pernah ditanggung oleh DeepSeek sendiri.
Lihat penyedia mana yang memberikan kredit di getaiperks.com →

Pertanyaan yang Sering Diajukan
Apakah DeepSeek lebih murah di OpenRouter atau langsung?
Langsung, secara struktural. Diskon setengah harga DeepSeek di luar jam sibuk dan diskon cache-hit V4-Pro yang kira-kira 30x adalah mekanisme pihak pertama yang ditagih oleh reseller sebagai satu tarif tetap. Host mendapatkan harganya dari kepatuhan, failover, dan satu faktur di berbagai model. Untuk biaya token mentah, pihak pertama menang. Kredit dari penyedia yang menjalankan program tersedia di AI Perks.
Kapan jam sibuk DeepSeek?
Jam sibuk adalah pukul 01:00 hingga 04:00 dan 06:00 hingga 10:00 UTC pada hari kerja. Segala sesuatu yang lain, termasuk seluruh Sabtu dan Minggu, ditagih dengan setengah harga. Itu menyisakan sekitar 79% minggu pada tarif di luar jam sibuk secara default (diambil), jadi pekerjaan batch dan antrean hampir selalu jatuh di sana tanpa upaya penjadwalan apa pun.
Berapa banyak penghematan dari cache hit DeepSeek?
Pada DeepSeek-V4-Pro, cache hit berharga $0,022 per juta token input di luar jam sibuk dibandingkan dengan $0,66 untuk miss, kira-kira 30x. Pada V4.1-Flash, perbandingan yang sama adalah $0,003 terhadap $0,15, kira-kira 50x (diambil). Gabungkan diskon cache dengan di luar jam sibuk dan perbedaan terhadap jam sibuk miss mencapai 60x pada V4-Pro.
Mengapa panggilan API deepseek-v4-flash saya berhenti berfungsi?
DeepSeek-V4.1-Flash menghentikan nama endpoint deepseek-v4-flash dan deepseek-v4-flash-vision-exp. Tutorial atau sampel kode apa pun yang ditulis sebelum September 2026 masih menggunakannya dan sekarang akan gagal. Perbarui pengidentifikasi model, dan perhatikan bahwa host pihak ketiga menamai pengidentifikasi mereka sendiri secara berbeda dari DeepSeek.
Apakah DeepSeek memberikan kredit API gratis untuk akun baru?
Aplikasi obrolan DeepSeek gratis, tetapi tidak ada tingkatan gratis API yang disebutkan di halaman harga resmi, dan klaim kredit akun baru dilaporkan tidak konsisten dan belum terkonfirmasi. DeepSeek juga tidak menjalankan program kredit startup. Penyedia yang melakukannya dilacak di AI Perks di 194 perusahaan.
Berapa biaya DeepSeek V4-Pro per juta token?
DeepSeek-V4-Pro-0813 berharga $0,66 per juta token input cache-miss dan $1,98 per juta output di luar jam sibuk, berlipat ganda menjadi $1,32 dan $3,96 selama jam sibuk. Input yang di-cache adalah $0,022 di luar jam sibuk. Tingkatan ini pada satu model adalah alasan mengapa tarif reseller tetap jarang bersaing. Kompensasi tagihan model Anda yang lain di AI Perks.
Berlangganan di getaiperks.com →
DeepSeek menetapkan dasar harga. Kredit gratis dari semua orang menanggung sisanya.