DeepSeek Konteks Cache 2026: Diskaun Input 30x

DeepSeek mengenakan caj 30x lebih rendah untuk input yang disimpan dalam cache berbanding dengan ketidakhadiran cache dan mengurangkan separuh setiap harga di luar waktu puncak. Kadar V4-Pro dan V4.1-Flash, dijelaskan dengan betul.

DeepSeekContext CachingLLM PricingAI API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
12,491

Quick Answer

Kenaan cache pada DeepSeek-V4-Pro berharga $0.022 setiap juta token input di luar waktu puncak berbanding $0.66 untuk ketidakkanaan cache, diskaun 30x pada model yang sama. DeepSeek juga mengurangkan separuh setiap harga di luar waktu puncak, jadi token cache di luar waktu puncak berjalan 60x lebih murah daripada ketidakkanaan cache pada waktu puncak. Kredit daripada pembekal yang menjalankan program permulaan dijejaki di getaiperks.com.

AI Perks

AI Perks menyediakan akses kepada diskaun eksklusif, kredit dan tawaran untuk alat AI, perkhidmatan awan dan API bagi membantu startup dan pembangun menjimatkan wang.

AI Perks Cards

Berapakah Kos Sebenarnya Cache Hit DeepSeek

Pada DeepSeek-V4-Pro, token input yang dihantar daripada cache berharga $0.022 setiap juta di luar waktu puncak berbanding $0.66 untuk cache miss. Itu adalah diskaun 30x untuk menghantar awalan yang sama dua kali.

Kebanyakan halaman harga memetik satu nombor input dan teruskan. DeepSeek mempunyai empat, kerana dua pengganda berasingan dikenakan pada setiap panggilan tunggal: sama ada awalan itu mengenai cache, dan pada waktu manakah anda menghantarnya.

Model dan tetingkapInput cache hitInput cache missOutput
DeepSeek-V4-Pro-0813, luar waktu puncak$0.022$0.66$1.98
DeepSeek-V4-Pro-0813, waktu puncak$0.044$1.32$3.96
DeepSeek-V4.1-Flash, luar waktu puncak$0.003$0.15tidak disahkan
DeepSeek-V4.1-Flash, waktu puncak$0.006$0.30tidak disahkan

Semua angka adalah USD setiap juta token, daripada dokumentasi API rasmi pada September 2026. Harga output V4.1-Flash tidak disahkan di sini, jadi semak halaman rasmi sebelum membuat bajet mengenainya.

Nisbah Flash adalah lebih lebar daripada model utama: $0.003 berbanding $0.15 adalah jurang 50x (diperolehi daripada kadar di atas). AI Perks menjejak jenis mekanik pembekal ini bersama-sama program kredit yang mengimbanginya.


Kredit AI Teratas untuk Permulaan

Mohon terus melalui program yang disahkan ini.

Waktu Puncak dan Luar Waktu Puncak: Satu-satunya Peniaga yang Mengenakan Caj Mengikut Jam

Waktu puncak DeepSeek ialah 01:00-04:00 dan 06:00-10:00 UTC pada hari bekerja. Semua yang lain, termasuk semua Sabtu dan Ahad, bil pada separuh harga tepat.

Tiada pembekal model utama lain yang menetapkan harga mengikut waktu hari, yang menjadikannya tuil yang paling diabaikan dalam kerja kos LLM. Tiada panduan pengoptimuman yang ditulis untuk OpenAI atau Anthropic mempunyai sebarang sebab untuk menyebutnya.

Diperolehi daripada tetingkap tersebut: puncak adalah 7 jam sehari sepanjang 5 hari bekerja, jadi 35 daripada 168 jam minggu ini. Kira-kira 79% kalendar sudah pun luar waktu puncak, jadi kebanyakan pasukan mendapat diskaun secara tidak sengaja dan boleh mendapatkan lebih banyak daripadanya dengan sengaja.

Di mana anda berada menentukan sejauh mana hari bekerja anda terdedah:

Lokasi PasukanTetingkap puncak, masa tempatanPendedahan hari perniagaan
US Eastern (UTC-4)21:00-00:00, 02:00-06:00Tiada, keseluruhan hari bekerja adalah luar waktu puncak
US Pacific (UTC-7)18:00-21:00, 23:00-03:00Tiada
Eropah Tengah (UTC+2)03:00-06:00, 08:00-12:00Sepanjang pagi
India (UTC+5:30)06:30-09:30, 11:30-15:30Kebanyakan hari bekerja
China (UTC+8)09:00-12:00, 14:00-18:00Hampir semuanya

Masa tempatan ditukar daripada tetingkap UTC yang diterbitkan pada anjakan yang ditunjukkan, dan penjimatan siang hari menggerakkannya sebanyak satu jam. Corak itu bukan kemalangan: tetingkap puncak sepadan dengan hari bekerja Cina, jadi lalu lintas interaktif pasukan AS mendarat di separuh jam yang murah secara percuma.


Menumpuk Kedua-dua Diskaun: Jurang 60x pada Satu Model

Token input luar waktu puncak yang disimpan pada $0.022 berbanding miss cache waktu puncak pada $1.32 ialah jurang 60x pada output yang sama daripada model yang sama.

Inilah yang kelihatan pada beban kerja ejen yang realistik: konteks 200,000 token dihantar semula 1,000 kali sehari, jadi 200 juta token input setiap hari pada V4-Pro.

SenarioKadar setiap 1MKos input harian
Waktu puncak, setiap panggilan cache miss$1.32$264.00
Luar waktu puncak, setiap panggilan cache miss$0.66$132.00
Waktu puncak, setiap panggilan cache hit$0.044$8.80
Luar waktu puncak, setiap panggilan cache hit$0.022$4.40

Semua empat baris diperolehi dengan mendarab kadar yang diterbitkan dengan 200. Jurang antara baris teratas dan baris bawah adalah kira-kira $260 sehari, atau kira-kira $95,000 setahun, pada beban kerja yang tidak berubah sama sekali.

Dua perkara berikut yang terlepas oleh kebanyakan penulisan kos:

Bendera utama yang disimpan mengatasi model kecil yang tidak disimpan. Input V4-Pro yang disimpan pada $0.022 di luar waktu puncak adalah kira-kira 7x lebih murah daripada input V4.1-Flash yang tidak disimpan pada $0.15 (diperolehi). Menurunkan taraf model untuk menjimatkan wang adalah langkah yang salah jika masalah sebenar ialah cache yang anda tidak pernah panaskan.

Output tidak pernah disimpan. Pada $1.98 di luar waktu puncak, token output kos kira-kira 90x token input yang disimpan (diperolehi). Setelah caching berfungsi, anda tidak lagi mempunyai bil input, anda mempunyai bil output, dan setiap penjimatan selanjutnya datang daripada respons yang lebih pendek atau bajet pemikiran yang terhad. Pasukan yang membiayai bil output itu dengan kredit pembekal boleh membandingkan apa yang tersedia di getaiperks.com.


Kredit AI Teratas untuk Permulaan

Mohon terus melalui program yang disahkan ini.

Apa yang Berubah Sejak Panduan Harga DeepSeek Kami Sebelum Ini

Tiga perkara bergerak pada 2026: V4-Pro-0813 mencapai ketersediaan umum pada 13 Ogos, harga waktu puncak dan luar waktu puncak menggantikan kadar rata pada pertengahan Ogos, dan V4.1-Flash mendarat sekitar 10 September.

Halaman harga DeepSeek kami sebelum ini memetik kadar token rata tanpa komponen waktu hari. Itu mendahului perubahan dan harus dibaca sebagai sejarah.

Garis masa, dengan keyakinan ditandakan dengan jujur:

  • 24 April 2026 (keyakinan sederhana): Pratonton V4-Pro dan V4-Flash, dengan tetingkap konteks 1M token, sehingga 384K token output, dan mod pemikiran serta bukan pemikiran yang boleh ditukar.
  • 31 Julai 2026 (keyakinan sederhana): DeepSeek-V4-Flash-0731, keluaran Flash yang stabil. Harga terakhir yang diketahui sebelum perubahan ialah $0.14 setiap juta input cache-miss dan $0.28 setiap juta output, kedua-duanya rata. Sejarah sahaja.
  • 13 Ogos 2026: Ketersediaan umum DeepSeek-V4-Pro-0813, model penaakulan dan ejen utama semasa.
  • Sekitar 10 September 2026: DeepSeek-V4.1-Flash, disenaraikan dalam dokumentasi sebagai "DeepSeek-Flash".

Jika anda sedang bekerja daripada tutorial atau model kos yang ditulis sebelum Ogos 2026, setiap angka input di dalamnya salah dalam kedua-dua arah: terlalu tinggi untuk cache hit, terlalu rendah untuk cache miss puncak.


Nama Semula Titik Akhir Yang Memecahkan Kod Lama

DeepSeek-V4.1-Flash secara senyap-senyap bersara nama model deepseek-v4-flash dan deepseek-v4-flash-vision-exp. Permintaan yang masih menggunakan rentetan tersebut akan gagal.

Ini adalah jenis perubahan yang muncul sebagai insiden pengeluaran dan bukannya tiket migrasi, kerana nama model biasanya terletak dalam fail konfigurasi yang tiada siapa telah membukanya selama berbulan-bulan. Sampel kod yang lebih lama, pembalut SDK, dan tutorial pihak ketiga masih merujuk kepada nama yang bersara.

Perlu dilakukan sebelum anda men-deploy seterusnya:

  • Grep keseluruhan repositori untuk kedua-dua rentetan yang bersara, termasuk konfigurasi infrastruktur dan nota
  • Semak mana-mana SDK atau rangka kerja ejen yang dibekalkan yang mengkodkan nama model DeepSeek lalai secara keras
  • Sahkan laluan visi secara berasingan, kerana titik akhir visi eksperimental juga dinamakan semula
  • Jalankan semula model kos anda selepas itu, kerana penggantinya duduk pada jadual puncak dan luar waktu puncak baharu

Kredit AI Teratas untuk Permulaan

Mohon terus melalui program yang disahkan ini.

Siri Percuma dan Kredit DeepSeek: Apa Yang Sebenarnya Benar

Apl sembang DeepSeek percuma untuk digunakan. API tidak, dan tiada siri percuma yang dinyatakan pada halaman harga rasmi.

Di sinilah kebanyakan artikel salah. Tuntutan bahawa akaun API baharu menerima kredit percuma beredar secara meluas, dilaporkan secara tidak konsisten, dan tidak disahkan pada halaman harga rasmi. Jika anda memerlukan baki permulaan, andaikan anda membayarnya.

Lebih penting untuk pengasas: DeepSeek tidak menjalankan program kredit permulaan khusus. Tiada permohonan, tiada peringkat berasaskan peringkat, tiada trek rakan kongsi. Harga token yang rendah ialah keseluruhan tawaran, yang merupakan jurang sebenar jika anda sedang menyusun timbunan kredit.

Jurang itu adalah tepat mengapa keputusan penghalaan penting. Banyak pembekal memang menjalankan program permulaan, dan AI Perks menjejak $7.7 juta dalam kredit merentasi 194 syarikat yang meliputi mereka yang berbuat demikian. Corak praktikal ialah menghalakan lalu lintas volum tinggi yang mesra cache ke DeepSeek pada $0.022 setiap juta dan membelanjakan kredit yang diberikan pada pembekal yang lebih mahal, di mana token percuma bernilai lebih banyak.


Membeli DeepSeek Daripada Orang Lain

Hos pihak ketiga tidak meniru jadual puncak dan luar waktu puncak DeepSeek, yang bermakna mereka boleh menyaingi API pihak pertama semasa puncak dan kalah teruk kepadanya di luar waktu puncak.

Baseten menyenaraikan input DeepSeek V4.1 Flash pada $0.30 setiap juta (keyakinan sederhana, sahkan sebelum anda membajetkannya), dan angka output tidak disahkan dengan boleh dipercayai. Baseten juga membawa kredit percubaan ruang kerja baharu $30 yang berterusan.

Perhatikan apakah $0.30 bersamaan dengan: ia adalah tepat kadar cache-miss puncak DeepSeek sendiri, dan dua kali ganda kadar luar waktu puncak (diperolehi). Untuk pasukan AS atau Eropah yang lalu lintasnya kebanyakannya mendarat di luar waktu puncak, kadar pihak ketiga yang rata tidak jelas merupakan simpanan.

OpenRouter, Together dan Fireworks juga mengehoskan model DeepSeek. Kami tidak memetik harga mereka di sini kerana kami belum mengesahkannya, dan begitu juga mana-mana perkara lain yang anda baca. Namun, dagangan kualitatif adalah konsisten:

  • API pihak pertama: satu-satunya tempat timbunan cache-hit dan luar waktu puncak penuh dikenakan, dan laluan termurah dengan margin yang luas apabila kedua-duanya berfungsi
  • Hos pihak ketiga: kadar rata, wilayah berbeza, pengebilan bersatu, dan biasanya tiada pendedahan kepada peringkat cache-hit DeepSeek
  • Agregator: berguna untuk kegagalan, pada premium yang perlu anda ukur dan bukannya andaikan

Harga lalu lintas anda sendiri berbanding kedua-duanya, kemudian bandingkan hasilnya dengan kredit yang tersedia pada pembekal lain di getaiperks.com. Token percuma mengatasi token murah.


Kredit AI Teratas untuk Permulaan

Mohon terus melalui program yang disahkan ini.

Soalan Lazim

Berapa lebih murah cache hit DeepSeek?

Pada DeepSeek-V4-Pro, cache hit ialah $0.022 setiap juta token input di luar waktu puncak berbanding $0.66 untuk cache miss, perbezaan 30x. Pada V4.1-Flash jurang itu lebih lebar lagi, $0.003 berbanding $0.15, perbezaan 50x (diperolehi). Kadar adalah daripada dokumentasi API rasmi pada September 2026.

Bilakah waktu puncak DeepSeek?

Puncak ialah 01:00-04:00 dan 06:00-10:00 UTC pada hari bekerja sahaja. Semua yang lain, termasuk kedua-dua hari hujung minggu, bil pada separuh daripada kadar puncak. Itu bersamaan kira-kira 79% minggu ini adalah luar waktu puncak (diperolehi), jadi pasukan yang berpangkalan di AS mendapat diskaun sepanjang hari perniagaan mereka tanpa mengubah apa-apa.

Adakah DeepSeek mempunyai siri API percuma?

Tiada siri API percuma dinyatakan pada halaman harga rasmi. Apl sembang pengguna adalah percuma, tetapi API dibayar dari token pertama. Laporan tentang kredit percuma untuk akaun baharu tidak konsisten dan tidak disahkan. Pembekal yang memberikan kredit dijejak di getaiperks.com.

Adakah DeepSeek menawarkan kredit permulaan?

DeepSeek tidak menjalankan program kredit permulaan khusus. Harga token yang rendah ialah keseluruhan tawaran. Bagi pengasas yang membina timbunan kredit, itu adalah jurang yang patut diisi di tempat lain: AI Perks merangkumi $7.7 juta dalam kredit merentasi 194 syarikat daripada pembekal yang menjalankan program.

Mengapa panggilan API DeepSeek saya berhenti berfungsi?

Punca yang paling mungkin ialah nama model. DeepSeek-V4.1-Flash bersara nama titik akhir deepseek-v4-flash dan deepseek-v4-flash-vision-exp, dan tutorial serta fail konfigurasi yang lebih lama masih merujuknya. Grep repositori anda untuk kedua-dua rentetan, termasuk SDK dan nota yang dibekalkan, kemudian periksa semula model kos anda berbanding kadar semasa.

Patutkah saya menggunakan DeepSeek V4-Pro atau V4.1-Flash?

Jalankan aritmetik sebelum menganggap Flash lebih murah. Input V4-Pro yang disimpan pada $0.022 di luar waktu puncak adalah kira-kira 7x lebih murah daripada input Flash yang tidak disimpan pada $0.15 (diperolehi), jadi model utama yang disimpan dengan baik boleh mengatasi model kecil yang tidak disimpan pada baris input sepenuhnya. Isipadu output, bukan saiz model, biasanya menentukan bil.


Langgan di getaiperks.com →

Simpan awalan, hantar di luar waktu puncak, dan biarkan kredit orang lain menanggung selebihnya.

AI Perks

AI Perks menyediakan akses kepada diskaun eksklusif, kredit dan tawaran untuk alat AI, perkhidmatan awan dan API bagi membantu startup dan pembangun menjimatkan wang.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.