AI Perks menyediakan akses kepada diskaun eksklusif, kredit dan tawaran untuk alat AI, perkhidmatan awan dan API bagi membantu startup dan pembangun menjimatkan wang.

Berapakah Kos Sebenarnya Cache Hit DeepSeek
Pada DeepSeek-V4-Pro, token input yang dihantar daripada cache berharga $0.022 setiap juta di luar waktu puncak berbanding $0.66 untuk cache miss. Itu adalah diskaun 30x untuk menghantar awalan yang sama dua kali.
Kebanyakan halaman harga memetik satu nombor input dan teruskan. DeepSeek mempunyai empat, kerana dua pengganda berasingan dikenakan pada setiap panggilan tunggal: sama ada awalan itu mengenai cache, dan pada waktu manakah anda menghantarnya.
| Model dan tetingkap | Input cache hit | Input cache miss | Output |
|---|---|---|---|
| DeepSeek-V4-Pro-0813, luar waktu puncak | $0.022 | $0.66 | $1.98 |
| DeepSeek-V4-Pro-0813, waktu puncak | $0.044 | $1.32 | $3.96 |
| DeepSeek-V4.1-Flash, luar waktu puncak | $0.003 | $0.15 | tidak disahkan |
| DeepSeek-V4.1-Flash, waktu puncak | $0.006 | $0.30 | tidak disahkan |
Semua angka adalah USD setiap juta token, daripada dokumentasi API rasmi pada September 2026. Harga output V4.1-Flash tidak disahkan di sini, jadi semak halaman rasmi sebelum membuat bajet mengenainya.
Nisbah Flash adalah lebih lebar daripada model utama: $0.003 berbanding $0.15 adalah jurang 50x (diperolehi daripada kadar di atas). AI Perks menjejak jenis mekanik pembekal ini bersama-sama program kredit yang mengimbanginya.
Kredit AI Teratas untuk Permulaan
Mohon terus melalui program yang disahkan ini.
Claude $10,000 credits
Layak untuk permulaan peringkat awal
OpenAI $2,500 credits
Layak untuk permulaan peringkat awal
Anthropic $25,000 credits
Layak untuk permulaan peringkat awal
AWS $300,000 credits
Layak untuk permulaan peringkat awal
Google Cloud $350,000 credits
Layak untuk permulaan peringkat awal
Lovable $6,000 credits
Layak untuk permulaan peringkat awal
Waktu Puncak dan Luar Waktu Puncak: Satu-satunya Peniaga yang Mengenakan Caj Mengikut Jam
Waktu puncak DeepSeek ialah 01:00-04:00 dan 06:00-10:00 UTC pada hari bekerja. Semua yang lain, termasuk semua Sabtu dan Ahad, bil pada separuh harga tepat.
Tiada pembekal model utama lain yang menetapkan harga mengikut waktu hari, yang menjadikannya tuil yang paling diabaikan dalam kerja kos LLM. Tiada panduan pengoptimuman yang ditulis untuk OpenAI atau Anthropic mempunyai sebarang sebab untuk menyebutnya.
Diperolehi daripada tetingkap tersebut: puncak adalah 7 jam sehari sepanjang 5 hari bekerja, jadi 35 daripada 168 jam minggu ini. Kira-kira 79% kalendar sudah pun luar waktu puncak, jadi kebanyakan pasukan mendapat diskaun secara tidak sengaja dan boleh mendapatkan lebih banyak daripadanya dengan sengaja.
Di mana anda berada menentukan sejauh mana hari bekerja anda terdedah:
| Lokasi Pasukan | Tetingkap puncak, masa tempatan | Pendedahan hari perniagaan |
|---|---|---|
| US Eastern (UTC-4) | 21:00-00:00, 02:00-06:00 | Tiada, keseluruhan hari bekerja adalah luar waktu puncak |
| US Pacific (UTC-7) | 18:00-21:00, 23:00-03:00 | Tiada |
| Eropah Tengah (UTC+2) | 03:00-06:00, 08:00-12:00 | Sepanjang pagi |
| India (UTC+5:30) | 06:30-09:30, 11:30-15:30 | Kebanyakan hari bekerja |
| China (UTC+8) | 09:00-12:00, 14:00-18:00 | Hampir semuanya |
Masa tempatan ditukar daripada tetingkap UTC yang diterbitkan pada anjakan yang ditunjukkan, dan penjimatan siang hari menggerakkannya sebanyak satu jam. Corak itu bukan kemalangan: tetingkap puncak sepadan dengan hari bekerja Cina, jadi lalu lintas interaktif pasukan AS mendarat di separuh jam yang murah secara percuma.
Menumpuk Kedua-dua Diskaun: Jurang 60x pada Satu Model
Token input luar waktu puncak yang disimpan pada $0.022 berbanding miss cache waktu puncak pada $1.32 ialah jurang 60x pada output yang sama daripada model yang sama.
Inilah yang kelihatan pada beban kerja ejen yang realistik: konteks 200,000 token dihantar semula 1,000 kali sehari, jadi 200 juta token input setiap hari pada V4-Pro.
| Senario | Kadar setiap 1M | Kos input harian |
|---|---|---|
| Waktu puncak, setiap panggilan cache miss | $1.32 | $264.00 |
| Luar waktu puncak, setiap panggilan cache miss | $0.66 | $132.00 |
| Waktu puncak, setiap panggilan cache hit | $0.044 | $8.80 |
| Luar waktu puncak, setiap panggilan cache hit | $0.022 | $4.40 |
Semua empat baris diperolehi dengan mendarab kadar yang diterbitkan dengan 200. Jurang antara baris teratas dan baris bawah adalah kira-kira $260 sehari, atau kira-kira $95,000 setahun, pada beban kerja yang tidak berubah sama sekali.
Dua perkara berikut yang terlepas oleh kebanyakan penulisan kos:
Bendera utama yang disimpan mengatasi model kecil yang tidak disimpan. Input V4-Pro yang disimpan pada $0.022 di luar waktu puncak adalah kira-kira 7x lebih murah daripada input V4.1-Flash yang tidak disimpan pada $0.15 (diperolehi). Menurunkan taraf model untuk menjimatkan wang adalah langkah yang salah jika masalah sebenar ialah cache yang anda tidak pernah panaskan.
Output tidak pernah disimpan. Pada $1.98 di luar waktu puncak, token output kos kira-kira 90x token input yang disimpan (diperolehi). Setelah caching berfungsi, anda tidak lagi mempunyai bil input, anda mempunyai bil output, dan setiap penjimatan selanjutnya datang daripada respons yang lebih pendek atau bajet pemikiran yang terhad. Pasukan yang membiayai bil output itu dengan kredit pembekal boleh membandingkan apa yang tersedia di getaiperks.com.
Kredit AI Teratas untuk Permulaan
Mohon terus melalui program yang disahkan ini.
Claude $10,000 credits
Layak untuk permulaan peringkat awal
OpenAI $2,500 credits
Layak untuk permulaan peringkat awal
Anthropic $25,000 credits
Layak untuk permulaan peringkat awal
AWS $300,000 credits
Layak untuk permulaan peringkat awal
Google Cloud $350,000 credits
Layak untuk permulaan peringkat awal
Lovable $6,000 credits
Layak untuk permulaan peringkat awal
Apa yang Berubah Sejak Panduan Harga DeepSeek Kami Sebelum Ini
Tiga perkara bergerak pada 2026: V4-Pro-0813 mencapai ketersediaan umum pada 13 Ogos, harga waktu puncak dan luar waktu puncak menggantikan kadar rata pada pertengahan Ogos, dan V4.1-Flash mendarat sekitar 10 September.
Halaman harga DeepSeek kami sebelum ini memetik kadar token rata tanpa komponen waktu hari. Itu mendahului perubahan dan harus dibaca sebagai sejarah.
Garis masa, dengan keyakinan ditandakan dengan jujur:
- 24 April 2026 (keyakinan sederhana): Pratonton V4-Pro dan V4-Flash, dengan tetingkap konteks 1M token, sehingga 384K token output, dan mod pemikiran serta bukan pemikiran yang boleh ditukar.
- 31 Julai 2026 (keyakinan sederhana): DeepSeek-V4-Flash-0731, keluaran Flash yang stabil. Harga terakhir yang diketahui sebelum perubahan ialah $0.14 setiap juta input cache-miss dan $0.28 setiap juta output, kedua-duanya rata. Sejarah sahaja.
- 13 Ogos 2026: Ketersediaan umum DeepSeek-V4-Pro-0813, model penaakulan dan ejen utama semasa.
- Sekitar 10 September 2026: DeepSeek-V4.1-Flash, disenaraikan dalam dokumentasi sebagai "DeepSeek-Flash".
Jika anda sedang bekerja daripada tutorial atau model kos yang ditulis sebelum Ogos 2026, setiap angka input di dalamnya salah dalam kedua-dua arah: terlalu tinggi untuk cache hit, terlalu rendah untuk cache miss puncak.
Nama Semula Titik Akhir Yang Memecahkan Kod Lama
DeepSeek-V4.1-Flash secara senyap-senyap bersara nama model deepseek-v4-flash dan deepseek-v4-flash-vision-exp. Permintaan yang masih menggunakan rentetan tersebut akan gagal.
Ini adalah jenis perubahan yang muncul sebagai insiden pengeluaran dan bukannya tiket migrasi, kerana nama model biasanya terletak dalam fail konfigurasi yang tiada siapa telah membukanya selama berbulan-bulan. Sampel kod yang lebih lama, pembalut SDK, dan tutorial pihak ketiga masih merujuk kepada nama yang bersara.
Perlu dilakukan sebelum anda men-deploy seterusnya:
- Grep keseluruhan repositori untuk kedua-dua rentetan yang bersara, termasuk konfigurasi infrastruktur dan nota
- Semak mana-mana SDK atau rangka kerja ejen yang dibekalkan yang mengkodkan nama model DeepSeek lalai secara keras
- Sahkan laluan visi secara berasingan, kerana titik akhir visi eksperimental juga dinamakan semula
- Jalankan semula model kos anda selepas itu, kerana penggantinya duduk pada jadual puncak dan luar waktu puncak baharu
Kredit AI Teratas untuk Permulaan
Mohon terus melalui program yang disahkan ini.
Claude $10,000 credits
Layak untuk permulaan peringkat awal
OpenAI $2,500 credits
Layak untuk permulaan peringkat awal
Anthropic $25,000 credits
Layak untuk permulaan peringkat awal
AWS $300,000 credits
Layak untuk permulaan peringkat awal
Google Cloud $350,000 credits
Layak untuk permulaan peringkat awal
Lovable $6,000 credits
Layak untuk permulaan peringkat awal
Siri Percuma dan Kredit DeepSeek: Apa Yang Sebenarnya Benar
Apl sembang DeepSeek percuma untuk digunakan. API tidak, dan tiada siri percuma yang dinyatakan pada halaman harga rasmi.
Di sinilah kebanyakan artikel salah. Tuntutan bahawa akaun API baharu menerima kredit percuma beredar secara meluas, dilaporkan secara tidak konsisten, dan tidak disahkan pada halaman harga rasmi. Jika anda memerlukan baki permulaan, andaikan anda membayarnya.
Lebih penting untuk pengasas: DeepSeek tidak menjalankan program kredit permulaan khusus. Tiada permohonan, tiada peringkat berasaskan peringkat, tiada trek rakan kongsi. Harga token yang rendah ialah keseluruhan tawaran, yang merupakan jurang sebenar jika anda sedang menyusun timbunan kredit.
Jurang itu adalah tepat mengapa keputusan penghalaan penting. Banyak pembekal memang menjalankan program permulaan, dan AI Perks menjejak $7.7 juta dalam kredit merentasi 194 syarikat yang meliputi mereka yang berbuat demikian. Corak praktikal ialah menghalakan lalu lintas volum tinggi yang mesra cache ke DeepSeek pada $0.022 setiap juta dan membelanjakan kredit yang diberikan pada pembekal yang lebih mahal, di mana token percuma bernilai lebih banyak.
Membeli DeepSeek Daripada Orang Lain
Hos pihak ketiga tidak meniru jadual puncak dan luar waktu puncak DeepSeek, yang bermakna mereka boleh menyaingi API pihak pertama semasa puncak dan kalah teruk kepadanya di luar waktu puncak.
Baseten menyenaraikan input DeepSeek V4.1 Flash pada $0.30 setiap juta (keyakinan sederhana, sahkan sebelum anda membajetkannya), dan angka output tidak disahkan dengan boleh dipercayai. Baseten juga membawa kredit percubaan ruang kerja baharu $30 yang berterusan.
Perhatikan apakah $0.30 bersamaan dengan: ia adalah tepat kadar cache-miss puncak DeepSeek sendiri, dan dua kali ganda kadar luar waktu puncak (diperolehi). Untuk pasukan AS atau Eropah yang lalu lintasnya kebanyakannya mendarat di luar waktu puncak, kadar pihak ketiga yang rata tidak jelas merupakan simpanan.
OpenRouter, Together dan Fireworks juga mengehoskan model DeepSeek. Kami tidak memetik harga mereka di sini kerana kami belum mengesahkannya, dan begitu juga mana-mana perkara lain yang anda baca. Namun, dagangan kualitatif adalah konsisten:
- API pihak pertama: satu-satunya tempat timbunan cache-hit dan luar waktu puncak penuh dikenakan, dan laluan termurah dengan margin yang luas apabila kedua-duanya berfungsi
- Hos pihak ketiga: kadar rata, wilayah berbeza, pengebilan bersatu, dan biasanya tiada pendedahan kepada peringkat cache-hit DeepSeek
- Agregator: berguna untuk kegagalan, pada premium yang perlu anda ukur dan bukannya andaikan
Harga lalu lintas anda sendiri berbanding kedua-duanya, kemudian bandingkan hasilnya dengan kredit yang tersedia pada pembekal lain di getaiperks.com. Token percuma mengatasi token murah.
Kredit AI Teratas untuk Permulaan
Mohon terus melalui program yang disahkan ini.
Claude $10,000 credits
Layak untuk permulaan peringkat awal
OpenAI $2,500 credits
Layak untuk permulaan peringkat awal
Anthropic $25,000 credits
Layak untuk permulaan peringkat awal
AWS $300,000 credits
Layak untuk permulaan peringkat awal
Google Cloud $350,000 credits
Layak untuk permulaan peringkat awal
Lovable $6,000 credits
Layak untuk permulaan peringkat awal
Soalan Lazim
Berapa lebih murah cache hit DeepSeek?
Pada DeepSeek-V4-Pro, cache hit ialah $0.022 setiap juta token input di luar waktu puncak berbanding $0.66 untuk cache miss, perbezaan 30x. Pada V4.1-Flash jurang itu lebih lebar lagi, $0.003 berbanding $0.15, perbezaan 50x (diperolehi). Kadar adalah daripada dokumentasi API rasmi pada September 2026.
Bilakah waktu puncak DeepSeek?
Puncak ialah 01:00-04:00 dan 06:00-10:00 UTC pada hari bekerja sahaja. Semua yang lain, termasuk kedua-dua hari hujung minggu, bil pada separuh daripada kadar puncak. Itu bersamaan kira-kira 79% minggu ini adalah luar waktu puncak (diperolehi), jadi pasukan yang berpangkalan di AS mendapat diskaun sepanjang hari perniagaan mereka tanpa mengubah apa-apa.
Adakah DeepSeek mempunyai siri API percuma?
Tiada siri API percuma dinyatakan pada halaman harga rasmi. Apl sembang pengguna adalah percuma, tetapi API dibayar dari token pertama. Laporan tentang kredit percuma untuk akaun baharu tidak konsisten dan tidak disahkan. Pembekal yang memberikan kredit dijejak di getaiperks.com.
Adakah DeepSeek menawarkan kredit permulaan?
DeepSeek tidak menjalankan program kredit permulaan khusus. Harga token yang rendah ialah keseluruhan tawaran. Bagi pengasas yang membina timbunan kredit, itu adalah jurang yang patut diisi di tempat lain: AI Perks merangkumi $7.7 juta dalam kredit merentasi 194 syarikat daripada pembekal yang menjalankan program.
Mengapa panggilan API DeepSeek saya berhenti berfungsi?
Punca yang paling mungkin ialah nama model. DeepSeek-V4.1-Flash bersara nama titik akhir deepseek-v4-flash dan deepseek-v4-flash-vision-exp, dan tutorial serta fail konfigurasi yang lebih lama masih merujuknya. Grep repositori anda untuk kedua-dua rentetan, termasuk SDK dan nota yang dibekalkan, kemudian periksa semula model kos anda berbanding kadar semasa.
Patutkah saya menggunakan DeepSeek V4-Pro atau V4.1-Flash?
Jalankan aritmetik sebelum menganggap Flash lebih murah. Input V4-Pro yang disimpan pada $0.022 di luar waktu puncak adalah kira-kira 7x lebih murah daripada input Flash yang tidak disimpan pada $0.15 (diperolehi), jadi model utama yang disimpan dengan baik boleh mengatasi model kecil yang tidak disimpan pada baris input sepenuhnya. Isipadu output, bukan saiz model, biasanya menentukan bil.
Simpan awalan, hantar di luar waktu puncak, dan biarkan kredit orang lain menanggung selebihnya.