آیا میتوانید DeepSeek را خودتان اجرا کنید؟
بله. نسخههای منتشر شده با وزن باز DeepSeek قابل دانلود و اجرا بر روی سختافزار خودتان هستند و Ollama کوتاهترین مسیر برای راهاندازی یک نمونه محلی آماده کار است. هزینه تقریباً هرگز دلیل انجام این کار نیست.
جمله دوم، بخشی است که تمام راهنماهای دیگر آن را نادیده میگیرند. API میزبانی شده DeepSeek دارای دو تخفیف است که با هم ترکیب میشوند و در مجموع نقطه سربهسر خود-میزبانی را به جایی میرسانند که اکثر تیمها با GPUهای اجارهای به آن نمیرسند.
خود-میزبانی DeepSeek یک تصمیم کنترلی است: اقامتگاه داده، عملیات آفلاین، تثبیت نسخه. آن را به عنوان یک برنامه پسانداز در نظر بگیرید و اعداد زیر شما را ناامید خواهند کرد.
اعتبارات مدل از ارائهدهندگانی که واقعاً آنها را ارائه میدهند در AI Perks ردیابی میشوند.

نحوه اجرای DeepSeek با Ollama
Ollama یک کپی کوانتیزه شده از وزنها را دانلود میکند، آنها را در دیسک محلی نگه میدارد و یک نقطه پایانی HTTP سازگار با OpenAI را در localhost:11434 در دسترس قرار میدهد، بنابراین کد موجود با تغییر یک خط URL پایه تغییر میکند.
توالی کاری کوتاه است:
ollama pull <deepseek-tag>برای دریافت وزنهاollama run <deepseek-tag>برای یک پرامپت تعاملی- SDK خود را به
http://localhost:11434/v1اشاره دهید و هر رشته غیرخالی را به عنوان کلید API ارسال کنید.
سه مورد را قبل از برنامهریزی محصول بر اساس یک تگ، در صفحه مدل بررسی کنید:
کدام واریانت واقعاً در تگ وجود دارد. وزنهایی که روی یک لپتاپ جا میشوند و وزنهایی که پشت نقطه پایانی میزبانی شده DeepSeek قرار دارند، اغلب یک مدل نیستند. واریانتهای تقطیر شده و کاهش یافته نام خانوادگی مشترکی دارند و رفتار متفاوتی دارند.
کدام کوانتیزاسیون را کشیدید. یک ساختار 4 بیتی حافظه را نسبت به یک ساختار 8 بیتی نصف میکند و خروجی یکسانی تولید نمیکند. اگر به صورت محلی بنچمارک گرفته و در API مستقر کنید، دو سیستم متفاوت را مقایسه میکنید.
سقف واقعی زمینه شما. به صورت محلی، زمینه محدود به حافظه شماست، نه حداکثر عددی که در اعلامیه ذکر شده است. عدد زمینه طولانی از یک انتشار میزبانی شده به دستگاه شما منتقل نمیشود.
آنچه خود-میزبانی باید بر آن غلبه کند
DeepSeek تنها فروشنده مدل بزرگ است که بر اساس زمان روز هزینه دریافت میکند. ساعات اوج مصرف 01:00 تا 04:00 و 06:00 تا 10:00 UTC در روزهای هفته است، و همه چیز خارج از این پنجرهها، از جمله تمام آخر هفته، دقیقاً نصف قیمت است.
بالای ساعت، یک تخفیف کش وجود دارد که بسیار بزرگتر است. نرخهای فعلی منتشر شده، به دلار به ازای هر میلیون توکن:
| مدل و نوع توکن | خارج از اوج | اوج |
|---|---|---|
| ورودی DeepSeek-V4-Pro، کش برخورد شده | 0.022 دلار | 0.044 دلار |
| ورودی DeepSeek-V4-Pro، کش برخورد نشده | 0.66 دلار | 1.32 دلار |
| خروجی DeepSeek-V4-Pro | 1.98 دلار | 3.96 دلار |
| ورودی DeepSeek-V4.1-Flash، کش برخورد شده | 0.003 دلار | 0.006 دلار |
| ورودی DeepSeek-V4.1-Flash، کش برخورد نشده | 0.15 دلار | 0.30 دلار |
یک کش برخورد شده در V4-Pro تقریباً 30 برابر ارزانتر از یک کش برخورد نشده است. این را با ساعت ترکیب کنید و یک توکن ورودی خارج از اوج کش شده با 0.022 دلار 60 برابر کمتر از یک کش برخورد شده در اوج با 1.32 دلار، در همان مدل، قرار میگیرد. هیچ چیز در زیرساخت شما چنین اهرم 60 برابری ندارد. تجزیه و تحلیل کامل پنجره در راهنمای قیمتگذاری خارج از اوج DeepSeek ما موجود است.

ریاضیات نقطه سربهسر اجرای DeepSeek به صورت محلی
برگرفته از نرخهای منتشر شده در بالا: برای غلبه بر API خارج از اوج DeepSeek در خروجی، سختافزار شما باید یک میلیون توکن خروجی در ساعت را با قیمتی کمتر از 1.98 دلار تولید کند، همه چیز در آن لحاظ شده است.
این چارچوب مفیدتر از هر لیست قیمت GPU است، زیرا هر چیزی را که اجاره میکنید در بر میگیرد. توان خروجی را که میتوانید واقعاً حفظ کنید، بگیرید و آن را با هزینه همان حجم در API مقایسه کنید:
| توان خروجی پایدار | هزینه API خارج از اوج | هزینه API در اوج |
|---|---|---|
| 100,000 توکن در ساعت | 0.20 دلار | 0.40 دلار |
| 500,000 توکن در ساعت | 0.99 دلار | 1.98 دلار |
| 1,000,000 توکن در ساعت | 1.98 دلار | 3.96 دلار |
| 5,000,000 توکن در ساعت | 9.90 دلار | 19.80 دلار |
| 10,000,000 توکن در ساعت | 19.80 دلار | 39.60 دلار |
اعداد برگرفته از نرخهای توکن به توکن منتشر شده DeepSeek، نه از DeepSeek نقل شده است.
ردیف میانی را با دقت بخوانید. دستگاهی که هر ساعت، شبانهروز، یک میلیون توکن خروجی را ارائه میدهد، حدود 1,425 دلار در ماه از هزینه API خارج از اوج را جایگزین میکند (محاسبه شده: 1.98 دلار × 24 ساعت × 30 روز = 1,425.60 دلار). شتابدهنده شما، میزبان، ذخیرهسازی، پهنای باند و مهندسی که آن را زنده نگه میدارد، همگی باید در این مبلغ جای بگیرند.
ورودی بدتر است. اگر حجم کار شما تحت سلطه یک پرامپت سیستمی تکراری است، API برای هر میلیون توکن کش شده خارج از اوج 0.022 دلار هزینه دریافت میکند. خود-میزبانی باید با دو سنت در میلیون رقابت کند. موفق نخواهد شد.
نتیجه صادقانه: خود-میزبانی DeepSeek در حجم واقعاً بزرگ، پایدار و با استفاده بالا سودآور است و تقریباً در هیچ جای دیگری. برای همه چیز در زیر این خط، ارزانترین حرکت، API به علاوه اعتبارات رایگان از سایر ارائهدهندگان است، که getaiperks.com برای نگاشت آن وجود دارد.
چه زمانی اجرای DeepSeek توسط خودتان گزینه درستی است
خود-میزبانی DeepSeek بر اساس کنترل برنده میشود، نه قیمت. پنج موقعیت آن را صرف نظر از جدول نقطه سربهسر توجیه میکنند.
اقامتگاه داده و انطباق. اگر پرامپتها حاوی مطالبی باشند که نمیتوانند از حوزه قضایی یا شبکه شما خارج شوند، هیچ تخفیف توکن به توکن گزینه میزبانی شده را عملی نمیکند. این رایجترین دلیل قانونی است.
عملیات هواپیمای دربسته و آفلاین. استقرار میدانی، تأسیسات امنیتی و اتصال ناپایدار همگی به استنتاجی نیاز دارند که به یک نقطه پایانی قابل دسترسی وابسته نباشد.
تثبیت نسخه. وزنهای محلی در زیر شما تغییر نمیکنند. مدلهای میزبانی شده تغییر میکنند و DeepSeek آن را ثابت کرده است.
مصونیت از ساعت. منحنی هزینه خود-میزبانی صاف است. منحنی API بین صبح سهشنبه و شب شنبه 2 برابر نوسان میکند، که برنامهریزی ظرفیت در برابر آن را برای هر چیزی که به ساعات کاری وابسته به تأخیر باشد، دشوار میکند.
دسترسی به خود وزنها. تنظیم دقیق، بازرسی لوگیت و رمزگشایی سفارشی از طریق API در دسترس نیستند. اگر محصول شما به آنها نیاز دارد، تصمیم هرگز در مورد هزینه نبود.

چه چیزی از راهنمای قبلی DeepSeek ما تغییر کرده است
صفحه قیمتگذاری DeepSeek سال 2026 ما قبل از نسل V4 و کل سیستم اوج و خارج از اوج است. چهار مورد تغییر کرده است.
| زمان | چه چیزی منتشر شد |
|---|---|
| 24 آوریل 2026 | پیشنمایش V4-Pro و V4-Flash، با زمینه 1M توکن و حالتهای تفکر قابل سوئیچ که در زمان عرضه گزارش شد |
| 31 جولای 2026 | DeepSeek-V4-Flash-0731، انتشار پایدار Flash |
| 13 آگوست 2026 | DeepSeek-V4-Pro-0813 به در دسترس بودن عمومی رسید |
| حدود 10 سپتامبر 2026 | DeepSeek-V4.1-Flash، که در مستندات به عنوان DeepSeek-Flash فهرست شده است |
قبل از تغییر قیمتگذاری آگوست، خط Flash آخرین بار در 0.14 دلار به ازای هر میلیون توکن ورودی کش-نخورده و 0.28 دلار به ازای هر میلیون خروجی شناخته شده بود. این زمینه تاریخی است، نه نرخی که امروز بتوانید در برابر آن صورتحساب صادر کنید.
تغییر مخرب شایسته هشدار جداگانه است. DeepSeek-V4.1-Flash نامهای نقطه پایانی deepseek-v4-flash و deepseek-v4-flash-vision-exp را به آرامی بازنشسته کرد. آموزشها، پاسخهای Stack Overflow و نمونه کدهای قدیمیتر هنوز به آنها اشاره میکنند و این تماسها اکنون با شکست مواجه میشوند. اگر یکپارچهسازی DeepSeek را که قبل از سپتامبر نوشته شده است، به ارث بردید، قبل از اشکالزدایی هر چیز دیگری، هر دو رشته راgrep کنید.
این بازنشستگی همچنین قویترین استدلال عملی برای وزنهای محلی است: مدلی که روی دیسک شما قرار دارد نمیتواند از زیر یک استقرار نامگذاری مجدد شود.
DeepSeek برنامه اعتبار راهاندازی ارائه نمیدهد
برنامه چت DeepSeek رایگان است. API اینطور نیست و DeepSeek اصلاً برنامه اعتبار راهاندازی اختصاصی ندارد.
دقیق بودن در اینجا مهم است، زیرا این جایی است که اکثر مقالات سهلانگار میشوند:
- برنامه چت مصرفکننده رایگان برای استفاده است
- هیچ سطح رایگان API ذکر شدهای در صفحه قیمتگذاری رسمی DeepSeek وجود ندارد
- ادعای اعتبارات API رایگان برای حسابهای جدید به طور ناسازگار گزارش شده و در صفحه رسمی تأیید نشده است، بنابراین آنها را به عنوان تأیید نشده در نظر بگیرید
- DeepSeek هیچ ردپای اعتبار بنیانگذار، راهاندازی یا تحقیقاتی منتشر نمیکند
نکته آخر یک شکاف واقعی است. یک بنیانگذار میتواند DeepSeek را ارزان اجرا کند، اما نمیتواند آن را رایگان اجرا کند، و نمیتواند آن را با یک کمک هزینه که با ارائهدهندگانی که برنامهها را اجرا میکنند، جبران کند. AI Perks 7.7 میلیون دلار اعتبار را در 194 شرکت ردیابی میکند که ارائهدهندگانی را پوشش میدهد که اعتبار ارائه میدهند.
میزبانان شخص ثالث مسیر دیگر هستند. Baseten ورودی DeepSeek V4.1 Flash را با قیمت 0.30 دلار به ازای هر میلیون لیست میکند و دارای اعتبار آزمایشی 30 دلاری برای فضای کاری جدید است. OpenRouter، Together و Fireworks نیز مدلهای DeepSeek را ارائه میدهند. قبل از بودجهبندی در برابر آنها، هر یک از نرخهای فعلی آنها را خودتان تأیید کنید، زیرا قیمتهای مسیریابی سریعتر از قیمتهای مدل حرکت میکنند.

سوالات متداول
آیا میتوانم DeepSeek را به صورت محلی با Ollama اجرا کنم؟
بله. Ollama یک کپی کوانتیزه شده از وزنها را به دیسک محلی میکشد و یک نقطه پایانی سازگار با OpenAI را در localhost:11434 ارائه میدهد، بنابراین کد موجود فقط نیاز به تغییر URL پایه دارد. قبل از بنچمارک، تأیید کنید که کدام واریانت و کوانتیزاسیون پشت تگ قرار دارند، زیرا ساختارهای محلی و مدل میزبانی شده DeepSeek اغلب یکسان نیستند.
آیا خود-میزبانی DeepSeek ارزانتر از استفاده از API است؟
معمولاً نه. DeepSeek برای هر میلیون توکن خروجی در خارج از اوج 1.98 دلار هزینه دریافت میکند، بنابراین یک دستگاه که یک میلیون توکن خروجی در ساعت ارائه میدهد، حدود 1,425 دلار در ماه را جابجا میکند (محاسبه شده: 1.98 دلار × 24 × 30). ورودی کش شده 0.022 دلار به ازای هر میلیون است که هیچ سختافزاری بر آن غلبه نمیکند. برای اقامتگاه و کنترل، خود-میزبانی کنید. برای هزینه، از اعتبارات AI Perks استفاده کنید.
آیا DeepSeek منبع باز است؟
DeepSeek بهتر از منبع باز به عنوان وزن باز توصیف میشود: فایلهای مدل منتشر شده قابل دانلود و اجرا هستند، که باعث راهاندازی محلی میشود. مخزن مدل خود DeepSeek را بررسی کنید تا تأیید کنید کدام نسل و کدام واریانت واقعاً منتشر شده است، زیرا پرچمدار ارائه شده از طریق API و ساختار قابل دانلود همیشه یکسان نیستند.
چرا تماس API deepseek-v4-flash من کار نکرد؟
DeepSeek-V4.1-Flash نامهای نقطه پایانی deepseek-v4-flash و deepseek-v4-flash-vision-exp را بازنشسته کرد. هر کد یا آموزشی که قبل از سپتامبر 2026 نوشته شده و به آنها ارجاع میدهد، با شکست مواجه خواهد شد. به شناسه مدل فعلی در مستندات API DeepSeek بهروزرسانی کنید. این تغییر نام دلیل خوبی برای تثبیت وزنهای محلی است اگر پایداری برای شما مهم است.
آیا DeepSeek به حسابهای جدید اعتبار API رایگان میدهد؟
هیچ سطح رایگان API در صفحه قیمتگذاری رسمی DeepSeek ذکر نشده است، و گزارشهای اعتبار حساب جدید ناسازگار و تأیید نشده است. DeepSeek همچنین هیچ برنامه اعتبار راهاندازی را اجرا نمیکند. ارائهدهندگانی که این کار را انجام میدهند، با مقادیر فعلی، در AI Perks ردیابی میشوند.
آیا برای اجرای DeepSeek به صورت محلی به GPU نیاز دارم؟
واریانتهای کوانتیزه شده کوچکتر روی CPU اجرا میشوند، اما توان خروجی به اندازهای افت میکند که بیشتر استفادههای تعاملی را غیرممکن میکند. ساختارهای بزرگتر به حافظه شتابدهنده متناسب با اندازه و کوانتیزاسیون خود نیاز دارند. به جای اعتماد به یک الزام کلی، کارت مدل را برای تگ خاص بررسی کنید و انتظار داشته باشید که شکاف واقعی بین "بارگذاری" و "قابل استفاده" وجود داشته باشد.
DeepSeek به شما یک انتخاب واقعی میدهد: یک API میزبانی شده که بر اساس ساعت و کش قیمتگذاری شده است، یا همان خانواده وزنها روی سختافزاری که شما کنترل میکنید. زمانی که به کنترل نیاز دارید، کنترل را انتخاب کنید. زمانی که به توان خروجی نیاز دارید، API را انتخاب کنید، و صورتحساب را با اعتبارات ارائهدهندگانی که هنوز آنها را رایگان میدهند، پوشش دهید.
در getaiperks.com مشترک شوید →
آن را خودتان اجرا کنید یا اجاره کنید. به هر حال، پرداخت کامل در getaiperks.com را متوقف کنید.