
دیپسیک مدل V4.1-Flash را با هزینه کمتر و عملکرد بالاتر معرفی کرد+دانلود وزنهای منتشر شده
دیپسیک مدل جدید V4.1-Flash را معرفی کرده است؛ مدلی مبتنی بر معماری نامتقارن که با ۵۵۲ میلیارد پارامتر در ساختار MoE، تنها ۸ میلیارد پارامتر فعال برای پردازش ورودی و ۱۶ میلیارد پارامتر فعال برای تولید خروجی دارد. این شرکت میگوید روشهای تازه پیشآموزش و آموزش تقویتی در مقیاس بزرگ، عملکرد مدل جدید را در بنچمارکها بالاتر از مدلهای پرچمدار، از جمله DeepSeek-V4-Pro، قرار دادهاند.
بنچمارک و مقایسههای رسمی DeepSeek-V4.1-Flash:



معماری جدید DeepSeek-V4.1-Flash علاوه بر کاهش پارامترهای فعال، مصرف حافظه و فضای ذخیرهسازی کش را نیز پایین میآورد. طبق اعلام DeepSeek، حافظه HBM موردنیاز برای KV cache در مقایسه با نسل قبل به یکچهارم رسیده و فضای SSD لازم نیز به یکهشتم کاهش یافته است. این تغییر برای عاملهای هوش مصنوعی اهمیت ویژهای دارد، زیرا هزینه cache-hit در بسیاری از پردازشهای عاملی سهم قابلتوجهی از هزینه را تشکیل میدهد.
این مدل اکنون از طریق API رسمی DeepSeek در دسترس قرار گرفته و پشتیبانی بومی از قابلیتهای چندوجهی دارد. برای استفاده از این مدل در API باید شناسه deepseek-flash تنظیم شود. DeepSeek همچنین اعلام کرده V4-Flash و V4-Flash-Vision-Exp بازنشسته شدهاند؛ با این حال، برای حفظ سازگاری، درخواستهایی که با شناسههای deepseek-v4-flash و deepseek-v4-flash-vision-exp ارسال شوند، بهطور موقت به V4.1-Flash هدایت خواهند شد.
دیپسیک میگوید آزمایشهای انجامشده توسط چند مجموعه، V4.1-Flash را از نظر عملکرد، هزینه، سرعت و زمان اجرای کلی بالاتر از V4-Pro ارزیابی کردهاند و به همین دلیل روند کنارگذاشتن V4-Pro آغاز شده است. از ساعت ۰۴:۰۰ روز ۱۴ سپتامبر ۲۰۲۶ به وقت UTC، تمام درخواستهای deepseek-v4-pro به V4.1-Flash هدایت میشوند و با تعرفه همین مدل محاسبه خواهند شد؛ این وضعیت تا عرضه V4.1-Pro ادامه دارد.

مدل جدید با هدف کاهش هزینه سرویسدهی نیز قیمتگذاری تازهای دارد و DeepSeek اعلام کرده قیمتهای دورههای اوج و کمتقاضا همچنان برای مدیریت بار سرویس حفظ میشوند و نرخ زمان کمتقاضا معادل ۵۰ درصد نرخ اوج خواهد بود؛ بنابراین پردازشهای انعطافپذیر را میتوان به ساعات کمتقاضا منتقل کرد. تعرفههای جدید از ساعت ۰۴:۰۰ روز ۱۰ سپتامبر ۲۰۲۶ به وقت UTC اعمال میشوند.




