به گزارش آی سی تی نیوز؛  شرکت دیپ‌سیک در ۹ سپتامبر ۲۰۲۶ (۱۸ شهریور ۱۴۰۵) از مدل جدید خود با نام DeepSeek-V4.1-Flash رونمایی کرد. این مدل که کوچک‌ترین عضو خانواده جدید این شرکت محسوب می‌شود، نه‌تنها از پرچم‌دار قبلی خود یعنی V4-Pro سریع‌تر و ارزان‌تر است، بلکه در بسیاری از آزمون‌های تخصصی نیز از آن پیشی گرفته است. به همین دلیل، دیپ‌سیک تصمیم گرفته پرچم‌دار قبلی را بازنشسته کرده و درخواست‌های کاربران را با هزینه کمتر به این مدل جدید هدایت کند.

معماری نامتقارن؛ ۵۵۲ میلیارد پارامتر با فعال‌سازی ۸ میلیاردی

DeepSeek-V4.1-Flash یک مدل ترکیبی از متخصصان (MoE) با ۵۵۲ میلیارد پارامتر است، اما هنگام پردازش ورودی تنها ۸ میلیارد پارامتر و هنگام تولید خروجی ۱۶ میلیارد پارامتر از این مجموعه عظیم فعال می‌شوند. این معماری نامتقارن، هزینه پردازشی را به‌طور چشمگیری کاهش می‌دهد و سرعت مدل را افزایش می‌دهد.

مهم‌ترین دستاورد فنی این مدل، بهینه‌سازی حافظه موقت است. دیپ‌سیک اعلام کرده که V4.1-Flash در مقایسه با نسل قبلی، تنها به یک‌چهارم حافظه HBM و یک‌هشتم فضای ذخیره‌سازی SSD نیاز دارد. ردپای حافظه کش از ۳,۵۱۴ بایت در هر توکن در نسخه قبلی به ۸۹۰ بایت کاهش یافته است که این کاهش ۷۵ درصدی، به‌ویژه برای وظایف طولانی و پیچیده، مزیت اقتصادی قابل‌توجهی محسوب می‌شود.

عملکرد فراتر از پرچم‌دار قبلی

نتایج بنچمارک‌های منتشرشده نشان می‌دهد که V4.1-Flash در بسیاری از آزمون‌ها از DeepSeek-V4-Pro، پرچم‌دار قبلی این شرکت، پیشی گرفته است. در بنچمارک DeepSWE v1.1 که توانایی مهندسی نرم‌افزار را می‌سنجد، این مدل امتیاز ۷۴.۲ را کسب کرده که بالاتر از GPT 5.6-Sol با امتیاز ۷۳.۰ قرار می‌گیرد و نزدیک به Claude Opus 5 با امتیاز ۷۴.۰ است.

در بنچمارک برنامه‌نویسی رقابتی Codeforces، V4.1-Flash امتیاز ۳۴۷۱ را ثبت کرده که بالاتر از V4-Pro با امتیاز ۳۳۴۸ و نسخه قبلی Flash با امتیاز ۳۲۸۹ است. همچنین در آزمون HLE (آخرین آزمون بششریت) با استفاده از ابزارها، امتیاز ۶۳.۹ را کسب کرده که از V4-Pro با امتیاز ۶۰.۰ فراتر رفته است.

کاهش چشمگیر تعرفه API

دیپ‌سیک هم‌زمان با معرفی این مدل، تعرفه‌های API آن را نیز کاهش داده است. در ساعات کم‌مصرف، هزینه هر یک میلیون توکن ورودی (بدون کش) ۰.۱۵ دلار، خروجی ۰.۶۰ دلار و ورودی کش‌شده تنها ۰.۰۰۳ دلار است. در ساعات اوج مصرف، این تعرفه‌ها دو برابر می‌شوند. کاربران در ساعات کم‌مصرف از تخفیف ۵۰ درصدی بهره‌مند خواهند شد. این قیمت‌ها در مقایسه با مدل‌های رقیب، بسیار رقابتی محسوب می‌شود.

بازنشستگی V4-Pro و هدایت درخواست‌ها

دیپ‌سیک اعلام کرده که از ۱۴ سپتامبر ۲۰۲۶، تمام درخواست‌های ارسال‌شده به مدل DeepSeek-V4-Pro به‌صورت خودکار به V4.1-Flash هدایت می‌شوند و با تعرفه پایین‌تر این مدل جدید محاسبه خواهند شد. این وضعیت تا زمان عرضه نسخه V4.1-Pro ادامه خواهد داشت.

کوی تیانی، رئیس تیم Harness دیپ‌سیک، در شبکه X درباره این تصمیم نوشت: با توجه به اینکه مدل DeepSeek V4.1 Flash در تمام معیارها به‌طور جامع از V4 Pro پیشی گرفته است، مناسب نیست که مدل V4 Pro با عملکرد پایین‌تر را با قیمت بالاتر در اختیار کاربران قرار دهیم.

عرضه وزن‌های باز

وزن‌های این مدل تحت مجوز MIT در Hugging Face منتشر شده است تا توسعه‌دهندگان و محققان بتوانند از آن برای پروژه‌های خود استفاده کنند. عرضه این مدل هم‌زمان با آماده‌سازی دیپ‌سیک برای عرضه اولیه سهام در بازار STAR Market شانگهای انجام شده است.

تحلیل ICTNews

رونمایی از DeepSeek-V4.1-Flash و تصمیم جسورانه این شرکت برای بازنشستگی پرچم‌دار قبلی، نشان‌دهنده یک تغییر پارادایم در صنعت هوش مصنوعی است. اگر تا دیروز مدل‌های «Flash» یا «Mini» به‌عنوان گزینه‌های ارزان‌تر و ضعیف‌تر شناخته می‌شدند، امروز دیپ‌سیک با V4.1-Flash این معادله را برعکس کرده است.

این حرکت می‌تواند فشار رقابتی شدیدی بر سایر شرکت‌های هوش مصنوعی وارد کند. وقتی یک مدل «سبک» از پرچم‌دار گران‌قیمت خود پیشی می‌گیرد، خریداران به‌طور طبیعی این سؤال را می‌پرسند که چرا باید برای مدل گران‌تر هزینه کنند. دیپ‌سیک با این تصمیم، استاندارد جدیدی برای نسبت قیمت به عملکرد در بازار API تعریف کرده است. با توجه به اینکه این مدل برای مخاطب عمومی نیز در دسترس قرار گرفته، می‌تواند گزینه‌ای جذاب برای کاربران عادی و کسب‌وکارهای کوچک باشد.