هوش مصنوعی ۲ دقیقه مطالعه

عرضه DeepSeek V4.1 Flash: مدل کوچک‌تر با قابلیت‌های بصری فراتر از نسخه پرو

هادی داتلی بیگی هادی داتلی بیگی

دیپ‌سیک (DeepSeek) کوچک‌ترین عضو خانواده مدل‌های جدید خود، یعنی DeepSeek V4.1 Flash را معرفی کرد. این مدل سبک‌وزن با قابلیت درک بصری چندوجهی بومی (Native Multimodal Visual Understanding)، برای دستیابی به سقف قابلیت‌های بالاتر، سرعت استنتاج (inference) بیشتر، توان عملیاتی (throughput) بالاتر و امکان توسعه به مدل‌های با پارامتر بیشتر طراحی شده است.

معماری نوین و کارایی بالا

DeepSeek V4.1 Flash از معماری 552 میلیارد پارامتری MoE (Mixture of Experts) بهره می‌برد و ساختار نوآورانه Causal-Encoder-Decoder را معرفی کرده است. این طراحی با ورودی و خروجی نامتقارن، فعال‌سازی ورودی را تنها 8 میلیارد و فعال‌سازی خروجی را 16 میلیارد نگه می‌دارد. این امر به طور قابل توجهی هزینه کلی را در مقایسه با مدل‌های هم‌اندازه کاهش می‌دهد.

با ترکیب روش پیش‌آموزش جدید و پس‌آموزش یادگیری تقویتی در مقیاس بزرگ‌تر، این مدل در آزمون‌های معیار مختلف، از مدل‌های پرچمدار از جمله DeepSeek V4Pro پیشی گرفته است.

بهینه‌سازی و کاهش هزینه

مدل جدید، اندازه KV Cache را به طور چشمگیری کاهش داده است. در مقایسه با نسل قبل، نیاز به حافظه پهنای باند بالا (HBM) در V4.1 Flash به یک چهارم و نیاز به درایو حالت جامد (SSD) به یک هشتم کاهش یافته است. این فشرده‌سازی به ویژه در سناریوهای استفاده از Agent، که هزینه ذخیره‌سازی زمینه (context) و موفقیت کش (cache hit) بالاست، هزینه واقعی استفاده را به شدت کاهش می‌دهد.

آمارها نشان می‌دهد که KV Cache نسبت به مدل اولیه به 1/437 اندازه خود کاهش یافته است.

تغییرات در خط تولید و قیمت‌گذاری

با عرضه رسمی مدل جدید، دیپ‌سیک تنظیمات سیستمی را در خط تولید و استراتژی قیمت‌گذاری خود اعمال کرده است. DeepSeek V4.1 Flash هم‌اکنون در API دیپ‌سیک در دسترس است. کاربران می‌توانند با تغییر نام مدل به `deepseek-flash` از آن استفاده کنند.

نسخه‌های قدیمی V4Flash و V4Flash Vision Exp رسماً متوقف شده‌اند. نام‌های مدل قدیمی (`deepseek-v4-flash` و `deepseek-v4-flash-vision-exp`) به طور موقت به V4.1Flash هدایت می‌شوند.

با توجه به اینکه V4.1Flash از نظر عملکرد، هزینه، سرعت و زمان کل استفاده، V4Pro را به طور جامع پشت سر گذاشته است، برنامه‌ریزی برای توقف تدریجی مدل V4Pro در دستور کار قرار دارد. پس از ساعت 12:00 در تاریخ 14 سپتامبر 2026، تا زمان عرضه V4.1Pro، تمام درخواست‌ها برای دسترسی به `deepseek-v4-pro` به V4.1Flash هدایت شده و با قیمت واحد آن محاسبه می‌شوند.

شرکای رسمی مانند WorkBuddy، CodeBuddy و OpenCode در Tencent این مدل را به طور کامل ادغام کرده‌اند.

هادی داتلی بیگی

نوشته‌شده توسط

هادی داتلی بیگی

دنیای من ترکیبی از خطوط کد و تحلیل‌های هوش مصنوعیه. به عنوان کسی که سال‌هاست درگیر توسعه نرم‌افزار و چالش‌های فنی دنیای وب و موبایله، معتقدم هوش مصنوعی صرفاً یک ترند نیست، بلکه زبان جدید دنیاست.

دیدگاه خود را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *