مدل جدید هوش مصنوعی DeepSeek Flash عملکردی نزدیک به GPT-5.6 Luna را با ۶۰ درصد هزینه کمتر ارائه میدهد
ارزیابی عملکرد و جایگاه نسبت به GPT-5.6 Luna
شرکت دیپسیک نسخه جدید مدل هوش مصنوعی اقتصادی خود را با نام DeepSeek V4 Flash 0731 منتشر کرد. این نسخه نسبت به مدل قبلی که در فروردین ۱۴۰۵ عرضه شده بود، بهبود قابلتوجهی در عملکرد دارد و بر اساس نتایج منتشرشده، هماکنون تنها یک امتیاز با مدل GPT-5.6 Luna از OpenAI فاصله دارد؛ در حالی که هزینه استفاده از آن بهمراتب کمتر است. همچنین، امتیاز این مدل در شاخص Artificial Analysis Intelligence Index از ۴۰ به ۵۰ افزایش یافته و عملکرد آن با GPT-5.6 Luna تنها یک امتیاز تفاوت دارد، امتیازی که نشاندهنده جلوهای قابلتوجه در رقابت میان مدلهای اقتصادی و پیشرفته است.
کاهش هزینه و بهبود کارایی
بر اساس دادههای منتشرشده، هزینه اجرای وظایف با DeepSeek V4 Flash حدود ۶۰ درصد کمتر از مدل اقتصادی OpenAI گزارش شده است. در عین حال، OpenAI پیشتر قیمت این مدل را حدود ۸۰ درصد کاهش داده بود. یکی از دلایل اصلی این اختلاف هزینه، ارائه ۹۸ درصد تخفیف برای Cache است که بهطور قابلتوجهی بالاتر از استاندارد رایج صنعت است. همچنین نسخه جدید برای انجام پردازشها به ۱۲ درصد توکن کمتر نسبت به نسخه قبلی نیاز دارد که میتواند هزینه اجرای درخواستها را کاهش دهد. این مجموعه از اقدامات، DeepSeek V4 Flash را در ارزیابیهای اقتصادی نسبت به رقبای خود از جمله GPT-5.6 Luna برتری میدهد.
عملکرد در آزمونها و کاهش هذیانگویی
دیپسیک اعلام کرده است که نسخه جدید در تمامی دستهبندیهای ارزیابیشده عملکرد بهتری نسبت به مدل قبلی ارائه میدهد و بیشترین پیشرفت در وظایف عاملمحور (Agentic Tasks) مشاهده شده است. در آزمون GDPval، که برای ارزیابی توانایی مدلها در انجام وظایف پیچیده و واقعی محیطهای اداری طراحی شده است، امتیاز مدل از ۱٬۱۸۹ به ۱٬٬۵۵۹ Elo افزایش یافته است. علاوه بر این، گزارشها نشان میدهد میزان هذیانگویی (Hallucination) مدل نسبت به نسخه قبلی کاهش یافته است. این بهبودها نشان میدهد که DeepSeek V4 Flash با بهبود کارایی و کاهش خطاها، گزینه مناسبی برای استفادههای حرفهای محسوب میشود.
ویژگیهای فنی و معماری DeepSeek V4 Flash 0731
مشخصات فنی DeepSeek V4 Flash 0731 به شکل زیر است: تعداد کل پارامترها ۲۸۴ میلیارد، پارامترهای فعال ۱۳ میلیارد، پنجره متنی (Context Window) به اندازه ۱ میلیون توکن. مجوز انتشار این مدل MIT است و وزنهای آن از طریق Hugging Face منتشر شدهاند. دیپسیک اعلام کرده است که معماری مدل نسبت به نسخه قبل تغییری نکرده و همچنان از ۲۸۴ میلیارد پارامتر با ۱۳ میلیارد پارامتر فعال و پنجره متنی یک میلیون توکنی استفاده میکند. این ترکیب فنی، امکان ارائه کارایی قویتر با مصرف بهینهتر منابع را فراهم میکند و به خوانندگان و کاربران حرفهای نشان میدهد که سطح عملکردی که DeepSeek ارائه میدهد، با هزینه کمتری نسبت به رقبا قابل دسترسی است.
چشمانداز استفاده و کاربردپذیری
نسخه DeepSeek V4 Flash 0731 نشان میدهد که دیپسیک همچنان بر ارائه مدلهای هوش مصنوعی با نسبت بالای قیمت به عملکرد تمرکز دارد. با بهبود امتیازهای عملکرد، کاهش مصرف توکن و کاهش نرخ هذیانگویی همراه است و در مقایسه با رقبای همرده مانند GPT-5.6 Luna، هزینه کمتر آن میتواند گزینه جذابی برای توسعهدهندگان و شرکتهایی باشد که به دنبال استفاده از مدلهای قدرتمند با هزینه پایینتر هستند. این وضعیت، DeepSeek را به گزینهای قابلتوجه در بازار مدلهای اقتصادی و متنباز تبدیل کرده است.