شواهدی از انتشار قریب الوقوع مدل هوش مصنوعی متن باز OpenAI
شواهد جدید نشان میدهد شرکت OpenAI در آستانه انتشار یک مدل هوش مصنوعی متنباز قدرتمند جدید قرار دارد که احتمالاً رونمایی خواهد شد.
سرنخهای دیجیتالی که توسط توسعهدهندگان با دقت بررسی شدهاند، شامل تصاویری از مخازن مدل با نامهایی مانند yofo-deepcurrent/gpt-oss-120b و yofo-wildflower/gpt-oss-20b بوده است. اگرچه این مخازن اکنون حذف شدهاند، اما حسابهای کاربری مرتبط با اعضای تیم OpenAI شناسایی شدهاند.
برچسب gpt-oss که به نظر میرسد مخفف «نرمافزار متنباز GPT» باشد، مهمترین سرنخ محسوب میشود. این اقدام برای شرکتی که مدلهای سطح بالای خود را به دقت محافظت کرده، تا حدی بازگشت به ریشههای اولیه آن محسوب میشود. وجود نسخههای متعدد با نامهای رمزی و اندازههای مختلف نشاندهنده یک خانواده مدل برنامهریزیشده است که به زودی رونمایی خواهند شد.
این حرکت میتواند تحول بزرگی در دسترسی جامعه توسعهدهندگان به مدلهای پیشرفته هوش مصنوعی ایجاد کند و موازنه قدرت در این صنعت را تغییر دهد.
بررسی فایل پیکربندی درز کرده از مدل احتمالی 120 میلیارد پارامتری OpenAI
به لطف یک فایل پیکربندی که به بیرون درز کرده است، میتوانیم نگاهی به زیر کاپوت مدل احتمالی 120 میلیارد پارامتری بیندازیم. این مدل ظاهراً بر اساس معماری ترکیبی از متخصصان (Mixture of Experts یا MoE) ساخته شده است. تصور کنید نه این که فقط یک مغز یکپارچه که سعی دارد همه چیز را بداند، بلکه شورایی از 128 مشاور متخصص داریم. وقتی پرسشی مطرح میشود، سیستم هوشمندانه 4 متخصص مناسب را انتخاب میکند. این طراحی به مدل امکان میدهد ضمن حفظ دانش گسترده ناشی از پارامترهای عظیمش، سرعت و چابکی یک سیستم بسیار کوچکتر را داشته باشد، چون تنها بخشی از آن در هر لحظه فعال است.
رقابت با غولهای متنباز
این طراحی، مدل متنباز OpenAI را مستقیماً در رقابت با مدلهای محبوبی مانند Mixtral از Mistral AI و خانواده Llama متا قرار میدهد.
مشخصات فنی چشمگیر
و مشخصات فنی به همین جا ختم نمیشود. این مدل ظاهراً از واژگان بسیار گستردهای برخوردار است که آن را برای پردازش طیف وسیعتری از زبانها کارآمدتر میکند. همچنین از مکانیزم تکنیک پردازش متن طولانی (Sliding Window Attention) استفاده میکند که امکان پردازش روان متون طولانی را فراهم میسازد. در عمل، همه این ویژگیها نشاندهنده مدلی است که هم قدرتمند است و هم از نظر اجرایی عملی.
چرا OpenAI چنین حرکتی میکند؟
سالهاست که OpenAI به دلیل فاصله گرفتن از رویکرد متنباز اولیهاش مورد انتقاد قرار گرفته است. انتشار یک مدل قدرتمند با نام gpt-oss میتواند یک اقدام تبلیغاتی بزرگ برای جلب نظر توسعهدهندگان و محققانی باشد که احساس کردهاند عقب ماندهاند.
یک حرکت استراتژیک هوشمندانه
این کار همچنین یک بازی رقابتی زیرکانه است. متا و Mistral نشان دادهاند که چگونه یک اکوسیستم متنباز پررونق میتواند محرک نوآوری باشد. با انتشار چنین مدل متنباز قدرتمندی، OpenAI نه تنها به این رقابت میپیوندد، بلکه تلاش میکند قواعد بازی را بازتعریف کند.
هنوز در حد شایعه؟
تا زمانی که OpenAI به طور رسمی این خبر را تأیید نکند، این موضوع از نظر فنی یک شایعه باقی میماند. اما این یک شایعه مستند است که با کدها و فایلهای پیکربندی پشتیبانی میشود.
یک رویداد تاریخی در راه است
رونمایی از یک مدل MoE متنباز با 120 میلیارد پارامتر از مشهورترین نام در حوزه هوش مصنوعی، بدون شک یک رویداد تاریخی خواهد بود و به نظر میرسد این رویداد به زودی اتفاق خواهد افتاد.