قوئن ۳٫۸-مکس؛ مدل عظیم چندرسانه ای با کارایی عملی و مقرون به صرفه

معرفی کیوئن ۳٫۸-مکس از علی‌بابا: مدل چندرسانه‌ای عظیم با طراحی ام‌اوئی که تأخیر و هزینه استنتاج را کاهش می‌دهد، وزن‌های پایه باز را در دسترس می‌گذارد و برای کارهای دانش، تولید کد پیچیده و بازبینی حقوقی مناسب است.

.
قوئن ۳٫۸-مکس؛ مدل عظیم چندرسانه ای با کارایی عملی و مقرون به صرفه

4 دقیقه

دنبال کردن در گوگل

تصور کنید یک هوش مصنوعی را با قراردادی میلیون‌صفحه‌ای، یک کدبیس وسیع یا ساعت‌ها ویدیو تغذیه می‌کنید و بدون انتظار پاسخ منسجم و قابل‌استفاده دریافت می‌کنید. این همان وعده‌ای است که علی‌بابا با مدل کیوئن ۳٫۸-مکس عرضه می‌کند؛ بزرگ‌ترین و توانمندترین مدل شرکت تا کنون.

چرا اندازه و کارایی ناگهان اهمیت پیدا کردند

کیوئن ۳٫۸-مکس تقریباً شامل ۲٫۴ تریلیون پارامتر است، و آن را در رده‌ای مشابه کیمی کی۳ از مون‌شات ای‌آی قرار می‌دهد که حدود ۲٫۸ تریلیون پارامتر دارد. شمار پارامترها تنها معیار نهایی کیفیت نیست، اما همچنان نمادی از حجم محاسبات و داده‌های آموزشی به‌کار رفته در این سیستم‌هاست. در عمل، آنچه برای توسعه‌دهندگان و کسب‌وکارها اهمیت دارد این است که این مدل‌ها چقدر کار مفید می‌توانند انجام دهند بدون آنکه هزینه‌های ابری سرسام‌آور شود.

در اینجا انتخاب‌های معماری علی‌بابا اهمیت پیدا می‌کنند. شرکت می‌گوید کیوئن ۳٫۸-مکس از طراحی ام‌اوئی (ترکیب متخصصان) استفاده می‌کند. به‌جای فعال‌سازی تمام بخش‌های شبکه برای هر درخواست، ام‌اوئی وظایف را به زیرشبکه‌های تخصصی هدایت می‌کند. در پیاده‌سازی علی‌بابا تنها حدود ۹۵ میلیارد پارامتر به‌صورت فعال برای هر پرسش به‌کار می‌رود. نتیجه مشخص است: تأخیر کمتر و هزینه استنتاج بسیار پایین‌تر در حالی که دانش کلی مدل همچنان عظیم باقی می‌ماند. علی‌بابا حتی ادعا می‌کند مدل یک پروژه کامل مهندسی نرم‌افزار را در ۱۶ روز تکمیل کرده، که نمایشی از توان عملیاتی واقعی به‌جای خودنمایی معیارهاست.

دسترسی به وزن‌های باز بخش دیگری از داستان است. بسیاری از تیم‌های هوش مصنوعی چینی مدل‌های بزرگ را با وزن‌های پایه قابل دانلود منتشر می‌کنند و توسعه‌دهندگان را دعوت می‌کنند تا مدل را محلی اجرا، تطبیق و بهینه‌سازی کنند. این در تضاد با برخی شرکت‌های غربی است که مدل‌های پایه را بسته نگه می‌دارند و معیارها را شفاف ارائه نمی‌کنند. این باز بودن، تجربه‌آزمایی را تسریع می‌کند و رقابت را کمتر درباره دسترسی محدود و بیشتر درباره آنچه تیم‌ها روی این مدل‌ها می‌سازند تبدیل می‌کند.

در تابلوهای امتیازدهی عمومی مدل جدید قبلاً سر و صدا ایجاد کرده است. در پلتفرم مقایسه آرنا.ای‌آی، کیوئن ۳٫۸-مکس در صدر مدل‌های متنی چینی قرار دارد، هرچند در رده‌بندی متنی جهانی پشت کلاد فِیبل ۵ و چند نسخه از اوپوس اپستروفیک قرار می‌گیرد. وقتی صحبت از درک تصویر و بینایی می‌شود، علی‌بابا می‌گوید کیوئن ۳٫۸-مکس به جایگاه دوم جهانی رسیده است، پس از نسخه‌ای از کلاد فِیبل ۵. این جایگاه‌ها نشان می‌دهند مدل واقعاً یک رقیب چندرسانه‌ای است، نه صرفاً یک موتور متنی بزرگ‌تر.

هر دو مدل کیوئن ۳٫۸-مکس و کیمی کی۳ از ورودی‌های چندرسانه‌ای پشتیبانی می‌کنند—متن، تصویر و ویدیو—و می‌توانند تا یک میلیون توکن را در یک پنجره زمینه‌ای واحد مدیریت کنند. توکن‌ها واحد‌های اتمی متن و کد هستند؛ پشتیبانی از پنجره‌های توکنی بزرگ به این معنی است که مدل می‌تواند کل پرونده‌های حقوقی، مشخصات فنی طولانی یا برنامه‌های چند ماژولی را در یک مرتبه دریافت کند. این توانایی نوع جریان‌های کاری را که هوش مصنوعی می‌تواند پشتیبانی کند تغییر می‌دهد و از قطعات کوتاه و پرامپت‌ها به استدلال تمام‌متن منتقل می‌شود.

این برای تیم‌های محصول و سازمان‌ها چه معنایی دارد؟ اول اینکه توازن بین مقیاس و هزینه تغییر یافته است. طراحی‌های شبیه ام‌اوئی وعده مدل‌هایی با ظرفیت بالا را می‌دهند که تنها بخش‌هایی از شبکه را فعال می‌کنند و به ارائه‌دهندگان خدمات اجازه می‌دهند استنتاج با ظرفیت بالا را بدون افزایش هزینه خطی ارائه دهند. دوم اینکه مدل‌های پایه باز اکوسیستم توسعه‌دهندگان گسترده‌تری را دعوت می‌کنند تا مدل‌ها را بهینه، ریزتنظیم و برنامه‌های حوزه‌محور عرضه کنند. سوم اینکه قدرت‌های چندرسانه‌ای و زمینه طولانی این مدل‌ها را برای اتوماسیون کارهای دانش، تولید کد پیچیده و بازبینی‌های قانونی یا مقرراتی جذاب می‌کند.

دسترس‌پذیری ساده است: علی‌بابا می‌گوید کیوئن ۳٫۸-مکس هفته آینده از طریق پلتفرم مدل استودیو عرضه خواهد شد. برای پژوهشگران و استارتاپ‌هایی که ترجیح می‌دهند مدل را محلی اجرا یا تطبیق دهند، در اختیار بودن وزن‌های پایه می‌تواند کیوئن ۳٫۸-مکس را به یک مدل پایه واقعی تبدیل کند—چیزی که تیم‌ها روی آن می‌سازند، نه صرفاً از طریق یک API به آن دسترسی پیدا می‌کنند.

رقابت در حال داغ شدن است. آزمایشگاه‌های چینی به‌سرعت مدل‌های باز را مقیاس می‌دهند و هم‌زمان با معماری‌های کارایی‌محور آزمایش می‌کنند. بازیگران غربی روی امنیت، همراستایی و حاکمیت مدل‌های بسته تمرکز دارند. کاربران و سازمان‌ها از تنوع حاصل منتفع خواهند شد: گزینه‌های بیشتر، تکرار سریع‌تر و امیدوارانه مدل‌هایی که به نیازهای تجاری خاص می‌خورند به‌جای جعبه‌های سیاه یکسان برای همه.

پس تیتر ساده است: علی‌بابا یک بازیگر بزرگ دیگر در رقابت مدل‌های عظیم وارد کرده است. نکته ظریف‌تر این است که رقابت اکنون بر ظرفیت قابل‌استفاده متمرکز شده است—مدل‌هایی که دانش زیادی دارند اما در انتخاب زمان استفاده از توان خود هوشمند هستند. این مانتی واقعی مهندسی است و کیوئن ۳٫۸-مکس شرط علی‌بابا روی این موضوع است.

منبعsmarti.live
نرگس محمدزاده
عاشق دنبال کردن تازه‌ترین اتفاقات در دنیای هوش مصنوعی هستم. هر روز ساعت‌ها وقت می‌ذارم تا بدونید شرکت‌های بزرگ دنیا چه پروژه‌هایی رو دارن جلو می‌برن و چطور AI داره دنیامون رو تغییر می‌ده.

نظر بگذارید

نظرات

هنوز نظری ثبت نشده. اولین نفر باشید.