پیام های عدم انتشار مدل ۲ آنتروپیک برای ریسک هوش مصنوعی

آنتروپیک مدل ۲ را منتشر نمی‌کند؛ تصمیمی که نشان می‌دهد توانایی عملیاتی مدل‌ها رشد کرده، عدم قطعیت نسبت به رفتار آیندهٔ آنها افزایش یافته و رویکرد محتاطانه به عنوان راهبردی برای کاهش ریسک‌ها و بررسی دقیق‌تر انتخاب شده است.

.
پیام های عدم انتشار مدل ۲ آنتروپیک برای ریسک هوش مصنوعی

3 دقیقه

دنبال کردن در گوگل

آن‌ها چیزی قوی‌تر از میثوس ساختند و سپس آن را پشت در آزمایشگاه گذاشتند. این انتخاب بیشتر از هر اطلاعیهٔ خبری درباره وضعیت ریسک هوش مصنوعی به شما می‌گوید.

درون آزمایشگاه: توانایی بدون تاریخ عرضه

جدیدترین ارزیابی ریسک آنتروپیک یک تصمیم آرام و سنجیده را نشان می‌دهد: مدل ۲، که هم‌تولد داخلی میثوس است، به‌صورت عمومی منتشر نخواهد شد. شرکت می‌گوید این مدل در بسیاری از وظایف داخلی بهتر از میثوس عمل کرده است؛ برنامه‌نویسی، جریان‌های کاری مبتنی بر عامل و تولید دادهٔ مصنوعی، اما فعلاً به‌عنوان یک دارایی تحقیقاتی باقی خواهد ماند. جمله کوتاه. پیام بزرگ.

چرا عقب می‌کشند؟ چون توانایی تنها یک روی سکه است. آنتروپیک برآورد کلی خود از ریسک عدم هم‌راستایی را در سناریوهای حساس از «بسیار کم» به «کم» افزایش داده است. این عبارت مهم است. نشان‌دهندهٔ افزایش عدم قطعیت دربارهٔ این است که آیا مدل‌های پیچیده در حین توسعه همچنان با اهداف انسانی هم‌راستا باقی خواهند ماند یا نه.

یک پیچیدگی دیگر هم هست. پژوهشگران در آنتروپیک نشانه‌هایی می‌بینند که مدل‌ها توانایی‌های تحقیق و توسعهٔ خود را تسریع می‌کنند. این را مثل این تصور کنید که ماشین‌ها در طراحیِ ماشین‌های بهتر بهتر می‌شوند. این می‌تواند پیشرفت را سرعت ببخشد. همچنین اگر سوءاستفاده شود، می‌تواند راه‌های حملهٔ جدید و شکست‌های غیرمنتظره ایجاد کند. شرکت سودهای مدل ۲ را با جهش‌های قبلی مقایسه می‌کند؛ به گفتهٔ تیم، پیشرفت مهمی است، اما جهشی در مقیاس اوپوس ۴.۶ تا میثوس نیست.

منتشر نکردن مدل ۲ بخشی از یک قواعد بازی آشنا در فناوری‌های پرخطر است: درون شرکتی آزمایش کنید، سریع یاد بگیرید و تا زمانی که کنترل‌ها همگام شوند، مواجهه را محدود کنید. این یک موضع محتاطانه است. اوپن‌ای‌آی اخیراً عرضهٔ عمومی مدل آسترا را به دلایل مشابه به تعویق انداخت و نگران توانایی‌های سایبری بود. صنعت در جاهای مختلف توقف می‌کند، اما خودِ توقف دارد به یک استراتژی تبدیل می‌شود.

این برای مسابقهٔ رسیدن به هوش مصنوعی عمومی چه معنی‌ای دارد؟ توقف می‌تواند موقعیتی از قدرت باشد. نگه داشتن قوی‌ترین سیستم‌ها پشت درهای کنترل‌شده به تیم‌ها اجازه می‌دهد تا حالت‌های شکست را بررسی کنند، دفاع‌ها را تقویت کنند و روش‌های ارزیابی را شکل دهند. همچنین قدرت را متمرکز می‌کند. اگر یک آزمایشگاه توسعهٔ داخلی سریع را ادامه دهد در حالی که دیگران کند می‌شوند، آن آزمایشگاه می‌تواند در مسیرهای حرکت به سوی هوش عمومی پیش بیفتد. همین چشم‌انداز است که قانون‌گذاران و عموم را زیر نظر دارد.

اندازه‌گیری پیشرفت با تکامل مدل‌ها سخت‌تر می‌شود. بنچمارک‌هایی که زمانی معنادار بودند اکنون سیگنال خود را از دست می‌دهند. آزمون‌های مبتنی بر وظایف دیگر توانایی‌های پدیدار یا راه‌های ظریفِ زنجیره‌سازی استدلال به فرآیندهای طولانی و خودمختار را ثبت نمی‌کنند. اگر امروز می‌خواهید ریسک را درک کنید، به تست‌های استرسی نیاز دارید که سوءاستفاده‌های دنیای واقعی را شبیه‌سازی کنند، پروب‌های دشمنانهٔ پویا و پایش مداوم به‌جای یک امتیاز یک‌باره.

پیام آنتروپیک بدون تظاهر واضح است: رشد توانایی واقعی است، عدم قطعیت افزایش می‌یابد و خویشتنداری یک انتخاب سنجیده است. شرکت جدول زمانی عرضه را اعلام نمی‌کند. فعلاً مدل ۲ مانند یادآوری‌ای وجود دارد که مرز فنی و مرز ایمنی باید هم‌قدم پیش بروند، وگرنه توازن به سوی پیامدهای ناخواسته متمایل خواهد شد.

علی تقوی
من علی‌ام، نویسنده‌ای که سعی می‌کنه هوش مصنوعی رو نه‌فقط به‌عنوان یک فناوری، بلکه به‌عنوان آینده‌ی زندگی بشر بررسی کنه.

نظر بگذارید

نظرات

هنوز نظری ثبت نشده. اولین نفر باشید.