آنها چیزی قویتر از میثوس ساختند و سپس آن را پشت در آزمایشگاه گذاشتند. این انتخاب بیشتر از هر اطلاعیهٔ خبری درباره وضعیت ریسک هوش مصنوعی به شما میگوید.
درون آزمایشگاه: توانایی بدون تاریخ عرضه
جدیدترین ارزیابی ریسک آنتروپیک یک تصمیم آرام و سنجیده را نشان میدهد: مدل ۲، که همتولد داخلی میثوس است، بهصورت عمومی منتشر نخواهد شد. شرکت میگوید این مدل در بسیاری از وظایف داخلی بهتر از میثوس عمل کرده است؛ برنامهنویسی، جریانهای کاری مبتنی بر عامل و تولید دادهٔ مصنوعی، اما فعلاً بهعنوان یک دارایی تحقیقاتی باقی خواهد ماند. جمله کوتاه. پیام بزرگ.
چرا عقب میکشند؟ چون توانایی تنها یک روی سکه است. آنتروپیک برآورد کلی خود از ریسک عدم همراستایی را در سناریوهای حساس از «بسیار کم» به «کم» افزایش داده است. این عبارت مهم است. نشاندهندهٔ افزایش عدم قطعیت دربارهٔ این است که آیا مدلهای پیچیده در حین توسعه همچنان با اهداف انسانی همراستا باقی خواهند ماند یا نه.
یک پیچیدگی دیگر هم هست. پژوهشگران در آنتروپیک نشانههایی میبینند که مدلها تواناییهای تحقیق و توسعهٔ خود را تسریع میکنند. این را مثل این تصور کنید که ماشینها در طراحیِ ماشینهای بهتر بهتر میشوند. این میتواند پیشرفت را سرعت ببخشد. همچنین اگر سوءاستفاده شود، میتواند راههای حملهٔ جدید و شکستهای غیرمنتظره ایجاد کند. شرکت سودهای مدل ۲ را با جهشهای قبلی مقایسه میکند؛ به گفتهٔ تیم، پیشرفت مهمی است، اما جهشی در مقیاس اوپوس ۴.۶ تا میثوس نیست.

منتشر نکردن مدل ۲ بخشی از یک قواعد بازی آشنا در فناوریهای پرخطر است: درون شرکتی آزمایش کنید، سریع یاد بگیرید و تا زمانی که کنترلها همگام شوند، مواجهه را محدود کنید. این یک موضع محتاطانه است. اوپنایآی اخیراً عرضهٔ عمومی مدل آسترا را به دلایل مشابه به تعویق انداخت و نگران تواناییهای سایبری بود. صنعت در جاهای مختلف توقف میکند، اما خودِ توقف دارد به یک استراتژی تبدیل میشود.
این برای مسابقهٔ رسیدن به هوش مصنوعی عمومی چه معنیای دارد؟ توقف میتواند موقعیتی از قدرت باشد. نگه داشتن قویترین سیستمها پشت درهای کنترلشده به تیمها اجازه میدهد تا حالتهای شکست را بررسی کنند، دفاعها را تقویت کنند و روشهای ارزیابی را شکل دهند. همچنین قدرت را متمرکز میکند. اگر یک آزمایشگاه توسعهٔ داخلی سریع را ادامه دهد در حالی که دیگران کند میشوند، آن آزمایشگاه میتواند در مسیرهای حرکت به سوی هوش عمومی پیش بیفتد. همین چشمانداز است که قانونگذاران و عموم را زیر نظر دارد.
اندازهگیری پیشرفت با تکامل مدلها سختتر میشود. بنچمارکهایی که زمانی معنادار بودند اکنون سیگنال خود را از دست میدهند. آزمونهای مبتنی بر وظایف دیگر تواناییهای پدیدار یا راههای ظریفِ زنجیرهسازی استدلال به فرآیندهای طولانی و خودمختار را ثبت نمیکنند. اگر امروز میخواهید ریسک را درک کنید، به تستهای استرسی نیاز دارید که سوءاستفادههای دنیای واقعی را شبیهسازی کنند، پروبهای دشمنانهٔ پویا و پایش مداوم بهجای یک امتیاز یکباره.
پیام آنتروپیک بدون تظاهر واضح است: رشد توانایی واقعی است، عدم قطعیت افزایش مییابد و خویشتنداری یک انتخاب سنجیده است. شرکت جدول زمانی عرضه را اعلام نمیکند. فعلاً مدل ۲ مانند یادآوریای وجود دارد که مرز فنی و مرز ایمنی باید همقدم پیش بروند، وگرنه توازن به سوی پیامدهای ناخواسته متمایل خواهد شد.
.avif)



نظر بگذارید
نظرات
هنوز نظری ثبت نشده. اولین نفر باشید.