آنها چیزی قدرتمندتر از میتوس ساختند و سپس آن را پشت درهای آزمایشگاه نگه داشتند. همین انتخاب، بیش از هر بیانیه مطبوعاتی، وضعیت ریسک هوش مصنوعی را آشکار میکند.
درون آزمایشگاه: توانمندی بدون تاریخ انتشار
جدیدترین ارزیابی ریسک آنتروپیک از تصمیمی آرام و حسابشده پرده برمیدارد: مدل ۲، همخانواده داخلی میتوس، بهصورت عمومی منتشر نخواهد شد. این شرکت میگوید این مدل در بسیاری از وظایف داخلی از میتوس بهتر عمل کرده است، از برنامهنویسی و گردشکارهای عاملمحور گرفته تا تولید داده مصنوعی، اما فعلا بهعنوان یک دارایی پژوهشی باقی میماند. جملهای کوتاه. پیامی بزرگ.
چرا باید جلوی انتشار آن را گرفت؟ چون توانمندی فقط یک سوی ماجراست. آنتروپیک برآورد کلی خود از ریسک ناهمراستایی در سناریوهای حساس را از «بسیار پایین» به «پایین» افزایش داده است. همین عبارت اهمیت دارد. این تغییر نشان میدهد عدمقطعیت درباره اینکه مدلهای پیچیده با بزرگتر شدن همچنان همسو با اهداف انسانی عمل کنند، رو به افزایش است.
نکته دیگری هم وجود دارد. پژوهشگران آنتروپیک نشانههایی میبینند که مدلها در حال شتاب دادن به تواناییهای تحقیق و توسعه خود هستند. میتوان آن را اینطور تصور کرد: ماشینهایی که در طراحی ماشینهای بهتر ماهرتر میشوند. این روند میتواند پیشرفت را چند برابر سریعتر کند. اما اگر بهدرستی مدیریت نشود، میتواند مسیرهای تازهای برای حمله و شکستهای پیشبینینشده ایجاد کند. این شرکت دستاوردهای مدل ۲ را با جهشهای قبلی مقایسه میکند و میگوید این پیشرفت مهم است، اما در مقیاس جهش از اوپوس ۴.۶ به میتوس نیست.

منتشر نکردن مدل ۲ بخشی از الگویی آشنا در فناوریهای پرریسک است: آزمایش در محیط داخلی، یادگیری سریع و محدود کردن دسترسی تا زمانی که سازوکارهای کنترلی به سطح لازم برسند. این رویکردی محتاطانه است. اوپنایآی نیز بهتازگی عرضه عمومی مدل آسترا را به دلایلی مشابه به تعویق انداخت و به نگرانیهایی درباره توانمندیهای سایبری اشاره کرد. صنعت در نقاط مختلفی مکث میکند، اما خود این مکث به یک راهبرد تبدیل شده است.
این موضوع برای رقابت بهسوی هوش جامع مصنوعی چه معنایی دارد؟ مکث میتواند نشانهای از قدرت باشد. نگه داشتن قدرتمندترین سامانهها پشت دروازههای کنترلشده به تیمها امکان میدهد حالتهای شکست را بررسی کنند، دفاعها را مستحکمتر سازند و روشهای ارزیابی را شکل دهند. البته این کار قدرت را نیز متمرکز میکند. اگر یک آزمایشگاه توسعه داخلی پرشتاب خود را ادامه دهد، در حالی که دیگران سرعتشان را کم میکنند، همان آزمایشگاه میتواند در مسیرهای منتهی به هوش عمومی جلو بیفتد. دقیقا به همین دلیل است که نهادهای تنظیمگر و افکار عمومی با دقت موضوع را دنبال میکنند.
با تکامل مدلها، سنجش پیشرفت دشوارتر میشود. معیارهایی که زمانی منطقی به نظر میرسیدند، دیگر سیگنال کافی نمیدهند. آزمونهای مبتنی بر وظیفه دیگر نمیتوانند تواناییهای نوظهور یا شیوههای ظریفی را که مدلها از طریق آنها زنجیره استدلال را به فرایندهای طولانیتر و خودمختار تبدیل میکنند، بهخوبی ثبت کنند. اگر امروز میخواهید ریسک هوش مصنوعی را بفهمید، به آزمونهای فشار شبیهساز سوءاستفاده واقعی، بررسیهای خصمانه پویا و پایش مستمر نیاز دارید، نه یک امتیازدهی مقطعی.
پیام آنتروپیک بدون اغراق روشن است: رشد توانمندی واقعی است، عدمقطعیت در حال افزایش است و خویشتنداری یک انتخاب آگاهانه محسوب میشود. این شرکت جدول زمانی برای عرضه اعلام نمیکند. فعلا مدل ۲ یادآور این واقعیت است که مرز فنی و مرز ایمنی باید همزمان پیش بروند، وگرنه توازن بهسوی پیامدهای ناخواسته متمایل خواهد شد.
.avif)



نظر بگذارید
نظرات (3)
خویشتن داری لازمه ولی تمرکز قدرت خطرناکه. کی قراره قوانین و شفافیت بیاد؟ سکوت طولانی فقط فرصت سوءاستفاده میده...
این افزایش ریسک واقعیه یا بیشتر بازی روابطعمومی؟ کسی آمار دقیق و مستند داره که نشون بده چقدر جدیه؟
وااای، واقعاً انتظار نداشتم؛ هم قدرت هست هم نگرانی. نگه داشتن مدل پشت در آزمایشگاه یه پیامه بزرگ اما، آیا کافی؟