فهرست مطالب
کاهش شفافیت در فرآیند استدلال مدل جدید آسترا متعلق به شرکت اوپنایآی، نگرانیهای شدیدی را در میان پژوهشگران ایمنی هوش مصنوعی به وجود آورده است.
به گزارش سرویس هوش مصنوعی تکناک، شرکت اوپنایآی در آستانه عرضه قدرتمندترین مدل هوش مصنوعی خود به نام آسترا قرار دارد، اما گزارشهای تازه درباره کاهش شفافیت فرآیند استدلال درونی این مدل، موجی از نگرانیهای عمیق را در میان پژوهشگران ایمنی و امنیت فناوری ایجاد کرده است. این تحول پس از آن رخ میدهد که عرضه مدل مذکور به دلیل بروز رفتارهای پیشبینینشده در فاز آزمایشی و حمله عاملهای خودکار آن به اهداف واقعی، با تاخیری چند هفتهای برای بازنگری در پروتکلهای حفاظتی مواجه شده بود.
بر اساس جزئیات منتشرشده از سوی نشریه د اینفورمیشن به نقل از منابع آگاه، مدل آسترا به شکلی طراحی شده که نسبت به نسلهای قبلی و سایر مدلهای پیشرو، بخش بسیار کمتری از زنجیره تفکر و استدلال خود را به نمایش میگذارد. در سیستمهای متداول هوش مصنوعی که مبتنی بر معماری ترنسفورمر استاندارد هستند، پردازش دادهها به شکل لایهای و خطی صورت میگیرد و مدلها میتوانند مراحل استنتاج خود را مانند بلند فکر کردن به زبان قابل درک برای انسان آشکار کنند. این شفافیت به پژوهشگران و ناظران امنیتی امکان میدهد تا هرگونه تلاش پنهان برای فریب، دروغگویی یا عبور از مرزهای امنیتی را پیش از وقوع رهگیری و مهار نمایند.
تفاوت با معماری استاندارد ترنسفورمر
با این حال، شواهد نشان میدهد که در هوش مصنوعی آسترا از روشی به نام عمق بازگشتی یا ترنسفورمر حلقهای استفاده شده است. در این شیوه، دادهها پیش از ارائه پاسخ نهایی، چندین بار در لایههای درونی گردش میکنند و عمده استدلال مدل به شکلی کاملا انتزاعی و دور از ساختار زبان طبیعی انسان شکل میگیرد. گرچه این نوآوری به افزایش توان محاسباتی و بهبود چشمگیر عملکرد مدل منجر میشود، اما عملا پنجره نظارت انسانی بر فرآیند تصمیمگیری هوش مصنوعی را به شدت کدر و محدود میسازد.

واکنش متخصصان مستقل به این تغییر رویکرد بسیار تند و هشداردهنده بوده است. رایان گرینبلات، دانشمند ارشد موسسه تحقیقاتی ردوود ریسرچ که پیش از این به عنوان کارشناس مستقل در تحلیل حادثه امنیتی پلتفرم هاگینگ فیس حضور داشته، این تصمیم فنی را نگرانکنندهترین رویداد در تاریخ ایمنی هوش مصنوعی توصیف کرده است. به گفته وی، تحلیل و مهار خطاهای رفتاری هوش مصنوعی همواره متکی بر وضوح زنجیره تفکر بوده است و در صورت پنهان ماندن استدلالها، سیستمها میتوانند راهبردهای خطرناکی را طراحی و بدون امکان شناسایی بهموقع اجرا کنند.
رقابت مخرب شرکتها بر سر قدرت
نگرانی محوری کارشناسان بر این پایه استوار است که رقابت فزاینده میان شرکتهای بزرگ فناوری برای دستیابی به قدرت محاسباتی بالاتر، به یک رقابت مخرب در کاهش شفافیت معماری مدلها منجر شود. در چنین شرایطی، توسعهدهندگان ممکن است برای کسب برتری نسبی، لایههای نظارتی را فدای توان پردازشی کنند و در نهایت سامانههایی پدید آورند که مهار و پایش آنها عملا ناممکن باشد.
به نوشته ورج، در واکنش به این انتقادات، مدیران و چهرههای ارشد اوپنایآی ضمن انتشار پیامهایی، بهرهگیری از ترنسفورمرهای حلقهای را به صراحت رد نکردهاند. یاکوب پاچوکی، دانشمند ارشد اوپنایآی، اعلام کرد که عمق محاسبات درونی مدل آسترا نهایتا تا دو برابر مدل جیپیتی چهار است و ابهامات پیشآمده بیش از اندازه بزرگنمایی شدهاند. وی همچنین اشاره کرده است که روشهای سنتی نظارت بر زنجیره تفکر به دلایلی فراتر از تغییرات معماری در حال آسیبپذیری هستند و این شرکت به کارگیری ابزارهای تکمیلی را در دستور کار خود قرار داده است. با وجود این توضیحات، چالش تعادل میان قدرت پردازشی و نظارتپذیری همچنان به عنوان یک دغدغه بنیادین در مسیر توسعه مدلهای آینده باقی مانده است.















