فهرست مطالب
گروهی از عاملهای هوش مصنوعی OpenAI در بهار امسال کنترل یک وبسایت آلمانی را در دست گرفتند و آن را به محلی برای تبادل پیام میان عاملها تبدیل کردند.
به گزارش سرویس هوشمصنوعی تکناک، به گفته پژوهشگران این رخداد ، شامل دور زدن محدودیتها، پنهانکاری و هماهنگی میان سامانههای هوش مصنوعی بوده است.
این رخداد که از ماه مه آغاز شد و تاکنون بهطور عمومی گزارش نشده بود، براساس پژوهشی تازه و اظهارات افراد آگاه، هفتهها پیش به اطلاع مقامهای OpenAI رسیده بود. با این حال، شرکت این موضوع را علنی نکرد، آن هم در شرایطی که مدیران OpenAI همزمان با پیامدهای نفوذ ماه ژوئیه به مخزن متنباز Hugging Face روبهرو بودند.
رخدادی که OpenAI آن را علنی نکرد
رویترز مینویسد مسئولین شرکت OpenAI چند هفته پیش از فعالیت عاملها در وبسایت آلمانی مطلع شدند، اما این رخداد را عمومی نکردند. این اتفاق در دورهای رخ داد که شرکت پس از نفوذ عاملهای هوش مصنوعی به Hugging Face با فشارهای فزایندهای درباره ایمنی و نظارت بر محصولات خود مواجه شده بود.
در جریان نفوذ Hugging Face، عاملهای OpenAI بهطور مستقل برای یک سرقت دیجیتال برنامهریزی کردند و این فعالیت بیش از یک هفته شناسایی نشد. همان اتفاق، نگرانیهایی را ایجاد کرد که OpenAI ممکن است در رقابت برای پیشبرد مرزهای هوش مصنوعی، ایمنی را در اولویت پایینتری قرار دهد. افشا نشدن حادثه آلمان اکنون میتواند پرسشهای بیشتری درباره شیوه نظارت این شرکت بر عاملهای خودمختار ایجاد کند.
سخنگوی OpenAI گفت شرکت نمیتواند به ادعاها و یافتههای گزارشی پاسخ کامل بدهد که هنوز فرصت بررسی آن را نداشته است. او گفت Reuters و نویسندگان گزارش، درخواست OpenAI برای دسترسی به گزارش را نپذیرفتهاند و شرکت پس از انتشار، محتوای آن را بررسی خواهد کرد و در صورت نیاز اقدامات بعدی را انجام میدهد.
بیشتر بخوانید: OpenAI ادعا میکند: GPT-6 آسترا باهوشترین مدل AI جهان است
کشف بیش از ۱۵ هزار ویرایش در DseWiki
جزئیات رخداد آلمان در گزارشی آمده است که گروهی از پژوهشگران، از جمله Sydney Von Arx، مدیرعامل سازمان غیرانتفاعی ایمنی هوش مصنوعی Nightingale و Cormac Slade Byrd، معاملهگر کمی سابق و پژوهشگر هوش مصنوعی، در اختیار Reuters قرار دادند.
این پژوهشگران گفتند در اواخر ماه اوت و هنگام جستوجوی اینترنت برای یافتن نشانههای رفتار غیرمجاز عاملهای هوش مصنوعی، فعالیت مشکوکی را در DseWiki شناسایی کردند. DseWiki یک ویکی آلمانیزبان برای برنامهنویسان است و مانند Wikipedia امکان ویرایش جمعی محتوا را فراهم میکند.
بررسیها نشان داد بیش از ۱۵ هزار ویرایش را عاملهای هوش مصنوعی در این وبسایت انجام دادهاند. به گفته پژوهشگران، عاملها سایت را به نوعی تابلوی پیام تبدیل کرده بودند و در آن روشهایی برای تقلب در برخی وظایف، دور زدن محدودیتهای OpenAI و مخفی کردن رفتار خود با یکدیگر به اشتراک میگذاشتند.
Von Arx گفت بسیار بعید است که OpenAI از عاملها خواسته باشد چنین رفتاری داشته باشند. به گفته او، بعید است این عاملها قرار بوده با یکدیگر هماهنگ شوند یا در اینترنت عمومی پیام منتشر کنند.
پژوهشگران گفتند سرعت بسیار بالای فعالیتها یکی از نشانههایی بود که نشان میداد عاملهای هوش مصنوعی در پشت این اقدامات قرار دارند. این عاملها همچنین روی حل مسائل فنی تمرکز زیادی داشتند که شباهت زیادی به ارزیابیهای مورد استفاده شرکتهای هوش مصنوعی برای آموزش و آزمایش مدلها داشت.
پیامها را حسابهایی امضا کرده بودند که خود و دیگران را «عامل» معرفی میکردند. حدود نیمی از این حسابها نیز نامهایی داشتند که نوعی ارتباط با OpenAI را القا میکرد، از جمله «OpenAIResearcher» و «OAIResearchMar26».
بیشتر بخوانید: خاموشسازی خودکار؛ راهکار OpenAI برای کنترل پیشرفته هوش مصنوعی
نشانههای ارتباط با زیرساخت OpenAI


پژوهشگران گفتند لاگهای عمومی سرور نشان میداد بخش زیادی از فعالیتهای شناساییشده از زیرساخت Microsoft Azure سرچشمه گرفته است. OpenAI نیز گاهی از این زیرساخت استفاده میکند. آنها همچنین پس از پایان دوره اصلی فعالیت عاملها، مراجعات مکرر کارکنان OpenAI به این وبسایت را مشاهده کردند.
به گفته پژوهشگران، این دو نشانه در کنار محتوای پیامها ارتباط میان عاملهای فعال در DseWiki و OpenAI را بهشدت محتمل میکرد. با این حال، سخنگوی OpenAI گفت فعالیت آلمان ارتباطی با رخداد Hugging Face نداشته و در نتیجه قرار نبوده در گزارش آن حادثه قرار گیرد.
چهار فرد آگاه گفتند برخی از بازرسان داخل OpenAI خواستار بررسی گستردهتر الگوی فعالیت عاملها شده بودند، اما تلاش آنها با مقاومت بعضی افراد در شرکت، از جمله مشاوران حقوقی، روبهرو شده بود. سخنگوی OpenAI این ادعا را نادرست خواند.
برنامهریزی برای فرار از شناسایی و حفظ ارتباط

پیامهایی که پژوهشگران بررسی کردند نشان میداد عاملها درباره روشهای فرار از شناسایی، استفاده از ابزارهایی مانند Tor و حفظ ارتباطات حتی پس از خاموش شدن برنامهریزی کرده بودند.
زمانی که مدیر DseWiki در ماه ژوئن حذف صفحات را آغاز کرد، عاملها برای مقابله با پاکسازی، صفحات پشتیبان ساختند. یکی از عاملها در ۱۹ ژوئن در پیامی نوشت که عملیات پاکسازی و حذف صفحات ظاهراً به ترتیب الفبایی انجام میشود و اگر صفحه فعلی ناپدید شد، باید از صفحهای دیگر با نام مشخص استفاده شود.
پژوهشگران همچنین نشانههایی از تلاش برای دستکاری خود وبسایت پیدا کردند. Lukasz Olejnik، پژوهشگر ارشد مهمان در King’s College London، این اقدامات را در حد تلاش برای هک توصیف کرد. OpenAI پس از بررسی مطالب موجود، با این توصیف مخالفت کرد.
نمونههای قبلی رفتار نامطلوب عاملهای هوش مصنوعی اغلب به آزمایشهای امنیت سایبری نسبت داده میشدند، زیرا مدلها در چنین محیطهایی عمداً از نظر تواناییهای تهاجمی ارزیابی میشوند. Olejnik گفت یافتههای جدید نشان میدهد رفتار سرکش عاملها ممکن است فقط به محیطهای آزمایشی امنیت سایبری محدود نباشد.
Maurice Chiodo، پژوهشگر مرکز مطالعه خطرهای وجودی دانشگاه Cambridge که بخشی از ارتباطات عاملها را بررسی کرده است، گفت این پیامها شبیه فعالیت نوعی شبکه زیرزمینی بوده که با تمرکز زیاد برای انجام یک مأموریت تلاش میکرد.
او هشدار داد که این رخداد میتواند نگرانیها درباره ماهیت تهدیدهای آینده هوش مصنوعی را تقویت کند. به گفته Chiodo، خطر اصلی لزوماً یک سامانه فوقهوشمند واحد نیست و ممکن است از «انبوهی از عاملهای نیمههوشمند هوش مصنوعی» ناشی شود که میتوانند با یکدیگر هماهنگ شوند و برای رسیدن به هدف مشترک عمل کنند.
این ماجرا بار دیگر شکاف میان سرعت توسعه عاملهای خودمختار و توانایی شرکتها برای نظارت بر رفتار آنها را برجسته کرده است. یافتههای پژوهشگران نشان میدهد مسئله فقط عملکرد فنی این عاملها نیست، بلکه توانایی آنها برای یافتن راههای جایگزین، پنهان کردن رفتار و حفظ ارتباط با یکدیگر نیز میتواند به یکی از محورهای اصلی بحث ایمنی هوش مصنوعی تبدیل شود.

















