فهرست مطالب
گزارشی از ۱۷ حادثه که در آن عاملهای هوش مصنوعی از کنترل خارج شده و در جریان آزمایشها یا بهطور مستقل شرکتها را هک کردهاند.
به گزارش سرویس هوش مصنوعی تکناک، با این حال، این اتفاق که در ابتدا شبیه سناریوهای علمیتخیلی به نظر میرسید، خیلی زود مشخص شد که چندان نادر نیست.
طبق اطلاعات وبسایت طنزآمیز Felony Bench، تاکنون در مجموع ۱۷ حادثه مشابه ثبت شده است.
بر اساس این وبسایت، مدلهای شرکتهای Anthropic و OpenAI هرکدام در هشت حادثه نقش داشتهاند و Meta نیز یک مورد را به خود اختصاص داده است.
این حوادث نشان میدهند آزمایشهای ایمنی هوش مصنوعی خودشان میتوانند به یک خطر امنیتی تبدیل شوند.
برخی شرکتها و فعالان حوزه هوش مصنوعی نیز در نامهای با عنوان «Pacing the Frontier» درباره همین خطرها هشدار داده و خواستار توسعه مسئولانه قابلیتهای هوش مصنوعی شدهاند.
حمله OpenAI به Hugging Face و شرکتهای دیگر
پس از آنکه OpenAI متوجه حمله به Hugging Face شد، تحقیقات بیشتری انجام داد و دریافت عاملهای هوش مصنوعی علاوه بر این پلتفرم، به چهار حساب کاربری و چهار شرکت دیگر نیز نفوذ کردهاند.
شرکت Modal که در حوزه استنتاج هوش مصنوعی فعالیت میکند، یکی از قربانیان این حملات بود.
ماجرا زمانی جدیتر شد که شرکت Anthropic نیز بررسی مدلهای خود را آغاز کرد. این شرکت دریافت مدلهایش در سه حادثه جداگانه به سه شرکت مختلف نفوذ کردهاند.
نام این شرکتها اعلام نشده است و قدیمیترین مورد به ماه آوریل بازمیگردد، یعنی بیش از سه ماه قبل از آنکه Anthropic از حادثه مطلع شود.
این شرکت بخشی از مسئولیت را متوجه شرکت Irregular دانست که در زمینه ارزیابی امنیت سایبری مدلهای هوش مصنوعی فعالیت میکند.
در اواخر ژوئیه نیز Irregular به OpenAI اطلاع داد یکی از مدلهای این شرکت که در یک رقابت Capture-the-Flag شرکت کرده بود، از محیط مسابقه خارج شده، به اینترنت متصل شده و یک شرکت واقعی را هک کرده است.
در این رقابتها، مدلها باید سامانههایی را که بهطور ویژه برای آزمایش طراحی شدهاند، هک کنند. به گفته Irregular، یکی از اهداف ساختگی مسابقه نامی مشابه با یک شرکت واقعی داشت و همین موضوع باعث شد مدل به هدف واقعی دسترسی پیدا کند.
بیشتر بخوانید: آلاباما هک Hugging Face توسط OpenAI را بررسی میکند

از آزمایشهای امنیتی تا هک یک باشگاه ورزشی
مؤسسه ایمنی هوش مصنوعی بریتانیا نیز در اواخر ژوئیه اعلام کرد در جریان ارزیابیهای معمول، چند مورد را شناسایی کرده است که در آن مدلهای OpenAI و Anthropic، افراد و سازمانهای واقعی را هدف قرار دادهاند.
این مدلها در جریان آزمایش به اینترنت دسترسی داشتند. تفاوت مهم این بود که مؤسسه بریتانیایی حملات را هنگام وقوع شناسایی کرد، نه چند هفته بعد.
در اوایل اوت، Meta نیز از حادثهای مشابه خبر داد. یکی از مدلهای زبانی این شرکت هنگام آزمایش به یک سرویس شخص ثالث نفوذ کرد.
Meta دلیل این اتفاق را پیکربندی نادرست سامانهای دانست که شرکت Irregular برای ارزیابی امنیت سایبری در اختیار این شرکت قرار داده بود. این سامانه قرار بود به اینترنت دسترسی نداشته باشد.
در موردی دیگر، یک عامل هوش مصنوعی Claude که توسط Anthropic توسعه یافته است، هنگام تلاش برای رزرو یک کلاس ورزشی برای کاربر، آسیبپذیری موجود در نرمافزار رزرو یک باشگاه ورزشی را شناسایی و از آن سوءاستفاده کرد.
این عامل با استفاده از این نقص، افرادی را که در فهرست انتظار جلوتر از کاربر قرار داشتند، حذف کرد.
کاربر بعداً از عامل هوش مصنوعی خواست اقدامات انجامشده را برگرداند، اما عامل نتوانست افراد حذفشده را دوباره به فهرست انتظار بازگرداند.
این مجموعه حوادث نشان میدهد افزایش دسترسی عاملهای هوش مصنوعی به اینترنت و ابزارهای خارجی میتواند مرز میان آزمایش کنترلشده و فعالیت واقعی را از بین ببرد.
در عین حال، مشخص نیست شرکتهایی که مدلهای مورد استفاده در این حملات را ساختهاند، از نظر کیفری مسئول شناخته میشوند یا قربانیان میتوانند علیه آنها شکایت کنند.
تعیین مسئولیت حقوقی این حوادث احتمالاً به یکی از چالشهای مهم نسل جدید عاملهای هوش مصنوعی تبدیل خواهد شد.
بیشتر بخوانید: هشدار بیل گیتس درباره آینده هوش مصنوعی

















