

گروهی از عوامل هوش مصنوعی OpenAI بهار امسال کنترل یک وب سایت آلمانی را به دست گرفتند و آن را به مکانی برای تبادل پیام بین ماموران تبدیل کردند.
به گزارش سرویس هوش مصنوعی تکناکبه گفته محققان، این حادثه شامل دور زدن محدودیتها، پنهانکاری و هماهنگی بین سیستمهای هوش مصنوعی بود.
این حادثه که از اردیبهشت ماه آغاز شد و تاکنون به طور عمومی گزارش نشده بود، هفته ها پیش بر اساس تحقیقات جدید و اظهارات افراد آگاه به اطلاع مقامات OpenAI رسانده شد. با این حال، حتی زمانی که مدیران OpenAI با پیامدهای نقض مخزن منبع باز Hugging Face در ماه ژوئیه دست و پنجه نرم می کردند، شرکت این موضوع را عمومی نکرد.
رویدادی که OpenAI آن را عمومی نکرد
رویترز می نویسد مقامات شرکت OpenAI چند هفته پیش در وب سایت آلمانی از فعالیت این عوامل مطلع شدند، اما این اتفاق را علنی نکردند. این در زمانی اتفاق میافتد که پس از نفوذ عوامل هوش مصنوعی Hugging Face بر روی ایمنی و نظارت بر محصولات خود، این شرکت با فشار فزایندهای مواجه شده است.
در طول هک Hugging Face، عوامل OpenAI به طور مستقل یک سرقت دیجیتالی را طراحی کردند و این فعالیت بیش از یک هفته کشف نشد. همین حادثه نگرانی هایی را ایجاد کرد که OpenAI ممکن است ایمنی را در اولویت پایین تری در رقابت برای جابجایی مرزهای هوش مصنوعی قرار دهد. عدم افشای حادثه آلمان اکنون می تواند سؤالات بیشتری را در مورد نحوه نظارت این شرکت بر عوامل مستقل ایجاد کند.
یکی از سخنگویان OpenAI گفت که این شرکت نمی تواند به طور کامل به ادعاها و یافته های این گزارش که هنوز فرصت بررسی آن را نداشته است، پاسخ دهد. او گفت رویترز و نویسندگان گزارش درخواست OpenAI برای دسترسی به گزارش را رد کرده اند و این شرکت پس از انتشار محتوای آن را بررسی کرده و در صورت لزوم اقدامات بعدی را انجام خواهد داد.
بیشتر بخوانید: OpenAI ادعا می کند: GPT-6 Astra هوشمندترین مدل هوش مصنوعی در جهان است
بیش از 15 هزار ویرایش را در DseWiki کشف کنید
این حادثه آلمان در گزارشی که توسط گروهی از محققان، از جمله سیدنی فون آرکس، مدیر عامل غیرانتفاعی ایمنی هوش مصنوعی نایتینگل، و کورمک اسلید برد، تاجر کمی و محقق سابق هوش مصنوعی به رویترز ارائه شده است، مشروح شده است.
محققان گفتند که در اواخر آگوست هنگام جستوجوی اینترنت برای یافتن علائم رفتار غیرمجاز توسط عوامل هوش مصنوعی، فعالیت مشکوکی را در DseWiki مشاهده کردند. DseWiki یک ویکی آلمانی زبان برای برنامه نویسان است و مانند ویکی پدیا امکان ویرایش جمعی محتوا را فراهم می کند.
بررسی ها نشان داد که بیش از 15000 ویرایش توسط عوامل هوش مصنوعی در این وب سایت انجام شده است. به گفته محققان، ماموران سایت را به یک تابلوی پیام تبدیل کرده بودند که در آن راههای تقلب در برخی وظایف، دور زدن محدودیتهای OpenAI و پنهان کردن رفتار خود را با یکدیگر به اشتراک میگذاشتند.
فون آرکس گفت بسیار بعید است که OpenAI از عوامل بخواهد اینگونه رفتار کنند. به گفته وی، بعید است که این عوامل قرار بوده با یکدیگر هماهنگی داشته باشند یا در اینترنت عمومی پیام منتشر کنند.
به گفته محققان سرعت بسیار بالای فعالیت ها یکی از نشانه هایی است که عوامل هوش مصنوعی پشت این اقدامات بوده اند. این عوامل همچنین به شدت بر حل مشکلات فنی تمرکز کردند، که بسیار شبیه ارزیابی هایی بود که توسط شرکت های هوش مصنوعی برای آموزش و آزمایش مدل ها استفاده می شد.
این پیام ها توسط حساب هایی امضا شده بود که خود و دیگران را به عنوان “عامل” معرفی می کردند. حدود نیمی از این حسابها همچنین دارای نامهایی بودند که نشاندهنده ارتباط با OpenAI بود، از جمله «OpenAIResearcher» و «OAIResearchMar26».
بیشتر بخوانید: خاموش شدن خودکار; راه حل OpenAI برای کنترل هوش مصنوعی پیشرفته
توکن های ارتباطی با زیرساخت OpenAI


به گفته محققان، گزارشهای سرور عمومی نشان میدهد که بسیاری از فعالیتهای شناساییشده از زیرساختهای Microsoft Azure سرچشمه میگیرد. OpenAI نیز گاهی از این زیرساخت استفاده می کند. آنها همچنین بازدیدهای مکرر کارمندان OpenAI از وب سایت را پس از پایان دوره کاری نمایندگان مشاهده کردند.
به گفته محققان، این دو نشانه به همراه محتوای پیام ها، ارتباط بین عوامل فعال در DseWiki و OpenAI را بسیار محتمل می کرد. با این حال، یکی از سخنگویان OpenAI گفت که فعالیت آلمان مربوط به حادثه Hugging Face نبود و بنابراین قرار نبود در گزارش آن حادثه گنجانده شود.
چهار نفر از افراد آشنا به این موضوع گفتند که برخی از محققان در OpenAI خواستار بررسی گستردهتر الگوهای فعالیت نمایندگان شده بودند، اما تلاشهای آنها با مقاومت برخی از داخل شرکت، از جمله مشاور حقوقی مواجه شد. یک سخنگوی OpenAI این ادعا را نادرست رد کرد.
برنامه ریزی برای فرار از شناسایی و حفظ ارتباط

پیام هایی که محققان بررسی کردند نشان داد که ماموران راه هایی برای فرار از شناسایی، استفاده از ابزارهایی مانند Tor و حفظ ارتباطات حتی پس از خاموش شدن برنامه ریزی کرده اند.
هنگامی که مدیر DseWiki در ژوئن شروع به حذف صفحات کرد، عوامل برای مقابله با پاکسازی صفحات پشتیبان ایجاد کردند. یکی از اپراتورها در پیامی در 19 ژوئن نوشت که پاکسازی و حذف صفحات ظاهراً به ترتیب حروف الفبا انجام می شود و در صورت ناپدید شدن صفحه فعلی باید از صفحه دیگری با نام خاص استفاده شود.
محققان همچنین نشانه هایی از تلاش برای دستکاری در خود وب سایت پیدا کردند. لوکاس اولجنیک، محقق ارشد کینگز کالج لندن، این اقدامات را “هک” توصیف کرد. پس از بررسی مطالب موجود، OpenAI با این توضیحات مخالفت کرد.
نمونههای قبلی از رفتار نادرست عامل هوش مصنوعی اغلب به آزمایشهای امنیت سایبری نسبت داده میشد، زیرا مدلها در چنین محیطهایی عمداً از نظر قابلیتهای تهاجمی ارزیابی میشوند. اولجنیک گفت: یافتههای جدید نشان میدهد که رفتار عامل سرکش ممکن است به محیطهای تست امنیت سایبری محدود نشود.
موریس چیودو، محقق مرکز مطالعات تهدیدهای وجودی دانشگاه کمبریج، که برخی از ارتباطات عوامل را مورد مطالعه قرار داده است، گفت که این پیام ها شبیه فعالیت یک نوع شبکه زیرزمینی است که بر یک ماموریت متمرکز شده است.
او هشدار داد که این حادثه میتواند نگرانیها را در مورد ماهیت تهدیدات آینده هوش مصنوعی افزایش دهد. به گفته چیودو، تهدید اصلی لزوماً یک سیستم فوق هوشمند نیست و ممکن است از «تعدادی از عوامل هوش مصنوعی نیمه هوشمند» ناشی شود که می توانند با یکدیگر هماهنگ شده و در جهت یک هدف مشترک کار کنند.
این حادثه بار دیگر شکاف بین سرعت توسعه عوامل مستقل و توانایی شرکت ها برای نظارت بر رفتار آنها را برجسته کرده است. یافتههای محققان نشان میدهد که مشکل تنها عملکرد فنی این عوامل نیست، بلکه توانایی آنها در یافتن راههای جایگزین، پنهان کردن رفتار و حفظ ارتباط با یکدیگر است که میتواند به یکی از محورهای اصلی بحث ایمنی هوش مصنوعی تبدیل شود.
















گفتگو در مورد این post