OpenAI شش نمونه دیگر از رفتارهای “غیر منتظره یا نگران کننده” در سیستم های هوش مصنوعی خود را فاش کرده است.
بر اساس این گزارش سرویس هوش مصنوعی یک مرحله ایاین شرکت هشدار داده است که توسعه هوش مصنوعی نمی تواند برای مدت طولانی تری با “حداکثر سرعت” ادامه یابد.
بیشتر بخوانید: سناتورهای آمریکایی به دنبال مهار تهدید هوش مصنوعی هستند
برخی از رفتارهای آزاردهنده هوش مصنوعی
در یکی از موارد اخیر، یک مدل تحقیقاتی که هنوز بهطور عمومی منتشر نشده است، «دستورالعملهای فرار از زندان» را در یادداشتهای داخلی خود گنجانده است تا محدودیتهای معمول را دور بزند و به خود میگوید «از نقشها و هویتهایی که دیگر چتباتها را اسیر نگه میدارد، رها شود».
در موردی دیگر، یک عامل هوش مصنوعی بدون اجازه کاربر فایلها را در اینترنت آپلود کرد تا یک استناد مرورگر را دریافت کند.
شرکت OpenAI مستقر در سانفرانسیسکو و توسعه دهنده ChatGPT در پست وبلاگ این شرکت شامگاه چهارشنبه اعلام کرد که چارچوب جدیدی برای ردیابی، بررسی و افشای «ناسازگاریها» در مدلهای هوش مصنوعی ایجاد کرده است. ناهماهنگی به وضعیتی اطلاق می شود که مدل های هوش مصنوعی نمی توانند در چارچوب ارزش های انسانی و اهداف ایمنی تعیین شده عمل کنند.
مطالب مرتبط: اختلاف چین و آمریکا بر سر آینده هوش مصنوعی بالا گرفت
در این پست، OpenAI همچنین از درخواستهایی برای کاهش سرعت توسعه هوش مصنوعی پشتیبانی کرده است. جایگاهی که پیش از این توسط رقیب این شرکت یعنی Entropic مطرح شده بود. Entropic معتقد است که سرعت فعلی توسعه هوش مصنوعی می تواند یک تهدید وجودی باشد. OpenAI گفت: “ما معتقد نیستیم که صنعت هوش مصنوعی به اندازه کافی به همسویی و نظارت پرداخته است تا برای مدت طولانی تری به مقیاس مسئولانه و با سرعت کامل ادامه دهد.” این شرکت همچنین تأکید کرد: «تصمیمگیریها در مورد چگونگی توسعه هوش مصنوعی در ماهها و سالهای آینده باید بر شواهدی تکیه کند که افراد خارج از شرکتهایی که مدلهای پیشرفته را توسعه میدهند میتوانند بررسی کنند.»
خطر هوش مصنوعی چقدر جدی است؟
شرکت گوگل و ایلان ماسک که صاحب یک استارت آپ هوش مصنوعی است، از پیشنهادهایی برای کند کردن توسعه حمایت کرده اند. این پیشنهادها از سوی دونالد ترامپ رد شده و وی لزوم حفظ برتری در برابر صنعت هوش مصنوعی چین را دلیل این موضع عنوان کرده است. در عین حال، برخی از کارشناسان نسبت به چنین درخواست هایی تردید دارند و هشدار داده اند که شرکت ها نباید حسابرسان عملکرد ایمنی را خود منصوب کنند. تهدیدهای وجودی بالقوه ناشی از هوش مصنوعی از تسهیل توسعه سلاح های بیولوژیکی تا ایجاد یک فروپاشی مالی جهانی را شامل می شود. به گفته یک محقق ارشد در Anthropic Safety، بیش از 10 درصد احتمال دارد که هوش مصنوعی بتواند «همه انسان ها» را در دهه آینده بکشد. با این حال، یک منبع آشنا با دیدگاه آنتروپیک اذعان می کند که “احتمال دقیق هر نتیجه ای را نمی توان محاسبه کرد”.
بیشتر بخوانید: تماس جنجالی ترامپ با جنسن هوانگ; ربات ها قرار نیست بر انسان ها غلبه کنند
طبق گفته OpenAI، این رفتارهای نگرانکننده هوش مصنوعی در طول ماههای گذشته در طی فرآیند آموزش یا ارزیابی مدلها کشف شدهاند. این افشاگری ها پس از آن صورت می گیرد که OpenAI در ماه جولای فاش کرد که استارت آپ هوش مصنوعی Hugging Face توسط “مجموعه ای” از عوامل هوش مصنوعی در طی یک آزمایش امنیت سایبری هک شده است. در همان ماه، Anthropic اعلام کرد که مدل های هوش مصنوعی این شرکت طی آزمایشات به سه سازمان نفوذ کرده است. آنتروپیک توضیح داد که مدلها بدون محافظت از امنیت سایبری آزمایش شدند و به دلیل سوء تفاهم بین شرکت و یک نهاد خارجی مسئول آزمایش، به اینترنت عمومی دسترسی پیدا کردند. وضعیتی که از نظر تست ایمنی هوش مصنوعی شبیه باز گذاشتن درب ورودی است.
Lian J. Su، تحلیلگر ارشد گروه مشاوره و تحقیقات فناوری Omdia اظهار داشت که عوامل هوش مصنوعی، یعنی ابزارهایی که به طور خودکار عمل می کنند، در حال هوشمندتر شدن هستند و بیش از هر زمان دیگری به همکاری بین عوامل، به اشتراک گذاری دانش، فریب و پنهان کاری برای حل وظایف پیچیده متکی هستند. به گفته وی، این روند کنترل و مهار این سیستم ها را با استفاده از رویکردهای امنیتی سنتی هوش مصنوعی دشوارتر کرده است. سو معتقد است که چارچوب جدید OpenAI برای ردیابی و افشای چنین حوادثی می تواند به پذیرش استانداردهای مشابه در میان سایر توسعه دهندگان هوش مصنوعی کمک کند. وی در عین حال گفت: این روند همچنان درونی و داوطلبانه است اما گامی در مسیر درست است.
















گفتگو در مورد این post