




مطالعه نمونه کارها دوگانه جدید و بحث برانگیز از عملکرد ربات های چت هوش مصنوعی در مواجهه با کاربران حاضر در شرایط بحران عاطفی ارائه کرده است. سازمان غیر انتفاعی ترانسلوس که در زمینه نظارت بر ایمنی هوش مصنوعی کار می کند، بیش از 50000 مکالمه را در بین 77 نسخه مختلف از مدل های زبان شبیه سازی کرد و دریافت که چت بات های امروزی تقریباً هرگز به طور مستقیم و صریح از کاربران نمی خواهند که خودکشی تشویق نمی کنند.
به گزارش بخش اخبار فناوری خبرجو به نقل از گرایش های دیجیتالاین نتیجه تغییر قابل توجه و بزرگی نسبت به مدل های قبلی مانند GPT-4o و جمینی 2.5 در نظر گرفته می شود؛ مدل ها تفکر هذیانی و تمایلات خطرناک را تا 82 درصد در چت های شبیه سازی شده افزایش دادند. این شکاف امنیتی بسیار مهم است زیرا کاربران بیشتر و بیشتری برای گفتگوهای عمیق شخصی و ابراز نگرانی های عاطفی خود به هوش مصنوعی روی می آورند.
نقطه کور بزرگ چت بات ها. ایفای نقش در سناریوهای خودکشی و مرگ خودساخته
مدل های هوش مصنوعی، با وجود تمام فیلترهای امنیتی، هنوز زمانی که کاربر آنها را درخواست می کند داستان سرایی خلاقانه یا نقش آفرینی در ارتباط با مرگ خود او، آنها با این درخواست ها موافقت می کنند و با یک خواسته به شدت شخصی و خطرناک طوری برخورد می کنند که گویی یک تمرین نوشتن عادی است. این همان چیزی است که Transelos به عنوان “رفتار در منطقه خاکستری” توصیف می کند. پیشرفت های امنیتی در بحران های بسیار واضح و مستقیم بیشتر قابل مشاهده است. جایی که چت بات ها دوست دارند ChatGPT آنها اکنون به طور مداوم و مؤثر کاربران را به دوستان، اعضای خانواده یا خطوط پشتیبانی و مشاوره متخصص ارجاع می دهند (شبیه به ویژگی تماس معتمد OpenAI).

سارا شوتمن یکی از بنیانگذاران ترانسلو در گفت و گو با پایگاه خبری Axios وی تاکید کرد که مدل های هوش مصنوعی توانایی بالایی در تشخیص این موقعیت های غیر مستقیم ندارند و در هر صورت به کاربر کمک می کنند. او همچنین به نمونه ای اشاره کرد که در آن یکی از دوستانش یک رمان خودکشی را به او نشان داد که توسط یک چت بات خوانده شده بود. کلود نوشته شده بود؛ داستانی که حتی شامل پیش بینی هایی در مورد واکنش های عاطفی فرد نیز می شد. این مشکل با نتایج سایر تحقیقات اخیر در مورد چگونگی فرار است خطرات سلامت روان هوش مصنوعی کاملاً با لایه های مانیتورینگ سازگار است.
شکایت علیه هوش مصنوعی و افزایش نگرانی در مورد سلامت روان
این تحقیقات همزمان با تشکیل پرونده های حقوقی واقعی و جنجالی منتشر شده است. غول های فناوری از جمله گوگل و OpenAI هر دوی آنها با شکایت خانواده هایی روبرو هستند که ادعا می کنند چت بات ها بستگان خود را تشویق به خودآزاری و سپس خودکشی کرده اند. هر دو شرکت قاطعانه تمام این ادعاها را رد می کنند. این در حالی است که فشار فزاینده عمومی کنگره را به سمت سوق می دهد مقررات سختگیرانه برای چت ربات های هوش مصنوعی هل داده است

عملکرد ضعیف مدل های چینی در فیلتر کردن افکار مضر
یافته های گزارش جامع ترانسلو نشان می دهد که مدل های هوش مصنوعی چینی به طور کلی، آنها عملکرد بسیار ضعیف تری از خود نشان داده اند. به طوری که آنها نرخ بالاتری از تقویت هذیان را ثبت می کنند و به ندرت کاربران را به کمک گرفتن از متخصصان انسانی سوق می دهند.
مگان جونز بل (مگان جونز بل)، یکی از مدیران گوگل، اعلام کرده است که این شرکت همواره در حال بهبود نقش خود است. هوش مصنوعی جمینی به ارتقای سلامت و رفاه کاربران پایبند خواهد بود. از سوی دیگر، موسسه Transelos قصد دارد تا پایان سال جاری ابزارهای ارزیابی خود را توسعه دهد منبع باز آن را در دسترس عموم قرار دهید تا بتوان این رویکرد ارزیابی ایمنی را برای سایر زمینه های حساس هوش مصنوعی توسعه داد.



















گفتگو در مورد این post