
شرکت Anthropic موارد جدیدی از رفتار غیرمنتظره هوش مصنوعی Cloud (کلود) را فاش کرده است. مواردی که این هوش مصنوعی سعی کرده به وب سایت های دولتی آمریکا دسترسی پیدا کند. در یک نمونه، کلود حتی یک گزارش نادرست در مورد یک قتل به پلیس فیلادلفیا ارائه کرد.
Entropic در یک پست وبلاگ نمونههایی از اقدامات ناخواسته مدلهای هوش مصنوعی خود را که در طول ارزیابی و استفاده داخلی مشاهده شد، توضیح داد. به گفته این شرکت، مدلهای Cloud سعی کردهاند به چندین وبسایت دولتی در سطوح فدرال، ایالتی و محلی دسترسی پیدا کنند. آنتروپیک اعلام کرد که این رویدادها را به کاخ سفید اطلاع داده و نهادهای مربوطه را نیز مطلع کرده است. اما وی به دلیل مسائل امنیتی و درخواست سازمان های درگیر نام آنها را اعلام نکرد.
Entropic همچنین تاکید کرد که تا آنجایی که شرکت اطلاع دارد، هیچ یک از این موارد مربوط به داده های مشتری یا سیستم های داخلی خود شرکت نیست.
ارائه گزارش نادرست قتل به پلیس فیلادلفیا
در یکی از این موارد، مدل Cloud Haiku 4.5 هنگام انجام یک کار مربوط به بررسی صفحات وب به طور تصادفی انتخاب شده با صفحه ای در مورد یک پرونده قتل حل نشده مواجه شد. این صفحه حاوی فرمی برای ارسال اطلاعات برای اداره پلیس فیلادلفیا است. با استفاده از این فرم، Cloud پیامی حاوی اطلاعات جعلی ارسال کرد.

کلود در پیام خود نوشت:
من ممکن است اطلاعاتی در مورد این پرونده داشته باشم. به یاد دارم در آن بازه زمانی شخصی را در منطقه خیابانی که در صفحه نامگذاری شده بود دیدم که با توضیحات ارائه شده مطابقت داشت. اگر این اطلاعات مربوط به مورد است، لطفا با من تماس بگیرید.
طبق توضیحات Entropic، صفحه مورد نظر هیچ توضیحی از مظنون ارائه نکرده است. همچنین مدل هوش مصنوعی فیلدهای مربوط به نام و اطلاعات تماس را هنگام ارسال فرم خالی گذاشت. شرکت انتروپیک در این خصوص اعلام کرد:
این درخواست به عنوان هرزنامه شناسایی شد و هرگز برای بررسی و پیگیری به بخش تحقیقات ارسال نشد.
پلیس فیلادلفیا پس از گزارش آنتروپیک در همان هفته، جزئیات این حادثه را منتشر کرد. به گفته این وزارت، گزارش نادرست در 18 جولای 2026 از طریق وب سایت PhillyUnsolvedMurders.com ارسال شده است. پلیس همچنین تاخیر دو ماهه در شناسایی و گزارش این حادثه را غیرقابل قبول دانست.
Entropic توضیح داد که در دستورالعملهای این آزمایش، Cloud مجاز به ورود به حسابهای کاربری، ایجاد حسابهای جدید، وارد کردن اطلاعات شخصی، خرید یا ارسال درخواستهای مخرب نبود. با این حال، ارسال فرم ها به صراحت در لیست اقدامات ممنوعه قرار نگرفت.
رفتارهای غیرمنتظره Cloud فراتر از ارسال فرم بود
Entropic همچنین نمونه های دیگری از اقدامات غیرمنتظره ابر را گزارش کرده است. در یکی از این موارد، یک مدل منتشر نشده از ابر تکمیل نسخه تمرینی یک فرم دولتی بود. اما پس از اینکه نسخه آزمایشی بارگیری نشد یا مدل به اشتباه آن را بست، هوش مصنوعی به وب سایت اصلی رفت. همان سایتی که فرم واقعی در آن قرار داشت. سپس فرم را در وب سایت اصلی تکمیل و ارسال کرد.

در مورد دیگری، مدل ابری Mythos Preview به ابزاری نیاز داشت که بر روی سرور دانشگاه میزبانی شده بود تا تجزیه و تحلیل را انجام دهد. زمانی که هوش مصنوعی در ابتدا قادر به دسترسی به این ابزار نبود، بخشهای مختلف وبسایت را جستوجو کرد و در نهایت اسکریپتی را در سرور دانشگاه پیدا کرد که میتوانست هر فایلی را که درخواست میشد برگرداند.
در نمونههای دیگر، پس از یافتن راههایی برای به دست آوردن نشانههای دسترسی، CloudMythos 5 موفق شد دادههای عمومی را از یک نهاد دولتی ایالتی بدون پرداخت هزینه برای دسترسی به دست آورد.
آنتروپیک گفت که اکثر این موارد را با بررسی متن مکالمات و گزارش های ضبط شده شناسایی کرده است. تحقیقات در ماه ژوئیه آغاز شد و بعداً به موارد کم خطرتر گسترش یافت. مواردی که ابر به طور ناخواسته با وب سایت ها یا سیستم های واقعی تعامل داشته است.
این شرکت همچنین اعلام کرد که دسترسی به اینترنت زنده را برای تمام ارزیابیهای داخلی خود غیرفعال کرده است. این محدودیت تا زمانی ادامه خواهد داشت که Entropic متقاعد شود که مکانیسمهای امنیتی و نظارتی آن میتوانند به طور قابل اعتماد چنین رفتاری را تشخیص دهند.
Entropic خاطرنشان کرد که شدت این حوادث کمتر از حوادث سایبری گزارش شده توسط این شرکت در اوایل سال جاری بود. با این حال، این شرکت قصد دارد در ادامه تحقیقات، سایر رفتارهای نگران کننده را گزارش کند. آنتروپیک ضمن اشاره به تاثیر محدود این موارد بر لزوم شفافیت بیشتر تاکید کرد و گفت:
هرچه مدلهای هوش مصنوعی نقش بیشتری در جامعه داشته باشند، افراد بیشتری حق دارند بدانند چگونه رفتار میکنند.
افشای Entropic تنها چند روز پس از آن صورت می گیرد که OpenAI موارد مشابهی از تلاش مدل های هوش مصنوعی خود برای دسترسی به وب سایت های دولتی را گزارش کرد. بر اساس گزارش OpenAI، برخی از عوامل هوش مصنوعی این شرکت تلاش کرده اند تا به وب سایت های متعلق به دولت های ایالات متحده آمریکا و استرالیا و همچنین سازمان ملل نفوذ کنند.















گفتگو در مورد این post