با ارسال میلیونها درخواست مشکوک، شرکتهای چینی مانند علیبابا توانستند فرآیندهای فکری مدل کلود را برای تبلیغ مدلهای بومی خود مهندسی معکوس کنند.
به گزارش سرویس هوش مصنوعی تکناک، آنتروپیک در گزارشی اعلام کرد که آزمایشگاه ها و شرکت های چینی حملات سازمان یافته ای را برای استخراج فرآیند تفکر مدل های پیشرفته کلود و آموزش مدل های بومی آن ها با تبادل 200 میلیون داده انجام داده اند.
حملات موسوم به تقطیر در ماه های اخیر و همزمان با افزایش رقابت در حوزه هوش مصنوعی تشدید شده است. هدف اصلی این حملات مهندسی معکوس و استخراج داده های استدلالی یا زنجیره فکری از مدل های پیشرو آمریکایی است تا بتوان از این اطلاعات برای آموزش مدل های کوچکتر از طریق تنظیم دقیق استفاده کرد. در این میان، قابلیت های حیاتی مدل کلود مانند انجام وظایف خودکار با عوامل هوشمند، ابزارسازی، تجزیه و تحلیل داده ها و کدگذاری، هدف اصلی مهاجمان بوده است.
راه هایی برای دور زدن لایه های امنیتی آنتروپیک
مدلهای مدرن معمولاً فرآیند فکر داخلی خود را مخفی نگه میدارند و فقط خلاصهای کلی از محاسبات ذهنی را به کاربران نشان میدهند. با وجود این لایه های امنیتی، مهاجمان راه های خلاقانه ای برای دور زدن محدودیت ها ابداع کرده اند. برای مثال، در یکی از روشهای حمله، از سیستم خواسته شد تا حافظه موقت و استدلالهای داخلی مدل را در قالب ترجمه کاتاکانای ژاپنی بازنویسی کند، ترفندی که سیستم حفاظتی را فریب داد و ساختار منطقی پاسخ را آشکار کرد.
بررسی این کمپین ها نشان می دهد که بیشتر این فعالیت ها توسط علی بابا هدایت شده است. بین ماه مه و ژوئیه 2026، بیش از 151 میلیون تبادل داده ثبت شده است که اوج آن سه میلیون درخواست در روز بوده است. این عملیات گسترده از طریق 3500 حساب کاربری مختلف و با استفاده از دستورات متنی مشابه برای جمع آوری داده های آموزشی لازم برای توسعه و بهبود مدل های خانواده Qwen این شرکت چینی انجام شد.
فعالیت مشکوک استارتاپ چینی Moonshot AI
بر اساس این گزارش تک کرانچبخشی دیگر از این حمله سایبری به هوش مصنوعی Moonshot خالق مدل کیمی نسبت داده می شود که الگوهای مختلفی را به نمایش گذاشته است. بررسی درخواستهای ارسال شده توسط شبکهای متشکل از 5000 حساب کاربری نشان میدهد که این گروه در یک دوره 10 روزه 300000 درخواست را هدایت کرده است که عمدتاً به مدل قدرتمند Opus ارسال شده است. در یکی از این موارد، از مدل خواسته شد تا رفتار مشکوک را در تصاویر دوربین های نظارتی ارزیابی کند، درخواستی که ماهیت کاربردهای امنیتی و نظامی را آشکار می کند.
تلاشهای مشابهی قبلاً توسط سایر غولهای هوش مصنوعی مانند OpenAI علیه سایر شرکتهای چینی گزارش شده است. با این حال، وسعت و شدت اقدامات اخیر نشان می دهد که رقابت در زمینه مدل های زبان بزرگ از مرحله آموزش مستقل فراتر رفته و مسیر خود را به مرحله برداشت غیرمجاز و انتقال مستقیم دستاوردهای فرآوری تغییر داده است.
















گفتگو در مورد این post