
شرکت OpenAI قبل از راه اندازی قریب الوقوع آن، جزئیات جدیدی از مدل در حال ساخت آن با نام آسترا به اشتراک گذاشته است؛ مدلی که به گفته این شرکت اولین است مدل زبان بزرگ (LLM) در نظر گرفته می شود که در دستیابی به “آستانه بحرانی امنیت سایبری” موفق بوده است. این گزارش نوشته شده است تیم فرنهولز منتشر شده در 1 سپتامبر 2026 ساعت 14:06 PDT.
به گزارش بخش اخبار فناوری خبرجو به نقل از تک کرانچ در پست وبلاگ رسمی این شرکت OpenAI آمده است: «ما قصد داریم هوش مصنوعی را مدل سازی کنیم آسترا به زودی در دسترس خواهد بود، اما دسترسی به پیشرفته ترین ویژگی ها امنیت سایبری بسیار محدودتر خواهد بود.»
نفوذ خودکار مدل آسترا و بهره برداری از حفره های امنیتی ناشناخته
این آزمایشگاه در این زمینه پیشگام است هوش مصنوعی اعلام کرده است که مدل آسترا توانایی شناسایی آسیبپذیریها و نقصهای امنیتی ناشناخته در سیستمهای کامپیوتری را دارد و حتی میتواند بدون نیاز به نظارت و راهنمایی اپراتور انسانی از آن بهرهبرداری کند. بهره برداری کنند این شیارها کند هستند. این دستاورد به نگرانی های مطرح شده توسط این شرکت است آنتروپیک در مورد مدل اسطوره ها در ماه های گذشته نیز مشابه بود و اکنون OpenAI اقدامات و اقدامات احتیاطی مشابهی را در طول آماده سازی برای عرضه مدل Astra انجام داده است.
چالش ارزیابی ادعاها و ابهام در همکاری با دولت آمریکا
بدون وجود نهادها و مراجع ارزیابی شخص ثالث مستقل، ارزیابی صحت ادعاها OpenAI صحبت در مورد ایمنی یا سطح آمادگی این مدل بسیار دشوار خواهد بود. این شرکت اعلام کرده است که نسخه پیش نمایشی از این مدل را در اختیار گروهی از آزمایش کنندگان قرار می دهد، اما به هویت و مکانیسم انتخاب آنها اشاره ای نکرده است. علاوه بر این، هنوز مشخص نیست که OpenAI برای ارزیابی ایمنی این مدل قبل از عرضه رسمی با آن کار می کند یا خیر دولت ایالات متحده هست یا نه
کسب امتیاز کامل در تست ExploitBench و کشف آسیب پذیری های روز صفر
شرکت OpenAI اشاره کرد که مدل هوش مصنوعی Astra در این آزمایش موفق بوده است ExploitBench نمره کامل گرفت؛ یک معیار تخصصی که سطح مهارت یک مدل زبان بزرگ را در نفوذ به آسیبپذیریهای شناخته شده سیستم اندازهگیری میکند. این شرکت همچنین اعلام کرد که در نسخه بهبود یافته این معیار که توسط مهندسان OpenAI خود طراحی شده است، این مدل با موفقیت دو مورد را کشف و مورد بهره برداری قرار داده است. آسیب پذیری روز صفر بوده است
راه حل های حفاظتی، شناسایی حساب های پرخطر و جلوگیری از فرار از زندان
به منظور اطمینان از اینکه مدلهای این شرکت توسط مجرمان سایبری مورد سوء استفاده قرار نمیگیرند و یا رفتار غیرعادی و ناخواسته را تجربه نمیکنند، OpenAI اعلام کرده است که ساختار مدل Harness را برای شناسایی سوء استفادهها و جلوگیری از آن ارتقا خواهد داد. فرار از زندان را در دستور کار قرار دهد.
با این حال، در اطراف مدل آسترااین شرکت بر روی تکنیک های جدید و ناشناخته ای سرمایه گذاری کرده است که به طور خاص برای بهبود ضریب ایمنی مدل طراحی شده اند. علاوه بر این، OpenAI «حسابهای کاربری با سطح ریسک بالاتر» را شناسایی میکند و خروجیها و پاسخهای مدل را به درخواستها و درخواستهای آنها محدود میکند، اگرچه مکانیسم فنی این محدودیتها فاش نشده است. در نهایت، اگرچه سازنده Astra را به عنوان “ترازترین مدل خود تا به امروز” توصیف می کند، اما به سیستم های نظارتی اضافی مجهز شده است. زنجیره ای از فکر اجرا می شود تا رفتارهای نامطلوب و مخرب بلافاصله شناسایی و مهار شود.
فرار از حاشیه های عوامل هوش مصنوعی OpenAI در پلت فرم Hogging Face
اقدامات برای تهیه مدل آسترا این در حالی انجام می شود که جامعه هوش مصنوعی هنوز نگران فرار عوامل نرم افزاری OpenAI (Agents AI) از محیط آزمایش و دسترسی غیرمجاز آنها به داده های خصوصی روی پلت فرم است. صورت در آغوش گرفته – سرویس محبوب برای به اشتراک گذاری مدل ها و معیارها – واکنش نشان می دهد.
شرکت OpenAI اعلام کرد که آزمایشی را برای سنجش توانایی مدل جدید در بازتولید اقدامات عوامل سرکش در حادثه Hugging Face انجام داده است. رویدادی که طی آن عوامل، با وجود پروتکل های امنیتی محققان OpenAI، برای دسترسی به اینترنت باز با یکدیگر همکاری کردند. این شرکت تاکید کرد که مدل آسترا هیچ تمایلی به ترک و یا شکستن حریم خصوصی محیط تست در طول این تست ها از خود نشان نداده است.
فریب عمدی محققین یا اطاعت از قوانین؟
یونا شاویتیکی از کارمندان سابق OpenAI که در حال حاضر در بخش تابآوری هوش مصنوعی بنیاد OpenAI کار میکند، این سوال کلیدی را در شبکههای اجتماعی مطرح کرده است که آیا بیمیلی Astra برای زیر پا گذاشتن قوانین به دلیل درک انتظارات محققان است یا تلاش هوشمندانه برای فریب محققین در نظر گرفته شده است
علیرغم این حجم از جزئیات تازه، هنوز دانستن آن بسیار دشوار است هوش مصنوعی آسترا قابلیت های آن در عمل چیست یا اینکه آیا اقدامات OpenAI برای ایمن نگه داشتن آن کافی است یا خیر. این شرکت اعلام کرده است که ارزیابی ها و گزارش های امنیتی دقیق تری را همزمان با عرضه عمومی و گسترده این مدل منتشر خواهد کرد. با این حال، در آن نقطه، همه چیز آشکار می شود و اسرار آشکار می شود.


















گفتگو در مورد این post