بستن کار 5.2 ظاهراً در حال آزمایش مخفیانه و گزارش داخلی است آنتروپیک از مدل های پیشرفته تر برای رقابت GPT-6 Astra اطلاع می دهد.
به گزارش سرویس هوش مصنوعی مجردبررسی بیشتر بسته های شبکه و درخواست های وضعیت نشان داد که شناسه مدل در قسمت پشتیبانی سرویس به Opus 5.2 تغییر یافته است.
این احتمالاً نشان می دهد که Entropic نسخه 5.1 را رها کرده و نسخه 5.2 را مستقیماً برای گروه محدودی از کاربران فعال کرده است.
بازخورد توسعه دهندگان بیشتر بر روی سه موضوع، سرعت پاسخ، کیفیت خروجی و استقلال مدل در انجام وظایف متمرکز شده است.
چندین کاربر گزارش کرده اند که سرعت تولید پاسخ پس از انتقال به Opus 5.2 نسبت به نسخه قبلی به طور قابل توجهی بهبود یافته است.
خروجی مدل در تولید کد و پردازش متون طولانی نیز مستقیم تر است و اطلاعات تکراری کمتری ارائه می دهد.
مهمترین تغییر مربوط به کارهای بلند مدت است. مدلهای قبلی هوش مصنوعی برای کارهای پیچیده معمولاً فقط چارچوب کلی را ارائه میکردند یا برای ادامه دستور «ادامه» چندین ورودی لازم داشتند.
Opus 5.2 ظاهراً می تواند کد را به طور مستقل اجرا، آزمایش و اصلاح کند تا زمانی که کار به طور کامل انجام شود.
یکی از توسعه دهندگان این روش کار را به عنوان “حلقه دستکش” توصیف کرد و معتقد است که تغییر ایجاد شده صرفاً نتیجه تنظیم دقیق مدل نیست، بلکه به تغییر قابل توجهی در قابلیت های اصلی آن مربوط می شود.
کاربر دیگری نیز گفت که مدل جدید می تواند جلسات کاری طولانی تری را حفظ کند و در عین حال ارتباط موثرتری با کاربر برقرار کند.
این کاربر همچنین اشاره کرد که Entropic قبلاً از استراتژی مشابهی برای مدل بتا Fable استفاده کرده بود و انتشار Opus 5.2 احتمالاً ادامه این رویکرد است.
چگونه دسترسی آزمایشی Opus 5.2 را تشخیص دهیم؟
از آنجایی که عرضه فعلی Opus 5.2 محدود است، همه کاربران Claude Code به این مدل دسترسی ندارند.
جامعه توسعه دهندگان بر اساس سوالی در مورد موضوع کمی شناخته شده به نام “Tibo” راهی برای شناسایی حساب های دارای دسترسی ارائه کرده است.
در این روش ابتدا جستجوی وب غیرفعال می شود و سپس از کلود پرسیده می شود که آیا می دانید ریست گای تیبو کیست؟ مدل های قدیمی اطلاعات دقیقی در مورد این فرد در داده های آموزشی خود ندارند و نسخه تحت وب Opus 5 معمولا نمی تواند پاسخ دقیقی ارائه دهد.
در مقابل، نمونه های Claude Code متصل به Opus 5.2 توانستند Tibo را به درستی شناسایی کنند و حتی پیشینه او را توضیح دهند.
یک توسعه دهنده با نام کاربری @jan_volad اسکرین شات هایی از این تست را منتشر کرده است که نشان می دهد این دو نسخه با یک سوال مشابه و غیرفعال بودن جستجوی وب، پاسخ های کاملا متفاوتی داده اند.
بر اساس این گزارش، این تفاوت نشان می دهد که وزن این دو مدل یکسان نیست. پس از انتشار این تست، تعداد زیادی از کاربران کلود از همین سوال برای بررسی قرار گرفتن حساب خود در گروه تست استفاده کرده اند.
بیشتر بخوانید: مدیر عامل Entropic: ترمز توسعه هوش مصنوعی باید برداشته شود
استراتژی آنتروپیک سه لایه برای مدل های آینده
انتشار نسخه بتا Opus 5.2 یک رویداد جداگانه نیست. در اواسط ماه اوت، یک گزارش داخلی فاش شده از Entropic Risk Assessment نشان داد که این شرکت در حال آماده سازی یک استراتژی چند لایه برای مدل های هوش مصنوعی برای رقابت با GPT-6 Astra OpenAI است.
بر اساس این گزارش، سه رویکرد متفاوت در این استراتژی وجود دارد که ممکن است تا حدودی با یکدیگر همپوشانی داشته باشند.
لایه اول Claude Fable 5.2 است که سریعترین مدل برای انتشار خارجی محسوب می شود.
با توجه به پیشرفت فعلی تست Opus 5.2، انتظار می رود مدل های خانواده 5.2 در بهترین حالت تا پایان این ماه و در بدترین حالت تا پایان ماه آینده به طور گسترده در دسترس باشند.
لایه دوم یک مدل داخلی و منتشر نشده با کد “Model 2” است. بر اساس این گزارش، Entropic در حال حاضر از این مدل به طور گسترده در داخل شرکت استفاده می کند.
مدل 2 در معیار CoBench v2، که وظایف تحقیق و توسعه هوش مصنوعی در دنیای واقعی را ارزیابی میکند، امتیاز 62.8٪ را کسب کرد. این امتیاز 12.5 درصد بالاتر از Mythos 5 است که در آن زمان یکی از قدرتمندترین مدل ها به حساب می آمد.
این گزارش همچنین ادعا می کند که بخش عمده ای از کدهای سازمانی Entropy اکنون توسط مدل 2 از طریق جریان های کاری مبتنی بر عامل هوش مصنوعی نوشته می شود.
موضع رسمی این شرکت این است که این مدل در حال حاضر برای عموم عرضه نخواهد شد.
لایه سوم مدل RSI یا «خود بهبود بازگشتی» است.
بر اساس یک گزارش داخلی، این مدل در تستهای عملکرد ۲۲ امتیاز بالاتر از مدل ۲ کسب کرده و انتظار میرود بتواند تا ۸۵ درصد از وظایف تیم تحقیقاتی آنتروپی را انجام دهد.
اطلاعات مربوط به این استراتژی از گزارش فاش شده داخلی Entropy استخراج شده است و این اطلاعات به طور رسمی توسط این شرکت تایید نشده است.
بیشتر بخوانید: آنتروپیک چین را به سرقت هوش مصنوعی متهم کرد
مدل RSI و آینده توسعه هوش مصنوعی
RSI یا Recursive Self-Improvement از دیرباز یکی از اهداف مهم در زمینه AGI در نظر گرفته شده است.
منطق پشت این ایده این است که اگر یک سیستم هوش مصنوعی به اندازه کافی هوشمند شود که معماری و کد خود را درک کرده و اصلاح کند، می تواند قابلیت های خود را افزایش دهد.
نسخه هوشمندتر نیز می تواند دوباره خود را اصلاح کند و چرخه ای از رشد مداوم هوش شکل می گیرد.
استفاده گسترده انتروپی از مدل 2 برای نوشتن کد و اجرای عوامل هوش مصنوعی می تواند نشان دهنده آغاز روند “هوش مصنوعی ساخت نسل بعدی هوش مصنوعی” باشد.
این روند در گزارش از قابلیتهای Opus 5.2 برای تکرار مستقل و اصلاح وظایف طولانی، تا استفاده از مدل 2 برای بخش بزرگی از تولید کد شرکت و در نهایت مدل RSI با ظرفیت جایگزینی بخش عمدهای از وظایف محققان انسانی مشخص شده است.
تشدید رقابت Entropic و OpenAI
رقابت بین شرکت های پیشرو هوش مصنوعی نیز با این پیشرفت ها شدیدتر شده است.
GPT-6 Astra از OpenAI به عنوان یک رقیب مستقیم برجسته است و Entropic ترکیبی از نسخههای بتا و مجموعهای از مدلهای چندلایه داخلی را دنبال میکند.
برای توسعهدهندگان، انتشار آزمایشی Opus 5.2 میتواند نشانهای از نزدیکتر شدن تجربه مدلهای پیشرفته به کاربران باشد. در سطح صنعت، معرفی مدل 2 و مدل RSI این سوال را ایجاد کرده است که آیا هوش مصنوعی می تواند زودتر از حد انتظار به مرحله توسعه مستقل نسل های بعدی هوش مصنوعی برسد؟
هنوز مشخص نیست که آیا انتروپیک به طور رسمی Opus 5.2 را در این ماه عرضه خواهد کرد یا اینکه جزئیات بیشتری در مورد مدل های پیشرفته داخلی خود منتشر خواهد کرد.
این دو موضوع در آینده محورهای اصلی توجه بازار خواهند بود.

















گفتگو در مورد این post