
آنتروپیک مدل کلود سونت 5.5 سرعت گرفتن ۳۰ درصد بیشتر و کاهش تا ۳۰ درصدی از هزینه انجام وظایف را در مقایسه با نسل قبلی ارائه می کرد.
به گزارش سرویس هوش مصنوعی مجرددر چندین آزمایش آنتروپیک، عملکرد Sonnet 5.5 به طور قابل ملاحظه ای به عملکرد گران قیمت Opus 5.5 نزدیک است.
Entropic این مدل پرچمدار جدید را تنها یک هفته پیش عرضه کرد. این میتواند Sonnet 5.5 را به گزینه دیگری برای شرکتهایی تبدیل کند که نمیخواهند برای یک مدل رده بالا هزینه بپردازند.
Entropic می گوید Sonnet 5.5 بیش از 30 درصد سریعتر از Claude Sonnet 5 خروجی تولید می کند و می تواند هزینه کلی یک کار را تا 30 درصد کاهش دهد.
این کاهش هزینه بیشتر به دلیل استفاده از توکنهای کمتر و تماسهای ابزار کمتر است، نه کاهش قیمت هر توکن در API.
قیمت API مدل Sonnet 5.5 همانند نسل قبلی Sonnet 5 است که معادل 2 دلار برای هر 1 میلیون توکن ورودی و 10 دلار برای هر 1 میلیون توکن خروجی است.
هزینه خواندن توکن های کش شده به 0.20 دلار برای هر یک میلیون توکن و نوشتن کش هزینه 2.50 دلار برای هر یک میلیون توکن رسیده است.
در مقابل، Opus 5.5 برای هر 1 میلیون توکن ورودی 4 دلار و برای هر 1 میلیون توکن خروجی 20 دلار هزینه دارد و قیمت نوشتن حافظه پنهان آن 5 دلار است.
ویژگی های Opus بیشتر به Sonnet می آیند

Anthropic می گوید Sonnet 5.5 برای کارهای معمولی و نسبتاً خاص مانند اشکال زدایی نرم افزار، برنامه نویسی، تولید اسناد، ایجاد ارائه ها و صفحات گسترده، و طراحی یا اصلاح رابط های کاربری مناسب است.
Opus 5.5 همچنان گزینه اصلی شرکت برای کارهای مبهم و باز است که نیاز به قضاوت مداوم دارند.
نتایج آزمونهای خود آنتروپیک نشان میدهد که فاصله بین این دو مدل در برخی از کارها به طور قابل توجهی کاهش یافته است.
Sonnet 5.5 در آزمون GDPval-AA امتیاز 1844 را به دست آورد، در حالی که Opus 5.5 1846 امتیاز و Sonnet 5 امتیاز 1449 را به دست آوردند.
Sonnet 5.5 همچنین در تست AA-Briefcase امتیاز 1811 را کسب کرد، در حالی که امتیاز Opus 5.5 1822 بود.
در ارزیابی OSWorld 2.1، این مدل به امتیاز 80.1% نیز رسید که با امتیاز 81.8% Opus 5.5 کمی فاصله دارد. غزل ۵ در این آزمون امتیاز ۵۷ درصد را کسب کرده است.
در تست تشخیص نمودار Chartography، Sonnet 5.5 امتیاز 61.6 درصد را به دست آورد، در حالی که Opus 5.5 امتیاز 64.4 درصد و Sonnet 5 فقط 15.6 درصد را به دست آوردند.
عملکرد Sonnet 5.5 در برنامه نویسی نیز بهبود یافته است. این مدل در تست Terminal-Bench 4.0 امتیاز 70.6٪ را به دست آورد، در حالی که Sonnet 5 امتیاز 10.3٪ و Opus 5.5 امتیاز 66.4٪ را کسب کردند.
Sonnet 5.5 در CursorBench 4.0 نیز به امتیاز 55.5% رسید که کمی کمتر از امتیاز 57.8% Opus 5.5 است.
Entropic تأکید میکند که نتایج بنچمارک لزوماً عملکرد مدل را در تمام محیطهای دنیای واقعی منعکس نمیکند و Opus 5.5 همچنان در کارهای دشوار و باز عملکرد بهتری دارد.
با این حال، از نقطه نظر اقتصادی، هزینه هر کار ممکن است مهمتر از رتبه بندی مدل ها در معیارها باشد.
در چندین ارزیابی، Entropic میگوید که Sonnet 5.5 میتواند با هزینه حدود یک دهم هزینه هر کار در هنگام استفاده از سطوح تلاش کم یا متوسط، بهتر از Sonnet 5 عمل کند.
در تست FrontierCode، Sonnet 5.5 حدود 10 امتیاز بیشتر از Sonnet 5 در سطح تلاش بالا کسب کرد و هزینه هر کار حدود یک پانزدهم مدل قدیمی بود.
در برنامه های مصرف کننده Claude Code و Entropic، سطح تلاش متوسط به طور پیش فرض فعال می شود، در حالی که پلتفرم Claude از سطح بالا استفاده می کند.
تنظیمات کمتر عمق استدلال را به قیمت کاهش تأخیر و مصرف توکن کاهش میدهد و تنظیمات بالاتر به مدل اجازه میدهد زمان بیشتری را برای بررسی و اصلاح خروجی صرف کند.
بیشتر بخوانید: Entropic نسخه پیشرفته Opus 5.5 را با هزینه کمتر منتشر کرد
مشتریان سازمانی کاهش تعداد مراحل را گزارش می دهند
Entropic همچنین نتایج اولیه آزمایش مشتری را منتشر کرده است که تصویر عملی تری از تأثیر این پیشرفت ها در محیط های سازمانی ارائه می دهد.
در Box، Yashoda Bhavanani، معاون محصولات هوش مصنوعی، گفت Sonnet 5.5 قادر به بررسی مجدد اسناد منبع و تشخیص خطاهایی بود که مدل قبلی از قلم افتاده بود.
وی اعلام کرد که این مدل 2.4 برابر سریعتر از نسل قبلی بوده و 12 درصد توکن کمتری مصرف کرده است.
Zendesk همچنین این مدل را بر روی صدها مورد پشتیبانی آزمایش کرده است. این شرکت اعلام کرده است که پردازش درخواستها 20 درصد سریعتر است و این مدل نسبت به مدلهای کلود که در حال حاضر در محیط عملیاتی استفاده میشود، تصمیمات اشتباه کمتری گرفته است.
Slack همچنین بیان کرد که Sonnet 5.5 تقریباً در تمام ارزیابیهای آفلاین Slackbot بهتر از Sonnet 5 عمل کرد و برای دستیابی به نتایج به مراحل کمتری نیاز داشت.
مصرف توکن خروجی نیز 14 درصد کاهش یافته است.
در فاکتورهای برنامه نویسی کاهش تعداد مراحل اهمیت بیشتری دارد.
Lovable اعلام کرده است که Sonnet 5.5 برای تکمیل وظایف برنامه نویسی نسبت به مدل قبلی به حدود یک سوم کمتر تماس ابزار و حدود نیمی از دستورات پوسته نیاز دارد.
پس از بررسی 118 بیلد واقعی اپلیکیشن، Base44 اعلام کرد که Sonnet 5.5 توانسته به همان نتایج Opus 5 با میانگین 3.6 تکرار در هر پروژه دست یابد، در حالی که Opus 5 به طور متوسط به 7.7 تکرار نیاز دارد.
این نتایج نشان می دهد که قیمت هر توکن تنها بخشی از هزینه واقعی استفاده از عوامل هوش مصنوعی است.
هرگونه فراخوانی غیرضروری ابزار، اقدامات ناموفق، و تلاش های مجدد می تواند تأخیر و هزینه های زیرساخت را افزایش دهد.
بیشتر بخوانید: خرابی سوئیچ توقف اضطراری؛ OpenAI آموزش قدرتمندترین مدل های خود را متوقف کرده است
رقابت قیمت مدلهای هوش مصنوعی شدیدتر میشود

Claude Sonnet 5.5 در بازاری عرضه شده است که رقابت بین مدلهای ارزانتر رده بالا تشدید شده است.
OpenAI هفته گذشته GPT-6 Sol را راه اندازی کرد و قیمت استاندارد API آن 2 دلار برای هر 1 میلیون توکن ورودی و 10 دلار برای هر 1 میلیون توکن خروجی است.
این مدل برای برنامه نویسی و فرآیندهای پیچیده مبتنی بر عوامل هوش مصنوعی طراحی شده است و دارای پنجره زمینه 1.05 میلیون توکن است.
گوگل با Gemini 3.8 Flash قیمت کمتری ارائه می دهد. قیمت اولیه این مدل تا پایان سال 2026 0.75 دلار برای هر یک میلیون توکن ورودی و 3.75 دلار برای هر یک میلیون توکن خروجی است.
گوگل اعلام کرده است که قیمت استاندارد از اول ژانویه 2027 به ترتیب به 1.50 و 7.50 دلار افزایش خواهد یافت.
در چنین شرایطی، Entropic سعی نمی کند صرفاً با ارزان ترین قیمت هر توکن رقابت کند.
استدلال این شرکت این است که مدلی که یک کار را با آرگومانها، نشانهها و تماسهای ابزار کمتر انجام میدهد، میتواند هزینه عملیاتی نهایی کمتری داشته باشد، حتی با قیمت ثابت برای هر توکن.
قابلیت های سایبری قدرتمندتر با محدودیت های بیشتر
بهبود عملکرد Sonnet 5.5 نیز با تغییرات امنیتی همراه است. این مدل اولین مدل Sonnet شرکت Entropic است که در زمان عرضه از همان مکانیزم های حفاظتی امنیت سایبری سیستم های قدرتمندتر این شرکت استفاده می کند.
Entropic میگوید توسعه نرمافزار معمولی و اصلاح آسیبپذیریها بدون محدودیت ادامه خواهد داشت، اما برخی از درخواستهای امنیت سایبری پرخطر بهطور خودکار به Sonnet 5 منتقل میشوند.
این شرکت همچنین قصد دارد برنامه تأیید سایبری را گسترش دهد تا متخصصان امنیتی معتبر بتوانند به قابلیتهای پیشرفتهتر مدلهای Sonnet 5.5، Opus 5.5 و Mythos دسترسی داشته باشند.
Sonnet 5.5 همچنین اولین مدل Sonnet است که با طبقه بندی کننده هایی برای جلوگیری از استخراج فرآیند استدلال ارائه می شود.
Entropic می گوید سیستم “تفکر حفظ شده” خود را نیز گسترش داده است تا فرآیند استدلال از حساب کاربری که آن را ایجاد کرده جدا نشود. مکانیسم های حفاظت بیولوژیکی مانند غزل 5 باقی می مانند.
انتشار Sonnet 5.5 در سرویس های ابری
Claude Sonnet 5.5 از طریق خود Entropic و همچنین خدمات وب آمازون، Google Cloud و Microsoft Azure در دسترس خواهد بود و از حفظ داده های صفر پشتیبانی می کند.
توسعه دهندگان می توانند این مدل را از طریق پلتفرم Claude با شناسه claude-sonnet-5-5 دریافت کنند.
Entropic اعلام کرده است که Claude Haiku 5.5 که برای کاربردهای چند وظیفه ای و مخصوصاً حساس به هزینه طراحی شده است، در هفته های آینده در دسترس خواهد بود.
برای توسعه دهندگان سازمانی، اهمیت اصلی Sonnet 5.5 کاهش چشمگیر قیمت API نیست.
Entropic سعی می کند مدل میان رده خود را آنقدر به مدل پرچمدار نزدیک کند که بسیاری از کارهای دیگر نیازی به استفاده از مدل گران قیمت نداشته باشد.















گفتگو در مورد این post