

تنها سه هفته پس از عرضه مدل قبلی، گوگل Gemini 3.8 Flash را با عملکرد برنامه نویسی بهتر و نسخه سایبری برای شناسایی آسیب پذیری های امنیتی معرفی کرد.
به گزارش سرویس هوش مصنوعی تکناکمدل جدید با تمرکز بر مهندسی نرم افزار، وظایف مبتنی بر عامل و استدلال چند مرحله ای توسعه یافته است و گوگل ادعا می کند که عملکرد آن در برخی از وظایف به مدل های پیشرفته تر و گران تر نزدیک می شود.
مدل فلش Gemini 3.8 سومین آپدیت خانواده فلش در سه ماه اخیر است. گوگل این محصول را به عنوان «هوشمندترین مدل کاری» خود معرفی کرده و می گوید که مدل جدید در چندین زمینه تخصصی پیشرفت چشمگیری نسبت به فلش Gemini 3.7 داشته است.
یکی از مهم ترین تغییرات Gemini 3.8 Flash مربوط به نحوه پردازش درخواست های پیچیده است. گوگل توضیح می دهد که مدل جدید در صورت مواجهه با مشکلات دشوار مراحل بیشتری از استدلال را طی می کند و در صورت نیاز چندین بار از ابزارها استفاده می کند. این روش میتواند مصرف توکن را در برخی درخواستها افزایش دهد، اما هدف آن دستیابی به پاسخ دقیقتر و کاملتر است.
بیشتر بدانید: مدل متای Muse Voice Transcribe چندین گوینده و زبان را به طور همزمان تشخیص می دهد
عملکرد بهتر در برنامه نویسی و استدلال

Gemini 3.8 Flash در بنچمارک DeepSWE v1.1 که عملکرد مدلها را در مهندسی نرمافزار بلندمدت ارزیابی میکند، از پیشرفتهترین و بزرگترین مدلها بهتر عمل کرد. این معیار توانایی مدل را برای حل خودکار و سرتاسر مسائل پیچیده مهندسی بررسی می کند. گوگل می گوید Gemini 3.8 Flash این سطح از عملکرد را با هزینه بسیار کمتر ارائه می دهد.
مدل جدید در زمینه های حرفه ای و کمی نیز بهبود یافته است. بر اساس اطلاعات منتشر شده، Gemini 3.8 Flash در بنچمارک هایی مانند Vals Finance Agent V2 و Harvey’s Legal Agent Benchmark بهتر از Gemini 3.7 Flash و برخی مدل های پیشرفته دیگر است. این تست ها توانایی مدل را برای انجام تحلیل و گزارش تخصصی در زمینه هایی مانند امور مالی و حقوقی بررسی می کنند.
Gemini 3.8 Flash نیز امتیاز 54.9% را در بنچمارک HLE-Verified ثبت کرده است. این معیار توانایی مدل را در استدلال چند مرحله ای در علوم، فناوری، مهندسی و ریاضیات، علوم انسانی و زمینه های حرفه ای ارزیابی می کند.
گوگل افزایش عملکرد مدل را نتیجه یک تصمیم اساسی در طراحی خود می داند. Gemini 3.8 Flash تلاش محاسباتی بیشتری را برای مشکلات پیچیده انجام می دهد و مراحل بیشتری را برای رسیدن به نتیجه طی می کند. توسعه دهندگانی که سرعت یا مصرف کمتر منابع را در اولویت قرار می دهند، می توانند تلاش مدل را کاهش دهند یا به استفاده از Gemini 3.7 Flash ادامه دهند.
تاریخ قطع دانش فلش Gemini 3.8 نیز در همه زمینه ها یکسان نیست. دانش مدل در برخی از حوزهها اطلاعات را تا مارس 2026 پوشش میدهد، اما در برخی حوزههای دیگر ممکن است به ژانویه 2025 محدود شود.
بیشتر بدانید: Entropic مدل قدرتمند Claude Fable 5.1 را معرفی می کند
Gemini 3.8 Flash قیمت و در دسترس بودن

گوگل قیمت اولیه Gemini 3.8 Flash را افزایش داده است ۳۱ دسامبر در طول این مدت، هزینه پردازش برای هر یک میلیون توکن ورودی را حفظ خواهد کرد ۰.۷۵ دلار و هر یک میلیون توکن خروجی ۳.۷۵ دلار تعیین می شود
Gemini 3.8 Flash اکنون در برنامه Gemini برای مشترکین Google AI Pro و Ultra، حالت AI و قابلیت Gemini در Google Sheets در دسترس است. توسعه دهندگان همچنین می توانند از طریق Google Antigravity، Google AI Studio و Gemini API به مدل جدید دسترسی داشته باشند. این مدل در ابزارهایی مانند Android Studio، Stitch و Gemini Enterprise نیز موجود است.
نسخه سایبری برای کشف آسیب پذیری ها

گوگل همچنین Gemini 3.8 Flash Cyber را همزمان معرفی کرده است. این مدل جایگزین 3.5 سایبر می شود و در ابتدا از طریق برنامه Fairwind در دسترس آزمایش کنندگان مورد اعتماد قرار خواهد گرفت. نسخه Cyber به طور ویژه برای کشف خودکار آسیبپذیریها و کمک به تولید وصلههای امنیتی توسعه یافته است.
نتایج آزمایش منتشر شده نشان میدهد که تیم امنیتی کروم با Gemini 3.8 Flash Cyber در مقایسه با مدلهای تجاری بسیار بزرگتر و با بهترین نژاد، توانسته 2.6 برابر اصلاحات صحیحتری برای آسیبپذیریهای کروم ایجاد کند.
Wiz همچنین گزارش داد که این مدل 7.5-9.7 درصد فراخوان بالاتری نسبت به سایر مدل های پیشرفته در معیار تست نفوذ داخلی داشته است. هزینه استفاده از آن نیز در این تست ها 2.3 تا 5.2 برابر کمتر اعلام شده است.
تیم تحقیقاتی آسیبپذیری Google Cloud نیز با کمک Gemini 3.8 Flash Cyber در کمتر از دو ساعت یک آسیبپذیری اساسی و حیاتی پیدا کرد. گوگل می گوید که روند تحقیق و کشف این آسیب پذیری ها معمولاً چندین ماه طول می کشد.
انتشار Gemini 3.8 Flash و نسخه Cyber نشان می دهد که گوگل به توسعه مدل های فلش در فواصل زمانی کوتاه ادامه می دهد. مدل اصلی بر استدلال، برنامه نویسی و وظایف عامل محور تمرکز دارد و نسخه سایبری قابلیت های این خانواده را به حوزه تخصصی امنیت سایبری گسترش می دهد.
















گفتگو در مورد این post