گوگل همزمان از ۳ مدل جدید خانواده Gemini رونمایی کرد؛ سریع، بهرهور، ایمن
مدلهای جدید Gemini بهرهوری، تأخیر پایین و قابلیت اطمینان موردنیاز برای ساخت عاملهای هوش مصنوعی در مقیاس گسترده را ارائه میکنند.
توسعهدهندگان و کاربرانی که عاملهای هوش مصنوعی را برای محیطهای عملیاتی و تولیدی توسعه میدهند، به بهرهوری بالاتر در مصرف توکن، تأخیر کمتر و عملکرد قابلاعتمادتر نیاز دارند. مجموعه مدلهای Flash برای دستیابی به نقطه تعادل میان بهرهوری و کیفیت طراحی شده است تا امکان مقیاسپذیری جریانهای کاری مبتنی بر عاملهای هوشمند را فراهم کند.
نسل جدید Gemini
گوگل باتکیهبر Gemini Flash 3.5، نسل جدید مدلهای جدید Gemini را معرفی میکند:
- Gemini Flash 3.6: مدل کاری اصلی (Workhorse) گوگل که عملکرد بهتری در برنامهنویسی، فعالیتهای دانشمحور و قابلیتهای چندوجهی ارائه میدهد. طبق شاخص Artificial Analysis Index، این مدل در مقایسه با Flash 3.5، میزان استفاده از توکنهای خروجی را ۱۷ درصد کاهش میدهد و در برخی معیارها مانند DeepSWE متعلق به Datacurve، این کاهش تا ۶۵ درصد نیز مشاهده شده است؛ آن هم با هزینه کمتر بهازای هر توکن خروجی.
- Gemini Flash 3.5-Lite: سریعترین و مقرونبهصرفهترین مدل از خانواده 3.5 که طبق شاخص Artificial Analysis، سرعت تولید ۳۵۰ توکن خروجی در ثانیه را ارائه میکند و در جریانهای کاری مبتنی بر عاملهای هوشمند، عملکردی بهمراتب بهتر از نسلهای قبلی Flash-Lite دارد.
- Gemini Flash 3.5 Cyber در CodeMender: کاربردهای موفق در حوزه امنیت سایبری نیازمند هماهنگی دقیق میان یک مدل و زیرساخت عامل هوشمند هستند. گوگل ترکیبی از یک مدل جدید، بسیار کارآمد و تخصصی در حوزه سایبری را به همراه عامل امنیت کدنویسی CodeMender معرفی میکند که عملکردی رقابتی در سطح پیشرفتهترین فناوریهای موجود ارائه میدهد.
فراتر از این ۳ مدل جدید، Gemini 3.5 Pro هماکنون در حال آزمایش با شرکای گوگل است و بهمحض آمادهشدن، بهصورت گسترده در دسترس قرار خواهد گرفت. همزمان، تیم گوگل تمرکز خود را بر ساخت نسل بعدی مدلها قرار داده است و ازاینرو بزرگترین اجرای پیشآموزش (Pre-training) خود تاکنون را برای Gemini 4 آغاز کرده است.
Flash 3.6: بهرهوری بیشتر و کیفیت بهتر نسبت به Flash 3.5
Gemini Flash 3.6 به طور مستقیم بر اساس بازخوردهای توسعهدهندگان و کاربران درباره Flash 3.5 ساخته شده است. این مدل نهتنها جهشی در زمینه برنامهنویسی و فعالیتهای دانشمحور ارائه میدهد، بلکه همزمان بهرهوری مصرف توکن را نیز به شکل قابلتوجهی بهبود میبخشد.
برای مثال، در شاخص Artificial Analysis، مشاهده شده که Flash 3.6 نسبت به Flash 3.5 حدود ۱۷ درصد توکن خروجی کمتری مصرف میکند. این مدل همچنین برای انجام جریانهای کاری چندمرحلهای، به گامهای استدلالی کمتر و فراخوانی ابزار کمتری نیاز دارد.
این بهرهوری ارتقایافته، همراه با قیمت پایینتر نسبت به Flash 3.5 ارائه میشود. با قیمت ۱.۵ دلار بهازای هر یک میلیون توکن ورودی و ۷.۵ دلار بهازای هر یک میلیون توکن خروجی، مدل Flash 3.6 هزینه کلی انجام وظایف مبتنی بر عاملهای هوشمند را کاهش میدهد و ساخت و اجرای عاملها را مقرونبهصرفهتر میکند.
حتی با وجود بهرهوری بالاتر، Flash 3.6 در کاربردهای مختلف نسبت به Flash 3.5 بهبود عملکرد نشان میدهد:
- Flash 3.6 دقت بالاتری با ویرایشهای ناخواسته کمتر در کد و کاهش حلقههای اجرای مجدد ارائه میدهد. این موضوع در معیار DeepSWE قابلمشاهده است؛ جایی که عملکرد مدل به ۴۹ درصد در برابر ۳۷ درصد رسیده است. همچنین در حوزه پژوهش یادگیری ماشین، طبق معیار MLE Bench، بهبود قابلتوجهی با عملکرد ۶۳.۹ درصد در برابر ۴۹.۷ درصد مشاهده میشود.
- قابلیتهای استفاده از رایانه در این مدل بهبود یافته است. این موضوع در معیار OSWorld-Verified با امتیاز ۸۳.۰ درصد در برابر ۷۸.۴ درصد مشاهده میشود. قابلیت استفاده از رایانه اکنون بهعنوان یک ابزار داخلی سمت کاربر (Client-side Tool) از طریق Gemini API و Gemini Enterprise در دسترس است.
- این مدل در فعالیتهای دانشمحور از Flash 3.5 عملکرد بهتری دارد. این موضوع در معیارهایی مانند GDPval-AA v2 با امتیاز ۱۴۲۱ در برابر ۱۳۴۹ مشخص شده است. مشتریانی مانند Hebbia و Harvey دریافتهاند که این مدل بهویژه در وظایف چندوجهی مانند پردازش اسناد، تحلیل نمودارها و دادهها و تهیه پیشنویس گزارشها توانمندی بالایی دارد.
Flash 3.6 با تدابیر ایمنی پیشرفته Frontier Safety در حوزههای سوءاستفاده مرتبط با حوزه مواد شیمیایی، زیستی، پرتوزا و هستهای (CBRN) و همچنین سوءاستفادههای مرتبط با حملات سایبری عرضه میشود. این تدابیر ایمنی، مقاومت مدل در برابر حملات دورزدن محدودیتها یا همان جیلبریک (Jailbreak) را به طور قابلتوجهی افزایش میدهند. در همین حال، مدل آموزش داده شده است تا میزان امتناع از پاسخگویی در کاربردهای مفید را به حداقل برساند.

برای اطلاعات بیشتر، به کارت مدل (Model Card) مربوط به Flash 3.6 مراجعه کنید.
Flash 3.5-Lite: ساختهشده برای مقیاسپذیری جریانهای کاری مبتنی بر عامل
علاوه بر Flash، گوگل مدل Gemini Flash 3.5-Lite را نیز عرضه میکند؛ مدلی که برای وظایف دارای تأخیر پایین و همچنین کاربردهایی طراحی شده است که در آنها توان عملیاتی بالا برای جریان کاری توسعهدهندگان حیاتی است؛ مانند جستوجوی مبتنی بر عامل (Agentic Search) و پردازش اسناد.
Flash 3.5-Lite سریعترین مدل در خانواده 3.5 است. طبق اندازهگیری Artificial Analysis، این مدل با سرعت ۳۵۰ توکن خروجی در ثانیه اجرا میشود. این مدل با قیمت ۰.۳ دلار بهازای هر یک میلیون توکن ورودی و ۲.۵ دلار بهازای هر یک میلیون توکن خروجی عرضه میشود و با کیفیتی بهمراتب بهتر از Flash-Lite 3.1، نسبت قیمت به عملکرد (Price-to-Performance Ratio) بسیار مناسبی برای توسعهدهندگان و مشتریانی ارائه میکند که ترافیک عملیاتی با حجم بالا را مدیریت میکنند.
Flash 3.5-Lite امکان مقیاسگذاری کارآمد سیستمهای مبتنی بر عامل را فراهم میکند. این مدل در تمام سطوح تفکر (Thinking Levels) عملکردی بسیار بهتر از Flash-Lite 3.1 دارد. بسته به نوع بار کاری، توسعهدهندگان میتوانند مدل را بهگونهای پیکربندی کنند که در وظایف پرتکرار، اجرای کمهزینه و کمتأخیر را با سطوح تفکر حداقلی و پایین اولویت دهد، یا برای پردازش وظایف چندمرحلهای عاملهای فرعی (Subagent Workloads)، از سطوح تفکر بالاتر استفاده کند.
این مدل اکنون قابلیت استفاده از رایانه را نیز بهعنوان یک ابزار داخلی در اختیار دارد تا بتواند این وظایف مبتنی بر عامل را در محیطهای مختلف بهصورت قابلاعتماد پشتیبانی کند.
این مدل در وظایف برنامهنویسی و عاملهای هوشمند یک جهش قابلتوجه محسوب میشود؛ همانطور که در معیارهایی مانند:
- Terminal-Bench 2.1: عملکرد ۵۴ درصد در برابر ۳۱ درصد
- GDM-MRCR v2 در زمینه پردازش زمینه طولانی: عملکرد ۷۲.۲ درصد در برابر ۶۰.۱ درصد
- GDPval-AA v2 در اجرای وظایف واقعی: عملکرد ۱۱۴۰ در برابر ۶۴۲
مشاهده میشود.
در واقع، در بسیاری از ارزیابیهای مرتبط با عاملهای هوشمند و برنامهنویسی، Flash 3.5-Lite حتی از Flash 3 نیز بهتر عمل میکند؛ از جمله:
- SWE-Bench Pro: عملکرد ۵۴.۲ درصد در برابر ۴۹.۶ درصد
- OSWorld-Verified: عملکرد ۷۴.۰ درصد در برابر ۶۵.۱ درصد
این موضوع، Flash 3.5-Lite را به گزینهای سریعتر و توانمندتر برای بارهای کاری مبتنی بر مدلهای 2.5 و Flash 3تبدیل میکند.


برای اطلاعات بیشتر درباره این مدل، به کارت مدل Flash 3.5-Lite مراجعه کنید.
Flash 3.5 Cyber در CodeMender: شناسایی و رفع کارآمد آسیبپذیریها
مدلهای هوش مصنوعی اکنون به توانایی شناسایی آسیبپذیریهای امنیتی با سرعتی بیشتر از توان سیستمهای فعلی برای اصلاح آنها دست یافتهاند. مقابله با این تهدید روبهرشد، نیازمند رویکردی برای امنیت نرمافزار است که هم توانمند و هم کارآمد باشد.
عملکرد و بهرهوری مدلهای Flash، آنها را به پایهای ایدهآل برای شناسایی، اعتبارسنجی و اصلاح مشکلات امنیتی کد در مقیاس گسترده تبدیل کرده است. مدل Gemini Flash 3.5 Cyber بر پایه Flash 3.5 ساخته شده و برای شناسایی و رفع آسیبپذیریهای امنیت سایبری بهصورت تخصصی فاینتیون شده است؛ آن هم با هزینه کمتر بهازای هر توکن نسبت به مدلهای بزرگتر.
در محیط CodeMender که از چندین عامل مبتنی بر Flash 3.5 Cyber استفاده میکند تا با همکاری یکدیگر یک گزارش نهایی ترکیبی تولید کنند، این مدل در معیار محبوب CyberGym به عملکردی رقابتی در سطح پیشرفتهترین فناوریها دست یافته است. این مدل بهزودی تنها از طریق CodeMender و در قالب یک برنامه آزمایشی با دسترسی محدود، در اختیار دولتها و شرکای مورداعتماد گوگل قرار خواهد گرفت.
دسترسی
مدلهای Flash 3.6 و Flash 3.5-Lite از امروز در دسترس هستند:
- برای توسعهدهندگان: از طریق Gemini API در Google AI Studio و Android Studio. همچنین Flash 3.6 در Google Antigravity نیز در دسترس است.
- برای سازمانها: در پلتفرم Gemini Enterprise Agent Platform. همچنین Flash 3.6 در اپلیکیشن Gemini Enterprise نیز ارائه شده است.
- برای همه کاربران: این دو مدل هماکنون از طریق اپلیکیشن Gemini برای همه کاربران دردسترس هستند. همچنین عرضه Flash 3.5-Lite در Google Search نیز آغاز شده است.