گوگل هم‌زمان از ۳ مدل جدید خانواده Gemini رونمایی کرد؛ سریع، بهره‌ور، ایمن

زمان مطالعه: 5 دقیقه

مدل‌های جدید Gemini بهره‌وری، تأخیر پایین و قابلیت اطمینان موردنیاز برای ساخت عامل‌های هوش مصنوعی در مقیاس گسترده را ارائه می‌کنند.

توسعه‌دهندگان و کاربرانی که عامل‌های هوش مصنوعی را برای محیط‌های عملیاتی و تولیدی توسعه می‌دهند، به بهره‌وری بالاتر در مصرف توکن، تأخیر کمتر و عملکرد قابل‌اعتمادتر نیاز دارند. مجموعه مدل‌های Flash برای دستیابی به نقطه تعادل میان بهره‌وری و کیفیت طراحی شده است تا امکان مقیاس‌پذیری جریان‌های کاری مبتنی بر عامل‌های هوشمند را فراهم کند.

نسل جدید Gemini

گوگل باتکیه‌بر Gemini Flash 3.5، نسل جدید مدل‌های جدید Gemini را معرفی می‌کند:

  • Gemini Flash 3.6: مدل کاری اصلی (Workhorse) گوگل که عملکرد بهتری در برنامه‌نویسی، فعالیت‌های دانش‌محور و قابلیت‌های چندوجهی ارائه می‌دهد. طبق شاخص  Artificial Analysis Index، این مدل در مقایسه با Flash 3.5، میزان استفاده از توکن‌های خروجی را ۱۷ درصد کاهش می‌دهد و در برخی معیارها مانند DeepSWE متعلق به Datacurve، این کاهش تا ۶۵ درصد نیز مشاهده شده است؛ آن هم با هزینه کمتر به‌ازای هر توکن خروجی.
  • Gemini Flash 3.5-Lite: سریع‌ترین و مقرون‌به‌صرفه‌ترین مدل از خانواده 3.5 که طبق شاخص Artificial Analysis، سرعت تولید ۳۵۰ توکن خروجی در ثانیه را ارائه می‌کند و در جریان‌های کاری مبتنی بر عامل‌های هوشمند، عملکردی به‌مراتب بهتر از نسل‌های قبلی Flash-Lite دارد.
  • Gemini Flash 3.5 Cyber در CodeMender: کاربردهای موفق در حوزه امنیت سایبری نیازمند هماهنگی دقیق میان یک مدل و زیرساخت عامل هوشمند هستند. گوگل ترکیبی از یک مدل جدید، بسیار کارآمد و تخصصی در حوزه سایبری را به همراه عامل امنیت کدنویسی CodeMender معرفی می‌کند که عملکردی رقابتی در سطح پیشرفته‌ترین فناوری‌های موجود ارائه می‌دهد.

فراتر از این ۳ مدل جدید، Gemini 3.5 Pro هم‌اکنون در حال آزمایش با شرکای گوگل است و به‌محض آماده‌شدن، به‌صورت گسترده در دسترس قرار خواهد گرفت. هم‌زمان، تیم گوگل تمرکز خود را بر ساخت نسل بعدی مدل‌ها قرار داده است و ازاین‌رو بزرگ‌ترین اجرای پیش‌آموزش (Pre-training) خود تاکنون را برای Gemini 4 آغاز کرده است.

Flash 3.6: بهره‌وری بیشتر و کیفیت بهتر نسبت به Flash 3.5

Gemini Flash 3.6 به طور مستقیم بر اساس بازخوردهای توسعه‌دهندگان و کاربران درباره Flash 3.5 ساخته شده است. این مدل نه‌تنها جهشی در زمینه برنامه‌نویسی و فعالیت‌های دانش‌محور ارائه می‌دهد، بلکه هم‌زمان بهره‌وری مصرف توکن را نیز به شکل قابل‌توجهی بهبود می‌بخشد.

برای مثال، در شاخص Artificial Analysis، مشاهده شده که Flash 3.6 نسبت به Flash 3.5 حدود ۱۷ درصد توکن خروجی کمتری مصرف می‌کند. این مدل همچنین برای انجام جریان‌های کاری چندمرحله‌ای، به گام‌های استدلالی کمتر و فراخوانی ابزار کمتری نیاز دارد.

این بهره‌وری ارتقایافته، همراه با قیمت پایین‌تر نسبت به Flash 3.5 ارائه می‌شود. با قیمت ۱.۵ دلار به‌ازای هر یک میلیون توکن ورودی و ۷.۵ دلار به‌ازای هر یک میلیون توکن خروجی، مدل Flash 3.6 هزینه کلی انجام وظایف مبتنی بر عامل‌های هوشمند را کاهش می‌دهد و ساخت و اجرای عامل‌ها را مقرون‌به‌صرفه‌تر می‌کند.

حتی با وجود بهره‌وری بالاتر، Flash 3.6 در کاربردهای مختلف نسبت به Flash 3.5 بهبود عملکرد نشان می‌دهد:

  • Flash 3.6 دقت بالاتری با ویرایش‌های ناخواسته کمتر در کد و کاهش حلقه‌های اجرای مجدد ارائه می‌دهد. این موضوع در معیار DeepSWE قابل‌مشاهده است؛ جایی که عملکرد مدل به ۴۹ درصد در برابر ۳۷ درصد رسیده است. همچنین در حوزه پژوهش یادگیری ماشین، طبق معیار MLE Bench، بهبود قابل‌توجهی با عملکرد ۶۳.۹ درصد در برابر ۴۹.۷ درصد مشاهده می‌شود.
  • قابلیت‌های استفاده از رایانه در این مدل بهبود یافته است. این موضوع در معیار OSWorld-Verified با امتیاز ۸۳.۰ درصد در برابر ۷۸.۴ درصد مشاهده می‌شود. قابلیت استفاده از رایانه اکنون به‌عنوان یک ابزار داخلی سمت کاربر (Client-side Tool) از طریق Gemini API و Gemini Enterprise در دسترس است.
  • این مدل در فعالیت‌های دانش‌محور از Flash 3.5 عملکرد بهتری دارد. این موضوع در معیارهایی مانند GDPval-AA v2 با امتیاز ۱۴۲۱ در برابر ۱۳۴۹ مشخص شده است. مشتریانی مانند Hebbia و Harvey دریافته‌اند که این مدل به‌ویژه در وظایف چندوجهی مانند پردازش اسناد، تحلیل نمودارها و داده‌ها و تهیه پیش‌نویس گزارش‌ها توانمندی بالایی دارد.

Flash 3.6 با تدابیر ایمنی پیشرفته Frontier Safety در حوزه‌های سوءاستفاده مرتبط با حوزه مواد شیمیایی، زیستی، پرتوزا و هسته‌ای (CBRN) و همچنین سوءاستفاده‌های مرتبط با حملات سایبری عرضه می‌شود. این تدابیر ایمنی، مقاومت مدل در برابر حملات دورزدن محدودیت‌ها یا همان جیلبریک (Jailbreak) را به طور قابل‌توجهی افزایش می‌دهند. در همین حال، مدل آموزش داده شده است تا میزان امتناع از پاسخ‌گویی در کاربردهای مفید را به حداقل برساند.

برای اطلاعات بیشتر، به کارت مدل (Model Card) مربوط به Flash 3.6 مراجعه کنید.

Flash 3.5-Lite: ساخته‌شده برای مقیاس‌پذیری جریان‌های کاری مبتنی بر عامل

علاوه بر Flash، گوگل مدل Gemini Flash 3.5-Lite را نیز عرضه می‌کند؛ مدلی که برای وظایف دارای تأخیر پایین و همچنین کاربردهایی طراحی شده است که در آن‌ها توان عملیاتی بالا برای جریان کاری توسعه‌دهندگان حیاتی است؛ مانند جست‌وجوی مبتنی بر عامل (Agentic Search) و پردازش اسناد.

Flash 3.5-Lite سریع‌ترین مدل در خانواده 3.5 است. طبق اندازه‌گیری Artificial Analysis، این مدل با سرعت ۳۵۰ توکن خروجی در ثانیه اجرا می‌شود. این مدل با قیمت ۰.۳ دلار به‌ازای هر یک میلیون توکن ورودی و ۲.۵ دلار به‌ازای هر یک میلیون توکن خروجی عرضه می‌شود و با کیفیتی به‌مراتب بهتر از Flash-Lite 3.1، نسبت قیمت به عملکرد (Price-to-Performance Ratio) بسیار مناسبی برای توسعه‌دهندگان و مشتریانی ارائه می‌کند که ترافیک عملیاتی با حجم بالا را مدیریت می‌کنند.

Flash 3.5-Lite امکان مقیاس‌گذاری کارآمد سیستم‌های مبتنی بر عامل را فراهم می‌کند. این مدل در تمام سطوح تفکر (Thinking Levels) عملکردی بسیار بهتر از Flash-Lite 3.1 دارد. بسته به نوع بار کاری، توسعه‌دهندگان می‌توانند مدل را به‌گونه‌ای پیکربندی کنند که در وظایف پرتکرار، اجرای کم‌هزینه و کم‌تأخیر را با سطوح تفکر حداقلی و پایین اولویت دهد، یا برای پردازش وظایف چندمرحله‌ای عامل‌های فرعی (Subagent Workloads)، از سطوح تفکر بالاتر استفاده کند.

این مدل اکنون قابلیت استفاده از رایانه را نیز به‌عنوان یک ابزار داخلی در اختیار دارد تا بتواند این وظایف مبتنی بر عامل را در محیط‌های مختلف به‌صورت قابل‌اعتماد پشتیبانی کند.

این مدل در وظایف برنامه‌نویسی و عامل‌های هوشمند یک جهش قابل‌توجه محسوب می‌شود؛ همان‌طور که در معیارهایی مانند:

  • Terminal-Bench 2.1: عملکرد ۵۴ درصد در برابر ۳۱ درصد
  • GDM-MRCR v2 در زمینه پردازش زمینه طولانی: عملکرد ۷۲.۲ درصد در برابر ۶۰.۱ درصد
  • GDPval-AA v2 در اجرای وظایف واقعی: عملکرد ۱۱۴۰ در برابر ۶۴۲

مشاهده می‌شود.

در واقع، در بسیاری از ارزیابی‌های مرتبط با عامل‌های هوشمند و برنامه‌نویسی، Flash 3.5-Lite حتی از  Flash 3 نیز بهتر عمل می‌کند؛ از جمله:

  • SWE-Bench Pro: عملکرد ۵۴.۲ درصد در برابر ۴۹.۶ درصد
  • OSWorld-Verified: عملکرد ۷۴.۰ درصد در برابر ۶۵.۱ درصد

این موضوع، Flash 3.5-Lite را به گزینه‌ای سریع‌تر و توانمندتر برای بارهای کاری مبتنی بر مدل‌های 2.5 و Flash 3تبدیل می‌کند.

برای اطلاعات بیشتر درباره این مدل، به کارت مدل Flash 3.5-Lite مراجعه کنید.

Flash 3.5 Cyber در CodeMender: شناسایی و رفع کارآمد آسیب‌پذیری‌ها

مدل‌های هوش مصنوعی اکنون به توانایی شناسایی آسیب‌پذیری‌های امنیتی با سرعتی بیشتر از توان سیستم‌های فعلی برای اصلاح آن‌ها دست یافته‌اند. مقابله با این تهدید روبه‌رشد، نیازمند رویکردی برای امنیت نرم‌افزار است که هم توانمند و هم کارآمد باشد.

عملکرد و بهره‌وری مدل‌های Flash، آن‌ها را به پایه‌ای ایده‌آل برای شناسایی، اعتبارسنجی و اصلاح مشکلات امنیتی کد در مقیاس گسترده تبدیل کرده است. مدل Gemini Flash 3.5 Cyber بر پایه Flash 3.5 ساخته شده و برای شناسایی و رفع آسیب‌پذیری‌های امنیت سایبری به‌صورت تخصصی فاین‌تیون شده است؛ آن هم با هزینه کمتر به‌ازای هر توکن نسبت به مدل‌های بزرگ‌تر.

در محیط CodeMender که از چندین عامل مبتنی بر Flash 3.5 Cyber استفاده می‌کند تا با همکاری یکدیگر یک گزارش نهایی ترکیبی تولید کنند، این مدل در معیار محبوب CyberGym به عملکردی رقابتی در سطح پیشرفته‌ترین فناوری‌ها دست یافته است. این مدل به‌زودی تنها از طریق CodeMender و در قالب یک برنامه آزمایشی با دسترسی محدود، در اختیار دولت‌ها و شرکای مورداعتماد گوگل قرار خواهد گرفت.

دسترسی

مدل‌های Flash 3.6 و Flash 3.5-Lite از امروز در دسترس هستند:

  • برای توسعه‌دهندگان: از طریق Gemini API در Google AI Studio و Android Studio. همچنین Flash 3.6 در Google Antigravity نیز در دسترس است.
  • برای سازمان‌ها: در پلتفرم Gemini Enterprise Agent Platform. همچنین Flash 3.6 در اپلیکیشن Gemini Enterprise نیز ارائه شده است.
  • برای همه کاربران: این دو مدل هم‌اکنون از طریق اپلیکیشن Gemini برای همه کاربران دردسترس هستند. همچنین عرضه Flash 3.5-Lite در Google Search نیز آغاز شده است.

طراحان خلاقی و فرهنگ پیشرو در زبان فارسی ایجاد کرد. در این صورت می توان امید داشت که تمام و دشواری موجود در ارائه راهکارها و شرایط سخت تایپ به پایان رسد.

دیدگاهتان را بنویسید