نسل جدید هوش مصنوعی برای جریانهای کاری عاملی و امنیت سایبری گوگل
مدلهای Gemini 3.8 Flash و Gemini 3.8 Flash Cyber
مدلهای جدید Gemini 3.8 بهعنوان قدرتمندترین مدلهای استدلال و کدنویسی گوگل، تنها سه هفته پس از نسخه 3.7 Flash و بهعنوان سومین انتشار سری Flash ظرف شش هفته معرفی شدهاند. این سری جدید شامل دو نسخه اصلی است که سرعت بالایی داشته و با قیمت رقابتی ۳.۷ دلار بهازای هر میلیون توکن خروجی و ۰.۷۵ دلار بهازای هر میلیون توکن ورودی عرضه میشوند:
- Gemini 3.8 Flash: مدل اصلی و هوشمند جهت انجام وظایف مهندسی نرمافزار، وظایف عاملمحور و استدلالهای چندمرحلهای پیچیده با تمرکز بر سرعت بالا.
- Gemini 3.8 Flash Cyber: پیشرفتهترین مدل امنیت سایبری گوگل برای کشف خودکار آسیبپذیریها و اصلاح آنها، مخصوص مدافعان امنیتی در قالب برنامهای موسوم به Fairwind.
هر دو مدل از یک هسته هوشمند مشترک بهره میبرند که با حلقههای عاملمحور طولانیمدت برای ارزیابی و بهبود خودکار تقویت شدهاند. نوآوری اصلی در آموزش فشرده و دقیق آنها در حوزه امنیت سایبری نهفته است.
Gemini 3.8 Flash: کدنویسی طولانیمدت و عاملهای خودکار
مدل 3.8 Flash ارتقای چشمگیری نسبت به نسخه 3.7 داشته و در بنچمارکهای مختلف عملکردی نزدیک به مدلهای گرانقیمت مرزی ثبت کرده است:
- مهندسی نرمافزار: در بنچمارک DeepSWE v1.1 (حل خودکار و سرتاسری مسائل پیچیده مهندسی)، بیشتر مدلهای بزرگتر را با هزینهای بسیار کمتر شکست میدهد.
- خودکاری و تحلیل تخصصی: این مدل در حوزههای مالی و حقوقی مانند بنچمارکهای Vals Finance Agent V2 و Harvey’s Legal Agent Benchmark نیز برتری دارد. همچنین در HLE-Verified امتیاز ۵۴.۹٪ را در استدلال چندمرحلهای علوم، علومانسانی و حوزههای تخصصی کسب کرده است.
دلیل این جهش عملکردی، معماری پرکارتر آن است؛ این مدل مراحل استدلال بیشتری اجرا کرده و ابزارها را بهصورت تکرارشونده فرامیخواند. برای پروژههای حساس به صرفهجویی در توکن، امکان تنظیم سطح تلاش (Effort level) یا استفاده از Gemini 3.7 Flash فراهم است.





Gemini 3.8 Flash Cyber: عملکرد تخصصی در امنیت سایبری
این نسخه امکان کشف خودکار آسیبپذیری و وصلهکردن سیستمها را فراهم میکند:
- کشف آسیبپذیری: در CyberGym عملکرد برتری نسبت به نسخه 3.5 Flash Cyber و مدلهای بزرگتر ثبت کرده است. همچنین در ارزیابی داخلی گوگل روی ۲۰ زبان برنامهنویسی مختلف، به نرخ موفقیت بالای ۷۰ درصد دست یافته است.
- ترمیم و اصلاح خودکار (Automated Patching): تمرکز اصلی بر تقویت مدافعان امنیت سایبری است. در بنچمارک CWE-Bench نرخ pass@1 معادل ۴۷.۲ درصد را به ثبت رسانده که همتراز با برترین مدلهای مرزی (۴۷.۸ درصد) اما با هزینهای بسیار نازلتر است.




کاربردهای واقعی در گوگل
- تیم امنیت Chrome: تولید ۲.۶ برابر وصله درست بیشتر نسبت به تجاریترین مدلهای بزرگ.
- مجموعه Wiz: افزایش بازخوانی (Recall) بین ۷.۵ تا ۹.۷ درصد در تست نفوذ با هزینهای ۲.۳ تا ۵.۲ برابر کمتر.
- تحقیقات Cloud Vulnerability: کشف یک آسیبپذیری بنیادی زیر ۲ ساعت (درحالیکه فرایند کشف آن معمولاً چند ماه زمان میبرد).
ایمنی
مدل 3.8 Flash شامل سازوکارهای محافظتی لازم در برابر سوءاستفادههای بیولوژیکی، شیمیایی، هستهای و حملات سایبری تهاجمی مطابق با Frontier Safety Framework است. همچنین مقاومت در برابر حملات تزریق پرامپت بر اساس ارزیابی Gray Swan به شکل چشمگیری افزایش یافته است.
دسترسی
این مدلها هماکنون برای توسعهدهندگان از طریق Gemini API، Google AI Studio و Android Studio)، مشتریان سازمانی (Gemini Enterprise) و کاربران عادی (Google AI Pro و Ultra) در دسترس هستند. نسخه Cyber نیز از طریق برنامه Fairwind در اختیار نهادهای تأییدشده و اپراتورهای زیرساختهای حیاتی قرار میگیرد.
