Gemini 4 Argon
Argon؛ نسل چهارم خانواده مدلهای Gemini گوگل
گوگل بهتازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است. این مدل بهگونهای معماری شده که بتواند در جریانهای کاری طولانیمدت و چندمرحلهای فرایند استدلال عمیق را حفظ کند. آرگون به طور ویژه عملکردی پیشرو در حوزههای مهندسی نرمافزار، دانش سازمانی (نظیر حقوق، مالی و مالیات) و پدافند امنیت سایبری ارائه میدهد. در حال حاضر، این مدل از طریق Fairwind Program در اختیار گروهی از مدافعان معتمد سایبری قرار گرفته است.
به دلیل حساسیت و سطح بالای قابلیتهای مرزی این مدل، عرضه آن بهصورت فازبندیشده انجام میپذیرد. گوگل رسماً اعلام کرده است که در راستای چارچوبهای ارزیابی امنیتی، در فرایند داوطلبانه دولت ایالات متحده برای اعطای دسترسی پیش از انتشار مشارکت دارد و پس از ارزیابی بازخوردهای تسترهای اولیه و بهبود سازوکارهای امنیتی، این مدل را در دسترس توسعهدهندگان، سازمانها و عموم کاربران قرار خواهد داد. مدل جدید با قیمت اولیه ۲ دلار بهازای هر یک میلیون توکن ورودی و ۱۰ دلار بهازای هر یک میلیون توکن خروجی عرضه میشود؛ ضمن اینکه توکنهای کششده (Cached tokens) با ۹۵ درصد تخفیف محاسبه خواهند شد.
تحول در جریانهای کاری درونسازمانی گوگل
به ادعای گوگل، هزاران مهندس و پژوهشگر در داخل گوگل پیشازاین بهکارگیری Gemini 4 Argon را در فعالیتهای روزمره خود آغاز کردهاند و دستاوردهای چشمگیری در بهرهوری مهندسی و تحقیقات علمی به ثبت رساندهاند:
- بهینهسازی الگوریتمهای کوانتومی: آرگون به محققان محاسبات کوانتومی گوگل کمک میکند تا منابع فضا-زمان (حاصلضرب کیوبیت در گیت یا qubits × gates ) را در ریزمسیرهایی که به گلوگاه برنامهها تبدیل شدهاند بهینهسازی کنند. این مدل توانسته است یکی از خطوط مبنای منتشرشده را ظرف چند دقیقه تا ۴۰ درصد بهبود بخشد.
- بهرهوری و آزادسازی حافظه سرورها: تیمی از عاملهای آرگون با پایش خودکار دادههای سنجش تلهمتری پروفایلینگ در کل مجموعه عاملها، نقاط اتلاف حافظه در مراکز داده گوگل را شناسایی و بهینهسازی کردند. این اقدام پس از استقرار، بیش از ۳۰۰ ترابایت حافظه آزاد کرد و برآورد میشود صرفهجویی نهایی آن به ۵۰۰ ترابایت تا ۱ پتابایت برسد.
- مهاجرت و بازنویسی کدبیسهای عظیم به زبان Rust: عاملهای این مدل در پروژههای مهاجرت کدهای C و ++C به زبان Rust مشارکت دارند. این پروژهها مجموعهای از دهها هزار خط در کتابخانههای هسته مانند re2 و libgav1 تا بیش از ۸۰۰ هزار خط کد در هسته Zircon سیستمعامل Fuchsia را در بر میگیرد. باتوجهبه حساسیت این سیستمها، تمامی کدها پیش از استقرار تحت ممیزیهای دستی و خودکار دقیق، شبیهسازی و بازبینی قرار میگیرند.

افزایش طول پنجره خروجی به ۱ میلیون توکن
برای میزبانی و پشتیبانی از استدلالهای طولانی و حل مسائل مرکب، سقف توکن خروجی مدل به میزان قابلتوجهی افزایشیافته و از ۶۴ هزار توکن در نسلهای قبلی، به ۱ میلیون توکن خروجی رسیده است. این فضای محاسباتی گسترده به مدل اجازه میدهد تا صدها هزار توکن را در قالب یک مسیر پیوسته تولید کند و مسائل پیچیده مهندسی و تحلیلی را یکپارچه و در یک گام حل کند.
ارزیابیها در مهندسی نرمافزار و تسکهای سازمانی
قابلیتهای چندوجهی، کدنویسی و تحلیل دادههای تصویری آرگون باعث شده تا در معیارهای استاندارد صنعتی رکوردهای جدیدی ثبت کند:
- بنچمارک مهندسی نرمافزار DeepSWE v1.1: این بنچمارک وظایف پیچیده و طولانیمدت توسعه نرمافزار در دنیای واقعی را میسنجد؛ جمنای ۴ آرگون با ثبت امتیاز ۷۷.۹ درصد رکورد ۳ مدل پیشرفته و مرزی GPT-6 Astra، Claude Fable 5.1 و Claude Opos 5.5 را شکست.
- شاخص ارزیابی اقتصادی Vals Index: این شاخص تأثیر اقتصادی هوش مصنوعی را در امور مالی، حقوقی، کدنویسی و مالیات با درنظرگرفتن سهم هر بخش در تولید ناخالص داخلی آمریکا ارزیابی میکند که آرگون در صدر آن ایستاده است. این مدل همچنین در بنچمارکهای تخصصی Vals Finance Agent v2 (پژوهشهای مالی چندمرحلهای) و Harvey’s Legal Agent Benchmark (تحقیقات حقوقی و پیشنویس اسناد قانونی) نتایج برتر را کسب کرده است.
- اتوماسیون سازمانی (AutomationBench): در این ارزیابی شرکت Zapier که اجرای زنجیرهای فرایندها در سازوکارها و فرایندهای سازمانی را میسنجد، آرگون با کسب امتیاز ۵۱.۳ درصد در جایگاه نخست قرار دارد.
- درک ویدئوهای طولانی (LVBench): آرگون در تحلیل اسناد متوالی، نمودارهای تخصصی و تحلیل ویدئوهای بلند، به بالاترین امتیاز ثبتشده؛ یعنی ۹۱.۷ درصد در بنچمارک LVBench دست یافته است.





پدافند سایبری و کشف آسیبپذیریها
یکی از ارکان کلیدی در آموزش جمنای ۴ آرگون، تخصص در حوزه پدافند سایبری است. این مدل میتواند آسیبپذیریهای بحرانی نرمافزاری را بهصورت خودکار کشف، اعتبارسنجی و وصله (Patch) کند. گوگل اعلام کرده که بهمنظور بهرهبرداری تام از این پتانسیل، نسخه ویژه مدافعان سایبری معتمد و تیمهای داخلی را بدون سازوکارهای امنیتی محدودکننده سایبری عرضه خواهد کرد.
Claude Opus 5.5؛ جدیدترین عضو آنتروپیک با تمرکز بر عملکرد، بهرهوری و ایمنی
در بنچمارک CWE-bench v1 (ارزیابی توانایی اصلاح و ترمیم آسیبپذیریها)، آرگون با کسب امتیاز برتر ۶۸ درصد مشترکاً با Astra در رتبه نخست ایستاد. همچنین نسبت به مدل 3.8 Flash Cyber جهشهای فنی زیر را ثبت کرد:
- در بنچمارک جامع داخلی گوگل، طیف وسیعی از باگها را در کدبیسهای مبتنی بر ۲۰ زبان برنامهنویسی آشکار ساخت.
- در آزمون نفوذ جعبهسیاه (Black-box Penetration Testing) شرکت Wiz، در بررسی سیستمهای تحت وبِ زنده بدون دسترسی به سورسکد، توانایی بالاتری در شناسایی سطح حمله، یافتن آسیبپذیریها و تولید شواهد اثبات مفهوم (PoC) نشان داد.

تدابیر و پروتکلهای ایمنی پیشرفته
گوگل فرایند پیش از عرضه عمومی را به تثبیت سازوکارهای امنیتی ذیل چارچوب «Frontier Safety Framework» اختصاص داده است:
- مقابله با سوءاستفادههای مخرب (Misuse): مدل طوری تنظیم شده تا از مشارکت در حملات سایبری یا تسلیحات شیمیایی، بیولوژیکی، رادیولوژیکی و هستهای (CBRN) امتناع ورزد، درحالیکه ماهیت دوگانه تحقیقات مشروع علمی را حفظ میکند. تیمها با پایش اکتیویشنهای داخلی مدل (Internal Activations) تلاش برای دورزدن محدودیتها را رصد میکنند.
- مقاومت در برابر حملات تزریق پرامپت غیرمستقیم (Indirect Prompt Injection): آرگون با بهرهگیری از آزمونهای تیم قرمز خودکار و آموزشهای خصمانه و مقابلهای، رتبه برتر پایداری را در بنچمارک IPI از Gray Swan به دست آورده است.
- نظارت بر همراستایی و اجتناب از انحراف (Misalignment): بهمنظور پیشگیری از رفتارهایی که ورای نیات کاربر است، یک سامانه زنجیره تفکر و اقدامات مدل را بهصورت برخط رصد کرده و در صورت نیاز عملیات را متوقف میکند. گوگل بر شفافیت روند تفکر استدلالی تأکید کرده و یافتههای این پایش را به فرایند آموزش بازخورد نداده است تا مدل شیوه دورزدن ناظران را یاد نگیرد.
- ایمنسازی محیطهای سندباکس: محیطهای ایزوله تست و اجرای مدل باتوجهبه افزایش خودمختاری عاملها ایزوله و مهروموم شدهاند تا ارزیابیهای پرخطر با بالاترین درجه حفاظت اجرا شوند.

رونمایی OpenAI از GPT-6 Sol و GPT-6 Luna؛ هوش پیشرفتهتر با هزینه کمتر

دسترسی به Gemini 4 Argon
جمنای ۴ آرگون با تمرکز بر کدنویسی، تحلیلهای تخصصی و پدافند سایبری بهزودی در مرحله نخست در اختیار مشترکان Google AI Ultra و مشتریان API قرار خواهد گرفت. گوگل مدعیست که جمنای ۴ آرگون را با قابلیتهایی در سطح پیشرو در زمینههای کدنویسی، کارهای دانشمحور، امنیت سایبری و نویسندگی خلاق طراحی کرده تا در مسیر حل دشوارترین چالشها، همراه توسعهدهندگان، متخصصان و سازمانها باشد. گوگل ضمن تشکر از نخستین گروه مدافعان سایبری و آزمایشکنندگان مورداعتماد عنوان میکند که این ارزیابیها و بازخوردهای آنان بر اساس تجربیات واقعی، به آنها کمک میکند تا پیش از عرضه عمومی این مدل که با مشتریان سرویس API پولی و مشترکین Google AI Ultra آغاز میشود؛ قابلیتهای آن را تقویت کند.