Gemini 3.1 Flash-Lite برای هوشمندی در مقیاس بزرگ
گوگل از Gemini 3.1 Flash-Lite، سریعترین و مقرونبهصرفهترین مدل سری Gemini 3 رونمایی کرد. این مدل برای پردازشهای حجیم و پرترافیک توسعهدهندگان در مقیاس بزرگ طراحی شده و باتوجهبه قیمت و سطح مدل، کیفیت بالایی ارائه میدهد. Gemini 3.1 Flash-Lite هماکنون از طریق Gemini API در Google AI Studio و برای شرکتها از طریق Vertex AI بهصورت پیشنمایش در دسترس توسعهدهندگان قرار گرفته است.
صرفهجویی در هزینه بدون کاهش کیفیت
با قیمت تنها ۰.۲۵ دلار بهازای هر ۱ میلیون توکن ورودی و ۱.۵۰ دلار بهازای هر ۱ میلیون توکن خروجی، Gemini 3.1 Flash-Lite عملکرد بهبودیافتهای را با کسری از هزینه مدلهای بزرگتر ارائه میدهد. بر اساس معیارهای Artificial Analysis، این مدل نسبت به Gemini 2.5 Flash، تقریباً ۲.۵ برابر سریعتر در رسیدن به اولین توکن پاسخ و ۴۵ درصد افزایش سرعت خروجی دارد، درحالیکه کیفیت مشابه یا بالاتری را حفظ میکند. این تأخیر کم برای جریانهای کاری با تکرار بالا ضروری است و این مدل را به گزینهای ایدهآل برای توسعهدهندگانی تبدیل میکند که میخواهند تجربههای بلادرنگ و پاسخگو بسازند.
عملکرد برجسته در آزمونها
Gemini 3.1 Flash-Lite توانسته در امتیاز Elo آزمون ۱۴۳۲ کسب کند و در مقایسه با سایر مدلهای همرده در آزمونهای استدلال و درک چندرسانهای عملکرد بهتری داشته باشد؛ از جمله کسب ۸۶.۹ درصد در GPQA Diamond و ۷۶.۸ درصد در MMMU Pro. این مدل حتی از مدلهای بزرگتر نسلهای قبلی مانند Gemini 2.5 Flash نیز پیشی گرفته است.
هوش تطبیقی در مقیاس بزرگ برای توسعهدهندگان
فراتر از عملکرد خام، Gemini 3.1 Flash-Lite به طور پیشفرض با سطوح تفکر در AI Studio و Vertex AI ارائه میشود. این قابلیت به توسعهدهندگان اجازه میدهد کنترل کنند که مدل چقدر «تفکر» برای انجام یک وظیفه انجام دهد، موضوعی که برای مدیریت جریانهای کاری پرتکرار حیاتی است.
Gemini 3.1 Flash-Lite میتواند وظایف حجیم مانند ترجمه طولانی و مدیریت محتوا که هزینه در آنها اولویت دارد را انجام دهد. همچنین میتواند جریانهای کاری پیچیدهتری مانند تولید رابطهای کاربری، ایجاد شبیهسازیها و پیروی از دستورالعملها و داشبوردها را مدیریت کند که نیازمند استدلال عمیقتر هستند.