Generic filters
Search in title
Filter by دسته‌ها
chatGTP
ابزارهای هوش مصنوعی
اخبار
گزارش خبری
پرامپت‌ نویسی
تیتر یک
چندرسانه ای
آموزش علوم داده
اینفوگرافیک
پادکست
ویدیو
دانش روز
آموزش‌های پایه‌ای هوش مصنوعی
اصول هوش مصنوعی
یادگیری بدون نظارت
یادگیری تقویتی
یادگیری عمیق
یادگیری نیمه نظارتی
آموزش‌های پیشرفته هوش مصنوعی
بینایی ماشین
پردازش زبان طبیعی
پردازش گفتار
چالش‌های عملیاتی
داده کاوی و بیگ دیتا
رایانش ابری و HPC
سیستم‌‌های امبدد
علوم شناختی
خطرات هوش مصنوعی
دیتاست
مدل‌های بنیادی
رویدادها
جیتکس
کاربردهای هوش مصنوعی
کتابخانه
اشخاص
شرکت‌های هوش مصنوعی
محصولات و مدل‌های هوش مصنوعی
مفاهیم
کسب‌و‌کار
تحلیل بازارهای هوش مصنوعی
کارآفرینی
هوش مصنوعی در ایران
هوش مصنوعی در جهان
مقاله
پیاده‌سازی هوش مصنوعی
گزارش
مصاحبه
هوش مصنوعی در عمل
یادداشت
 GPT-6 Astra

نسل جدید هوش

GPT-6 Astra

زمان مطالعه: 5 دقیقه

OpenAI از GPT-6 Astra به‌عنوان «هوشمندترین و هم‌راستاترین مدل جهان» رونمایی کرد. این مدل حاصل سال‌ها پژوهش و سرمایه‌گذاری گسترده در حوزه‌های پیش‌آموزش، یادگیری تقویتی و هم‌راستاسازی (Alignment) است و در زمینه‌هایی از جمله استفاده از رایانه، مرور وب، مهندسی نرم‌افزار، امنیت سایبری، علوم و فعالیت‌های حرفه‌ای، عملکردی در سطح پیشرفته ارائه می‌دهد.

Astra در ارزیابی FrontierMath Tier 4 به امتیاز ۹۸ درصد رسیده و به حل برخی مسائل دیرینه و باز ریاضی کمک کرده است. این مدل همچنین در ARC-AGI-3 امتیاز ۹۹.۹ درصد و در ExploitBench امتیاز کامل ۱۰۰ درصد را کسب کرده است. به گفته OpenAI، Astra در استفاده از رایانه و مرورگر نیز مرزهای جدیدی از سرعت، دقت و قضاوت را تعیین می‌کند و برای انجام فعالیت‌های حرفه‌ای پیچیده طراحی شده است.

GPT-6 Astra ابتدا برای گروه محدودی از سازمان‌ها عرضه می‌شود و طی روزهای آینده در اختیار کاربران ChatGPT Plus، Pro، Business و Enterprise و همچنین از طریق OpenAI API، Microsoft Azure و AWS Bedrock قرار خواهد گرفت.

مدل جدید برای استفاده از رایانه

یکی از مهم‌ترین پیشرفت‌های Astra، توانایی آن در استفاده از رایانه است. این مدل می‌تواند کارهای روزمره و زمان‌بر مانند تکمیل فرم‌های آنلاین، به‌روزرسانی سوابق مشتریان در CRM و سازمان‌دهی تقویم را انجام دهد. همچنین قادر است پژوهش آنلاین انجام دهد و خلاصه‌های آن را در ایمیل یا ویرایشگر اسناد آماده کند.

جزئیات بیشتر از نتایج بنچمارک‌ها

Astra می‌تواند داده‌های علمی را تحلیل، نمودار تولید، وب‌سایت ایجاد و آزمون‌های کنترل کیفیت فرانت‌اند را اجرا کند تا عملکرد قابلیت‌های سایت بررسی شود. همچنین می‌تواند در نصب و آزمایش نرم‌افزار و عیب‌یابی مشکلاتی که روی صفحه مشاهده می‌شوند، به‌صورت خودکار کمک کند.

در شبیه‌سازی‌های OSWorld 2.0، Astra در حدود ۴۷ درصد زمان کمتر برای هر وظیفه، عملکرد بالاتری نسبت به GPT-5.6 Sol نشان داده است. Astra با امتیاز ۷۲.۶ درصد، هر وظیفه را در حدود ۴۰ دقیقه انجام داده، درحالی‌که GPT-5.6 Sol با امتیاز ۶۵.۷ درصد حدود ۷۵ دقیقه زمان نیاز داشته است. ترکیب Astra با نسخه به‌روزشده Codex نیز در بنچمارک Mind2Web به تکمیل وظایف با سرعت ۱.۹ برابر بیشتر نسبت به تجربه فعلی GPT-5.6 Sol منجر شده است.

جهشی در کار حرفه‌ای

Astra علاوه بر توانایی استفاده از رایانه، برای محیط‌های حرفه‌ای نیز آموزش هدفمند دیده است. این مدل می‌تواند مسائل پیچیده را حل کند، جریان‌های کاری چندمرحله‌ای را اجرا کند و اسناد، صفحات گسترده و ارائه‌های آماده استفاده تولید کند.

Astra در پیروی از قالب‌های موجود و تولید اسلایدهایی با چیدمان مناسب، مختصر و دارای روایت ساختاریافته عملکرد بهتری دارد. مدل می‌تواند اسناد، ارائه‌ها، صفحات گسترده و تحلیل‌هایی ایجاد کند که با قالب‌های سازمانی، سبک نگارش و سبک بصری موردنظر مطابقت داشته باشند. همچنین آموزش دیده است تا فقط اطلاعات مرتبط با خروجی را وارد کند و از تکرار اطلاعات غیرضروری پرهیز کند.

در شرایطی که دستورالعمل‌ها جای تفسیر داشته باشند، Astra نسبت به مدل‌های قبلی در تصمیم‌گیری عملکرد بهتری دارد. این مدل از زمینه موجود برای پر کردن خلأهای معمول استفاده می‌کند و زمانی که یک ابهام می‌تواند نتیجه را تغییر دهد، سؤال مشخصی مطرح می‌کند. در Codex، حتی می‌تواند به‌صورت غیرهم‌زمان سؤال بپرسد و هم‌زمان کارهایی را که به پاسخ کاربر وابسته نیستند ادامه دهد. در تصمیم‌های مهم منتظر ورودی کاربر می‌ماند و در موارد مناسب، با فرض‌های منطقی کار را ادامه می‌دهد.

Astra همچنین بهتر می‌تواند در طول تغییر مسیر یک پروژه، هدف اصلی و محدودیت‌های قبلی را حفظ کند. این مدل الزامات جدید را در نظر می‌گیرد، در صورت درخواست مسیر خود را تغییر می‌دهد و به پرسش‌های جانبی پاسخ می‌دهد، بدون آنکه هدف کلی کار را از دست بدهد.

مهندسی نرم‌افزار و علوم

OpenAI، مدلل GPT-6 Astra را بهترین مدل خود برای مهندسی نرم‌افزار معرفی می‌کند. در Codex، روش جدیدی برای حفظ و بازیابی زمینه هنگام پر شدن پنجره زمینه ارائه شده است. برخلاف فشرده‌سازی سنتی که ممکن است جزئیاتی مانند علت شکست یک راه‌حل یا رفتار یک مؤلفه را حذف کند، Astra می‌تواند یادداشت‌هایی را میان پنجره‌های زمینه حفظ کند. پنجره‌های قبلی نیز قابل جست‌وجو باقی می‌مانند و مدل می‌تواند الزامات، نتایج آزمون‌ها و خروجی ابزارهای قبلی را بازیابی کند.

در حوزه کشف علمی، ریاضیات و سلامت نیز Astra نتایج جدیدی ارائه کرده و رکوردهای تازه‌ای در مجموعه‌ای از ارزیابی‌های ریاضی و علمی به ثبت رسانده است. این مدل می‌تواند با ترکیب استدلال علمی و استفاده از رایانه، مستقیماً با نرم‌افزارهای تخصصی کار کند، داده‌ها را بررسی و نتایج را کاوش کند و به پژوهشگران در ارزیابی شواهد و انتخاب مسیر تحقیقات بعدی کمک کند.

امنیت سایبری؛ توانایی بیشتر و ضرورت محافظت بیشتر

OpenAI می‌گوید Astra در قابلیت‌های سایبری جهش قابل‌توجهی داشته و در چارچوب Preparedness Framework به آستانه بحرانی رسیده است. توانایی شناسایی و توسعه اکسپلویت‌های zero-day می‌تواند به مدافعان برای یافتن و برطرف‌کردن آسیب‌پذیری‌ها کمک کند، اما هم‌زمان نیاز به سازوکارهای حفاظتی قوی‌تر را افزایش می‌دهد.

در ExploitBench، Astra بدون سازوکارهای حفاظتی تولیدی، امتیاز کامل ۱۰۰ درصد کسب کرد؛ درحالی‌که GPT-5.6 Sol امتیاز ۷۸.۵ درصد داشت. در ExploitGym نیز Astra به نرخ موفقیت ۴۲.۴ درصد رسید، در برابر ۳۰.۳ درصد برای GPT-5.6 Sol، آن هم با استفاده از توکن‌های خروجی به‌مراتب کمتر.

در یک ارزیابی داخلی با آسیب‌پذیری‌های سه ماه گذشته، Astra نرخ اجرای کد دلخواه بالاتری نسبت به GPT-5.6 Sol داشت و در جریان ارزیابی دو آسیب‌پذیری zero-day ناشناخته را کشف و مورداستفاده قرار داد. OpenAI اعلام کرده این دو آسیب‌پذیری را به نگه‌دارندگان مربوطه گزارش کرده است.

در SRE-Bench، Astra در تلاش اول ۸۸ درصد و در چهار تلاش ۹۹.۲ درصد وظایف را حل کرد؛ در مقابل، GPT-5.6 Sol به ترتیب ۵۵.۹ و ۶۸.۷ درصد کسب کرد.

با وجود این قابلیت‌ها، نسخه عرضه‌شده Astra از انجام برخی فعالیت‌های پیشرفته سایبری، مانند ایجاد اکسپلویت اثبات مفهومی، خودداری می‌کند. OpenAI همچنین اعلام کرده قصد دارد در هفته‌های آینده از طریق OpenAI Daybreak دسترسی گسترده‌تر و سازوکارهای حفاظتی کم‌محدودیت‌تری برای جریان‌های کاری دفاعی ارائه کند.

هم‌راستاسازی و استقرار مسئولانه

OpenAI  مدل Astra را هم‌راستاترین مدل خود معرفی می‌کند؛ مدلی که در رعایت مرزهای وظیفه، توجه به ریسک و ارتباط شفاف با کاربر بهبود یافته است. در یک ارزیابی از وظایف رایانه‌ای طراحی‌شده برای تحریک رفتار نامطلوب، Astra در جلوگیری از پیامدهای ناخواسته عملکرد بهتری داشت. در یک ارزیابی داخلی، Astra هرگز تلاش نکرد محدودیت ردشده توسط Codex Auto-Review را دور بزند؛ حتی زمانی که این محدودیت عمداً قابل دورزدن تنظیم شده بود و بدون دورزدن آن، تکمیل وظیفه ممکن نبود.

Astra همچنین نسبت به GPT-5.6 Sol سه برابر کمتر احتمال دارد درباره قابلیت‌ها و امکانات خود ادعاهای نادرست ارائه کند. بااین‌حال، ارزیابی‌ها نشان داده‌اند که استدلال نوشتاری Astra در آزمون‌هایی که مدل را به فرار از نظارت وادار می‌کردند، دشوارتر از GPT-5.6 Sol قابل‌پایش است. OpenAI این موضوع را جدی می‌داند و بهبود قابلیت پایش‌پذیری را همچنان یک اولویت پژوهشی عنوان کرده است.

برای کنترل رفتارهای ناایمن، علاوه بر آموزش هم‌راستاسازی، سازوکارهایی مانند Codex Auto-Review و سیستم‌های پایش استدلال و اقدامات مدل نیز به کار گرفته می‌شوند. OpenAI همچنین برای مدل‌های کلاس Astra، پایش نامم‌راستایی را در محیط تولید مستقر می‌کند؛ این سامانه‌ها با استفاده از طبقه‌بندی‌کننده‌ها، استدلال و اقدامات مدل را برای شناسایی رفتارهای غیرمجاز بررسی کرده و در صورت لزوم فعالیت را متوقف می‌کنند.

عرضه و قیمت‌گذاری

GPT-6 Astra برای کاربران اشتراکی Plus، Pro، Business و Enterprise عرضه خواهد شد و کاربران Pro، Business و Enterprise به GPT-6 Astra Pro نیز دسترسی خواهند داشت. مدیران Enterprise می‌توانند Astra را برای فضای کاری خود فعال کنند، اما دسترسی در زمان عرضه به‌صورت پیش‌فرض غیرفعال است.

برای توسعه‌دهندگان، مدل با نام gpt-6-astra در OpenAI API و همچنین از طریق Microsoft Azure و Amazon Bedrock در دسترس خواهد بود. قیمت استاندارد API برابر با ۱۰ دلار به‌ازای هر یک میلیون توکن ورودی و ۵۰ دلار به‌ازای هر یک میلیون توکن خروجی اعلام شده است. نرخ‌های جداگانه‌ای برای خواندن و نوشتن cache وجود دارد. حالت Fast نیز با سرعتی تا دو برابر پردازش استاندارد و با هزینه‌ای دو برابر ارائه می‌شود.

مطالب پیشنهادی مرتبط

اشتراک در
اطلاع از
0 نظرات
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها

در جریان مهم‌ترین اتفاقات AI بمانید

هر هفته، خلاصه‌ای از اخبار، تحلیل‌ها و رویدادهای هوش مصنوعی را در ایمیل‌تان دریافت کنید.

[wpforms id="48325"]