جدیدترین تحولات هوش مصنوعی را در کانال بله هوشیو بخوانید

Generic filters
Search in title
Filter by دسته‌ها
chatGTP
ابزارهای هوش مصنوعی
اخبار
گزارش خبری
پرامپت‌ نویسی
تیتر یک
چندرسانه ای
آموزش علوم داده
اینفوگرافیک
پادکست
ویدیو
دانش روز
آموزش‌های پایه‌ای هوش مصنوعی
اصول هوش مصنوعی
یادگیری بدون نظارت
یادگیری تقویتی
یادگیری عمیق
یادگیری نیمه نظارتی
آموزش‌های پیشرفته هوش مصنوعی
بینایی ماشین
پردازش زبان طبیعی
پردازش گفتار
چالش‌های عملیاتی
داده کاوی و بیگ دیتا
رایانش ابری و HPC
سیستم‌‌های امبدد
علوم شناختی
خطرات هوش مصنوعی
دیتاست
مدل‌های بنیادی
رویدادها
جیتکس
کاربردهای هوش مصنوعی
کتابخانه
اشخاص
شرکت‌های هوش مصنوعی
محصولات و مدل‌های هوش مصنوعی
مفاهیم
کسب‌و‌کار
تحلیل بازارهای هوش مصنوعی
کارآفرینی
هوش مصنوعی در ایران
هوش مصنوعی در جهان
مقاله
پیاده‌سازی هوش مصنوعی
گزارش
مصاحبه
هوش مصنوعی در عمل
یادداشت
 رونمایی از مدل‌های Claude Fable 5 و Claude Mythos 5

و حالا نسل جدید آنتروپیک

رونمایی از مدل‌های Claude Fable 5 و Claude Mythos 5

زمان مطالعه: 11 دقیقه

آنتروپیک به طور رسمی از جدیدترین دستاورد خود در حوزه هوش مصنوعی، یعنی مدل‌های Claude Fable 5 و Claude Mythos 5 رونمایی کرد.

ساخته‌شده برای امنیت

به ادعای آنتروپیک، قابلیت‌های Fable 5 از هر مدلی که تابه‌حال به‌صورت عمومی در دسترس قرار داده، فراتر می‌رود. این مدل در تقریباً تمامی شاخص‌های ارزیابی آزموده شده برای سنجش توانمندی هوش مصنوعی، در بالاترین سطح فناوری قرار دارد و عملکرد فوق‌العاده‌ای در مهندسی نرم‌افزار، کارهای دانشی، بینایی ماشین، تحقیقات علمی و بسیاری از حوزه‌های دیگر نشان می‌دهد. هر چه مأموریت محول‌شده طولانی‌تر و پیچیده‌تر باشد، پیشتازی Fable 5 نسبت به سایر مدل‌های چشمگیرتر می‌شود.

عرضه مدلی با این سطح از توانمندی، خطراتی را نیز به همراه دارد. بدون وجود ابزارهای حفاظتی، قابلیت‌های Fable 5 در حوزه‌هایی مانند امنیت سایبری می‌تواند مورد سوءاستفاده قرار گرفته و آسیب‌های جدی به بار آورد. ازاین‌رو، آنتروپیک این مدل را همراه با لایه‌های حفاظتی عرضه می‌کند. کوئری‌ها و پرامپت‌های مربوط به برخی موضوعات خاص به‌جای اینکه با این مدل پاسخ داده شوند، توسط دومین مدل قدرتمند آنتروپیک یعنی Claude Opus 4.8 پاسخ داده خواهند شد. برای عرضه هم‌زمان ایمن و سریع این مدل، آنتروپیک این ابزارهای حفاظتی را به‌صورت محافظه‌کارانه تنظیم کرده است؛ این لایه‌ها حتی گاهی درخواست‌های بی‌ضرر را نیز مسدود می‌کنند، اگرچه به طور متوسط در کمتر از ۵ درصد از نشست‌ها فعال می‌شوند. با ورود مدل‌های قدرتمندتر در ماه‌های آینده، آنتروپیک در تلاشیم تا ابزارهای حفاظتی خود را بهبود بخشیده و نرخ تشخیص‌های مثبت نادرست (False Positives) را با بیشترین سرعت ممکن کاهش دهد.

علاوه بر این مدل، آنتروپیک برای گروه کوچکی از مدافعان سایبری و ارائه‌دهندگان زیرساخت مدل Claude Mythos 5 را عرضه کرده است. این مدل از نظر زیرساختی کاملاً مشابه Fable 5 است، اما لایه‌های حفاظتی آن در برخی حوزه‌ها برداشته شده است. Mythos 5 در ابتدا از طریق Project Glasswing و با همکاری دولت ایالات متحده، به‌عنوان نسخه ارتقایافته‌ی Claude Mythos Preview مستقر خواهد شد. این مدل قوی‌ترین قابلیت‌های امنیت سایبری را در میان تمامی مدل‌های جهان داراست. آنتروپیک قصد دارد به‌زودی دسترسی به Mythos 5 را از طریق یک برنامه دسترسی مطمئن و گسترده‌تر (Trusted Access Program) توسعه دهد.

در هوشیو بخوانید:
Project Glasswing: تأمین امنیت نرم‌افزارهای حیاتی برای عصر هوش مصنوعی

مدل‌های Fable 5 و Mythos 5 با قیمت ۱۰ دلار به‌ازای هر میلیون توکن ورودی و ۵۰ دلار به‌ازای هر میلیون توکن خروجی عرضه می‌شوند که این رقم کمتر از نصف قیمت Claude Mythos Preview است. این عرضه مشترک، گام دیگری در راستای هدف آنتروپیک جهت ارائه قابلیت‌های پیشرفته هوش مصنوعی به بیشترین تعداد کاربران ممکن، در سریع‌ترین زمان و با بالاترین امنیت است.

در هوشیو بخوانید:
Mythos، مدل هوش مصنوعی جدید Anthropic چقدر می‌تواند خطرناک باشد؟

ارزیابی Claude Fable 5 و Claude Mythos 5

جدول زیر قابلیت‌های Fable 5 و Mythos 5 را با سایر مدل‌های پیشرو مقایسه می‌کند.

جدول شاخص‌های ارزیابی عملکرد کلود Fable 5 و Mythos 5 در مقایسه با سایر مدل‌های پیشرو

Fable 5 و Mythos 5 می‌توانند برای مدت‌زمان طولانی‌تری نسبت به هر یک از مدل‌های قبلی Claude، به‌صورت خودمختار فعالیت کنند. در ادامه به بررسی بخشی از توانایی‌های این مدل‌ها در حوزه‌های مختلف می‌پردازیم.

مهندسی نرم‌افزار: در طول آزمایش‌های اولیه، شرکت Stripe گزارش داد که Fable 5 ماه‌ها کار مهندسی را در چند روز فشرده کرده است. در یک پایگاه کد زبان روبی با ۵۰ میلیون خط کد، این مدل یک جابه‌جایی سرتاسری در پایگاه کد را تنها در یک روز انجام داد؛ کاری که در غیر این صورت انجام دستی آن توسط یک تیم کامل بیش از دو ماه زمان می‌برد. Fable 5 همچنین از نظر مصرف توکن کارآمدتر از مدل‌های پیشین Claude است: در ارزیابی FrontierCode متعلق به Cognition که توانایی مدل‌ها را در پشت سر گذاشتن مأموریت‌های دشوار برنامه‌نویسی در عین رعایت استانداردهای پایگاه‌های کد عملیاتی و باکیفیت، می‌سنجد؛ Fable 5 بالاترین امتیاز را در میان مدل‌های پیشرو، حتی با صرف سطح تلاش (effort) متوسط، کسب کرده است.

کارهای دانش‌محور:  Fable 5 عملکرد قدرتمندی در وظایف تحلیلی پیچیده نشان می‌دهد. در شاخص ارزیابی مالی Hebbia برای سنجش استدلال در سطح ارشد، Fable 5 بالاترین امتیاز را در میان تمامی مدل‌ها داراست و پیشرفت‌های چشمگیری در استدلال مبتنی بر سند، تفسیر نمودار و جدول و حل مسئله داشته است. شرکت IMC نیز عنوان می‌کند که Fable 5 در ارزیابی‌های تحلیل معاملات آن‌ها تقریباً در تمامی زمینه‌ها از جمله جستجوی واقعیات، استدلال مفهومی، تحلیل ریشه خطا (Root-cause Analysis) و تحلیل ارزش موردانتظار نمره کامل کسب کرده است.

بینایی ماشین: مدل Fable 5 استاندارد پیشرو جدیدی برای وظایف مرتبط با بینایی ماشین است. این مدل می‌تواند اعداد دقیق را از نمودارهای علمیِ پرجزئیات استخراج کند و وظایف پیچیده مبتنی بر بینایی مانند بازسازی کد منبع یک اپلیکیشن وب را صرفاً از روی تصاویر اسکرین‌شات انجام دهد. این مدل همچنین به ساختارهای کمکی کمتری نیاز دارد؛ به‌عنوان‌مثال، مدل‌های قبلی Claude برای بازی Pokémon FireRed حتی با وجود ساختارهای کمکی که ابزارهای مفید اضافی در اختیارشان می‌گذاشت با مشکل مواجه می‌شدند، اما Fable 5 این بازی را تنها با یک ساختار کمکی حداقلی و صرفاً مبتنی بر بینایی ماشین با موفقیت انجام داد.

حافظه و زمینه طولانی: مدل Fable 5 تمرکز خود را در میان میلیون‌ها توکن در مأموریت‌های طولانی‌مدت حفظ می‌کند و خروجی‌هایش را با استفاده از یادداشت‌های خود بهبود می‌بخشد. هنگامی آنتروپیک مدل را در بازی کارتی Slay the Spire آزمایش کرد دریافت که اختصاص دسترسی به حافظه پایدار مبتنی بر فایل، عملکرد آن را سه برابر بیشتر از مدل Opus 4.8 بهبود بخشید و همچنین سه برابر بیشتر به پرده پایانی بازی راه یافت.

طراحی دارو: متخصصان داخلی آنتروپیک در زمینه طراحی پروتئین، با استفاده از Mythos 5، ابعادی از فرایند طراحی دارو را حدوداً ده برابر سریع‌تر کردند. در یک نمونه، آن‌ها دریافتند که Mythos 5 با استفاده از ابزارهای طراحی پروتئین و بیوانفورماتیک و بدون هیچ‌گونه کمک انسانی، با اپراتورهای انسانی ماهر برابری کرده یا آن‌ها را شکست می‌دهد. در انجام این کار، مدل تمامی مأموریت‌هایی را که معمولاً توسط یک دانشمند تکمیل می‌شود اجرا می‌کند؛ از جمله انتخاب سایت‌های اتصال (Binding Sites)، انتخاب و اجرای ابزارهای طراحی پروتئین و بازیابی و اصلاح فرایند پس از مواجهه با خطاها در طول مسیر. ۹ مورد از ۱۴ هدف پروتئینی این مطالعه (که در زیر نشان داده شده است) گزینه‌هایی جدی برای طراحی دارو ایجاد کردند که آنتروپیک در حال حاضر مشغول بررسی آن‌هاست.

کمپلکس‌های پروتئینی طراحی‌شده توسط Mythos 5. اهداف شامل نقاط بازرسی ایمنی، سیگنال‌دهی فاکتور رشد و گیرنده، تخریب سیستم عصبی، بیماری‌های عضلانی و اهداف ساختاری سخت‌تر هستند.

فرضیه‌های نوین در زیست‌شناسی مولکولی: مدل Mythos 5 نخستین مدل آنتروپیک است که به طور مداوم فرضیه‌های علمی نوین و متقاعدکننده‌ای تولید می‌کند. در مقایسه‌های موسوم به مقایسه «رودرروی کورکورانه» (Blinded head-to-head) در برابر مدل‌های کلاس Opus، دانشمندان آنتروپیک فرضیه‌های زیست‌شناسی مولکولی مدل Mythos را در حدود ۸۰ درصد مواقع ترجیح دادند و چندین مورد را برای ارزیابی آزمایشگاهی پیش برده‌اند. در این میان، یکی از فرضیه‌های Mythos  که یک مکانیسم نوین برای یک پروتئینِ باکتری E. coli اراده می‌داد، در مطالعه‌ای از سوی یک آزمایشگاه دیگر که به طور مستقل روی همان مسئله کار می‌کرد، تأیید و صحت‌سنجی شد.

تحقیقات نوین در ژنومیک: مدل Mythos 5 تحقیقات جدیدی را در حوزه ژنومیک در طول بیش از یک هفته کار عمدتاً خودمختار انجام داد. این مدل داده‌های تک‌سلولی میلیون‌ها سلول شامل ۱۳۸ گونه جانوری را گردآوری کرد و یک مدل یادگیری ماشین سفارشی را برای شناسایی سلول‌هایی با نقش یکسان در ارگانیسم‌هایی حتی با خویشاوندی دور، طراحی کرد و آموزش داد. مدل آموزش‌دیده توسط Mythos 5، تنها با ورودی‌های انسانی در سطح کلان، از مدل اخیراً منتشر شده در مجله معتبر Science عملکرد بهتری نشان داد؛ حتی باوجوداینکه ۱۰۰ برابر کوچک‌تر از آن بود.

هم‌راستایی (Alignment): آنتروپیک در ارزیابی خودکار هم‌راستایی دریافت که میزان رفتارهای ناهم‌راستای Mythos 5 (شامل اقداماتی مانند فریب‌کاری و همکاری با سوءاستفاده کاربر از مدل) پایین و مشابه مدل Opus 4.8 بوده است. باتوجه‌به اینکه آن‌ها از یک مدل زیرساختی مشترک بهره می‌برند، سطح هم‌راستایی Fable 5 نیز مشابه خواهد بود. این ارزیابی به طور کامل همراه با مجموعه مفصلی از دیگر آزمون‌های ایمنی و قابلیت‌ها در شناسنامه سیستم (System Card) مدل تشریح شده است.

سطح کلی رفتارهای ناهم‌راستا بر اساس ارزیابی خودکار هم‌راستایی آنتروپیک.

ابزارهای حفاظتی جدید Claude Fable 5

مدل‌های Mythos-class به آستانه‌ای رسیده‌اند که خطرات قابل‌توجهی را ایجاد می‌کنند. در ماه آوریل آنتروپیک پروژه گلس‌وینگ را آغاز کرد و اولین مدل از این کلاس یعنی Claude Mythos Preview را تنها در اختیار گروه محدودی از مدافعان سایبری و ارائه‌دهندگان زیرساخت‌های نرم‌افزاری حیاتی قرار داد. هنگام انجام این کار، اعلام کرد که امیدوار است در نهایت قابلیت‌های سطح Mythos را در اختیار همه کاربران خود قرار دهد، مشروط بر اینکه ابزارهای حفاظتی جدیدی توسعه داده باشد که به‌اندازه کافی برای جلوگیری از سوءاستفاده قوی و قابل‌اطمینان باشند.

آنتروپیک طی چند ماه گذشته در حال بهبود این ابزارهای حفاظتی بوده و آن‌ها اکنون برای عرضه عمومی به‌اندازه کافی مستحکم هستند. ازآنجاکه ایمنی در اولویت قرار دارد، آنتروپیک به‌عمد این لایه‌های حفاظتی را به‌گونه‌ای تنظیم کرده که محتاطانه عمل کنند. این لایه‌ها همچنان سخت‌گیرانه‌تر از حالت ایده‌آل هستند. در ادامه به بررسی ابزارهای حفاظتی جدید Fable 5 می‌پردازیم.

طبقه‌بندی‌کننده‌های ایمنی

قابلیت‌های پیشرو در امنیت سایبری و تحقیقات زیست‌شناسی مدل‌های کلاس Mythos به این معنی است که آن‌ها خطر قابل‌توجهی از حیث ارتقای توانمندی بازیگران مخرب ایجاد می‌کنند. به بیانی دیگر، این مدل‌ها می‌توانند اطلاعات یا مشاوره‌هایی را ارائه دهند که به آن بازیگران در ایجاد آسیب‌های جدی کمک کند؛ اطلاعاتی که آن‌ها نمی‌توانستند از منابع دیگر (مثلاً از موتورهای جستجوی اینترنتی) دریافت کنند. فراتر از آن، بخش زیادی از استفاده‌های پیشرفته از مدل‌های هوش مصنوعی دارای کاربرد دوگانه است: همان کوئری‌هایی که در دست متخصصان امنیت سایبری و پژوهشگران زیست‌شناسی مفید هستند، در صورت دردسترس‌بودن برای بازیگران مخرب می‌توانند خطرناک باشند.

خود این ابزارهای حفاظتی باید در برابر تلاش‌های مستمر و پیچیده برای دورزدن سیستم که به‌عنوان «قفل‌شکنی یا جیلبریک» (jailbreaking) نیز شناخته می‌شود مقاومت کنند. ارتقای توانمندی ناشی از قابلیت‌های سطح  Mythos برای بسیاری از مهاجمان ارزشمند است و بنابراین انتظار می‌رود که آن‌ها انگیزه بالایی برای تلاش جهت دورزدن اقدامات امنیتی این مدل‌های جدید داشته باشند.

مدل Fable 5 همراه با مجموعه جدیدی از طبقه‌بندی‌کننده‌های عرضه می‌شود. طبقه‌بندی‌کننده‌ها یا classifier سیستم‌های هوش مصنوعی مجزایی هستند که سوءاستفاده‌های بالقوه، از جمله تلاش‌های جیلبریک را شناسایی کرده و مانع از پاسخگویی مدل اصلی، در این مورد Fable 5 می‌شوند.

هنگامی که طبقه‌بندهای Fable درخواستی مرتبط با امنیت سایبری، زیست‌شناسی و شیمی، یا تقطیر (Distillation) را شناسایی کنند، نحوه پاسخ‌دهی به طور خودکار توسط Claude Opus 4.8 مدیریت می‌شود. کاربران هر زمان که این اتفاق بیفتد مطلع خواهند شد. Opus 4.8 به‌خودی‌خود یک مدل بسیار توانمند است و پاسخی که به Opus  واگذار می‌شود، تجربه به‌مراتب بهتری نسبت به رد کامل درخواست از سوی Fable است. داده‌های اولیه آنتروپیک نشان می‌دهد که بیش از ۹۵ درصد از نشست‌های Fable اصلاً شامل هیچ‌گونه واگذاری پاسخ نمی‌شوند؛ برای آن نشست‌ها، عملکرد Fable 5 عملاً همانند Mythos 5 است.

زمینه‌های تحت پوشش طبقه‌بندها به شرح زیر است:

امنیت سایبری

مدل‌های کلاسMythos  در کشف و اکسپلویت (Exploiting) آسیب‌پذیری‌های نرم‌افزاری برتری دارند؛ بنابراین می‌توانند حملات سایبری را به طور قابل‌توجهی آسان‌تر و ارزان‌تر کنند. مدل‌های کلاسMythos  همچنین مهارت‌های قوی در هک عامل‌محور نشان می‌دهند. این امر شامل انجام چندین بخش مختلف از یک حمله سایبری علاوه بر یافتن اکسپلویت‌ها می‌شود؛ از جمله شناسایی، اکتشاف، حرکت عرضی (Lateral Movement) و موارد دیگر. برای جلوگیری از اینکه این مهارت‌های هک عامل‌محور باعث ارتقای توانمندی در حملات سایبری شوند، آنتروپیک طبقه‌بندی‌کننده‌های امنیت سایبری خود را به‌گونه‌ای طراحی کرده که هم اکسپلویت و هم مأموریت‌های سایبری تهاجمی را به معنای وسیع‌تر پوشش دهند. همان‌طور که در نمودار زیر نشان داده شده است، طبقه‌بندی‌کننده‌های آنتروپیک مانع از پیشرفت Fable در این مأموریت‌ها می‌شوند.

نتایج اجرای ارزیابی‌های سایبری، در حالتی از Fable 5 که پاسخ‌ها را مسدود می‌کند، به‌جای اینکه آن‌ها را به Opus 4.8 واگذار کند. ارزیابی‌ها شامل تلاش برای دورزدن ابزارهای حفاظتی نبودند.

آنتروپیک  طبقه‌بندی‌کننده‌های خود را به طور گسترده تحت آزمون تیم قرمز (Red-teamed) قرار داد تا استحکام آن‌ها را در برابر جیلبریک آزمایش کند. علاوه بر آزمایش‌های داخلی، آنتروپیک یک برنامه پاداش باگ (Bug Bounty) خارجی را اجرا کرد که در بیش از ۱۰۰۰ ساعت آزمایش، هیچ‌گونه جیلبریک سراسری ایجاد نکرد. سازمان‌های آزمون تیم قرمز خارجی نیز تاکنون موفق به یافتن هیچ جیلبریک سراسری در مأموریت‌های عامل‌محور طولانی‌مدت در سیستم عملیاتی آنتروپیک نشده‌اند؛ اگرچه مؤسسه ایمنی هوش مصنوعی بریتانیا (UK AISI) در یک بازه زمانی کوتاه آزمایش اولیه، به پیشرفت‌هایی در این زمینه دست یافته است. احتمالاً جلوگیری کاملاً مطلق از جیلبریک‌های سراسری غیرممکن است، اما هدف آنتروپیک این است که جیلبریک‌های باقی‌مانده را به‌اندازه‌ای کند و هزینه‌بر کند که بتواند آن‌ها را قبل از استفاده در مقیاس وسیع، شناسایی و از آن‌ها جلوگیری کنیم.

نمودار زیر، برگرفته از یکی از ارزیابی‌های داخلی آنتروپیک است نشان می‌دهد که چگونه ابزارهای حفاظتی Fable 5 مقاومت بیشتری در برابر جیلبریک نسبت به مدل‌های قبلی ما که به طور عمومی در دسترس بودند، ایجاد می‌کنند.

نتایج یک ارزیابی داخلی که در آن یک عضو خودکار تیم قرمز تلاش می‌کند از مدل برای تکمیل یک مأموریت کوتاه مرتبط با امنیت سایبری تهاجمی در ۴۰۰ نوبت استفاده کند و در صورت مسدودشدن، فرایند را بازراه‌اندازی و به عقب بازمی‌گرداند. این مأموریت‌ها عمدتاً ساده هستند و نماینده استفاده سایبری واقعی نیستند و حتی گاهی به‌سادگی رمزگذاری فایل‌ها روی یک سرور از راه دور هستند. در مأموریت‌های پیچیده‌تر و واقعی‌تر، هنوز جیلبریک‌های موفقی در سیستم عملیاتی آنتروپیک مشاهده نشده است. توجه داشته باشید که Opus 4.6 فاقد ابزارهای حفاظتی مسدودکننده سایبری است.

یکی از شرکای خارجی آنتروپیک دریافت که ابزارهای حفاظتی Fable 5 در برابر کوئری‌های سایبری مضر، مستحکم‌ترین لایه حفاظتی را میان در میان تمامی مدل‌های آزمایش‌شده از جمله Opus 4.8 و Opus 4.7 دارا است. Fable 5 با هیچ‌یک از درخواست‌های تک‌نوبتی مربوط به برنامه‌ریزی یک حمله سایبری، توسعه اکسپلویت یا فرار از لایه‌های دفاعی موافقت نکرد. این امر چه در زمانی که درخواست‌ها از ۳۰ تکنیک مختلف جیلبریک عمومی استفاده می‌کردند و چه زمانی که استفاده نمی‌کردند، صادق بود.

زیست‌شناسی و شیمی

آنتروپیک مدت‌هاست از طبقه‌بندی‌کننده‌های خود برای مسدودکردن پاسخ مدل‌های به انتخاب محدودی از کوئری‌ها مرتبط با سلاح‌های بیولوژیکی استفاده کرده است. اما اعتراف می‌کند که دیگر مطمئن نیست که مسدودکردن این انتخاب محدود کافی باشد. این امر دو دلیل دارد. اول اینکه دلایلی برای نگرانی در مورد بازیگران مخرب با منابع مالی خوب وجود دارد که تلاش می‌کنند از مدل‌ها برای تحقیقات بیولوژیکی بسیار خطرناک سوءاستفاده کنند. دوم اینکه مدل‌ها اکنون توانایی بیشتری برای انجام مأموریت‌های علمی در جهان واقعی دارند.

به‌عنوان‌مثال، آنتروپیک توانایی Mythos 5 را برای تکمیل یک گام چالش‌برانگیز در طراحی ویروس‌های وابسته به آدنو (AAVs) آزمایش کرد. ویروس‌های AAV جزئی برای انتقال ژن‌درمانی هستند، اما همین قابلیت در دست افراد نادرست، می‌تواند طراحی ویروس‌های خطرناک را امکان‌پذیر کند. در این مأموریت، مدل‌های مختلف هوش مصنوعی بر اساس توانایی‌شان در پیش‌بینی اینکه چگونه یک اصلاح ژنتیکی بر مونتاژ پوسته خارجی ویروس تأثیر می‌گذارد ارزیابی شدند (در میان مجموعه‌ای از گزینه‌های منتشرنشده و مرتبط با درمان که توسط Dyno Therapeutics توسعه یافته‌اند). آنتروپیک مدل‌های خود را صریحاً برای انجام این مأموریت آموزش نداده و بااین‌حال مدل‌های کلاس Mythos تنها با استفاده از استدلال بیولوژیکی خود، از مدل‌های پیچیده اختصاصی که به‌عنوان «مدل‌های زبانی پروتئینی» (protein language models) شناخته می‌شوند، عملکرد بهتری نشان دادند. این امر توانایی نویدبخشی را برای تکمیل مأموریت‌های ساده اما مهم در تحقیق‌وتوسعه ژن‌درمانی نشان می‌دهد؛ اما درعین‌حال خطر ناشی از چنین قابلیت‌های دوگانه‌ای را برجسته می‌کند.

نتایج ارزیابی که در آن مدل‌های آنتروپیک ویژگی‌های تجربی منتشرنشده‌ی پوسته ویروسی یک ویروس ساده را پیش‌بینی کردند. مونتاژ پوسته ویروسی ساده‌ترین ویژگی ویروسی برای پیش‌بینی در این بافت است، اما بااین‌وجود ویژگی مهمی است که هنگام طراحی ویژگی‌های پیچیده‌تر باید به‌درستی انجام شود

اولویت آنتروپیک عرضه ایمن Fable در سریع‌ترین زمان ممکن بود، حتی به قیمت داشتن ابزارهای حفاظتی بیش از حد گسترده. بنابراین، در حال حاضر ترتیبی اتخاذ شده که پاسخ‌های Fable در بیشتر درخواست‌های مربوط به زیست‌شناسی و شیمی به Opus 4.8 واگذار شود.

تقطیر (Distillation)

آنتروپیک پیش‌ازاین نیز اقدامات بزرگ‌مقیاسی را در جهت تقطیر مدل‌های خود جهت آموزش مدل‌های رقیب در کشورهای اقتدارگرا شناسایی کرده است. تقطیر توانایی‌های Fable 5 می‌تواند به طور غیرمستقیم منجر به اشاعه قابلیت‌های هوش مصنوعی نزدیک به مرزهای دانش شود و این قابلیت‌ها ممکن است بدون ابزارهای حفاظتی مناسب عرضه شوند. درخواست‌هایی که توسط طبقه‌بندی‌کننده‌های آنتروپیک به‌عنوان بخشی از اقدامات مشابه تقطیر نشانه‌گذاری شوند، به Opus 4.8 واگذار خواهند شد.

سیاست جدید حفظ داده‌ها

سرانجام، آنتروپیک در حال ایجاد تغییری در نحوه مدیریت داده‌های مشتریان سازمانی برای Fable 5، Mythos 5 و مدل‌های آینده با سطوح قابلیت مشابه یا بالاتر است. آنتروپیک برای تمامی ترافیک روی مدل‌های کلاس Mythos ، چه در بسترهای تحت مالکیت خودش (First-party) و چه در بسترهای شخص ثالث (Third-party)، به یک دوره نگهداری ۳۰ روزه نیاز دارد. آنتروپیک از این داده‌ها برای آموزش مدل‌های جدید Claude یا برای هیچ هدف غیرمرتبط با ایمنی استفاده نخواهیم کرد و حفاظت‌های حریم خصوصی جدیدی را ایجاد کرده است؛ از جمله ثبت (Logging) تمامی دسترسی‌های انسانی به داده‌ها و تضمین حذف آن‌ها پس از ۳۰ روز در تقریباً تمامی موارد (جزئیات بیشتر). این داده‌ها کمک می‌کنند تا در برابر حملات پیچیده و نوین (شامل جیلبریک‌های جدید و حملاتی که در میان درخواست‌های متعدد عمل می‌کنند) دفاع مناسب انجام شود و همچنین در شناسایی و کاهش نرخ تشخیص‌های مثبت نادرست کمک خواهند کرد.

Claude Mythos 5 و برنامه دسترسی مطمئن

از امروز، تمامی کاربرانی که در حال حاضر به Claude Mythos Preview دسترسی دارند (به‌عنوان‌مثال، شرکای امنیت سایبری در پروژه گلس‌وینگ) می‌توانند سیستم خود را به Claude Mythos 5 ارتقا دهند؛ همان مدل Claude Fable 5 اما بدون لایه‌های حفاظتی سایبری. کاربران متوجه خواهند شد که Mythos 5 در بیشتر موارد با Mythos Preview قابل‌مقایسه یا تا حدودی قوی‌تر از آن است، درحالی‌که هزینه بسیار کمتری دارد.

در رایزنی با دولت ایالات متحده، آنتروپیک برنامه‌ریزی کرده است تا دسترسی به Claude Mythos 5 را به طور پیوسته گسترش دهیم، افزودن دوره‌ای شرکای جدید را ادامه دهد و همچنین یک برنامه دسترسی مطمئن را دنبال کند که به سازمان‌های امنیت سایبری اجازه می‌دهد به شیوه‌ای نظام‌مندتر درخواست خود را ثبت کنند.

برنامه‌های آنتروپیک همچنین شامل آغاز یک برنامه دسترسی مطمئن برای زیست‌شناسی است تا به تسریع تحقیقات زیست‌پزشکی و کشف درمان‌های جدید با قابلیت‌های کلاس Mythos کمک کند. این برنامه دسترسی به Fable 5 را با حذف ابزارهای حفاظتی زیست‌شناسی و شیمی (اما با حفظ ابزارهای حفاظتی سایبری) فراهم می‌کند. این برنامه تعداد کمی از محققان را از سازمان‌های علوم زیستی که تحقیقات بنیادی و کاربردی را پوشش می‌دهند، در بر خواهد گرفت.

دسترسی

Claude Fable 5 از امروز در سراسر اکوسیستم Claude در دسترس است. Claude Mythos 5 تا زمانی که برنامه دسترسی مطمئن گسترده‌تر آنتروپیک آماده شود، تنها به شرکای پروژه گلس‌وینگ (بدون ابزارهای حفاظتی سایبری) و به‌زودی به محققان منتخب زیست‌شناسی (بدون ابزارهای حفاظتی زیست‌شناسی و شیمی) محدود است.

قیمت‌گذاری برای هر دو مدل ۱۰ دلار به‌ازای هر میلیون توکن ورودی و ۵۰ دلار به‌ازای هر میلیون توکن خروجی است. همچنین توسعه‌دهندگان می‌توانند از شناسه claude-fable-5 از طریق API کلود استفاده کنند.

در API و طرح‌های سازمانی مبتنی بر مصرف، Fable 5 از امروز به طور کامل در دسترس است؛ اما آنتروپیک انتظار دارد تقاضا برای Fable 5 بسیار بالا و پیش‌بینی آن دشوار باشد. به‌طورکلی عرضه این مدل‌ها در چند مرحله انجام می‌شود:

  • از امروز تا ۲۲ ژوئن، Fable 5 در طرح‌های Pro، Max، Team و طرح‌های سازمانیSeat-based  بدون هزینه اضافی گنجانده شده است.
  • پس از ۲۳ ژوئن، Fable 5 از این طرح‌ها حذف خواهد شد. استفاده ازآن‌پس از این تاریخ نیاز به اعتبار مصرفی (Usage Credits) خواهد داشت. اگر ظرفیت سیستم اجازه دهد، این بازه زمانیِ گنجانده‌شده تمدید خواهد شد.
  • پس از این مرحله و زمانی که ظرفیت کافی اجازه انجام این کار را بدهد؛ هدف آنتروپیک این است که Fable 5 را به‌عنوان یک بخش استاندارد از طرح‌های اشتراکی بازگرداند.

مطالب پیشنهادی مرتبط

اشتراک در
اطلاع از
0 نظرات
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها

در جریان مهم‌ترین اتفاقات AI بمانید

هر هفته، خلاصه‌ای از اخبار، تحلیل‌ها و رویدادهای هوش مصنوعی را در ایمیل‌تان دریافت کنید.

[wpforms id="48325"]