گزارش ارزیابی Muse Spark 1.1 به بررسی توانمندیها، عملکرد و ایمنی جدیدترین نسخه از خانواده مدلهای هوش مصنوعی Muse Spark توسعهیافته توسط متا میپردازد. این مدل که نسخه ارتقایافته Muse Spark 1.0 و موتور جدید هوش مصنوعی Meta AI محسوب میشود، علاوه بر استفاده در محصولات متا، از طریق API در اختیار توسعهدهندگان خارجی نیز قرار گرفته است. نسخه جدید با قابلیتهای عاملمحور، از جمله فراخوانی ابزارها و توابع، برای انجام وظایف پیچیدهتر طراحی شده و در مجموعهای از معیارهای ارزیابی، بهبود عملکرد نشان داده است.
این گزارش، پروفایل ارزیابی Muse Spark 1.1 را از دو جنبه اصلی بررسی میکند:
- تواناییهای مدل
- سطح ایمنی در چارچوب Advanced AI Scaling Framework متا
ارزیابیها حوزههای پرریسک شامل تهدیدهای شیمیایی و زیستی، امنیت سایبری و ازدسترفتن کنترل بر مدل را پوشش میدهند. نتایج نشان میدهد که بدون اعمال تدابیر حفاظتی، نمیتوان احتمال رسیدن توانمندیهای مدل به سطح «ریسک بالا» در حوزههای شیمیایی-زیستی و امنیت سایبری را رد کرد. بااینحال، در حوزه ازدستدادن کنترل، تواناییهای مدل در سطح «متوسط یا پایینتر» باقی میماند. متا اعلام کرده است که با طراحی و اعتبارسنجی مجموعهای از سازوکارهای چندلایه کاهش ریسک، سطح ریسک باقیمانده در تمامی حوزهها به محدوده «متوسط یا پایینتر» کاهش یافته و بر همین اساس، Muse Spark 1.1 را منتشر کرده است.