در جریان رویداد Build 2026
رونمایی مایکروسافت از ۷ مدل جدید و اختصاصی MAI
مصطفی سلیمان، مدیر هوش مصنوعی مایکروسافت در جریان رویداد Build 2026 خانوادهای متشکل از هفت مدل جدید را معرفی کرد که به طور کامل در داخل Microsoft AI توسعه یافتهاند.
اما فراتر از این مدلها، مایکروسافت در حال ساخت یک آزمایشگاه ابرهوش است؛ مجموعهای از سامانهها و رویکردهایی که معتقدیم مرحله بعدی تکامل هوش مصنوعی را تعریف خواهند کرد.
وضعیت فعلی
اکنون در مقطعی استثنایی از تاریخ فناوری قرار داریم. میزان توان محاسباتی مورداستفاده برای آموزش مدلهای پیشگام یک تریلیون برابر افزایش یافته است. مایکروسافت انتظار دارد این مقدار طی سه سال آینده هزار برابر دیگر نیز رشد کند؛ روندی که به ظهور قابلیتهای پیشرفتهتر و گسترش مستمر سامانههای هوش مصنوعی هرچه کارآمدتر منجر خواهد شد.
مجموعه مدلهای جدید مایکروسافت در حوزههای تصویر، صدا، رونویسی گفتار، برنامهنویسی و استدلال، در کنار یکدیگر خانواده مدلهای MAI را شکل میدهند؛ اکوسیستمی چندوجهی (Multimodal) که برای انجام وظایفی طراحی شده است که در دنیای واقعی اهمیت دارند.
MAI-Thinking-1
مدل MAI-Thinking-1، مدل پرچمدار استدلالی Microsoft AI است. این مدل با وجود اندازه متوسط خود، در میان قویترین مدلهای همرده قرار میگیرد. این مدل در معیارهای کلیدی مهندسی نرمافزار با مدلهای پیشرو رقابت میکند، تواناییهای پیشرفتهای در استدلال ریاضی از خود نشان میدهد و در ارزیابیهای دوسویه و کور انسانی مایکروسافت، به Sonnet 4.6 ترجیح داده شده است. این مدل از ابتدا و بر پایه دادههای تمیز و باکیفیت آموزشدادهشده و در فرایند توسعه آن هیچگونه تقطیر دانش (Distillation) از مدلهای متعلق به طرفهای ثالث انجام نشده است.
MAI-Code-1-Flash
مدل MAI-Code-1-Flash یک مدل کدنویسی عاملمحور با بهرهوری بالای استنتاج است. این مدل به طور ویژه برای GitHub Copilot، VS Code و اکوسیستم نرمافزاری مایکروسافت طراحی شده و بهصورت عمیق در آنها ادغام شده است. با داشتن ۵ میلیارد پارامتر، عملکردی همتراز با Haiku ارائه میدهد، اما با هزینهای کمتر.
MAI-Image-2.5
مدل MAI-Image-2.5 به همراه نسخه Flash از قابلیتهای تولید تصویر از متن و همچنین ویرایش تصویر در سطح رقبای پیشرو پشتیبانی میکند. این مدل در امتیاز Arena حتی از Nano Banana Pro نیز فراتر رفته است.
MAI Transcribe-1.5
مدل MAI Transcribe-1.5 به ادعای مایکروسافت دقیقترین مدل رونویسی گفتار در جهان محسوب میشود و به بالاترین سطح عملکرد موجود دست یافته است. این مدل ۵ برابر سریعتر از مدلهای رقیب عمل میکند و بهصورت درونساخت از اصطلاحات تخصصی حوزههای مختلف در ۴۳ زبان پشتیبانی میکند.
MAI-Voice-2
مدل MAI-Voice-2 قابلیت تولید گفتار طبیعی و باکیفیت را در ۱۵ زبان فراهم میکند. این مدل میتواند تنها بر اساس یک نمونه کوتاه صوتی با صدای موردنظر سازگار شود و درعینحال دارای سازوکارهای حفاظتی قدرتمندی برای جلوگیری از سوءاستفاده است. نسخه MAI-Voice-2-Flash نیز بهزودی عرضه خواهد شد و همین قابلیتها را در قالبی بسیار بهینهتر و کمهزینهتر ارائه خواهد کرد.
علاوه بر عرضه این مدلها از طریق Foundry و بهینهسازی آنها برای محصولات اختصاصی مایکروسافت، این مدلها در OpenRouter، Fireworks و Baseten در اختیار توسعهدهندگان نیز قرار خواهند گرفت. همچنین برای نخستینبار، توسعهدهندگان قادر خواهند بود وزنهای مدل را شخصاً تنظیم و سفارشیسازی کنند.
تمام این مدلها بر پایه یک زیرساخت مشترک توسعه یافتهاند؛ مسیری که از پایینترین سطوح آغاز شده و بدون استفاده از تقطیر دانش طی شده است. همه آنها از یک رویکرد مشترک در مدیریت داده، زیرساخت و چارچوب ارزیابی بهره میبرند. این مدلها بهگونهای طراحی شدهاند که بتوانند در کنار یکدیگر عمل کرده و مستقیماً در محصولاتی ادغام شوند که مردم هر روز از آنها استفاده میکنند.

سازگارشده برای کاربران
هوش مصنوعی وارد مرحلهای جدید شده است. با استفاده از یادگیری تقویتی در محیطهای واقعی، اکنون برای نخستینبار هوش مصنوعی میتواند خود را به طور کامل با ویژگیها و نیازهای خاص یک جریان کاری مشخص تطبیق دهد.
مایکروسافت این رویکرد را Microsoft Frontier Tuning مینامد و معتقد است آینده حضور و کاربرد هوش مصنوعی در همین مسیر شکل خواهد گرفت.
در این چارچوب، ارزشمندترین دادهها متعلق به شما هستند. ردپای واقعی کارهایی که یک عامل هوشمند انجام میدهد، توالی مراحل انجام کار، تصمیمها و اقداماتی که مشخص میکنند وظایف درون یک سازمان واقعاً چگونه به انجام میرسند. محیطهای یادگیری تقویتی (Reinforcement Learning Environments) به مدلهای MAI اجازه میدهند مستقیماً از جریانهای کاری سازمانی کاربر یاد بگیرند. میتوان این محیطها را به باشگاههای تمرینی اختصاصی برای هوش مصنوعی تشبیه کرد که تنها در اختیار کاربر قرار دارند.
با Frontier Tuning، شما در حال ساخت مدل اختصاصی خود هستید؛ مدلی که بر دادههای شما آموزش دیده، در محیط شما فعالیت میکند و تحت کنترل کامل شما قرار دارد. دانش سازمانی شما به بخشی از مدل تبدیل میشود و مالکیت آن همچنان در اختیار خودتان باقی میماند. مزیت مهمتر این است که چنین سازگاریای به بهبود بهرهوری و عملکرد منجر میشود.
تجربیات بهدستآمده در داخل مایکروسافت و همچنین در میان مشتریانش نشان میدهد مدلهای سفارشی نهتنها عملکرد بهتری دارند، بلکه کارآمدتر نیز هستند. برای مثال، مدل MAI تنظیمشده برای Excel عملکردی همسطح GPT 5.4 ارائه میدهد، درحالیکه تا ۱۰ برابر بهرهوری بیشتری دارد.
کاربران اولیه این فناوری نیز دستاوردهای مشابهی را در مرز فناوری تجربه کردهاند. هنگامی که مدل MAI بر اساس استانداردهای سختگیرانه سازمانی مککنزی تنظیم شد، بالاترین نرخ موفقیت را در میان تمام مدلهای آزمایششده به دست آورد؛ آن هم با هزینهای تقریباً ۱۰ برابر کمتر.
آزمایشگاه مایکروسافت
تمام اجزای سامانهها، از معماری و خط لوله آموزش گرفته تا مراحل پس از آموزش، توسط خود مایکروسافت توسعه یافتهاند. همچنین طراحی این سامانهها را با تراشه اختصاصی Maia 200 مایکروسافت بهصورت همزمان انجام میشود و تاکنون از این تلاشها بهبود بهرهوری ۱.۴ برابری به دست آورده است. هدف همه این اقدامات دستیابی به خودکفایی بلندمدت برای مایکروسافت و شرکای آن است.
این رویکرد در نهایت به ساخت مدلهایی منجر میشود که بتوان به آنها اعتماد کرد. هدف مایکروسافت ساخت چیزی است که آن را «ماشین صعود به قله» (hill-climbing machine) مینامد؛ سازمانی که بتواند بهصورت مداوم و در چرخههای پیدرپی، با استفاده از توان محاسباتی بیشتر، دادههای بهتر و ارزیابیهای دقیقتر، خود را ارتقا دهد.
ابرهوش انسانمحور
این همان چیزی است که مایکروسافت در MAI در حال ساخت آن است؛ آزمایشگاهی مبتنی بر اصول بنیادین که بر توسعه قابلیتهای بلندمدت تمرکز دارد و رویکردی تازه در زمینه تنظیم و مالکیت مدلها که معتقد است مرحله بعدی تحول هوش مصنوعی را شکل خواهد داد.
مایکروسافت هدف نهایی خود را دستیابی به چیزی که آن را ابرهوش انسانمحور (Humanist Superintelligence) مینامند، بیان میکند. منظور از این مفهوم، سامانههای پیشرفته هوش مصنوعی است که برای خدمت به انسانها و سازمانها طراحی شدهاند، نه برای جایگزینی آنها. این سامانهها باید همواره در جایگاه ابزار باقی بمانند؛ ابزارهایی که بر اساس نیت و خواست انسان شکل میگیرند، تحت نظارت انسان پاسخگو هستند و در نهایت در خدمت اهداف انسانی قرار دارند.