
و حالا پیشنمایش GPT 5.6
OpenAI از جدیدترین خانواده مدلهای خود رونمایی کرد؛ پیشنمایش محدود از سری GPT 5.6 شامل مدل پرچمدار Sol، مدل متوازن Terra برای کارهای روزمره و مدل سریع و مقرونبهصرفه Luna.

OpenAI از جدیدترین خانواده مدلهای خود رونمایی کرد؛ پیشنمایش محدود از سری GPT 5.6 شامل مدل پرچمدار Sol، مدل متوازن Terra برای کارهای روزمره و مدل سریع و مقرونبهصرفه Luna.

گوگل سه بهروزرسانی بزرگ برای ابزار جستوجوی فایل API در جمنای (Gemini API File Search) را معرفی کرد.


شرکت xAI مدل جدید Grok Imagine Video 1.5 را به صورت عمومی در دسترس قرار داد.

گوگل در حال معرفی قابلیتهای جدید برای Gemini است که به طور اختصاصی برای کسبوکارهای کوچک بهینهسازی شدهاند.

مدل Gemini 3.5 Live Translate جدیدترین مدل صوتی گوگل است که امکان ترجمه گفتار به گفتار را در لحظه برای بیش از ۷۰ زبان فراهم میکند.

Agent view، تصویرسازی و تعامل با نشستهای Claude Code شما را در رابط خط فرمان (CLI) بهبود میبخشد.

برای میلیونها توسعهدهنده، استودیوی هوش مصنوعی گوگل (Google AI Studio) به سریعترین مسیر برای تبدیل پرامپت به یک اپلیکیشن آماده تولید شده است.

آنتروپیک به طور رسمی از جدیدترین دستاورد خود در حوزه هوش مصنوعی، یعنی مدلهای Claude Fable 5 و Claude Mythos 5 رونمایی کرد.

آنتروپیک از طریق پروژه Glasswing به گروه کوچکی از ۵۰ شریک تجاری و معتمد خود، دسترسی انحصاری و زودهنگام به نسخه پیشنمایش Claude Mythos را داده است.

بهروزرسانیهای جدید گوگل برای NotebookLM قابلیتهای عاملمحور جدید و استدلال پیشرفتهتری را برای مقابله با پروژههای تحقیقاتی پیچیده ارائه میدهند.

رویداد Microsoft Build 2026 در روزهای ۲ و ۳ ژوئن ۲۰۲۶ در سانفرانسیسکو برگزار شد و میتوان یکی از نقطههای چرخش معماری در استراتژی هوش مصنوعی مایکروسافت دانست.

اگر تا سال گذشته، ساخت یک ویدیوی باکیفیت نیازمند دوربینهای گرانقیمت، استودیوهای عایق صدا، نورپردازیهای پیچیده و ساعتها تدوین طاقتفرسا بود، امروز به لطف نسل جدید هوش مصنوعی چندوجهی گوگل، یعنی Gemini Omni، تمام این فرایند به یک صفحه مرورگر و چند خط متن خلاصه شده است.

مایکروسافت مدل MAI-Transcribe-1.5 را معرفی کرد و ادعا میکند دقیقترین مدل چندزبانه تبدیل گفتار به متن (Speech-to-Text) است که در حال حاضر در میان ۴۳ زبان، کمترین نرخ خطای کلمهای دارد.

مایکروسافت در جریان رویداد Build 2026 از جدیدترین مدل استدلالی MAI به نام MAI-Thinking-1 رونمایی کرد. این مدل در رده مدلهای میانمقیاس قرار میگیرد و در میان مدلهای همرده خود از قدرتمندترینها محسوب میشود.

مایکروسافت از جدیدترین طبیعیترین و بیانگرترین مدل تبدیل متن به گفتار (Text-to-Speech) خود به نام MAI-Voice-2 رونمایی کرد.

MAI-Image-2.5 قویترین مدل تصویری مایکروسافت تاکنون است و اکنون در جدول رتبهبندی ویرایش تصویر Arena در جایگاه شماره ۲ قرار گرفته و از Nano Banana 2 پیشی گرفته است.

گوگل CodeMender را در اواخر سال گذشته میلادی با اتخاذ یک رویکرد جامع نسبت به امنیت کد که هم واکنشی است و هم پیشگیرانه عرضه کرد.

استارتاپ برنامهنویسی محبوب Cursor جدیدترین مدل کدنویسی اختصاصی خود به نام 2.5 Composer را منتشر کرد.

Antigravity 2.0 نسخه حدید برنامه دسکتاپ مستقل و متعلق به اکوسیستم هوش مصنوعی گوگل است که تجربه کاملاً بهینهشدهای برای عاملها ارائه میدهد و روی سیستمعاملهای مک (macOS)، لینوکس و ویندوز در دسترس است.

گوگل جدیدترین نسل لپتاپهای خود به نام «گوگلبوک» (Googlebook) را معرفی کرد؛ دستگاهی که مبتنی بر هوش جمنای (Gemini Intelligence) طراحی شده است.

Anthropic اخیراً محصولی جدید به نام Claude Design را معرفی کرده است که امکان خلق آثار بصری مانند طراحیها، نمونههای اولیه (prototypes)، اسلایدها و موارد دیگر استفاده کند.

سامسونگ اخیراً از «دستیار وبگردی» خود رونمایی کرده است؛ یک دستیار هوش مصنوعی محاورهای که مستقیماً در مرورگر سامسونگ در دستگاههای اندرویدی گلکسی و رایانههای شخصی ویندوزی تعبیه شده است.

نسخههای Instant موتور محرک روزمره برای صدها میلیون نفر است؛ لذا پیشرفتهای کوچک تفاوت بزرگی ایجاد میکنند.

گوگل روز گذشته به طور تصادفی اپلیکیشنی تحت عنوان «COSMO» را در پلیاستور منتشر کرد که بلافاصله پس از جلب توجه کارشناسان، از دسترس خارج شد.

هوش مصنوعی نمیتواند جایگزین سلیقه یا تخیل شود؛ اما میتواند راههای جدیدی را نشان دهد، راههایی برای ایدهپردازی سریعتر و جاهطلبانهتر، مجموعه مهارتهای گستردهتر و توانایی متخصصان خلاق برای پذیرش پروژههایی در مقیاس بزرگتر.

مدل جدید Mistral Medium 3.5 یک مدل متراکم (dense) با ۱۲۸ میلیارد پارامتر است که بهصورت وزنباز و تحت یک مجوز تغییریافته MIT منتشر شده است.

مدل Gemini Embedding 2، اولین مدل تعبیهسازی ذاتاً چندوجهی گوگل است که متن، تصاویر، ویدئو، صدا و اسناد را به یک فضای تعبیهشده واحد نگاشت میکند.

همزمان با توجه پنتاگون به هوش مصنوعی عاملیتمحور، یک شرکت تأسیس شده بهدست کهنهسربازان، ابزاری معرفی کرده است که اولویت را به نیازهای ارتش میدهد.

نها چند روز بعد از انتشار سه مدل پرچمدار جدید از جمله DeepSeek V4، Qwen 3.6 و ChatGPT5.5، شیائومی با انتشار MiMo-V2.5 دوباره نگاهها را به سمت خود برگرداند.

غول فناوری چینی Alibaba Cloud با معرفی نسل جدید مدلهای زبانی خود به نام Qwen3.6، مسیر توسعه مدلهای هوش مصنوعی را به سمت «کاربردپذیری واقعی» و «بهرهوری بالا» سوق داده است.

شرکت چینی DeepSeek نسخه پیشنمایش نسل جدید و موردانتظار مدلهای زبانی خود با عنوان DeepSeek-V4 Preview را بهصورت رسمی منتشر کرد.

شیائومی سومین تولیدکننده بزرگ گوشیهای هوشمند جهان است و پس از اپل و سامسونگ، در سال ۲۰۲۵ تقریباً ۱۷۰ میلیون گوشی به بازار عرضه کرده است.

گوگل DeepMind چهار مدل زبانی بزرگ استنتاجی جدید با قابلیت پردازش بینایی و تحت لایسنس Apache 2.0 را در اندازههای ۲، ۴ و ۳۱ میلیارد پارامتری معرفی کرده است.

به نقل از رویترز مدل جدید چینی DeepSeek V4، بر روی جدیدترین تراشههای طراحیشده توسط شرکت فناوری هواوی اجرا خواهد شد.

احراز هویت غیرحضوری که روزگاری، نمونهای درخشان از حل مسائل ملی با همکاری منسجم بخش خصوصی و دولتی قلمداد میشد، امروز با مداخله و انحصارگرایی بخشهایی از دولت، به سمت اضمحلال میرود؛ رویکردی که اگر با موضعگیری قاطع سیاستگذاران و فعالان هوش مصنوعی و اقتصاد دیجیتال کشور تغییر نیابد، کورسوی امید کنشگران این بخش را به ناامیدی بدل خواهد کرد.

این مقاله به بررسی نقش تحولآفرین هوش مصنوعی (AI) در حوزه تصویربرداری پزشکی میپردازد و نشان میدهد چگونه الگوریتمهای یادگیری ماشین و یادگیری عمیق، تحلیل، بازسازی و تفسیر تصاویر پزشکی را متحول ساختهاند.

دانشمندان آمریکایی سامانهای مبتنی بر هوش مصنوعی توسعه دادهاند که با تحلیل اسکنهای MRI متوالی، احتمال بازگشت تومور مغزی (گلیوما) در کودکان را پیشبینی میکند.

چه میشود اگر مدلهای زبانی بزرگ (LLM) بتوانند نظرات عمومی، واکنشها و پویاییهای اجتماعی را شبیهسازی کنند، بدون اینکه نیازی به اجرای نظرسنجیها به روشهای سنتی باشد؟

شرکت OpenAI مدلهای جدید هوش مصنوعی خود، o3 و o4-mini، را معرفی کرده که در حل مسائل پیچیده مانند کدنویسی و ریاضی بسیار توانمند هستند. اما این مدلها مشکلی جدی دارند.
هوشیو رسانهای تخصصی در حوزه هوش مصنوعی است که با هدف ایجاد محیطی فراگیر و پویا به ترویج و ارتقای این دانش میپردازد. ما تلاش میکنیم تا علاقهمندان به این حوزه درک عمیقتری از هوش مصنوعی پیدا کنند، از جدیدترین تحولات آن در ایران و جهان مطلع شوند و فعالان و پیشروان این صنعت را بشناسند. هوشیو با تمرکز بر تولید محتوای چندرسانهای شامل ویدئوکست، پادکست، موشنگرافیک و … تجربهای جذاب و آموزنده برای مخاطبان فراهم میکند. همچنین، هوشیو با پوشش رسانهای گسترده رویدادهای هوش مصنوعی در ایران و جهان، بستری را برای اطلاعرسانی و تعامل میان فعالان و علاقهمندان این حوزه ایجاد کرده است.