بینایی ماشین

Generic filters
Search in title
Filter by دسته‌ها
chatGTP
ابزارهای هوش مصنوعی
اخبار
گزارش خبری
پرامپت‌ نویسی
تیتر یک
چندرسانه ای
آموزش علوم داده
اینفوگرافیک
پادکست
ویدیو
دانش روز
آموزش‌های پایه‌ای هوش مصنوعی
اصول هوش مصنوعی
یادگیری بدون نظارت
یادگیری تقویتی
یادگیری عمیق
یادگیری نیمه نظارتی
آموزش‌های پیشرفته هوش مصنوعی
بینایی ماشین
پردازش زبان طبیعی
پردازش گفتار
چالش‌های عملیاتی
داده کاوی و بیگ دیتا
رایانش ابری و HPC
سیستم‌‌های امبدد
علوم شناختی
خطرات هوش مصنوعی
دیتاست
مدل‌های بنیادی
رویدادها
جیتکس
کاربردهای هوش مصنوعی
کتابخانه
اشخاص
شرکت‌های هوش مصنوعی
محصولات و مدل‌های هوش مصنوعی
مفاهیم
کسب‌و‌کار
تحلیل بازارهای هوش مصنوعی
کارآفرینی
هوش مصنوعی در ایران
هوش مصنوعی در جهان
مقاله
پیاده‌سازی هوش مصنوعی
گزارش
مصاحبه
هوش مصنوعی در عمل
یادداشت

بینایی ماشین

بینایی ماشین یکی از شاخه‌های اصلی هوش مصنوعی است که به سیستم‌های هوشمند توانایی درک و پردازش محیط اطراف را می‌دهد. در دهه‌های اخیر، تأثیرات پیشرفت‏‌های بوقوع پیوسته در زمینه بینایی ماشین، حیرت‏‌انگیز بوده بطوریکه سیستم‏‌های امروزی در تشخیص و واکنش سریع به ورودی‏‌های بصری دقیق‏‌تر از انسان عمل می‏‌نمایند. چیستی این فناوری، تاریخچه، نحوه کار و تفاوتش با بینایی کامپیوتر از جمله مواردی است که به شناخت این حوزه فناوری کمک می‌نماید.

همچنین نرم‌افزارها و ابزارهای رایج، کتاب‌های مرجع، کاربردها و برخی از سرویس‌های برجسته این حوزه فناوری جز مباحث ارزشمند و برجسته‌ای است که می‌تواند به درک عمیق‌تر بینایی ماشین کمک نماید … درباره بینایی ماشین بیشتر بخوانید

معماری لایه‌بندی‌شده داده‌های بیومدیکال؛ از رمزگشایی ژنوم تا چالش کیفیت در مدیریت کلان نظام سلامت
چالش موازنه کیفیت و هزینه در جراحی دیجیتال
وبینار«از ایده تا اجرای هوش مصنوعی برای شرکتهای نرم افزاری» توسط بازارچه ویرا برگزار می‌شود
آیا ChatGPT واقعاً معادله ناویر–استوکس را فقط در ۸۸ ساعت حل کرده است؟
ChatGPT Images 2.5؛ سریع‌تر، ویرایش دقیق‌تر و کنترل بیشتر

بینایی ماشین

کشف الگوهای زوال عقل با استفاده از هوش مصنوعی

دانشمندان امیدوارند با دسترسی به بیش از ۱.۶ میلیون اسکن مغزی جمع‌آوری‌شده از بیماران در سراسر اسکاتلند بتواند به پیش‌بینی خطر ابتلای افراد به زوال عقل کمک کند. تیمی متشکل از ۲۰ محقق از دانشگاه‌های ادینبورگ و داندی موفق به کسب مجوزی بی‌سابقه برای بررسی این تعداد عظیم از اسکن‌های مغز به صورت ناشناس شده‌اند که در طول یک دهه از سراسر جمعیت اسکاتلند جمع‌آوری شده‌اند.

هوش مصنوعی در امنیت سایبری

هوش مصنوعی در امنیت سایبری و نقش چشمگیر آن

این روزها هوش مصنوعی بیشتر از این که یک زمینه علمی باشد، بخشی از زندگی ما شده است. سرویس‌های مربوط به برنامه‌های تلویزیونی از هوش مصنوعی و یادگیری ماشین برای پیش‌بینی این که دوست دارید برنامه بعدی که تماشا می‎کنید چه باشد، استفاده می‌کنند. یکی دیگر از کاربردهای هوش مصنوعی

یادگیری زبان اشاره

یادگیری زبان اشاره به کمک یک بازی مبتنی بر هوش مصنوعی

خواندن آهنگ الفبا از اولین دروسی است که کودکان باید بیاموزند. اهمیت این درس و یادگیری زبان اشاره برای خانواده‌هایی که کودک ناشنوا یا کم‌شنوا دارند، به هیچ‌وجه کمرنگ‌تر نیست. در این شرایط، زبان‌های بصری جای محرک‌های شنیداری را گرفته و نقشی حیاتی در رشد اولیه‌ی کودک ایفا می‌کنند. استودیوی

Qoves

با Qoves آشنا شوید: هوش مصنوعی به شما می‌گوید چقدر زیبا هستید

من برای اولین بار از طریق کانال یوتیوب Qoves Studio با این کسب‌وکار آشنا شدم؛ در این کانال که میلیون‌ها بازدیدکننده دارد ویدئوهایی با مضامینی از قبیل مدل مو چه تأثیری بر زیبایی دارد؟ راز جذابیت تیموتی شالامِی در چیست؟ و جراحی فک چه تأثیری بر مقبولیت اجتماعی دارد؟ بارگذاری

شبکه عصبی مولد

تغییر مدل مو به وسیله فضای پنهان شبکه عصبی مولد برای انجام ویرایش‌های معنایی

پیشرفت‌‌هایی که اخیراً در انواع شبکه عصبی مولد حاصل شده، تأثیرات شگرفی بر کیفیت و وضوح تصاویر، به ویژه در حوزه تغییر و انتقال سبک Style transfer، داشته است. مشوق اصلی ما برای نگارش مقاله پیش‌رو، موفقیت‌های اخیر StyleGAN بوده است. در مدل StyleGAN، تغییرات تصادفی در تصاویر ایجاد شده

شبکه های ‌عصبی گراف

راهنمای تخصصی شبکه های عصبی گراف در بینایی رایانه‌

در مقاله حاضر، قصد داریم به آن دسته از پرسش‌هایی پاسخ دهیم که افرادِ تازه کار با گراف یا شبکه های عصبی گراف مطرح می‌کنند. در همین راستا، از نمونه‌های PyTorch برای طبقه‌بندیِ ایدۀ پشت این نوع مدل نسبتاً جدید استفاده کرده‌ایم. پرسش‌هایی که در این بخش از مقاله بررسی

GAN

معرفی شبکه های مولد تخاصمی GAN به زبان ساده

شبکه‌های مولد تخاصمی یا GAN ها گروهی از الگوریتم‌های یادگیری عمیق و متعلق به دسته‎‌ی مدل‌های مولد هستند. هدف اصلی مدل‌های مولد، توصیف چگونگی تولید یک دیتاست، از نظر قواعد احتمالی، است. بدین طریق هرگاه بر اساس این قواعد احتمال، نمونه‌گیری انجام دهیم، دیتاستی جدید به دست می‌آوریم که با

توابع فعال سازی

توابع فعال سازی: سیگموید، ReLU ،Leaky ReLU و Softmax در شبکه‌های عصبی

در این نوشتار به بررسی و مطالعه مبانی نورون‌ها، شبکه های عصبی و توابع فعال سازی می‌پردازیم. شبکه‌های عصبی مصنوعی از نورون‌ها تشکیل می‌شوند. هر نورون را می‌توان یک تابع در نظر گرفت که عددی در خود جای داده است. نورون‌ها این جریان/ورودی را از انشعابات انتهایی (سیناپس‌ها) دریافت می‌کنند.

تعامل انسان و هوش مصنوعی

تعامل انسان و هوش مصنوعی: چطور تجربه مشتری را بهینه کنیم

یکی از ویژگی‌های بارز مشاغل موفق در قرن بیست و یکم، تعامل مشتری است. طبق توضیح هاب اسپات Hubspot تعامل مشتری ایجاد تعامل با مصرف کنندگان در چندین کانال برای تقویت ارتباط شرکت با آن‌ها است و امروزه به لطف پیشرفت در شبکه های اجتماعی، تعامل مشتری در بالاترین حد

بینایی رایانه

بینایی رایانه و 9 دیتاست مهم در این حوزه

بینایی رایانه به عنوان یکی از حوزه‌های هوش مصنوعی با سرعت قابل توجهی در حال توسعه است. به لطف حرکت سخاوتمندانه برخی از شرکت‌ها در ارائه عمومی دیتاست‌ تصاویر، اکنون دانشمندان داده‌ قادرند به راحتی اقدام به ساخت معماری‌های مختلف مدل نمایند. مقالۀ حاضر بر آن است تا 9 مورد

تشخیص اشیاء

بررسی جامعِ تشخیص اشیاء و بخش‌ بندی نمونه

تشخیص اشیاء Object Detection یکی از مهم‌ترین حوزه‌های تحقیق در «بینایی رایانه Computer Vision» به شمار می‌آید. محققان از مدت‌ها پیش علاقه‌مند به انجام تحقیق در این حوزه بوده‌اند، اما در سال‌های اخیر به لطف ابداع «Convents» که نقش استخراج‌کننده ویژگی را دارد و همچنین «یادگیری انتقال Transfer learning» که روشی

مهندسی ویژگی

مهندسی ویژگی خودکار با استفاده از شبکه‌های عصبی

برای همگان مشخص است که مهندسی ویژگی یکی از مهم‌ترین گام‌های تولید مدل‌های دقیق است. بعضی از برنامه‌نویس‌ها عاشق این مرحله هستند ولی من علاقه‌ چندانی به این مرحله ندارم. به نظر من این مرحله بسیار خسته‌کننده است و معتقدم که هر کار خسته‌کننده‌ای را می‌توان به صورت خودکار درآورد.

پردازش تصویر و بینایی ماشین

بهترین دانشگاه‌های دنیا برای پردازش تصویر و بینایی ماشین کدامند؟

به نظر شما پردازش تصویر و بینایی ماشین چه تفاوت‌هایی دارند؟ برخی افراد به اشتباه گمان می‌برند، بینایی ماشین یکی از زیرمجموعه‌های پردازش تصویر است. به‌این معنی که می‌اندیشند رایانه می‌تواند تصویری که به آن دسترسی دارد را تفسیر و درک کند و از آن تفسیر برای اهداف خود استفاده

جعل عمیق

جعل عمیق و کشمکش بین این فناوری و تشخیص‌دهنده‌های آن

جعل عمیق به زودی همانند فتوشاپ به صورت گسترده مورد استفاده همگان قرار می‌گیرد و از آنجایی که هنوز روش مناسبی برای تشخیص این فناوری وجود ندارد، نگرانی‌ها از در دسترس قرار گرفتن این تکنولوژی افزایش یافته است.

خودروهای هوشمند

  پیش بینی موقعیت ‌های چند عاملی توسط خودروهای هوشمند

به‌تازگی پیش بینی موقعیت‌ های چندعاملی توسط خودروهای هوشمند، محقق شده است؛ خودروهای خودران، با کمک سیستم جدید یادگیری ماشینی، می‌توانند حرکات بعدی رانندگان خودروهای اطراف، عابران پیاده و دوچرخه/موتور‌سواران را در لحظه پیش‌بینی کنند. برجسته‌ترین مانعی که پیش روی حرکت خودروهای تماماً خودران در سطح شهر وجود دارد، انسان‌ها

چالش های دیپ فیک

چالش های دیپ‌ فیک، پاشنه آشیل تحولات دیجیتال

تحولات دیجیتالی علیرغم گسترش کسب‌وکارها، چالش‌هایی را نیز شکل داده است. داستان دیپ‌فیک چالش جدید دیگری است که سایۀ آن این سال‌ها بر بسیاری از صنایع سنگینی می‌کند. در واقع چالش های دیپ فیک، پاشنه آشیل تحولات دیجیتال محسوب می‌شود. دیپ‌فیک چیست؟ همانطور که از نامش پیداست، دیپ‌فیک همان تصاویر،

مسئله تشخیص شیء

مسئله تشخیص شیء و بررسی آن به منظور یادگیری پایتورچ

از آنجایی که بهترین راه برای یادگیری هر تکنولوژی جدید استفاده از آن در حل یک مسئله ساده است، برای یادگیری PyTorch از آن در حل یک مسئله ساده استفاده می‌کنیم. استفاده از یک شبکه‌ عصبی از پیش آموزش دیده در مسئله تشخیص شیء. در این نوشتار، علاوه بر توضیح

داده افزایی تصویری

داده افزایی تصویری و چگونگی انجام آن در کتابخانه‌ی OpenCV

چند روز پیش در حال نوشتن مقاله‌­ای بودم که به استفاده از فضای رنگی Color spaces متفاوت به عنوان ورودی شبکه های عصبی پیچشی (CNN) می‌پرداخت و به همین دلیل لازم بود از یک مولد داده برای داده افزایی تصویری استفاده کنم؛ چون نمی‌توانستم از مولد داده داخلی تنسورفلو بدین

مقدمه‌ای بر معماری CNNها و متداول‌ترین لایه‌های آن

شبکه‌های عصبی پیچشی یا CNN خانواده‌ای از معماری‌های شبکه‌ عصبی مصنوعی هستند که ویژه‌ مسائل بینایی کامپیوتری و پردازش تصویر ساخته شده‌اند. این شبکه‌ها، عصبی و چندلایه‌ای هستند و هدف از ساخت آن‌ها تجزیه و تحلیل ورودی‌های دیداری و اجرای مسائلی همچون قطعه‌بندی تصویر، رده‌بندی، حذف نویز (با استفاده از

کتابخانه های نرم افزاری

کتابخانه های نرم افزاری سبک TF-GAN

کتابخانه های نرم افزاری که امروزه برای یادگیری ماشینی استفاده می‌شوند، نقش بسیار مهمی در موفقیت تحقیقات ما دارند. باید کتابخانه های نرم افزاری با چنان سرعتی به‌روزرسانی شوند که تحقیقات یادگیری ماشینی از قافله عقب نماند و به پیشرفت خود ادامه دهد.

فناوری‌ بینایی ماشین

فناوری‌های بینایی ماشین؛‌ چشمی که به روی زندگی انسان‌ها باز شده است

با رشد اینترنت در دهه ۱۹۹۰ و در دسترس قرار گرفتن مجموعه‏‌های زیادی از تصاویر به صورت آنلاین برای تجزیه و تحلیل، مدل‌های بینایی ماشین رونق گرفت. همچنین، پیشرفت‌های سخت‌افزاری در کنار مجموعه‌داده‌‏های در حال رشد، باعث شد ماشین‏‌ها بتوانند اجسام متنوعی را در عکس‏‌ها و فیلم‏‌ها شناسایی کنند. در

سیستم های بینایی هوش مصنوعی

سیستم های بینایی هوش مصنوعی تجربه‌ای شگفت‌انگیز برای انسان‌ها خلق می‌کنند

فناوری هوش مصنوعی امروزه بیش از هر زمان دیگری به خودکار کردن فرآیندهای متنوع در تولید و امور دیگر کمک می‌کند. یک نظرسنجی که اخیرا توسط Landing AI و Association of Advancing Manufacturing انجام شده نشان می‌دهد که ۲۶ درصد از کسب و کارهای تولیدی در حال حاضر از سیستم

تولیدکننده داده Keras

ساخت تولیدکننده داده Keras برای ایجاد توالی‌ از فریم‌های ویدئویی و انجام تحلیل زمانی با RNN

مدل‌های یادگیری عمیق برای آموزش به حجم بالایی از داده‌ها نیاز دارند و به دلیل پیچیدگی‌های حافظه Space complexitites عملکرد ضعیفی دارند. انواع تولیدکننده داده برای رفع این مشکل،  به جای این‌که دیتاست را در حافظه ذخیره کند، داده‌ها را در بسته تولید می‌کنند. در این حالت کاربر می‌تواند استفاده

عقل سلیم

رویکرد عقل سلیم ؛ تماشای جهان از دریچه چشم انسان

رویکرد جدید «عقل سلیم» به بینایی کامپیوتر، هوش مصنوعی را قادر می‌سازد که نسبت به دیگر سیستم‌ها، صحنه‌‌ها را با دقت بیشتری تفسیر کند. سیستم‌های بینایی ماشین، گاهی از مواقع صحنه‌ها را دقیقاً بر خلاف عقل سلیم استتناج می‌کنند. به‌عنوان مثال، اگر رباتی در حال پردازش تصویر میز شام باشد،

داده‌افزایی

تکنیک‌های داده‌افزایی در یادگیری عمیق

افرادی که برای انجام پروژه‌‍‌های خود به داده‌های تصویری احتیاج دارند، معمولاً این‌‌گونه داده‌ها را جمع‌آوری می‌کنند و برخی مواقع نیز ترجیح می‌دهند دیتاست‌های تصویری را از وب‌سایت‌ها دانلود کنند. از جمله مشکلاتی که ممکن است در این‌گونه دیتاست‌ها وجود داشته باشد می‌توان به کنتراست پایین، تفاوت در وضوح و

دیتاست چهره

10 دیتاست چهره برای آغاز پروژه‌های تشخیص چهره

تشخیص چهره یکی از حوزه‌های مهم تحقیق به شمار می‌آید و در سال‌های گذشته مورد توجه دولت‌ها و سازمان‌های بسیاری قرار گرفته است. تولیدکنندگان برجسته گوشی‌های هوشمند از قبیل اپل و سامسونگ این فناوری را در گوشی‌های هوشمند خود به کار برده‌اند تا بالاترین سطح امنیت را برای کاربران‌شان فراهم

اخبار جعلی

متأسفانه هوش مصنوعی نمی‌تواند انتشار اخبار جعلی را متوقف کند

دروغ‌پراکنی سالیان سال در  جنگ‌ها و استراتژی‌های نظامی کاربرد داشته است؛ اما بدون شک به‌کارگیری فناوری‌های هوشمند و رسانه‌های اجتماعی آن را تشدید کرده است؛ زیرا این فناوری‌های ارتباطی راه‌های کم‌هزینه و بهینه‌ای برای انتشار اطلاعات در سرتاسر دنیا ایجاد کرده‌اند. اما پرسش چند میلیون دلاری این است که آیا

یادگیری ماشین خودکار

یادگیری ماشین خودکار و جست‌وجوی معماری شبکۀ عصبی 

یکی از مهم‌ترین دستاوردها در حوزه هوش مصنوعی در سال 2018، یادگیری ماشین خودکار (AutoML) بود. این فناوری، فرایند یادگیری ماشین را خودکار می‌کند. شرکت گوگل در ژانویه این سال فرایند یادگیری ماشین خودکار را در مسائل بینایی ماشین به کار گرفت و سپس در ژوئیۀ همان سال نسخه دیگری

آموزش گام به گام PyTorch

آموزش گام به گام PyTorch

در حال حاضر PyTorch بیشترین نرخ رشد را در میان چارچوب‌های کاری یادگیری عمیق دارد و در دوره‌های آموزشی Fast.ai، با عنوان «یادگیری عمیق برای برنامه‌نویس‌ها»، و کتابخانه آن مورد استفاده قرار می‌گیرد. PyTorch به شدت پایتونی است، به عبارت دیگر برای برنامه نویسان Python، کار کردن با PyTorch بسیار

دوربین پلاک خوان

دوربین پلاک خوان چیست و چگونه عمل می‌کند؟

تشخیص پلاک خودرو یک فناوری جدید است که از تشخیص کاراکتر نوری یا همان OCR در تصاویر برای خواندن پلاک خودرو و ایجاد اطلاعاتی از مکان خودرو استفاده می‌کند. دوربین پلاک خوان با استفاده از فناوری هوش مصنوعی، موقعیت پلاک در انواع خودرو را ردیابی می‌کند سپس به تقسیم‌بندی کاراکترها

گردنبند هوشمند

گردنبند هوشمند حالات صورت را برای سنجش احساسات کنترل کرد

سال گذشته دانشمندان دانشگاه کرنل پژوهش جالبی در مورد استفاده از دوربین‌های پوشیدنی برای ردیابی حالات چهره انجام دادند. این فناوری اکنون شکل عملی‌تری به خود گرفته است. همین تیم پژوهشی دستگاهی شبیه یک گردنبند طراحی کرده است که از دوربین‌های مادون قرمز برای تصویربرداری از حرکات کامل صورت استفاده

واحدهای پردازش بینایی

واحدهای پردازش بینایی (VPU)

اکثر مواقع، پاسخی که در مقابل این پرسش «از چه کارت گرافیکی استفاده کنم؟» می‌شنویم، این است: «NVIDIA». زیرا این کارت گرافیک به شتاب‌دهنده‌های CUDA و CUDNN مجهز است. این دو شتاب‌دهنده در مدل‌های یادگیری عمیق به کار برده می‌شود و فقط کارت گرافیک NVIDIA از آنها پشتیبانی می‌کند. اگر

اتوبوس های مدرسه

نصب آزمایشی دوربین‌های مجهز به هوش مصنوعی بر روی اتوبوس های مدرسه

شهر ساکرامنتو، واقع در ایالت کالیفرنیا، در حال نصب آزمایشی دوربین‌های مجهز به هوش مصنوعی بر روی 5 اتوبوس مدرسه است. هدف از نصب چنین دوربین‌هایی جلوگیری از سبقت غیرقانونی سایر خودروها از اتوبوس های مدرسه در هنگام سوار کردن و پیاده کردن دانش‌آموزان است. شهر ساکرامنتو با استفاده از

داده افزایی

داده افزایی و جلوگیری از بیش‌برازش مدل در مسائل طبقه‌بندی تصویر

فرض کنید یک مدل طبقه‌بندی تصویری آموزش داده‌اید که عملکرد نسبتاً ضعیفی دارد؛ آیا می‌دانید روش‌های زیادی برای بهبود عملکرد و کاهش سوگیری‌های مدل وجود دارد؟ زمان زیادی را صرف ایجاد روال پردازشی مدل کرده‌اید و با استفاده از شبکه‌های عصبی یک مدل پیش‌بینی کننده ساخته‌اید، اما نتایج ، آن‌طور

Clearview AI

چرا افرادی که دلیلی برای پنهان‌کاری ندارند از سیستم تشخیص چهره Clearview AI می‌ترسند؟

گاه این سؤال پیش می‌آید که چرا افرادی که دلیلی برای پنهان‌کاری ندارند، این همه از سیستم تشخیص چهره Clearview AI هراس دارند؟ پاسخ این است: زیرا افرادی که دلیلی برای پنهان‌کاری ندارند، تنها کسانی هستند که حریم خصوصی‌شان تضمین شده است. اوایل هفته جاری، دولت استرالیا پس از اینکه

سیستم های تشخیص چهره

نگاهی به نقش هوش مصنوعی در سیستم های تشخیص چهره

ایده «مَستر فیس » چندی پیش سر و صدای زیادی در رسانه‌های مختلف به پا کرده است. به مجموعه‌ای از تصاویر جعلی که به دست الگوریتم‌های یادگیری ماشین ساخته می‌شود، مستر فیس می‌گویند. این مفهوم با جعل هویت افراد، زمینه را برای نفوذ به سیستم‌های بیومتریک فراهم می‌کند و سیستم

قایق خودران

قایق خودران MIT کارش را از آمستردام شروع می‌کند

قایق خودران ملقب به ربوقایق (Robaot)  که به کوشش دانشگاه MIT ساخته شده سفر خود را از کانال‌های آبی آمستردام آغاز می‌کند. اگر جزء آن دسته از افرادی هستید که دچار دریازدگی نمی‌شوند، شاید قایق خودران وسیله مناسبی برای رفت و آمد شما باشد. دانشمندانی از آزمایشگاه علوم کامپیوتر و

تبدیل تصویر به متن

نرم افزارهای تبدیل تصویر به متن؛ تعاریف و کاربردها

امروز به لطف فناوری تبدیل تصویر به متن و نویسه‌خوان‌های نوری (OCR) می‌توان به‌راحتی و با دقت بسیار بالا متن‌ها را از تصاویر بیرون کشید. اگر بخواهیم تعریفی کاملاً ساده و ملموس از نرم ‌افزارهای تبدیل تصویر به متن و OCR (Optical character Recognition) ارائه دهیم باید بگوییم که این

[wpforms id="48325"]