
الگوریتم Wav2vec 2.0: تشخیص خودکار گفتار با استفاده از نمونه 10 دقیقهای
در این مقاله قصد داریم به الگوریتم Wav2vec 2.0 بپردازیم. تلاشهای بیوقفه پژوهشگران برای ارتقای عملکرد سیستمهای خودکار تشخیص گفتار Automatic speech recognition (ASR) system و پیشرفتهای عظیمی که در حوزه فنآوریهای یادگیری ماشین حاصل شده و همچنین افزایش میزان دسترسپذیری به دیتاستهای بزرگ گفتار موجب شده میزان محبوبیت، تأثیرگذاری و
پردازش گفتار که به ماشینها قابلیت درک و پردازش گفتار انسانها را میدهد، یکی از فناوریهای اصلی هوش مصنوعی میباشد که امروزه بسیار مورد توجه قرار گرفته است. این فناوری با تمرکز بر ایجاد ارتباط کلامی بین ماشینها و انسانها منجر به تبدیل هر چه بیشتر دنیای واقعی به فیلمهای علمی-تخیلی شده است. چیستی این فناوری، تاریخچه، نحوه کار و ارزیابی سیستمهای پردازش گفتار و تفاوتش با پردازش صدا از جمله مواردی است که میتواند به شناخت این حوزه فناوری کمک نماید، 







