سیستم تشخیص گفتار

تعداد بازدید:۷۱

سیستم‌ تشخیص گفتار (Speech Recognition System)

در این پروژه هدف طراحی سیستمی است که پس از دریافت یک ورودی صوتی به صورت زنده یا فایل ذخیره شده، گفتار (Speech) بیان شده در آن را تشخیص و جداسازی نموده و در خروجی گفتار بیان شده به صورت نوشتار (Text) مشاهده شود.

کاربردها :

سیستم‌های تشخیص گفتار کاربرد‌های فراونی در زمینه‌های مختلف علمی، پژوهشی و تجاری دارند. از جمله این کاربرد‌ها می‌توان به موارد زیر اشاره نمود:

  • شناسایی گوینده به عنوان یک پارامتر امنیتی
  • دستیار صوتی هوشمند
  • تهیه رونوشت از مکالمات
  • تبدیل زنده گفتار به نوشتار برای ناشنوایان

علاوه بر موارد ذکر شده، این سیستم‌ها در سایر زمینه‌های مرتب با گفتار نیز کابرد دارند.

توضیح اجمالی:

سیستم‌های تشخیص گفتار شامل سه بخش اصلی پیش پردازش (Preprocess)، مدل آکوستیک (Acoustic Model) و مدل زبانی (Language Model) می‌باشند. در بخش پیش پردازش، پس از فریم بندی ورودی، ویژگی‌های هر فریم استخراج شده و با استفاده از مدل آکوستیک واحد‌های زبانی متناظر با هر فریم تشخیض داده می‌شود. سپس در مدل زبانی که شامل احتمال توالی کلمات مختلف است، کلمات گفتار ورودی تشخیص داده شده و خروجی سیستم، بسته به نوع کاربرد، حاصل می‌شود.

اعضای پروژه:

آخرین ویرایش ۱۸ مرداد ۱۴۰۲