سیستم تشخیص گفتار
سیستم تشخیص گفتار (Speech Recognition System)
در این پروژه هدف طراحی سیستمی است که پس از دریافت یک ورودی صوتی به صورت زنده یا فایل ذخیره شده، گفتار (Speech) بیان شده در آن را تشخیص و جداسازی نموده و در خروجی گفتار بیان شده به صورت نوشتار (Text) مشاهده شود.

کاربردها :
سیستمهای تشخیص گفتار کاربردهای فراونی در زمینههای مختلف علمی، پژوهشی و تجاری دارند. از جمله این کاربردها میتوان به موارد زیر اشاره نمود:
- شناسایی گوینده به عنوان یک پارامتر امنیتی
- دستیار صوتی هوشمند
- تهیه رونوشت از مکالمات
- تبدیل زنده گفتار به نوشتار برای ناشنوایان
علاوه بر موارد ذکر شده، این سیستمها در سایر زمینههای مرتب با گفتار نیز کابرد دارند.
توضیح اجمالی:
سیستمهای تشخیص گفتار شامل سه بخش اصلی پیش پردازش (Preprocess)، مدل آکوستیک (Acoustic Model) و مدل زبانی (Language Model) میباشند. در بخش پیش پردازش، پس از فریم بندی ورودی، ویژگیهای هر فریم استخراج شده و با استفاده از مدل آکوستیک واحدهای زبانی متناظر با هر فریم تشخیض داده میشود. سپس در مدل زبانی که شامل احتمال توالی کلمات مختلف است، کلمات گفتار ورودی تشخیص داده شده و خروجی سیستم، بسته به نوع کاربرد، حاصل میشود.
اعضای پروژه:
- سهند حلاجی دیزجی
- سحر هماورد
