توضیحات
مقدمه:
سیستمهای تشخیص خودکار گفتار معمولاً با دریافت سیگنال صوتی، ویژگیهای آن را استخراج کرده و با استفاده از مدلهای آماری، یادگیری ماشین یا شبکههای عصبی، کلمات و جملات بیانشده را شناسایی میکنند. کیفیت عملکرد این سیستمها به عواملی مانند کیفیت سیگنال صوتی، نویز محیط، لهجه و نحوه بیان گوینده، نوع زبان و ساختار مدل مورد استفاده وابسته است.