به کارگیری اطلاعات زبانی در یک سیستم بازشناسی گفتار پیوسته فارسی

محمد بحرانی; حسین صامتی

به کارگیری اطلاعات زبانی در یک سیستم بازشناسی گفتار پیوسته فارسی

Publish place: Language and linguistics، Vol: 6، Issue: 11

Publish Year: 1389

نوع سند: مقاله ژورنالی

زبان: Persian

This Paper With 26 Page And PDF Format Ready To Download

دریافت فایل کامل Paper

Certificate
من نویسنده این مقاله هستم

استخراج به نرم افزارهای پژوهشی:

لینک ثابت به این Paper:

https://civilica.com/doc/1581052

شناسه ملی سند علمی:

JR_LSI-6-11_005

تاریخ نمایه سازی: 17 دی 1401

Abstract:

در این مقاله یک سامانه بازشناسی گفتار پیوسته برای زبان فارسی معرفی می شود و نقش مدل آوایی و مدل زبانی در آن مورد بررسی قرار می گیرد. مدل های آوایی با روش های مستقل از بافت و وابسته به بافت در این سامانه به کار رفته و نتایج به کارگیری آن ها ارائه شده است. مدل زبانی سه کلمه ای نیز با روش های مبتنی بر کلمه، مبتنی بر مقوله نحوی و مبتنی بر طبقه، با استفاده از پیکره متنی زبان فارسی استخراج و در سامانه بازشناسی به کار گرفته شده است. همچنین مدل زبانی دستوری مبتنی بر دستور ساخت- گروهی تعمیم یافته در این سامانه پیاده سازی شده و نیز در ترکیب با مدل زبانی آماری به کار رفته است. نتایج حاصل نشان می دهد که مدل آوایی وابسته به بافت، مطابق انتظار، بهترین عملکرد را دارد. همچنین مدل زبانی سه کلمه ای مبتنی بر کلمه، نسبت به سایر روش های استخراج مدل زبانی آماری برتری دارد. درضمن ترکیب مدل زبانی دستوری با مدل زبانی آماری منجر به بهبود نتایج بازشناسی می شود. سامانه بازشناسی گفتار معرفی شده در این مقاله، اولین سامانه بازشناسی برای گفتار پیوسته فارسی بوده و با پشتوانه فعالیت های تحقیقاتی متعددی که برای پیاده سازی آن انجام شده است، قابلیت استفاده به صورت کاربردی را یافته است.

Keywords:

بازشناسی گفتار پیوسته , مدل سازی آوایی , مدل سازی زبانی , مدل زبانی آماری , مدل زبانی دستوری

Authors

محمد بحرانی

دانشگاه صنعتی شریف( آزمایشگاه پردازش گفتار)

حسین صامتی

دانشگاه صنعتی شریف( آزمایشگاه پردازش گفتار)