دانلود ترجمه مقاله شناسایی احساسات قوی از گفتار (اسپرینگر ۲۰۱۸) (ترجمه ویژه – طلایی ⭐️⭐️⭐️)

 

 

این مقاله انگلیسی ISI در نشریه اسپرینگر در ۱۷ صفحه در سال ۲۰۱۸ منتشر شده و ترجمه آن ۲۶ صفحه میباشد. کیفیت ترجمه این مقاله ویژه – طلایی ⭐️⭐️⭐️ بوده و به صورت کامل ترجمه شده است.

 

دانلود رایگان مقاله انگلیسی + خرید ترجمه فارسی
عنوان فارسی مقاله:

شناسایی احساسات قوی از گفتار: ویژگی ها و مدل گاما

عنوان انگلیسی مقاله:

Robust emotion recognition from speech: Gamma tone features and models

 

 

مشخصات مقاله انگلیسی (PDF)
سال انتشار مقاله ۲۰۱۸
تعداد صفحات مقاله انگلیسی ۱۷ صفحه با فرمت pdf
نوع مقاله ISI
نوع ارائه مقاله ژورنال
رشته های مرتبط با این مقاله مهندسی کامپیوتر
گرایش های مرتبط با این مقاله هوش مصنوعی و مهندسی الگوریتم ها و محاسبات
چاپ شده در مجله (ژورنال) مجله بین المللی تکنولوژی گفتار – International Journal of Speech Technology
کلمات کلیدی سيستم تشخيص احساسات (ERS)، ویژگی های نوای گاما ، چند سازی برداری (VQ)، الگوریتم خوشه بندی c میانگین (FCM)، چند مدل مارکوف پنهان (MHMM)، ماشین بردار پشتیبانی (SVM)
کلمات کلیدی انگلیسی Emotion recognition system (ERS), Gamma tone features, Vector quantization (VQ), Fuzzy C means clustering (FCM), Multi variate hidden Markov models (MHMM), Support vector machine
ارائه شده از دانشگاه گروه ECE / SEEE، هند
نویسندگان A. Revathi· N. Sasikaladevi · R. Nagakrishnan · C. Jeyalakshmi
نمایه (index)  Scopus – Master journals
شناسه شاپا یا ISSN ISSN ۱۵۷۲-۸۱۱۰
شناسه دیجیتال – doi https://doi.org/10.1007/s10772-018-9546-1
ایمپکت فاکتور(IF) مجله ۱٫۲۱۸ در سال ۲۰۱۸
شاخص H_index مجله ۲۴ در سال ۲۰۱۹
شاخص SJR مجله  ۰٫۲۲۲ در سال ۲۰۱۸
شاخص Q یا Quartile (چارک) Q3 در سال ۲۰۱۸
بیس است 
مدل مفهومی دارد  
پرسشنامه ندارد 
متغیر ندارد 
رفرنس دارد  
کد محصول ۹۵۷۱
لینک مقاله در سایت مرجع لینک این مقاله در سایت Springer
نشریه اسپرینگر

 

مشخصات و وضعیت ترجمه فارسی این مقاله (Word)
وضعیت ترجمه انجام شده و آماده دانلود در فایل ورد و PDF
کیفیت ترجمه ویژه – طلایی ⭐️⭐️⭐️
تعداد صفحات ترجمه تایپ شده با فرمت ورد با قابلیت ویرایش  ۲۶ صفحه با فونت ۱۴ B Nazanin
ترجمه عناوین تصاویر  ترجمه شده است 
ترجمه متون داخل تصاویر ترجمه نشده است 
درج تصاویر در فایل ترجمه درج شده است  
درج فرمولها و محاسبات در فایل ترجمه  به صورت عکس درج شده است  
منابع داخل متن درج نشده است 

 

فهرست مطالب

چکیده

۱- مقدمه

۲- استخراج ویژگی

۲-۱ بانک های فیلتر نوای گاما

۳- شناسایی احساسات مبتنی بر ویژگی ها و تکنیک های مدل سازی

۳-۱ تحلیل آزمایشی مبتنی بر تکنیک های VQ/FCM/MHMM/SVM

۳-۲ ارزیابی آزمایشی : نتایج و مباحث

۴- جمع بندی

 

بخشی از ترجمه

چکیده

اکنون ، اهمیت رایانش احساسی برای تضمین تعامل بهتر و موثرتر انسان – ماشین بسیار افزایش یافته است. به دلیل این که سیگنال های وابسته به دهان و حنجره و سیگنال های گفتاری، نشان دهنده مشخصه های ماهیت احساسی گویشور به علاوه ی اطلاعات زبانی می باشد، احساسات گویشور نیز باید شناسایی شود تا پاسخ صحیحی توسط سیستم ارائه شود. این مقاله ، تاکیدش بر روی کارایی و تاثیر انتخاب ویژگی های انرژی با گذر دادن کلام از طریق فیلتر های نوای گاما می باشد که در پهنای باند مستطیلی معادل (ERB) ، MEL و مقیاس BARK قرار گرفته اند. تکنیک های مدل سازی مختلفی برای توسعه ی سیستم قوی شناسایی تنش/ احساسات گویشور مستقل از حضور چندین گویشور ارائه شده است. به دلیل این که مجموعه داده ی EMO-DB Berlin و مجموعه داده ی صوتی – تصویری احساسی SAVEE که در این کار مورد استفاده قرار گرفته اند تنها شامل مجموعه ای محدود از گفتمان های گفتاری هستند که توسط ۱۰/۴ عامل / گویشور در حالات احساسی مختلف ادا شده است، بهبود عملکرد سیستم های شناسایی تنش / احساسات کار دشواری می باشد. شناسایی احساسات گویشور به صورت مستقل با استخراج ویژگی های نوای گاما و ویژگی های کپسترال ، از طریق عبور دادن گفتار الحاق شده از فیلتر های نوای گاما در ERB ، MEL و مقیاس BARK که برای تمرین در نظر گرفته شده است ، انجام می شود. سپس، مدل های دسته بندی فازی / VQ و مدل های مارکوف پنهان با تراکم پیوسته برای تمام احساسات ایجاد می شود و ارزیابی آن نیز تنها با استفاده از گفتار گویشور مستقل از گویش های در نظر گرفته شده برای تمرین، انجام می شود. ویژگی های پیشنهاد شده برای گفتار تست ثبت شده و سپس بر روی مدل های VQ/Fuzzy/MHMM/SVM اعمال می شوند و سپس تست این روند با استفاده از معیار های احتمال لگاریتمی بیشینه / معیار حداقل فاصله ارزیابی می شود. ویژگی های کپسترال/ انرژی نوای گاما و تکنیک های مدل سازی ارائه شده، می توانند شواهد اضافی ارائه کنند تا عملکرد سیستم ارائه شده را ارزیابی کنیم. این الگوریتم ۹۶% ، ۷۹% و ۹۵٫۳% را به عنوان بازیابی صحت وزن دار برای سیستم شناسایی تنش نسبت به طبقه بندی انجام شده در گروه های خاص احساسی با مدل های VQ/Fuzzy/MHMM/SVM برای ویژگی های انرژی GFT با فیلتر های گاما قرار گرفته به ترتیب بر روی مقیاس های ERB ، MEL و BARK ارائه می کند که برای سیستمی به دست آمده که با دیتابیس EMO-DB ارزیابی شده است. صحت بازیابی وزن دار نیز برای سیستم شناسایی تنش نسبت به طبقه بندی انجام شده در گروه های خاص احساسی با مدل های VQ/Fuzzy/MHMM/SVM برای ویژگی های انرژی GFT با فیلتر های گاما قرار گرفته به ترتیب بر روی مقیاس های ERB ، MEL و BARK د که برای سیستمی با دیتابیس SAVEE ارزیابی شده است ، به صورت ۹۱% ، ۹۳% و ۹۴% می باشد. ویژگی های کپسترال نوای گاما ، صحت کلی ۹۲% ، ۹۰% و ۹۲% را برای فیلتر های قرار گرفته در مقیاس ERB ، MEL و BARK را برای مجموعه داده ی Berlin EMO-BD ایجاد می کند. طبقه بندی ترکیب سطح تصمیم گیری مبتنی بر ویژگی های انرژی GTF و تکنیک های مدل سازی می تواند صحت کلی ۹۹٫۸% را برای مجموعه داده های EO-DB و برای مجموعه داده ی SAVEE صحت ۱۰۰% را ایجاد کند.

 

۴- جمع بندی
این مقاله روش را ارائه می کند که بر اساس آن، ویژگی های انرژی GTF و ویژگی های کپسترال GTF با استفاده از فیلتر های نوای گاما از گفتار استخراج می شود که بر روی مقیاس های ERB/MEL/BARK قرار دارند و سپس از تکنیک های مدل سازی برای ارزیابی سیستم شناسایی احساسات برای گفتار های انتخاب شده از دیتابیس EMO-DB و SAVEE استفاده می کند. گفتار ادا شده توسط افراد که برای تمرین این الگوریتم ها مورد استفاده قرار می گیرد با یکدیگر ترکیب شده اند و به صورت قاب های زمانی همراه با پیش پردازش مورد استفاده قرار می گیرند. ویژگی های GTF و GTFCC با فیلتر های نوای گاما در مقیاس ERB/MEL/BARK از این اطلاعات استخراج می شوند. این ویژگی ها به صورتی تنظیم می شوند که بتوان از آن ها بر روی تکنیک های تولید نمونه ی VQ/ FCM/MHMM/SVM استفاده کرد و سپس با استفاده از این روش، مدل ها و نمونه های احساسات ایجاد می شوند. انرژی GTF و ویژگی های GTFCC از گفتار های تست استخراج شده و سپس بر روی مدل های خاص هر احساس در گروه های مختلف اعمال می شوند و طبقه بندی گروه ها نیز بر اساس احساسات بر انگیخته یا نرم، انجام می شود. سپس ، شناسایی احساسات با استفاده از مدل های خاص احساسی در یک گروه انجام می شود و عملکرد این روش نیز بر اساس محاسبه ی صحت شناسایی انجام می شود.

 

بخشی از مقاله انگلیسی

Abstract

Affective computing is gaining paramount importance in ensuring the better and effective human–machine interaction. As glottal and speech signals depict the characteristics of the emotional nature of the speaker in addition to the linguistic information, speaker’s emotions are needed to be recognised to give meaningful response by the system. This paper emphasises the effectiveness and efficiency in selecting the energy features by passing the speech through the Gamma tone filters spaced in Equivalent rectangular bandwidth (ERB), MEL and BARK scale. Various modelling techniques are used to develop the robust multi-speaker independent speaker’s emotion/stress recognition system. Since EMO-DB Berlin database and SAVEE emotional audio-visual database used in this work contain the only limited set of speech utterances uttered by 10/4 actors/ speakers in different emotions, it has become challenging to improve the performance of the stress/emotion recognition system. Speaker independent emotion recognition is done by extracting the Gamma tone energy features and cepstral features by passing the concatenated speech considered for training through the Gamma tone filters spaced in ERB, MEL and BARK scales. Subsequently, VQ/Fuzzy clustering models and continuous density hidden Markov models are created for all emotions and evaluation is done with the utterances of a speaker independent of speeches considered for training. The proposed features for test utterances are captured and applied to the VQ/Fuzzy/MHMM/SVM models and testing is performed by using minimum distance criterion/maximum log-likelihood criterion. The proposed Gamma tone energy/cepstral features and modelling techniques provide complementary evidence in assessing the performance of the system. This algorithm offers 96%, 79%, and 95.3% as weighted accuracy recall for the stress recognition system with respect to the classification done on emotion-specific group VQ/Fuzzy/MHMM/SVM models for GTF energy features with Gamma tone filters spaced in ERB, MEL and BARK scale respectively for the system evaluated for the EMO-DB database. Weighted accuracy recall is found to be 91%, 93% and 94% for the classification done on emotion-specific group models for GTF energy features with Gamma tone filters spaced in ERB, MEL and BARK scale respectively for the evaluation done on the utterances chosen from the SAVEE database. Gamma tone Cepstral features provide the overall accuracy of 92%, 90% and 92% for filters spaced in ERB, MEL and BARK scale for Berlin EMO-DB. Decision level fusion classification based on GTF energy features and modelling techniques provides the overall accuracy as 99.8% for EO-DB database and 100% for SAVEE database.

 

۴ Conclusions

This paper proposes the extraction of GTF energy and GTF Cepstral features with the Gamma tone filters spaced in ERB/MEL/BARK scale from the speech signal and modelling techniques to evaluate the performance of the emotion recognition system for the utterances chosen from EMO-DB database and SAVEE database. Speech utterances considered for training are concatenated and converted into frames after pre-emphasis and windowing. GTF energy and GTFCC features with Gamma tone filters spaced in ERB/MEL/BARK scale are extracted. This feature set is applied to the VQ/ FCM/MHMM/SVM template production techniques, and templates/models are created. GTF energy and GTFCC features extracted from the test utterances and applied to the emotion-specific models in a group and group classification is done between arousal and soft emotions. Subsequently, identification of emotion is done with emotion specific models in a group, and the performance is assessed with computation of recognition accuracy.

 

 

تصویری از مقاله ترجمه و تایپ شده در نرم افزار ورد

 

 

 

دانلود رایگان مقاله انگلیسی + خرید ترجمه فارسی
عنوان فارسی مقاله:

شناسایی احساسات قوی از گفتار: ویژگی ها و مدل گاما

عنوان انگلیسی مقاله:

Robust emotion recognition from speech: Gamma tone features and models

 

 

 

نوشته های مشابه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

دکمه بازگشت به بالا