Dergiler / ACADEMIC PLATFORM-JOURNAL OF ENGINEERING AND SCIENCE / 2016 / Cilt: 4 - Sayı: 2

Alman Dili Üzerinde Konuşmacı Cinsiyetinin Otomatik Olarak Belirlenmesi

Automatic Determination of the Speaker on the German Language

Sayfa
52–58
DOI
—

Özet

Kişi tanıma sistemleri biyometrik verilerin güvenli bir şekilde iletimini, tasarımını, sınıflandırılmasını gerekli kılmaktadır. Ayrıca konuşmacıların cinsiyeti belirlenerek biyometrik ses işlemlerinde daha başarılı sonuçlar elde edilebilir. Bu çalışmada Almanca ses biçim ve özelliklerine bakılarak konuşmacının cinsiyetinin otomatik olarak tanınması için bir sistem tasarlanması amaçlanmıştır. 50 erkek ve 50 kadından Almanca farklı uzunlukta kelime ve cümle olarak yaklaşık 2658 ses örneği alınmıştır. Bu ses örnekleri tek kelime olduğu gibi birden fazla kelime de içermektedir. Ses örneklerinin öznitelikleri MFCC (Mel Frequency Cepstral Coefficients) kullanılarak elde edilmiştir. Elde edilen ses örneklerinin öznitelik vektörleri Saklı Markov Modelleri(Hidden Markov Models-HMM), Dinamik Zaman Bükmesi(Dynamic Time Warping-DTW) ve Gauss Mixture Models (Gauss Karışım Modeli-GMM) yöntemleri ile eğitilmiştir. Test aşamasında ise eğitilen ses örneklerine bakılarak verilen ses örneğinin cinsiyeti belirlenmeye çalışılmıştır. Ayrıca çalışmada kullanılan tüm sınıflandırma algoritmalarının sonuçları ve performansları karşılaştırılmalı olarak sunulmuştur.

Abstract

Authentication systems necessitate transmission, design and classification of biometric data in a secure manner. Moreover, in voice process of biometric can be obtained successful results by determining gender of speaker. In this study, the aim was to designed system taking German sound forms and properties for automatic recognition gender of speaker. Approximately 2658 German voice samples of words and clauses with differing lengths have been collected from 50 males and 50 females. This voice samples includes more than one word as a word. Features of these voice samples have been obtained using MFCC (Mel Frequency Cepstral Coefficients). Feature vectors of the voice samples obtained have been trained with such methods as Hidden Markov Model, Dynamic Time Warping and Gauss Mixture Model. In the test phase, gender of a given voice sample has been identified taking the trained voice samples into consideration. Results and performances of the algorithms employed in the study for classification have been also demonstrated in a comparative manner