Journals / Erciyes Üniversitesi Fen Bilimleri Enstitüsü Fen Bilimleri Dergisi / 2002 / Cilt: 18 - Sayı: 1

PRACTICAL ASPECTS OF BUILDING A SPEECH DATABASE FOR SPEAKER RECOGNITION SYSTEMS

KONUŞMACI TANIMA SİSTEMLERİ İÇİN SÖZ VERİTABANI OLUŞTURMANIN PRATİK YÖNLERİ

Pages
34–43
DOI
—

Abstract

Speech databases are of vital importance in many area of speech research. In particular, the evolution of current automatic speech and speaker recognition systems has been strictly related to the availability of large corpora of speech. The success of developing practical systems heavily depends on the use of proper databases. However, there are difficulties in the definition of universal standards for the development of speech databases.A certain difficulty is the presence of many variabilities in the speech signals. In this paper, sources of variability in speech and speakers that affect the system performance are briefly discussed with regard to building a speech database. A comparative discussion on most popular databases is also given

Özet

Söz veri tabanları, söz araştırmalarının bir çok alanında hayati öneme sahiptir. Özellikle otomatik söz ve konuşmacı tanıyan sistemlerin gelişimi, geniş kapsamlı söz veri tabanlarının elde bulunmasına bağlı olmuştur. Pratik sistemlerin geliştirilmesindeki başarı, büyük oranda uygun veri tabanı kullanılmasına bağlı olmaktadır. Bununla beraber, söz veri tabanı oluşturmak için ortak bir standart tanımlamada büyük zorluklar bulunmaktadır. Bu zorluklardan biri, konuşma işaretlerindeki mevcut değişimlerdir. Bu makalede, konuşma işaretindeki değişimler etraflıca tartışılmış ve en bilinen veri tabanları için karşılaştırmalı bir inceleme yapılmıştır

Keywords: Konuşma, konuşmacı, çevre, değişim, söz veri tabanı