Master'sOpen Access

A Turkish broadcast news speech database for investigation of the effect of deep neural network and long short term memory hyperparameters on speech recognition based systems

2021
0 views
0 downloads
Advisor: Doç. Dr. Zekeriya Tüfekci

Abstract (TR)

Konuşma tanıma, söylenen kelime ve cümlelerin metne dönüştürülmesidir. Ses ile kontrol uygulamalarının yanı sıra çeşitli dikte işlemleri için de kullanılmaktadır. Son zamanlarda birçok ülkede konuşma tanıma ile ilgili bir çok çalışma yapılmıştır, bunun en büyük nedeni kendilerine ait bir dilde büyük ses veri setlerinin olması ve bunların erişime açık olmasıdır. Fakat ülkemizde konuşma tanıma uygulamaları ile ilgili yapılan çalışmalar çok azdır, bunun nedenlerinden biri ses veri seti eksikliğidir. Bu çalışmada, Türkçe konuşma tanıma tabanlı sistemler için bir Türkçe konuşma veritabanı geliştirilmiştir. Ses kayıtları Türkçe Haber TV kanallarının farklı zamanlarda yayınladıkları haberlerden elde edilmiştir. Veri tabanı oluşturma aşamaları adım adım incelenmiş ve kullanılan araçlar ele alınmıştır. Oluşturulan veri seti diğer çalışmalara da emsal teşkil etmesi açısından herkesin erişebileceği şekilde web ortamında paylaşılmıştır. Ek olarak, katman sayısı ve hücre sayısı hiper parametrelerinin Uzun Kısa Süreli Hafıza (LSTM) ve Derin Sinir Ağı (DNN) modelleri üzerindeki etkisini oluşturduğumuz Türkçe Yayın Haberleri Konuşma Veri seti üzerinde inceledik ve karşılaştırdık.

Author

Dr. Serhat Ok

How to Cite

Serhat Ok (Yüksek Lisans Tezi). A Turkish broadcast news speech database for investigation of the effect of deep neural network and long short term memory hyperparameters on speech recognition based systems, 2021, Çukurova University.

Keywords

License

Tüm Hakları Saklıdır

This work is shared under the specified license terms.

More theses from Çukurova University