Music emotion recognition: A multimodal machine learning approach
Is this your thesis?
This record came from a bulk archive import. If it’s yours, link it to your profile.
2019
0 views
0 downloads
Advisor: Dr. Öğr. Üyesi Ahmet Onur Durahim ; Doç. Abdullah Daşcı
Abstract (TR)
Müzik duygusu tanıma, müzik bigisi çıkarım bilimsel topluluğunun yeni gelişmekte olan bir alanıdır ve aslında, duygular üzerinden yapılan müzik aramaları, web kullanıcıları tarafından kullanılan en önemli tercihlerden biridir. Dünya dijitale giderken, Last.fm gibi çevrimiçi veritabanlarındaki müzik içerikleri katlanarak genişlemesi, içeriklerin yönetilmesi ve güncel tutulması için önemli bir manuel çaba gerektiriyor. Bu nedenle, kullanıcıların duygusal durumuna göre kişiselleştirilebilecek ileri ve esnek arama mekanizmalarına olan talep son yıllarda artan ilgi görmektedir. Bu tezde, metinsel bazlı özelliklerin yanısıra müzikten türetilen sessel niteliklerle beslenen çeşitli sınıflandırılma modelleri sunarak, müzik duygu tanıma problemini ele almaya odaklanan bir çerçeve tasarlamıştır. Bu çalışmada, tempo, akustiklik ve enerji gibi ses özelliklerinin duygusal rolünü ve, iki farklı yaklaşımla, TF-IDF ve Word2Vec, elde edilen metinsel özelliklerin etkisini, hem denetimli hem de yarı denetimli tasarımlarla, dört araştırma deneyi altında ele aldık. Ayrıca, müzikten türetilen sessel özellikleri, içeriğe duyarlı verilerden gelen özelliklerle birleştirerek, çok modlu bir yaklaşım önerdik. Yüksek performanslı, otomatik bir duygu sınıflandırma sistemi oluşturmayı başarmak adına, 1500'den fazla etiketli şarkı sözü ve 2.5 milyondan fazla Türkçe belgenin bulunduğu etiketlenmemiş büyük veriyi içeren temel bir gerçek veri seti oluşturduk. Analitik modeller Python kullanılarak çapraz doğrulanmış veriler üzerinde birkaç farklı algoritma benimseyerek gerçekleştirildi. Deneylerin bir sonucu olarak, sadece ses özellikleri kullanılırken elde edilen en iyi performans %44,2 iken, metinsel özelliklerin kullanılmasıyla, sırasıyla denetimli ve yarı denetimli öğrenme paradigmaları dikkate alındığında, % 46,3 ve % 51,3 doğruluk puanları ile gelişmiş bir performans gözlenmiştir. Son olarak, sessel ve metinsel özelliklerin birleşimiyle oluşturulan bütünsel bir özellik seti yaratmış olsak da, bu yaklaşımın sınıflandırma performansı için önemli bir gelişme göstermediği gözlemlendi.
Author
Cemre Gökalp
Institution

Sabancı University
Endüstri Mühendisliği ve İşletme Yönetimi Bilim Dalı
How to Cite
Cemre Gökalp (Yüksek Lisans Tezi). Music emotion recognition: A multimodal machine learning approach, 2019, Sabancı University.
Keywords
License
Tüm Hakları Saklıdır
This work is shared under the specified license terms.
More theses from Sabancı University
- Internal party democracy in Turkey: Theory, prospect and problems(2019)
- Bride: Comes with a price / a visual narrative of bride exchange and child marriage(2019)
- Populism, failures, and a sense of crisis(2019)
- Ways of seeing: Nev'izâde Atâ'i's Alemnümâ and changes in the visual perception of Ottoman society in the early Seventeenth century(2020)
- Who's There? staging the silenced pasts in contemporary theater in Turkey: Kim Var Orada? Muhsin Bey'in Son Hamleti(2020)
- Two worlds meeting in one neighborhood: Receiving society members-Afghan workers relations in Yenimahalle, İstanbul(2019)