PISA başarısını tahmin etmede kullanılan veri madenciliği yöntemlerinin incelenmesi
2018
0 görüntülenme
0 i̇ndirme
Danışman: Doç. Dr. Nuri Doğan
Özet (TR)
Bu çalışmada veri madenciliği ve makine öğrenme yaklaşımının eğitim alanında kullanılması ve bu algoritmalara dayalı olarak elde edilen sonuçların güvenirlik ve geçerlik değerlerinin ne düzeyde olduğu belirlenmeye çalışılmıştır. PISA 2015 Türkiye ortalamasına göre öğrencilerin başarılı ve başarısız olarak sınıflandığı çalışmada farklı öğrenme yöntemleri kullanılarak fen okuryazarlığı bakımından öğrencilerin hangi sınıfta yer alacağı tahmin edilmiş ve bu aşamada elde edilen sonuçların güvenirlik ve geçerlik ölçütleri incelenmiştir. Bunun yanında WEKA programının sahip olduğu tüm algoritma ve yöntemler farklı koşullar altında karşılaştırılarak hangi makine öğrenme yönteminin hangi durumlarda avantajlı veya dezavantajlı olduğu belirlenmiştir. Araştırmada elde edilen sonuçlar doğrultusunda PISA Fen okuryazarlığını yordamak amacıyla kullanılacak değişken sayısının 29 olması sebebiyle ilk olarak farklı algoritmalar yardımıyla en iyi özellikler belirlenmeye çalışılmıştır ve 10 katlı çapraz geçerleme yöntemiyle her katmanda başarılı olan 12 değişken yardımıyla PISA 2015 fen okuryazarlığı başarıları tahmin edilmiştir. Sonrasında çalışma kapsamında ele alınan 8 farklı öğrenme yönteminden doğru sınıflama sayısı, doğru sınıflama oranı, kappa istatistiği, karekök hata ve göreceli karekök hata değerleri bakımından en iyi sonuçların Random Forest yöntemiyle elde edilirken Ridge lojistik regresyon, Lojistik model ve Hoefding tree yöntemlerinin en başarılı diğer yöntemler olduğu belirlenmiştir. Çapraz geçerleme yöntemi kullanılmadan tüm veri setinin eğitim ve test veri seti olarak ayrılması durumunda Lojistik model, Random Forest ve Ridge Regresyon yöntemlerinin farklı büyüklükteki test verilerinde en düşük hata değerlerini verirken Random Tree ve J.48 yönteminlerinin en yüksek hata değerlerine sahip olduğu belirlenmiştir. Ridge regresyon, Random forest ve Lojistik model tarafından elde edilen hata değerlerinin de farklı yüzdelikteki test verilerinde oldukça tutarlı olduğu sonucuna ulaşılmıştır. Farklı yöntemler yardımıyla elde edilen ölçme sonuçlarının veri setini test ve eğitim verisi olarak ayırmayıp aynı veri seti üzerinden hem öğrenme yöntemini eğitip hem de test ettiğimiz taktirde özellikle Random tree ve J.48 öğrenme yöntemlerinin gerçek performanslarından daha yüksek doğru sınıflama oranına sahip oldukları belirlenmiştir.
Yazar
Dr. Gökhan Aksu
Kurum
Bu Yayına Nasıl Atıf Yapılır
Gökhan Aksu (Doktora Tezi). PISA başarısını tahmin etmede kullanılan veri madenciliği yöntemlerinin incelenmesi, 2018, Hacettepe University.
Anahtar Kelimeler
Lisans
Tüm Hakları Saklıdır
Bu eser belirtilen lisans koşulları altında paylaşılmaktadır.
Hacettepe University tezlerinden daha fazlası
- Gençlerin ve Gençlik Çalışanlarının Gözünden Gençlik Politikaları ve Hizmetlerinin Değerlendirilmesi(2022)
- Characterization of Ayvalik (Edremit yaglik) extra virgin olive oils volatile compounds with SPME-GC/MS and Raman spectroscopy(2018)
- Çocuk işçi nedenli boykot tehdidinin Fildişi Sahili kakao üretimine etkisi(2018)
- Türkçe konuşan çocuklarda fonatuar aerodinamik özelliklerin belirlenmesi(2018)
- The discord between the elements and human nature: Ecophobia and Renaissance English drama(2018)
- Kan kültüründen izole edilen karbapenem dirençli Klebsiella pneumoniae ve Escherichia coli suşlarında karbapenemaz varlığının fenotipik ve moleküler yöntemlerle araştırılması(2018)
