Yüksek LisansAçık Erişim

İntihal tespitinde yaklaşık dizi eşleştirme algoritmaları ile terim sıklığının birleştirilmesi

2022
0 görüntülenme
0 i̇ndirme
Danışman: Prof. Dr. Cihan Varol

Özet (TR)

İntihalin arkasındaki en önemli faktörlerden biri, internet üzerinde hızla erişilebilen büyük miktarda veri ve bilginin bulunmasıdır. Bu, akademik dolandırıcılık ve fikri mülkiyet hırsızlığı riskini artırır. İntihal üzerine endişe arttıkça, otomatik intihal tespitine yönelik daha fazla araştırmalar yapıldı. Hibrit algoritmalar, bir öğrenci tarafından yazılan günlük dil veya kaynak kodun benzerliğini tespit etmenin en olası yollarından biri olarak kabul edilir. Bu çalışma, hem Levenshtein düzenleme mesafesi yaklaşık dizi eşleştirme algoritmasını hem de frekans ters belge frekansı (TF-IDF) terimini birleştirmenin uygulanabilirliğini ve başarısını araştırıp, böylece kosinüs benzerliği kullanılarak ölçülen benzerlik oranını saptamada daha etkili bir yöntem sunmaktadır. Önerilen hibrit algoritma aynı zamanda doğal dilde, kaynak kodlarında, tam ve kılık değiştirmiş kelimelerde meydana gelen intihalleri de tespit edebilmektedir. Geliştirilen algoritma, yeniden düzenlenmiş sözcükleri, metinler arası ekleme veya silme benzerliğini ve dilbilgisi değişikliklerini algılayabilmektedir. Bu araştırmada test için üç farklı veri seti kullanılmıştır: otomatik makine paragrafları, yanlış yazılmış kelimeler ve java kaynak kodları. Genel olarak, sistem intihalleri tek başına kullanılan TF-IDF yaklaşımından daha iyi tespit ettiğini kanıtlamıştır.

Yazar

Dr. Zına Balanı

Bu Yayına Nasıl Atıf Yapılır

Zına Balanı (Yüksek Lisans Tezi). İntihal tespitinde yaklaşık dizi eşleştirme algoritmaları ile terim sıklığının birleştirilmesi, 2022, Fırat University.

Lisans

Tüm Hakları Saklıdır

Bu eser belirtilen lisans koşulları altında paylaşılmaktadır.

Fırat University tezlerinden daha fazlası