Master'sOpen Access

Topic-centric querying of web resources

2001
0 views
0 downloads
Advisor: Doç. Dr. Özgür Ulusoy

Abstract (TR)

ÖZET WEB BİLGİ KAYNAKLARININ KONU-MERKEZLİ SORGULANMASI ismail Sengör Altmgövde Bilgisayar Mühendisliği, Yüksek Lisans Tez Yöneticisi: Doç. Dr. Özgür Ulusoy Eylül, 2001 internetin insanlık tarafından bilinen hemen hemen en büyük bilgi kaynağı ol masıyla, aranılan bilgiye web üzerinde yeterince kısa bir zamanda ulaşabilmek önemli bir sorun ve araştırma konusu haline gelmiştir. Uzmanlarca hazırlanmış yüksek kaliteli indekslerden ve bilgi erişim tekniklerini kullanan (kimi zaman özelleştirilmiş) arama motorlarından anahtar-kelime tabanlı aramalar için fay- dalanılırken, çoğu akademik araştırma amaçlı bir çok web sorgu dili de literatürde önerilmiştir. Ancak, anahtar-kelime aramaya dayalı yaklaşımlar web üzerindeki "bilgi kirliliğine" karşı savunmasız olup aranılan konuyla ilgisi olmayan pek çok sonuç geri döndürebilmektedir. Diğer taraftan web sorgu dilleri ise pratikte kul lanımlarını sağlayabilecek hız ve genel geçerlikten uzak durumdadır. Bu tezde, web kaynak alanlarını temsil etmek ve yüksek kaliteli arama sonuçlarını kabul edilebilir sürede geri döndürebilecek sorgu kapasitesi sağlamak için "metadata"da,rı ve beraberinde XML temelli bir takım standartlardan fay dalanılmaktadır. Bu tezde web bilgi kaynakları için "web bilgi uzayı" metadata modeli ve bu model üzerinde işlem yapan SQL-TC (Konu-merkezli SQL) sorgu dili sunulmaktadır. Bahsedilen web bilgi uzayı modelinin bileşenleri ise web- tabanlı bilgi kaynakları (internetteki XML veya HTML belgeleri), uzman öneri veri-tabanları (bilgi kaynakları için alan/konu uzmanlarınca belirlenmiş meta data) ve kullanıcılar için özelleştirilmiş bilgilerdir (XML belgeleri olarak saklanan kullanıcı profilleri ve tercihleri). Uzman önerileri, literatürde yakın zamanda sunulmuş olan konu haritaları çalışması göz önüne alınarak belli bir ilgi alanındaki "konu'l&r ve konular-arası "ilişkiler" (metalink'ler) kullanılarak verilmektedir. Alan uzmanları, tanımladıkları konulara ve metalinklere bunların o alandaki önemlerini yansıtan sayısal önem değerleri de iliştirmektedirler. Uygun koşullarVI altında, bu konu ve rnetalinklerin web ortamındaki gerçek bilgi kaynaklarıyla ilişkilendirilmesiyle uzman öneri veritabanı bu bilgi kaynakları için bir kavramsal indeks işlevi kazanmaktadır. Modelin bir diğer bileşeni olan kullanıcı profilleri ise kullanıcının bilgi seviyesini ve web dolaşım tarihçesini yine konular ve zi yaret edilen web kaynakları cinsinden saklamaktadır. Kullanıcı tercihleri ise belli bir alan uzmanının önerilerine karşı kullanıcının yaklaşımını ve/veya güvenini yansıtmaktadır. Bu tezde sunulan SQL-TC sorgu dili uzman öneri veri-tabanlarmda sağlanan metadata'yı kullanmakta ve sorgu sonuçlarını daraltmak ve özelleştirmek için (yukarıda bahsedilen) kullanıcı bilgilerinden faydalanmaktadır. Sorgu sonucunda bulunan nesneler veya veri tablosu satırları ise uzmanlarca atanan ve kullanıcı ter cihlerine göre değerlendirilen önem değerleri göz önüne alınarak sıralanmaktadır. Bu sıralama sonrasında kullanıcıya (isteğine göre) sadece en önemli ilk n nesne ve/veya belli bir önem değerinin üstündeki nesneler ya da her ikisi birden sunula bilmektedir. Bunlardan dolayı, SQL-TC sorgu dilinin aranılan konuyla "anlam sal" olarak ilişkili sonuçları kısa zamanda bulabilmesi beklenmektedir. Anahtar sözcükler: metadata, XML, Konu Haritaları, web veri modellemesi, web sorgulaması, kavramsal indeksleme, kullanıcı profili.

Author

Dr. İsmail Şengör Altıngövde

How to Cite

İsmail Şengör Altıngövde (Yüksek Lisans Tezi). Topic-centric querying of web resources, 2001, Bilkent University.

License

Tüm Hakları Saklıdır

This work is shared under the specified license terms.

More theses from Bilkent University