Master'sOpen Access

Incomplete preferences and robust satisficing in multi-armed bandits

2025
0 views
0 downloads
Advisor: Doç. Cem Tekin

Abstract (TR)

Bu tez, çok kollu haydut (MAB) problemlerinde sıralı karar vermeyi iki farklı bağlamda incelemektedir: birden fazla amacın bulunduğu ve eylemler arasındaki tercihlerin tam olmadığı durumlarda ve eylemlerin hasım saldırılarına maruz kaldığı durumlarda. İlk bölümde, skalerleştirmeler yerine koniler ile temellendirilen karşılaştırmalar kullanan, eksik tercihler altında vektör değerli ödüller için saf keşif algoritması olan PaVeBa'yı sunuyoruz. Algoritmanın davranışını analiz ediyor ve güçlü temel metotlara karşı deneysel olarak doğruluyoruz. Bu alandaki araştırmaları ve tekrar üretilebilirliği desteklemek için, PaVeBa ve yanı sıra daha geniş bir vektör optimizasyonu algoritmaları ve araçları yelpazesini içeren VOPy isimli bir Python kütüphanesi de geliştiriyoruz. İkinci kısımda ise, hasım saldırıları altında gürbüz yeterlilik problemini inceliyoruz. Mevcut gürbüz yeterlilik formülasyonlarını (örneğin, kararlılık yarıçapı ve kırılganlık tabanlı) temel alarak, bir algoritma ailesinin Thompson-örnekleme varyantını tasarlıyor ve hedeflenmiş bozucu saldırılar altında güvenilir bir yeterlilik performansı elde ettiğini gösteriyoruz.

Author

Dr. Yaşar Cahit Yıldırım

How to Cite

Yaşar Cahit Yıldırım (Yüksek Lisans Tezi). Incomplete preferences and robust satisficing in multi-armed bandits, 2025, Bilkent University.

Keywords

License

Tüm Hakları Saklıdır

This work is shared under the specified license terms.

More theses from Bilkent University