Incomplete preferences and robust satisficing in multi-armed bandits
2025
0 views
0 downloads
Advisor: Doç. Cem Tekin
Abstract (TR)
Bu tez, çok kollu haydut (MAB) problemlerinde sıralı karar vermeyi iki farklı bağlamda incelemektedir: birden fazla amacın bulunduğu ve eylemler arasındaki tercihlerin tam olmadığı durumlarda ve eylemlerin hasım saldırılarına maruz kaldığı durumlarda. İlk bölümde, skalerleştirmeler yerine koniler ile temellendirilen karşılaştırmalar kullanan, eksik tercihler altında vektör değerli ödüller için saf keşif algoritması olan PaVeBa'yı sunuyoruz. Algoritmanın davranışını analiz ediyor ve güçlü temel metotlara karşı deneysel olarak doğruluyoruz. Bu alandaki araştırmaları ve tekrar üretilebilirliği desteklemek için, PaVeBa ve yanı sıra daha geniş bir vektör optimizasyonu algoritmaları ve araçları yelpazesini içeren VOPy isimli bir Python kütüphanesi de geliştiriyoruz. İkinci kısımda ise, hasım saldırıları altında gürbüz yeterlilik problemini inceliyoruz. Mevcut gürbüz yeterlilik formülasyonlarını (örneğin, kararlılık yarıçapı ve kırılganlık tabanlı) temel alarak, bir algoritma ailesinin Thompson-örnekleme varyantını tasarlıyor ve hedeflenmiş bozucu saldırılar altında güvenilir bir yeterlilik performansı elde ettiğini gösteriyoruz.
Author
Dr. Yaşar Cahit Yıldırım
Institution
How to Cite
Yaşar Cahit Yıldırım (Yüksek Lisans Tezi). Incomplete preferences and robust satisficing in multi-armed bandits, 2025, Bilkent University.
Keywords
License
Tüm Hakları Saklıdır
This work is shared under the specified license terms.
More theses from Bilkent University
- The Lower Danube in Late Antiquity: The case of Histria(2023)
- Oil price surges and the yield curve(2024)
- Essays on forward guidance(2014)
- Multi-armed bandit algorithms for communication networks and healthcare(2022)
- Comparative constitutional happiness in the light of the jurisprudence of the Turkish Constitutional Court(2023)
- Density functional theory investigation of linear carbon chains(2023)
