An actor-critic reinforcement learning approach for bilateral negotiation
Is this your thesis?
This record came from a bulk archive import. If it’s yours, link it to your profile.
Abstract (TR)
Bir çıkar çatışması olduğunda yazılım aracılarının karşılıklı bir anlaşma bulmak amacıyla birbirleriyle yaptığı pazarlık için etkili ve akıllı bir teklif stratejisi tasarlamak otomatik müzakeredeki en zorlayıcı araştırma zorluklarından biridir. Bu tez de, elle hazırlanmış bir karar verme modülü tasarlamak yerine, ikili bir müzakerede hangi teklifi sunulacağını öğrenen bir aktör-eleştirmen takviyeli öğrenme yaklaşımını benimseyen yeni bir teklif stratejisi önerilmiştir. Teklif verme yaklaşımı için Soft Actor-Critic (SAC) adı verilen bir entropi pekiştirmeli öğrenme yaklaşımı kullanılmıştır. Önceki teklif değişimlerine ve kalan süreye dayalı olarak gelecek teklifin hedef değerini belirleyen SAC modeli eğitmek için bir kendi kendine oynama yaklaşımı kullanılır. Ayrıca, öğrenme sürecini hızlandırmak için davranış klonlama adı verilen bir taklit öğrenme yaklaşımı benimsenmiştir. Bunlara ek olarak, müzakerenin sonunda yalnızca temsilcinin aldığı teklif değerini değil, aynı zamanda rakibin teklif değerinide kullanan yeni bir ödül işlevi tanıtıldı. Bu tez kapsamında geliştirilen SAC ajanı ampirik olarak değerlendirildi. Bu amaçla, büyüklük ve zorluk bakımından farklı alanlarda seçilen çeşitli muhaliflere karşı çok sayıda pazarlık oturumları yürütüldü. Ajanın performansı rakipleriyle ve aynı rakiplerle pazarlık eden temel ajanların performansıyla karşılaştırıldı. Ampirik sonuçlar, temsilcimizin, rakip veya alan hakkında önceden herhangi bir bilgi gerektirmeden farklı pazarlık senaryolarında zorlu rakiplere karşı başarılı bir şekilde pazarlık ettiğini göstermektedir. Ayrıca, başarılı pazarlık sonunda alınan teklif değeri göz önünde bulundurulduğunda temel aracılardan daha iyi sonuçlar elde etmektedir.
Author
Furkan Arslan
Institution
How to Cite
Furkan Arslan (Yüksek Lisans Tezi). An actor-critic reinforcement learning approach for bilateral negotiation, 2021, Özyeğin University.
Keywords
License
Tüm Hakları Saklıdır
This work is shared under the specified license terms.
More theses from Özyeğin University
- A metaheuristic approach for multiple-item economic lot sizing problem with inventory dependent demand(2023)
- Design and implementation of a data stream management system with advanced complex event processing capabilities(2013)
- A performance based assesment of biological self-healing cement-based mortar(2022)
- Türk Ceza Kanununda uyuşturucu ve uyarıcı madde suçlarında etkin pişmanlık(2023)
- Visual state-space based multi-task learning for building segmentation and height estimation(2025)
- Dual circularly polarized horn antenna and feed network for full ka-band satcom(2025)
