Toward foundations of multi-team learning: Convergence, coordination, and equilibrium
Çok takımlı öğrenmenin temellerine doğru: Yakınsama, iş birliği ve denge
- Tez No: 985643
- Danışmanlar: DR. ÖĞR. ÜYESİ MUHAMMED ÖMER SAYIN, PROF. SİNAN GEZİCİ, PROF. FARUK POLAT
- Tez Türü: Yüksek Lisans
- Konular: Elektrik ve Elektronik Mühendisliği, Electrical and Electronics Engineering
- Anahtar Kelimeler: Belirtilmemiş.
- Yıl: 2025
- Dil: İngilizce
- Üniversite: İhsan Doğramacı Bilkent Üniversitesi
- Enstitü: Mühendislik ve Fen Bilimleri Enstitüsü
- Ana Bilim Dalı: Elektrik ve Elektronik Mühendisliği Ana Bilim Dalı
- Bilim Dalı: Belirtilmemiş.
- Sayfa Sayısı: Belirtilmemiş.
Özet
Modern sosyo-teknik sistemlerdeki sonuçlar, giderek artan bir şekilde izole bireyler tarafından değil, dışarıya karşı rekabet ederken kendi içlerinde koordine olan akıllı etmen takımları tarafından şekillenmektedir. Bu tez, akıllı etmenlerin (insan veya yapay) karmaşık ve dinamik ortamlarda nasıl takımlar halinde öğrendiği ve hareket ettiğine dair ortaya çıkan büyük zorluğa odaklanmaktadır. İki stratejik ortamı ele alıyoruz: tekrarlanan normal-form oyunlarda takımlar arası rekabet ve dinamik, stokastik ortamlarda takım içi işbirliği. Eşzamanlı öğrenmenin neden olduğu durağansızlığın üstesinden gelmek için dönem tabanlı stokastik yaklaşılama ve diferansiyel içermelere dayalı birleşik bir çerçeve oluşturuyoruz. Takımlar arası rekabet için, potansiyel ve sıfır toplamlı polimatris oyunlarını genelleştiren Sıfır Toplamlı Potansiyel Takım Oyunlarını (ZSPTG'ler) tanıtıyoruz. Takım arkadaşı geçmişine ve rakip inançlarına karşı yumuşatılmış en iyi yanıtları kullanan merkeziyetsiz bir dinamik olan Takım-Hayali-Oyun'u (Team-FP) öneriyoruz. Team-FP altındaki ampirik ortalamaların, keşif parametreleri aracılığıyla hatayı nicelendirerek, bir Takım-Nash Dengesi'ne (TNE) yakın bir noktaya neredeyse kesin yakınsadığını kanıtlıyoruz. Standart dinamiklerin sıklıkla başarısız olduğu takım içi işbirliğini ele alarak, Logit-Q dinamiklerini geliştiriyoruz. Log-lineer öğrenmeyi Q-learning ile birleştiren bu yöntem, model bilgisi olmadan değer fonksiyonlarının ve politikaların eşzamanlı öğrenilmesine olanak tanır. Durağan olmayan süreci izlenebilir bir yarı-durağan referansla eşleştirerek doğruladığımız, verimli durağan dengeye neredeyse kesin yakınsamayı kanıtlıyoruz. Son olarak, sayısal deneyler teorik bulgularımızı doğrulamakta ve etkili koordinasyonu göstermektedir.
Özet (Çeviri)
Outcomes in modern socio-technical systems are increasingly shaped not by isolated individuals, but by teams of intelligent agents that coordinate internally while competing externally. This thesis focuses on the emerging grand challenge of how intelligent agents (human or artificial) learn and act as teams in complex and dynamic environments. We address two strategic environments: inter-team competition in repeated normal-form games and intra-team cooperation in dynamic, stochastic environments. We establish a unified framework based on epoch-based stochastic approximation and differential inclusions to overcome non-stationarity induced by simultaneous learning. For inter-team competition, we introduce Zero-Sum Potential Team Games (ZSPTGs), generalizing potential and zero-sum polymatrix games. We propose Team-Fictitious-Play (Team-FP), a decentralized dynamic using smoothed best responses to teammate history and opponent beliefs. We prove empirical averages under Team-FP converge almost surely to a near Team-Nash Equilibrium (TNE), quantifying error via exploration parameters. Addressing intra-team cooperation where standard dynamics often fail, we develop Logit-Q dynamics. Combining log-linear learning with Q-learning, this method allows simultaneous learning of value functions and policies without model knowledge. We prove almost sure convergence to the efficient stationary equilibrium, validated by coupling the non-stationary process with a tractable quasi-stationary reference. Finally, numerical experiments validate our theoretical findings and demonstrate effective coordination.
Benzer Tezler
- Zihinsel ağırlıklı işler için bilişsel görev analizi yöntemi
Başlık çevirisi yok
NİLGÜN YAPICIOĞLU FIĞLALI
Doktora
Türkçe
1998
Endüstri ve Endüstri Mühendisliğiİstanbul Teknik ÜniversitesiEndüstri Mühendisliği Ana Bilim Dalı
PROF. DR. AHMET F. ÖZOK
- Çok uluslu işletmelerde yönetim ve organizasyon modelleri
Organization and management models in multinational companies
ÇEŞMİAHU AKSOYTÜRK
- Kol seviyesindeki birliklere yönelik intikallerde EYP ile mücadele kapsamında sistem mühendisliği yaklaşımıyla ciddi oyun geliştirilmesi: ihtiyaç ve gereksinim analizi
Developing serious game with systems engineering approach within the scope of struggle against improvised explosive device during movement towards team-level units: needs and requirement analysis
ALİ EMRAH YILDIZ
Yüksek Lisans
Türkçe
2016
Bilim ve TeknolojiKara Harp Okulu KomutanlığıTeknoloji Yönetimi Ana Bilim Dalı
YRD. DOÇ. DR. ALTAN ÖZKİL
- Selection of heating, ventilating and air conditioning (HVAC) suppliers for green buildings with fuzzy-evaluation based on distance from average solution (EDAS) method
Bulanık-EDAS yöntemi ile yeşil binalarda ısıtma, havalandırma ve iklimlendirme (HVAC) sistemleri tedarikçileri seçimi
HASAN GÖKBERK BAYHAN
Yüksek Lisans
İngilizce
2018
İnşaat Mühendisliğiİstanbul Teknik Üniversitesiİnşaat Mühendisliği Ana Bilim Dalı
PROF. DR. GÜL POLAT TATAR