Geri Dön

Toward foundations of multi-team learning: Convergence, coordination, and equilibrium

Çok takımlı öğrenmenin temellerine doğru: Yakınsama, iş birliği ve denge

  1. Tez No: 985643
  2. Yazar: AHMED SAİD DÖNMEZ
  3. Danışmanlar: DR. ÖĞR. ÜYESİ MUHAMMED ÖMER SAYIN, PROF. SİNAN GEZİCİ, PROF. FARUK POLAT
  4. Tez Türü: Yüksek Lisans
  5. Konular: Elektrik ve Elektronik Mühendisliği, Electrical and Electronics Engineering
  6. Anahtar Kelimeler: Belirtilmemiş.
  7. Yıl: 2025
  8. Dil: İngilizce
  9. Üniversite: İhsan Doğramacı Bilkent Üniversitesi
  10. Enstitü: Mühendislik ve Fen Bilimleri Enstitüsü
  11. Ana Bilim Dalı: Elektrik ve Elektronik Mühendisliği Ana Bilim Dalı
  12. Bilim Dalı: Belirtilmemiş.
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

Modern sosyo-teknik sistemlerdeki sonuçlar, giderek artan bir şekilde izole bireyler tarafından değil, dışarıya karşı rekabet ederken kendi içlerinde koordine olan akıllı etmen takımları tarafından şekillenmektedir. Bu tez, akıllı etmenlerin (insan veya yapay) karmaşık ve dinamik ortamlarda nasıl takımlar halinde öğrendiği ve hareket ettiğine dair ortaya çıkan büyük zorluğa odaklanmaktadır. İki stratejik ortamı ele alıyoruz: tekrarlanan normal-form oyunlarda takımlar arası rekabet ve dinamik, stokastik ortamlarda takım içi işbirliği. Eşzamanlı öğrenmenin neden olduğu durağansızlığın üstesinden gelmek için dönem tabanlı stokastik yaklaşılama ve diferansiyel içermelere dayalı birleşik bir çerçeve oluşturuyoruz. Takımlar arası rekabet için, potansiyel ve sıfır toplamlı polimatris oyunlarını genelleştiren Sıfır Toplamlı Potansiyel Takım Oyunlarını (ZSPTG'ler) tanıtıyoruz. Takım arkadaşı geçmişine ve rakip inançlarına karşı yumuşatılmış en iyi yanıtları kullanan merkeziyetsiz bir dinamik olan Takım-Hayali-Oyun'u (Team-FP) öneriyoruz. Team-FP altındaki ampirik ortalamaların, keşif parametreleri aracılığıyla hatayı nicelendirerek, bir Takım-Nash Dengesi'ne (TNE) yakın bir noktaya neredeyse kesin yakınsadığını kanıtlıyoruz. Standart dinamiklerin sıklıkla başarısız olduğu takım içi işbirliğini ele alarak, Logit-Q dinamiklerini geliştiriyoruz. Log-lineer öğrenmeyi Q-learning ile birleştiren bu yöntem, model bilgisi olmadan değer fonksiyonlarının ve politikaların eşzamanlı öğrenilmesine olanak tanır. Durağan olmayan süreci izlenebilir bir yarı-durağan referansla eşleştirerek doğruladığımız, verimli durağan dengeye neredeyse kesin yakınsamayı kanıtlıyoruz. Son olarak, sayısal deneyler teorik bulgularımızı doğrulamakta ve etkili koordinasyonu göstermektedir.

Özet (Çeviri)

Outcomes in modern socio-technical systems are increasingly shaped not by isolated individuals, but by teams of intelligent agents that coordinate internally while competing externally. This thesis focuses on the emerging grand challenge of how intelligent agents (human or artificial) learn and act as teams in complex and dynamic environments. We address two strategic environments: inter-team competition in repeated normal-form games and intra-team cooperation in dynamic, stochastic environments. We establish a unified framework based on epoch-based stochastic approximation and differential inclusions to overcome non-stationarity induced by simultaneous learning. For inter-team competition, we introduce Zero-Sum Potential Team Games (ZSPTGs), generalizing potential and zero-sum polymatrix games. We propose Team-Fictitious-Play (Team-FP), a decentralized dynamic using smoothed best responses to teammate history and opponent beliefs. We prove empirical averages under Team-FP converge almost surely to a near Team-Nash Equilibrium (TNE), quantifying error via exploration parameters. Addressing intra-team cooperation where standard dynamics often fail, we develop Logit-Q dynamics. Combining log-linear learning with Q-learning, this method allows simultaneous learning of value functions and policies without model knowledge. We prove almost sure convergence to the efficient stationary equilibrium, validated by coupling the non-stationary process with a tractable quasi-stationary reference. Finally, numerical experiments validate our theoretical findings and demonstrate effective coordination.

Benzer Tezler

  1. Zihinsel ağırlıklı işler için bilişsel görev analizi yöntemi

    Başlık çevirisi yok

    NİLGÜN YAPICIOĞLU FIĞLALI

    Doktora

    Türkçe

    Türkçe

    1998

    Endüstri ve Endüstri Mühendisliğiİstanbul Teknik Üniversitesi

    Endüstri Mühendisliği Ana Bilim Dalı

    PROF. DR. AHMET F. ÖZOK

  2. Muhabir bankacılık

    Correspondent banking

    CANAN DAĞISTAN

    Yüksek Lisans

    Türkçe

    Türkçe

    1992

    BankacılıkMarmara Üniversitesi

    PROF.DR. İLHAN ULUDAĞ

  3. Çok uluslu işletmelerde yönetim ve organizasyon modelleri

    Organization and management models in multinational companies

    ÇEŞMİAHU AKSOYTÜRK

    Yüksek Lisans

    Türkçe

    Türkçe

    1991

    İşletmeİstanbul Teknik Üniversitesi

    DOÇ.DR. SELİME SEZGİN

  4. Kol seviyesindeki birliklere yönelik intikallerde EYP ile mücadele kapsamında sistem mühendisliği yaklaşımıyla ciddi oyun geliştirilmesi: ihtiyaç ve gereksinim analizi

    Developing serious game with systems engineering approach within the scope of struggle against improvised explosive device during movement towards team-level units: needs and requirement analysis

    ALİ EMRAH YILDIZ

    Yüksek Lisans

    Türkçe

    Türkçe

    2016

    Bilim ve TeknolojiKara Harp Okulu Komutanlığı

    Teknoloji Yönetimi Ana Bilim Dalı

    YRD. DOÇ. DR. ALTAN ÖZKİL

  5. Selection of heating, ventilating and air conditioning (HVAC) suppliers for green buildings with fuzzy-evaluation based on distance from average solution (EDAS) method

    Bulanık-EDAS yöntemi ile yeşil binalarda ısıtma, havalandırma ve iklimlendirme (HVAC) sistemleri tedarikçileri seçimi

    HASAN GÖKBERK BAYHAN

    Yüksek Lisans

    İngilizce

    İngilizce

    2018

    İnşaat Mühendisliğiİstanbul Teknik Üniversitesi

    İnşaat Mühendisliği Ana Bilim Dalı

    PROF. DR. GÜL POLAT TATAR