Geri Dön

Multi agent reinforcement learning using function approximation

Fonksiyon yaklaşımı kullanarak çoklu etmen takviye öğrenme

  1. Tez No: 82462
  2. Yazar: OSMAN ABUL
  3. Danışmanlar: DOÇ. DR. FARUK POLAT
  4. Tez Türü: Yüksek Lisans
  5. Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Computer Engineering and Computer Science and Control
  6. Anahtar Kelimeler: Takviye Öğrenme, AFCW, Çoklu-Etmen Öğrenme, Koordinasyon, Fonksiyon Yaklaşımı iv, Öğrenme yöntemleri, Reinforcement Learning, AFCW, Multi-Agent Learning, Cooperation, Function Approximation 111, Learning methods
  7. Yıl: 1999
  8. Dil: İngilizce
  9. Üniversite: Orta Doğu Teknik Üniversitesi
  10. Enstitü: Fen Bilimleri Enstitüsü
  11. Ana Bilim Dalı: Bilgisayar Mühendisliği Ana Bilim Dalı
  12. Bilim Dalı: Belirtilmemiş.
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

oz FONKSİYON YAKLAŞIMI KULLANARAK ÇOKLU-ETMEN TAKVİYE ÖĞRENME Abul, Osman Yüksek Lisans, Bilgisayar Mühendisliği Bölümü Tez Yöneticisi: Doç. Dr. Faruk Polat Ağustos 1999, 67 sayfa Düşmanca unsurların bulunduğu bir ortamda öğrenme ve çevreye uyum önem kazanmaktadır. Eğer etmenler yaşadıkları çevrenin dinamikleri hakkında çok az bilgiye sahipseler takviye öğrenme tekniklerini kullanabilirler. Bu tezde düşmanca bir ortam olan AFCW'de takviye öğrenme teknikleri üzerinde çalışılmıştır. AFCW'de yaşayan etmenler yaşamak için öğrenmek zorundadır. Bunun yanında çoklu-etmen AFCW'de etmenler yaşamayı daha kolay hale getirmek için koordinasyona ihtiyaç duyarlar. Etmenler arasında açık iletişim gerektirmeyen iki tane koordinasyon yöntemi sunulmuştur. AFCW, çok büyük durum uzayına sahiptir, dolayısıyla öğrenilen bilginin saklandığı geleneksel bakma tabloları yetersiz kalmaktadır. Büyük ölçüler için fonksiyon yaklaşımı ve genelleme metodları kullanılmıştır. Çok sayıda fonksiyon yaklaşımı mimarisi ve takviye öğrenme algoritması ile deney yapılmıştır. Hem tek-etmen hem de çoklu-etmen AFCW için deney sonuçları sunulmuştur.

Özet (Çeviri)

ABSTRACT MULTI-AGENT REINFORCEMENT LEARNING USING FUNCTION APPROXIMATION Abul, Osman M.S., Department of Computer Engineering Supervisor: Assoc. Prof. Dr. Faruk Polat August 1999, 67 pages Learning and adaptation become more important for agents living in hostile environments. Agents can use reinforcement learning techniques if they have little information about dynamics of their environment. In this thesis, we have studied reinforcement learning techniques in a dynamic hostile environment (AFCW). The agents in AFCW need to learn to survive. Besides, the agents in multi-agent AFCW need to cooperate for making the task easier. Two cooperation methods that don't require explicit communication among agents are presented. The AFCW domain has huge state space, so traditional lookup tables are insufficient to store acquired knowledge. Function approximation and generalization methods are used for scaling up. We have experimented with various function approximation architectures and reinforcement learning algorithms. The experimental results for both single-agent and multi-agent AFCW environments are presented.

Benzer Tezler

  1. Multi-agent reinforcement learning

    Çoklu etmen takviye öğrenme

    SELÇUK ŞENKUL

    Yüksek Lisans

    İngilizce

    İngilizce

    1999

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolOrta Doğu Teknik Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    DOÇ. DR. FARUK POLAT

  2. S-learning: A multi-agent reinforcement learning method

    S-öğrenme: Bir çoklu-etmen takviye-öğrenme metodu

    UĞUR KUTER

    Yüksek Lisans

    İngilizce

    İngilizce

    2000

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolOrta Doğu Teknik Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    DOÇ. DR. FARUK POLAT

  3. Saf ve cam elyaf takviyeli naylon 6 numunelerinin kalıplanması ve bazı özelliklerinin incelenmesi

    Molding and determination of some properties of nylon 6 with and without glass fiber reinforcement

    NİHAT AYDIN

    Yüksek Lisans

    Türkçe

    Türkçe

    1992

    Kimya Mühendisliğiİstanbul Teknik Üniversitesi

    DOÇ. DR. A. TUNCER ERCİYES

  4. Coordination of agents in multi-agent search

    Çok etmenli aramada etmenlerin koordinasyonu

    ARMAĞAN ÇAKIR

    Yüksek Lisans

    İngilizce

    İngilizce

    2000

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolOrta Doğu Teknik Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    DOÇ. DR. FARUK POLAT

  5. A Negatiation platform for cooperating multi-agents systems

    Yardımlaşan akıllı sistemler için bir model

    FARUK POLAT