Multi agent reinforcement learning using function approximation
Fonksiyon yaklaşımı kullanarak çoklu etmen takviye öğrenme
- Tez No: 82462
- Danışmanlar: DOÇ. DR. FARUK POLAT
- Tez Türü: Yüksek Lisans
- Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Computer Engineering and Computer Science and Control
- Anahtar Kelimeler: Takviye Öğrenme, AFCW, Çoklu-Etmen Öğrenme, Koordinasyon, Fonksiyon Yaklaşımı iv, Öğrenme yöntemleri, Reinforcement Learning, AFCW, Multi-Agent Learning, Cooperation, Function Approximation 111, Learning methods
- Yıl: 1999
- Dil: İngilizce
- Üniversite: Orta Doğu Teknik Üniversitesi
- Enstitü: Fen Bilimleri Enstitüsü
- Ana Bilim Dalı: Bilgisayar Mühendisliği Ana Bilim Dalı
- Bilim Dalı: Belirtilmemiş.
- Sayfa Sayısı: Belirtilmemiş.
Özet
oz FONKSİYON YAKLAŞIMI KULLANARAK ÇOKLU-ETMEN TAKVİYE ÖĞRENME Abul, Osman Yüksek Lisans, Bilgisayar Mühendisliği Bölümü Tez Yöneticisi: Doç. Dr. Faruk Polat Ağustos 1999, 67 sayfa Düşmanca unsurların bulunduğu bir ortamda öğrenme ve çevreye uyum önem kazanmaktadır. Eğer etmenler yaşadıkları çevrenin dinamikleri hakkında çok az bilgiye sahipseler takviye öğrenme tekniklerini kullanabilirler. Bu tezde düşmanca bir ortam olan AFCW'de takviye öğrenme teknikleri üzerinde çalışılmıştır. AFCW'de yaşayan etmenler yaşamak için öğrenmek zorundadır. Bunun yanında çoklu-etmen AFCW'de etmenler yaşamayı daha kolay hale getirmek için koordinasyona ihtiyaç duyarlar. Etmenler arasında açık iletişim gerektirmeyen iki tane koordinasyon yöntemi sunulmuştur. AFCW, çok büyük durum uzayına sahiptir, dolayısıyla öğrenilen bilginin saklandığı geleneksel bakma tabloları yetersiz kalmaktadır. Büyük ölçüler için fonksiyon yaklaşımı ve genelleme metodları kullanılmıştır. Çok sayıda fonksiyon yaklaşımı mimarisi ve takviye öğrenme algoritması ile deney yapılmıştır. Hem tek-etmen hem de çoklu-etmen AFCW için deney sonuçları sunulmuştur.
Özet (Çeviri)
ABSTRACT MULTI-AGENT REINFORCEMENT LEARNING USING FUNCTION APPROXIMATION Abul, Osman M.S., Department of Computer Engineering Supervisor: Assoc. Prof. Dr. Faruk Polat August 1999, 67 pages Learning and adaptation become more important for agents living in hostile environments. Agents can use reinforcement learning techniques if they have little information about dynamics of their environment. In this thesis, we have studied reinforcement learning techniques in a dynamic hostile environment (AFCW). The agents in AFCW need to learn to survive. Besides, the agents in multi-agent AFCW need to cooperate for making the task easier. Two cooperation methods that don't require explicit communication among agents are presented. The AFCW domain has huge state space, so traditional lookup tables are insufficient to store acquired knowledge. Function approximation and generalization methods are used for scaling up. We have experimented with various function approximation architectures and reinforcement learning algorithms. The experimental results for both single-agent and multi-agent AFCW environments are presented.
Benzer Tezler
- Multi-agent reinforcement learning
Çoklu etmen takviye öğrenme
SELÇUK ŞENKUL
Yüksek Lisans
İngilizce
1999
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolOrta Doğu Teknik ÜniversitesiBilgisayar Mühendisliği Ana Bilim Dalı
DOÇ. DR. FARUK POLAT
- S-learning: A multi-agent reinforcement learning method
S-öğrenme: Bir çoklu-etmen takviye-öğrenme metodu
UĞUR KUTER
Yüksek Lisans
İngilizce
2000
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolOrta Doğu Teknik ÜniversitesiBilgisayar Mühendisliği Ana Bilim Dalı
DOÇ. DR. FARUK POLAT
- Saf ve cam elyaf takviyeli naylon 6 numunelerinin kalıplanması ve bazı özelliklerinin incelenmesi
Molding and determination of some properties of nylon 6 with and without glass fiber reinforcement
NİHAT AYDIN
- Coordination of agents in multi-agent search
Çok etmenli aramada etmenlerin koordinasyonu
ARMAĞAN ÇAKIR
Yüksek Lisans
İngilizce
2000
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolOrta Doğu Teknik ÜniversitesiBilgisayar Mühendisliği Ana Bilim Dalı
DOÇ. DR. FARUK POLAT
- A Negatiation platform for cooperating multi-agents systems
Yardımlaşan akıllı sistemler için bir model
FARUK POLAT
Doktora
İngilizce
1993
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİhsan Doğramacı Bilkent ÜniversitesiPROF. DR. H. ALTAY GÜVENİR