Institutional Repository [SANDBOX]
Technical University of Crete
EN  |  EL

Search

Browse

My Space

Coordinated coverage in sensor networks via reinforcement learning

Kotzabasakis Georgios

Simple record


URIhttp://purl.tuc.gr/dl/dias/3B99A3C5-D256-4D61-89EA-3B0A0852F489-
Identifierhttps://doi.org/10.26233/heallink.tuc.78763-
Languageen-
Extent62 σελίδεςel
TitleΣυντονισμός κάλυψης σε δίκτυα αισθητήρων μέσω ενισχυτικής μάθησηςel
TitleCoordinated coverage in sensor networks via reinforcement learningen
CreatorKotzabasakis Georgiosen
CreatorΚοτζαμπασακης Γεωργιοςel
Contributor [Thesis Supervisor]Lagoudakis Michailen
Contributor [Thesis Supervisor]Λαγουδακης Μιχαηλel
Contributor [Committee Member]Chalkiadakis Georgiosen
Contributor [Committee Member]Χαλκιαδακης Γεωργιοςel
Contributor [Committee Member]Deligiannakis Antoniosen
Contributor [Committee Member]Δεληγιαννακης Αντωνιοςel
PublisherΠολυτεχνείο Κρήτηςel
PublisherTechnical University of Creteen
Academic UnitTechnical University of Crete::School of Electrical and Computer Engineeringen
Academic UnitΠολυτεχνείο Κρήτης::Σχολή Ηλεκτρολόγων Μηχανικών και Μηχανικών Υπολογιστώνel
Content SummaryMachine Learning is a fast developing and ever growing field in computer science. In addition to that, Sensor Networks are also a very promising field that has significant impact on a variety of applications. Given these facts, a multi-agent system (MAS) approach on wireless sensor networks (WSNs) comprising sensor-actuator nodes is very promising, as it has the potential to tackle the resource constraints inherent in these networks by efficiently coordinating the activities among the nodes. Furthermore, a very common issue in the field of sensor networks is the sensing coverage problem, which is the task of properly and sufficiently covering an area. In this thesis, we consider the coordinated sensing coverage problem and study the behavior and performance of the fully distributed Q-Learning algorithm for reinforcement learning using linear value function approximation. We use the Tossim platform to simulate our TinyOS application, which consists of different topologies of sensor networks with parametric sizes. Subsequently, we present the results of our simulation and display a number of graphs to visualize performance and learning outcomes on three specific topologies. We consider issues, such as successful convergence to optimal policies and maximization of local and global rewards. The implementation results are quite promising, since our algorithms exhibit high percentage of successful convergence to optimal policies.en
Content SummaryΗ μηχανική μάθηση είναι ένα ταχύτατα και διαρκώς αναπτυσσόμενο πεδίο στην επιστήμη των υπολογιστών. Εκτός από αυτό, τα δίκτυα αισθητήρων είναι επίσης ένα πολλά υποσχόμενο πεδίο που έχει σημαντική επίδραση σε μία ποικιλία από εφαρμογές. Βάσει των παραπάνω, μία προσέγγιση πολυπρακτορικού συστήματος (MAS) σε ασύρματα δίκτυα αισθητήρων (WSNs) που περιλαμβάνει αισθητήρες-ενεργοποιητές κόμβους είναι πολλά υποσχόμενη, καθώς μπορεί δυνητικά να αντιμετωπίσει τους περιορισμούς σε πόρους που είναι έμφυτοι σε αυτά τα δίκτυα με το να συντονίζει αποδοτικά τις δραστηριότητες μεταξύ των κόμβων. Επιπλέον, ένα κοινό θέμα στο πεδίο των δικτύων αισθητήρων είναι το πρόβλημα της συντονισμένης κάλυψης, στο οποίο καλείται κάποιος να καλύψει κατάλληλα και επαρκώς μία περιοχή με αισθητήρες. Σε αυτή τη διπλωματική εργασία, εξετάζουμε το πρόβλημα της συντονισμένης κάλυψης των αισθητήρων και μελετάμε τη συμπεριφορά και την απόδοση του τελείως κατανεμημένου Q-Learning αλγορίθμου ενισχυτικής μάθησης χρησιμοποιώντας γραμμική προσέγγιση της συνάρτησης χρησιμότητας. Χρησιμοποιούμε την πλατφόρμα Tossim για να προσομοιώσουμε την TinyOS εφαρμογή μας, η οποία αποτελείται από διαφορετικές τοπολογίες δικτύου αισθητήρων με παραμετροποιημένο μέγεθος. Στη συνέχεια, παρουσιάζουμε τα αποτελέσματα της υλοποίησης μας και δείχνουμε έναν αριθμό από γραφήματα για να οπτικοποιήσουμε τις εκβάσεις της απόδοσης και της μάθησης σε τρεις συγκεκριμένες τοπολογίες. Λαμβάνουμε υπ’ όψιν θέματα, όπως επιτυχή σύγκλιση σε βέλτιστες πολιτικές και μεγιστοποίηση των τοπικών και καθολικών ανταμοιβών. Τα αποτελέσματα της υλοποίησης είναι αρκετά ενθαρρυντικά από την άποψη των υψηλών ποσοστών επιτυχών συγκλίσεων του αλγορίθμου μας σε βέλτιστες πολιτικές.el
Type of ItemΔιπλωματική Εργασίαel
Type of ItemDiploma Worken
Licensehttp://creativecommons.org/licenses/by-sa/4.0/en
Date of Item2018-09-14-
Date of Publication2018-
SubjectSensor networksen
SubjectReinforcement learningen
Bibliographic CitationGeorgios Kotzabasakis, "Coordinated coverage in sensor networks via reinforcement learning", Diploma Work, School of Electrical and Computer Engineering, Technical University of Crete, Chania, Greece, 2018en
Bibliographic CitationΓεώργιος Κοτζαμπασάκης, "Συντονισμός κάλυψης σε δίκτυα αισθητήρων μέσω ενισχυτικής μάθησης", Διπλωματική Εργασία, Σχολή Ηλεκτρολόγων Μηχανικών και Μηχανικών Υπολογιστών, Πολυτεχνείο Κρήτης, Χανιά, Ελλάς, 2018el

Available Files

Services

Statistics