Μηχανική μάθηση στην αναγνώριση ορθογραφικών λαθών λέξεων εντός λεξιλογίου στην ελληνική γλώσσα
Date Issued
May 25, 2018
Type
bachelor thesis
Abstract
Στην παρούσα πτυχιακή εργασία μελετάται το πρόβλημα της αναγνώρισης ορθογραφικών λαθών σε κείμενα της ελληνικής γλώσσας με τη χρήση μεθόδων μηχανικής μάθησης. Ο αυτόματος ορθογραφικός έλεγχος των κειμένων είναι μία διαδικασία για την οποία έχουν αναπτυχθεί διάφορα παραδοσιακά εργαλεία, τα οποία, ωστόσο, τις περισσότερες φορές αποτυγχάνουν να εντοπίσουν λάθη που μπορεί να οφείλονται σε χρήση λανθασμένης γραμματικής ή στην επιλογή μη κατάλληλων λέξεων με βάση τα συμφραζόμενα.
Η μηχανική μάθηση έρχεται να προσφέρει πιο προηγμένες μεθόδους για την αυτόματη αναγνώριση ορθογραφικών λαθών, οι οποίες μαθαίνουν από τα δεδομένα και κάνουν προβλέψεις σχετικά με αυτά. Το πρόβλημα της αναγνώρισης ορθογραφικών λαθών υπάγεται στον κλάδο της Επεξεργασίας Φυσικής Γλώσσας (Natural Language Processing), όπου μέσω μίας πληθώρας τεχνικών μηχανικής μάθησης πραγματοποιείται η αυτοματοποιημένη ανάλυση του προφορικού και γραπτού λόγου.
Στην παρούσα, λοιπόν, πτυχιακή εργασία, αφού οριστούν οι βασικές έννοιες που διέπουν το πρόβλημα, θα γίνει η ανάλυση διαφόρων τεχνικών μηχανικής μάθησης και η εφαρμογή αυτών σε δεδομένα που έχουν προέλθει από κείμενα ηλεκτρονικών εφημερίδων. Πιο συγκεκριμένα, θα μελετηθούν ομόηχα ρήματα τα οποία έχουν κατάληξη –ται και –τε. Τα πειράματα θα διεξαχθούν στην πλατφόρμα WEKA και η αξιολόγηση των διαφορετικών μοντέλων θα βασιστεί σε μετρικές που χρησιμοποιούνται ευρέως στα προβλήματα μηχανικής μάθησης.
Subjects
File(s)![Thumbnail Image]()
![Thumbnail Image]()
Loading...
Name
Πτυχιακή Εργασία_Καπετανοπούλου_Νίκη.pdf
Size
1.35 MB
Format
Adobe PDF
Checksum
(MD5):860bd26a378a9956fceb4cd3f46f9d54
Loading...
Name
Διαφάνειες_Πτυχιακής_Καπετανοπούλου_Νίκη.pdf
Size
2.24 MB
Format
Adobe PDF
Checksum
(MD5):91d82b7a010dcf9be90ee6463fe07c9b
