Μια εφαρμογή η οποία χρησιμοποιεί την τεχνητή νοημοσύνη για να αναγνωρίσει κείμενο γραμμένο (και) σε πολυτονικό, που υπάρχει αποτυπωμένο σε εικόνες, ανέπτυξε η ομάδα Ψηφιακής Επεξεργασίας Εγγράφων του Εργαστηρίου Υπολογιστικής Ευφυίας του Εθνικού Κέντρου Έρευνας Φυσικών Επιστημών «Δημόκριτος».
Η εφαρμογή παρουσιάζεται στο «Athens Science Festival», που φιλοξενείται μέχρι σήμερα, Κυριακή 21 Απριλίου, στην Τεχνόπολη του Δήμου Αθηναίων.
Η πλατφόρμα αναπτύχθηκε στο πλαίσιο του έργου «reBook», που υλοποιείται σε συνεργασία με το Σύλλογο προς διάδοσιν ωφελίμων βιβλίων (ΣΩΒ) και την εταιρεία Innews, στο πλαίσιο του ΕΣΠΑ 2014-2020. Στόχος είναι η ανάπτυξη νέων τεχνικών και μεθοδολογιών αναγνώρισης κειμένων, κυρίως γραμμένων σε πολυτονικό σύστημα, για την επιστημονική τεκμηρίωση της πολιτιστικής κληρονομιάς.
Με τη βοήθεια της εφαρμογής ερευνητές του Δημόκριτου ψηφιοποιούν και επανεκδίδουν ψηφιακά, περίπου 100 βιβλία από τα αρχεία του ΣΩΒ, τα οποία χρονολογούνται από τις αρχές του 20ού αιώνα και μετά. Ανάμεσα σε αυτά βρίσκονται το σύγγραμμα του Αδαμάντιου Κοραή Επιστολαί προς τον Πρωτοψάλτην, που εκδόθηκε το 1911 και επανεκδόθηκε το 1959. Επίσης, το βιβλίο Η ελληνικότης των νομών Προύσης και Σμύρνης του Παντελή Κοντογιάννη, που πρωτοεκδόθηκε το 1919.
Στην εφαρμογή ανεβαίνουν εικόνες σκαναρισμένων βιβλίων και στη συνέχεια με τη βοήθεια της τεχνητής νοημοσύνης αναγνωρίζεται το κείμενο της κάθε εικόνας, ακόμα και αν είναι γραμμένο σε πολυτονικό σύστημα. Επίσης, στο στάδιο της προεπεξεργασίας της κάθε εικόνας, η εφαρμογή διορθώνει τα προβλήματα που μπορεί να έχει η εικόνα του βιβλίου, από το στραβό σκανάρισμα μέχρι τη διόρθωση ξεθωριασμένων σελίδων.
«Υπάρχει ένας τεράστιος όγκος βιβλίων που δεν είναι διαθέσιμα ψηφιακά και θέλουμε να τα κάνουμε διαθέσιμα, να βγάλουμε στην επιφάνεια τεκμήρια, τα οποία είναι στα ντουλάπια και τα ράφια βιβλιοθηκών. Οπότε ο στόχος μας είναι ιστορικά βιβλία να φτάσουν στο ευρύ κοινό και τους ερευνητές», εξηγεί στο ΑΠΕ-ΜΠΕ η Κατερίνα Χριστοπούλου, υποψήφια διδάκτορας Οικολογίας Τοπίου και επιστημονική συνεργάτιδα του «Δημόκριτου».
Εξηγώντας την αξία της εφαρμογής η Κ. Χριστοπούλου επισημαίνει ότι «δεν βλέπουμε απλώς ένα PDF με την εικόνα της σελίδας, αλλά η εικόνα έχει από πίσω την οπτική αναγνώριση χαρακτήρων (OCR), οπότε ο αναγνώστης μπορεί να χρησιμοποιήσει τμήματα του αρχείου ή να κάνει αναζήτηση μέσα σε αυτό». Η μεγάλη διαφορά όμως της εφαρμογής έγκειται «στην ανάγνωση του πολυτονικού συστήματος».