Πώς να κάνω ένα σαρωμένο PDF αναζητήσιμο: OCR οδηγός
PDF Toucan editorial team · Τελευταία ενημέρωση: 20 Σεπτεμβρίου 2026 · 9 λεπτά ανάγνωσης

Αν αναρωτιέστε πώς να κάνω ένα σαρωμένο PDF αναζητήσιμο, χρειάζεστε OCR: το εργαλείο αναγνώρισης προσθέτει ένα αόρατο επίπεδο κειμένου πίσω από τη σελίδα-εικόνα. Στο OCR PDF, επιλέξτε το αρχείο, ορίστε τη γλώσσα ή τις γλώσσες του εγγράφου, πατήστε «Αναγνώριση κειμένου» και κατεβάστε το νέο PDF. Έπειτα, επιβεβαιώστε το αποτέλεσμα με αναζήτηση λέξης και με αντιγραφή ενός σύντομου αποσπάσματος.
Τι κάνει το OCR σε ένα σαρωμένο PDF;
Ένα σαρωμένο PDF συνήθως περιέχει φωτογραφίες ή εικόνες των σελίδων του χαρτιού. Μπορεί να βλέπετε καθαρά μια επιστολή, μια απόδειξη ή ένα συμβόλαιο, αλλά το πρόγραμμα ανάγνωσης PDF δεν «βλέπει» λέξεις: βλέπει μόνο pixels. Γι’ αυτό η αναζήτηση με Ctrl+F ή ⌘+F δεν επιστρέφει αποτελέσματα και η επιλογή με το ποντίκι πιάνει ολόκληρη την εικόνα αντί για μια πρόταση.
Το OCR, δηλαδή η οπτική αναγνώριση χαρακτήρων, αναλύει τα σχήματα των γραμμάτων στη σαρωμένη εικόνα και δημιουργεί ένα επίπεδο επιλέξιμου κειμένου στην ίδια θέση. Η οπτική εμφάνιση της σελίδας παραμένει ουσιαστικά η ίδια, αλλά μπορείτε πλέον να:
- αναζητάτε ονόματα, ημερομηνίες και αριθμούς,
- αντιγράφετε αποσπάσματα κειμένου,
- χρησιμοποιείτε το PDF ως αφετηρία για μετατροπή σε Word.
Το OCR δεν αποτελεί εγγύηση τέλειας μεταγραφής. Καθαρές εκτυπώσεις και ευθείες σαρώσεις δίνουν συνήθως καλύτερα αποτελέσματα. Αντίθετα, θολές φωτογραφίες, σκιές, πολύ μικρά γράμματα, χειρόγραφα, σφραγίδες, πίνακες και σελίδες με πολλές στήλες χρειάζονται προσεκτικό έλεγχο.
Πώς κάνω ένα σαρωμένο PDF αναζητήσιμο με OCR;
Το PDF Toucan προσφέρει OCR για αρχεία PDF, χωρίς λογαριασμό, υδατογράφημα ή ημερήσιο όριο στα εργαλεία του προγράμματος περιήγησης. Η διαδικασία είναι η ίδια από υπολογιστή, tablet ή κινητό.
- Ανοίξτε το εργαλείο OCR PDF.
- Πατήστε «Επιλέξτε αρχεία PDF» και διαλέξτε το σαρωμένο PDF. Εναλλακτικά, σύρετε το αρχείο οπουδήποτε στη σελίδα ή επικολλήστε το.
- Στην ενότητα γλώσσας εγγράφου, επιλέξτε τουλάχιστον μία γλώσσα που υπάρχει πραγματικά στο αρχείο.
- Προαιρετικά, ανοίξτε τις πρόσθετες επιλογές για να καθορίσετε ποιες σελίδες θα αναγνωριστούν ή να εφαρμόσετε διορθώσεις στις σελίδες.
- Πατήστε «Αναγνώριση κειμένου».
- Περιμένετε να ολοκληρωθεί η αναγνώριση. Ένα έγγραφο με πολλές σελίδες μπορεί να χρειαστεί λίγα λεπτά.
- Όταν εμφανιστεί η επιβεβαίωση ολοκλήρωσης, πατήστε «Λήψη του αναζητήσιμου PDF».
Μπορείτε να προσθέσετε περισσότερα από ένα PDF στην ίδια εργασία. Κάθε αρχείο αναγνωρίζεται ξεχωριστά και λαμβάνετε ξεχωριστό αναζητήσιμο αποτέλεσμα.
Ποιες γλώσσες πρέπει να επιλέξω στο OCR;
Η επιλογή γλώσσας είναι σημαντική για την ακρίβεια. Δεν αλλάζει απλώς τη γλώσσα του μενού: βοηθά το OCR να αναγνωρίσει σωστά το αλφάβητο, τους τόνους και πιθανούς συνδυασμούς χαρακτήρων.
- Για ένα αποκλειστικά ελληνικό έγγραφο, επιλέξτε «Ελληνικά».
- Για έγγραφο με ελληνικά και αγγλικά, επιλέξτε και τις δύο γλώσσες.
- Για έγγραφο με ελληνικό κυρίως κείμενο αλλά αγγλικούς τεχνικούς όρους, η επιλογή «Ελληνικά» και «Αγγλικά» είναι συνήθως η σωστή.
- Μπορείτε να συνδυάσετε έως πέντε γλώσσες σε μία εκτέλεση.
Το εργαλείο υποστηρίζει 30 γλώσσες και γραφές, συμπεριλαμβανομένων ελληνικών, λατινικών, κυριλλικών, αραβικών, εβραϊκών, κινεζικών, ιαπωνικών και κορεατικών. Μην επιλέγετε επιπλέον γλώσσες «για κάθε ενδεχόμενο»: επιβραδύνουν την επεξεργασία και μπορεί να δυσκολέψουν την αναγνώριση παρόμοιων χαρακτήρων.
Πρέπει να ισιώσω ή να γυρίσω τις σαρωμένες σελίδες;
Ναι, όταν το αρχείο έχει σαρωθεί πρόχειρα ή από κινητό. Οι διορθώσεις σελίδας βοηθούν το OCR να εντοπίσει σωστά γραμμές, λέξεις και προσανατολισμό.
| Επιλογή | Τι κάνει | Πότε να τη χρησιμοποιήσετε | Σημαντική συνέπεια |
|---|---|---|---|
| «Scan pages without text» | Αναγνωρίζει μόνο σελίδες χωρίς υπάρχον κείμενο | Για τις περισσότερες σαρώσεις και μικτά PDF | Οι σελίδες με ήδη υπάρχον κείμενο μένουν ως έχουν |
| «Recognize existing text again» | Αφαιρεί λανθασμένο υπάρχον κείμενο και το διαβάζει ξανά | Όταν το PDF έχει κακό ή άχρηστο παλιό OCR | Δεν διατίθεται ευθυγράμμιση λοξών σελίδων |
| «Treat every page as an image» | Μετατρέπει κάθε σελίδα σε εικόνα και κάνει νέα αναγνώριση από την αρχή | Για πολύ προβληματικά ή ασυνεπή αρχεία | Χάνονται το παλιό επιλέξιμο κείμενο και οι σύνδεσμοι |
Για ένα τυπικό σκαναρισμένο έγγραφο, ξεκινήστε με «Scan pages without text», που είναι και η προτεινόμενη επιλογή. Οι σελίδες που περιέχουν ήδη πραγματικό κείμενο δεν θα αλλάξουν άσκοπα.
Ενεργοποιήστε το «Straighten tilted pages» όταν οι γραμμές του εγγράφου φαίνονται ελαφρώς λοξές. Η ευθυγράμμιση είναι χρήσιμη σε σελίδες που μπήκαν στραβά στον σαρωτή. Χρησιμοποιήστε επίσης την αυτόματη διόρθωση προσανατολισμού όταν ορισμένες σελίδες είναι ανάποδα ή στο πλάι. Η ευθυγράμμιση δεν είναι διαθέσιμη μαζί με το «Recognize existing text again».
Πώς ελέγχω αν το OCR διάβασε σωστά το κείμενο;
Μην περιοριστείτε στο ότι το PDF ανοίγει κανονικά. Ακολουθήστε έναν σύντομο έλεγχο ποιότητας πριν βασιστείτε στο κείμενο για αναζήτηση, αρχειοθέτηση ή επεξεργασία.
- Ανοίξτε το PDF που κατεβάσατε στο συνηθισμένο πρόγραμμα προβολής σας.
- Πατήστε Ctrl+F σε Windows ή ChromeOS, ή ⌘+F σε Mac. Σε κινητό, χρησιμοποιήστε το εικονίδιο αναζήτησης της εφαρμογής προβολής.
- Αναζητήστε 3 έως 5 χαρακτηριστικές λέξεις σε διαφορετικές σελίδες: ένα επώνυμο, ένα τοπωνύμιο, έναν αριθμό τιμολογίου, έναν ΑΦΜ ή μια ημερομηνία.
- Επιλέξτε μία σύντομη πρόταση, αντιγράψτε την και επικολλήστε την σε έναν απλό επεξεργαστή κειμένου.
- Συγκρίνετε το αντιγραμμένο κείμενο με τη σαρωμένη σελίδα, ιδίως σε ονόματα, ποσά, αριθμούς και διευθύνσεις.
Δώστε ιδιαίτερη προσοχή σε οπτικά παρόμοιους χαρακτήρες, όπως 0 και Ο, 1 και Ι, 5 και S, καθώς και σε τόνους και σημεία στίξης. Αν η αναζήτηση δεν βρίσκει εμφανείς λέξεις, ελέγξτε πρώτα ότι επιλέξατε τη σωστή γλώσσα. Αν το αρχείο είχε ήδη αλλά λανθασμένο επίπεδο κειμένου, δοκιμάστε «Recognize existing text again». Για πλήρη νέα επεξεργασία, χρησιμοποιήστε «Treat every page as an image», έχοντας υπόψη την απώλεια συνδέσμων και παλιού επιλέξιμου κειμένου.
Πώς ψάχνω ή μετατρέπω το αναγνωρισμένο PDF σε Word;
Για απλή εύρεση στοιχείων, κρατήστε το αναζητήσιμο PDF και χρησιμοποιήστε την αναζήτηση του προγράμματος προβολής. Αυτό είναι συχνά αρκετό για να εντοπίσετε μια αναφορά, έναν αριθμό παραγγελίας ή μια συγκεκριμένη παράγραφο χωρίς να αλλάξετε τη μορφή του εγγράφου.
Αν χρειάζεστε επεξεργάσιμο έγγραφο, η σειρά των ενεργειών είναι κρίσιμη:
- Κάντε πρώτα OCR στο αρχικό σαρωμένο PDF.
- Κατεβάστε το αναζητήσιμο PDF.
- Ανοίξτε το εργαλείο PDF σε Word.
- Πατήστε «Επιλέξτε αρχεία PDF» και προσθέστε το PDF που έχει ήδη περάσει από OCR.
- Πατήστε «Μετατροπή σε Word» και κατεβάστε το αρχείο DOCX.
- Ανοίξτε το DOCX στο Word και ελέγξτε το δίπλα στο αρχικό PDF πριν κάνετε ουσιαστικές αλλαγές.
Η μετατροπή ενός αρχικού σαρωμένου PDF κατευθείαν σε Word δεν αναγνωρίζει από μόνη της το κείμενο: οι σαρωμένες σελίδες προστίθενται ως εικόνες. Επομένως, το OCR είναι το απαραίτητο πρώτο βήμα. Ιδιαίτερη προσοχή χρειάζονται πίνακες, υποσημειώσεις, έντυπα με πεδία και έγγραφα πολλών στηλών.
Τι συμβαίνει με το αρχείο και την ψηφιακή υπογραφή;
Η αναγνώριση OCR στο PDF Toucan εκτελείται σε διακομιστές στην Ευρωπαϊκή Ένωση. Το PDF αποστέλλεται μέσω HTTPS, υποβάλλεται σε επεξεργασία στη μνήμη και δεν εγγράφεται σε δίσκο ούτε αποθηκεύεται. Διαγράφεται μόλις κατεβάσετε το αποτέλεσμα και, το αργότερο, μετά από 10 λεπτά.
Αν ένα έγγραφο είναι τόσο ευαίσθητο ώστε δεν πρέπει να φύγει ποτέ από τη συσκευή σας, επιλέξτε λογισμικό OCR εκτός σύνδεσης αντί για διαδικτυακή επεξεργασία.
Επίσης, το OCR αλλάζει το περιεχόμενο του PDF προσθέτοντας επίπεδο κειμένου. Επομένως, μια υπάρχουσα ψηφιακή υπογραφή δεν παραμένει έγκυρη. Κρατήστε το αρχικό υπογεγραμμένο PDF ανέπαφο και χρησιμοποιήστε το αναζητήσιμο αντίγραφο μόνο για αναζήτηση, αντιγραφή ή μετατροπή.
Συχνές ερωτήσεις
Μπορώ να κάνω αναζήτηση σε σαρωμένο PDF από κινητό;
Ναι. Εκτελέστε πρώτα OCR από τον browser του κινητού και κατεβάστε το αναζητήσιμο PDF. Στη συνέχεια, ανοίξτε το σε μια εφαρμογή προβολής PDF και χρησιμοποιήστε το εικονίδιο αναζήτησης. Για αξιόπιστο έλεγχο, δοκιμάστε ένα όνομα ή έναν αριθμό που βλέπετε καθαρά στη σελίδα.
Ποια γλώσσα επιλέγω για PDF με ελληνικά και αγγλικά;
Επιλέξτε και «Ελληνικά» και «Αγγλικά». Έτσι, το OCR μπορεί να ερμηνεύσει σωστά τόσο ελληνικούς χαρακτήρες και τόνους όσο και αγγλικούς όρους, ονόματα ή διευθύνσεις. Αποφύγετε να προσθέσετε άσχετες γλώσσες, επειδή καθυστερούν την αναγνώριση και ενδέχεται να μειώσουν την ακρίβεια.
Γιατί δεν βρίσκει λέξεις το PDF μετά το OCR;
Ελέγξτε αν αναζητάτε λέξη που πράγματι αναγνωρίστηκε σωστά και αν επιλέξατε την κατάλληλη γλώσσα. Η χαμηλή ποιότητα σάρωσης, οι λοξές ή ανάποδες σελίδες, τα χειρόγραφα και οι πίνακες μπορούν να προκαλέσουν λάθη. Δοκιμάστε ξανά με διόρθωση προσανατολισμού ή με νέα αναγνώριση υπάρχοντος κειμένου.
Το OCR μετατρέπει αυτόματα ένα σαρωμένο PDF σε επεξεργάσιμο Word;
Όχι απευθείας. Το OCR προσθέτει αναζητήσιμο και επιλέξιμο κείμενο στο PDF. Για αρχείο Word, κατεβάστε πρώτα το PDF μετά το OCR και μετατρέψτε αυτό το αρχείο με το εργαλείο PDF σε Word. Ελέγξτε πάντα το DOCX, ειδικά σε πίνακες, ποσά και κρίσιμα προσωπικά στοιχεία.
