OCR PDF online za darmo: Jak wyszukać tekst w skanie
PDF Toucan editorial team · Ostatnia aktualizacja: 20 września 2026 · 9 min czytania

Aby wykonać OCR PDF online za darmo, prześlij zeskanowany plik, wskaż język dokumentu i uruchom rozpoznawanie. Otrzymasz PDF z warstwą tekstową, w którym można wyszukiwać frazy, zaznaczać fragmenty i kopiować treść. Przy krzywych albo odwróconych skanach warto przed startem włączyć korektę stron.
Jak działa OCR PDF i co zmienia w zeskanowanym dokumencie?
Skanowany PDF zwykle nie zawiera prawdziwego tekstu. Jest zbiorem obrazów stron: dokument wygląda jak tekst, ale czytnik PDF „widzi” tylko piksele. Dlatego skrót wyszukiwania nie znajduje słów, a zaznaczenie kursorem może obejmować całą stronę zamiast pojedynczego zdania.
OCR, czyli optyczne rozpoznawanie znaków, analizuje kształty liter widoczne na obrazie. Następnie dodaje do PDF niewidoczną warstwę rozpoznanego tekstu, dopasowaną do położenia słów na stronie. Sam wygląd skanu i jego układ pozostają zasadniczo takie same, ale dokument staje się przeszukiwalny.
Po poprawnym OCR możesz:
- wyszukać wyraz przez
Ctrl+Fw Windows i Linux alboCommand+Fna Macu; - zaznaczyć oraz skopiować tekst z dokumentu;
- sprawdzić numer faktury, nazwisko, datę lub kwotę bez ręcznego przeglądania wszystkich stron;
- użyć tekstu jako podstawy do dalszej konwersji do formatu edytowalnego.
Dokładność zależy od jakości źródła. Wyraźny skan drukowanego dokumentu daje zwykle lepszy wynik niż wyblakła kopia, fotografia wykonana pod kątem, ozdobny krój pisma, pieczątka lub odręczne dopiski. Jeśli w PDF da się już zaznaczać pojedyncze słowa, sprawdź najpierw wyszukiwanie — plik może mieć warstwę tekstową, ale niekoniecznie poprawną.
Jak zrobić OCR PDF online za darmo w PDF Toucan?
W narzędziu OCR PDF w PDF Toucan można rozpoznać tekst w jednym lub wielu plikach PDF. Każdy dodany plik jest przetwarzany osobno.
- Otwórz narzędzie OCR PDF.
- Kliknij „Wybierz pliki PDF” i wskaż dokument. Możesz również przeciągnąć plik PDF w dowolne miejsce strony albo wkleić go ze schowka.
- W sekcji języka dokumentu wybierz co najmniej jeden język użyty w skanie.
- W razie potrzeby otwórz dodatkowe opcje i ustaw zakres stron lub korektę ułożenia stron.
- Kliknij „Rozpoznaj tekst”.
- Poczekaj na komunikat o zakończeniu rozpoznawania, a następnie pobierz przeszukiwalny PDF.
Długie dokumenty mogą być rozpoznawane przez kilka minut, zwłaszcza jeśli zawierają wiele stron lub wybrano kilka języków. Narzędzie nie wymaga konta, nie dodaje znaku wodnego i nie ma dziennego limitu dla narzędzi przeglądarkowych; serwis jest finansowany reklamami.
Warto znać sposób przetwarzania tego konkretnego narzędzia. Plik jest przesyłany przez HTTPS na serwery w Unii Europejskiej, przetwarzany w pamięci i nie jest zapisywany na dysku ani przechowywany. Po pobraniu wyniku jest usuwany, najpóźniej po 10 minutach. Jeżeli dokument nie może opuścić urządzenia, wybierz rozwiązanie OCR działające lokalnie.
Jaki język wybrać do OCR dokumentu po polsku i wielojęzycznego?
Dobór języka nie jest tylko ustawieniem kosmetycznym. Silnik OCR korzysta z alfabetu i wzorców językowych, aby rozróżniać podobne znaki. Dla tekstu po polsku pomaga to poprawnie odczytać między innymi: ą, ć, ę, ł, ń, ó, ś, ź i ż.
- Dla dokumentu wyłącznie po polsku wybierz język polski.
- Gdy dokument rzeczywiście jest dwujęzyczny, na przykład polsko-angielski, wybierz polski i angielski.
- Dodaj język trzeci, czwarty lub piąty wyłącznie wtedy, gdy pojawia się w treści dokumentu.
- Nie zaznaczaj dodatkowych języków „na wszelki wypadek”. Spowalniają one rozpoznawanie i mogą utrudniać dopasowanie znaków.
W jednym procesie można połączyć maksymalnie pięć języków. OCR obsługuje 30 języków oraz pisma: łacińskie, cyrylicę, grekę, arabskie, hebrajskie, dewanagari, tajskie, chińskie, japońskie i koreańskie.
Kiedy wyprostować lub obrócić strony przed rozpoznaniem tekstu?
Korekta stron ma znaczenie przede wszystkim dla skanów wykonanych z podajnika lub aparatem w telefonie. Tekst ustawiony pod kątem albo bokiem jest trudniejszy do poprawnego odczytania.
| Ustawienie | Działanie | Kiedy użyć | Ważne ograniczenie |
|---|---|---|---|
| Skanowanie stron bez tekstu | Rozpoznaje tylko strony bez warstwy tekstowej i pozostawia pozostałe bez zmian | W większości skanów i dokumentów mieszanych | Istniejący, błędny tekst pozostaje bez zmian |
| Ponowne rozpoznanie istniejącego tekstu | Usuwa starą warstwę tekstową i odczytuje ją ponownie | Gdy w PDF jest błędny OCR | Nie można wtedy użyć prostowania stron |
| Traktowanie każdej strony jako obrazu | Zamienia każdą stronę na obraz i wykonuje OCR od początku | Gdy warstwa tekstowa jest nieużyteczna lub niespójna | Usuwa dotychczasowy zaznaczalny tekst i linki |
Domyślnie warto pozostać przy opcji skanowania stron bez tekstu. Jest zalecana, ponieważ nie zmienia stron, które już mają prawidłowy tekst cyfrowy.
Włącz „Straighten tilted pages”, gdy strony są lekko przekrzywione. Prostowanie ułatwia silnikowi OCR odczytywanie wierszy i poprawia wygodę czytania wyniku. Włącz automatyczną korektę orientacji, gdy część stron jest zeskanowana do góry nogami albo poziomo — zdarza się to w aktach z tabelami i mieszanymi formatami oryginałów.
Jeśli istniejąca warstwa tekstowa jest wyraźnie błędna, wybierz ponowne rozpoznanie. Pamiętaj jednak, że prostowanie stron nie jest dostępne w tym trybie. Jeżeli dokument wymaga pełnego odczytania od nowa, użyj opcji traktowania wszystkich stron jak obrazów, świadomie godząc się na utratę wcześniejszych linków i tekstu zaznaczalnego.
Jak sprawdzić, czy OCR PDF zadziałał poprawnie?
Nie zakładaj, że rozpoznanie jest bezbłędne, nawet gdy pobrany PDF pozwala już wyszukiwać. Krótka kontrola jest szczególnie ważna w przypadku umów, faktur, formularzy i dokumentów zawierających dane liczbowe.
- Otwórz pobrany PDF w przeglądarce albo czytniku PDF.
- Użyj
Ctrl+FlubCommand+Fi wyszukaj charakterystyczne słowo widoczne na stronie, na przykład nazwisko, miejscowość lub numer faktury. - Sprawdź wynik na początku, w środku i pod koniec dokumentu.
- Zaznacz kilka zdań oraz wklej je do prostego edytora tekstu.
- Porównaj wklejony tekst z obrazem oryginału, zwłaszcza liczby, daty, kwoty, polskie znaki i nazwy własne.
Szczególną uwagę zwróć na znaki podobne wizualnie, takie jak 0 i O, 1 i l oraz 5 i S. Kontroluj też strony z cienkim drukiem, pieczątkami, tabelami, słabym kontrastem, odręcznymi adnotacjami i wieloma kolumnami.
Jeżeli wynik jest słaby, sprawdź język OCR, uruchom korektę nachylenia lub orientacji i wykonaj rozpoznawanie ponownie. Ważne informacje zawsze porównuj z obrazem skanu. OCR jest pomocą w odczycie, a nie gwarancją wiernej transkrypcji.
OCR modyfikuje PDF, dlatego podpis cyfrowy w dokumencie przestaje być ważny. Zachowaj podpisany oryginał bez zmian, a kopię po OCR traktuj jako wersję roboczą do wyszukiwania, kopiowania lub konwersji.
Jak po OCR wyszukiwać tekst lub przekonwertować PDF do Worda?
Jeśli chcesz jedynie znaleźć albo skopiować fragment, zachowaj przeszukiwalny PDF. W czytniku dokumentów używaj Ctrl+F lub Command+F, wpisuj dokładne słowa, numery lub daty i przechodź między wynikami wyszukiwania.
Do dalszej edycji tekstu w Wordzie zachowaj właściwą kolejność:
- Najpierw wykonaj OCR i pobierz przeszukiwalny PDF.
- Otwórz narzędzie PDF do Word.
- Kliknij „Wybierz pliki PDF” i dodaj PDF po OCR, a nie pierwotny skan.
- Kliknij „Konwertuj na Word”.
- Pobierz dokument DOCX i otwórz go w Microsoft Word.
- Sprawdź akapity, tabele, nagłówki, przypisy i kluczowe dane przed rozpoczęciem edycji.
Nie pomijaj etapu OCR. Konwerter PDF do Word nie rozpoznaje tekstu w skanie samodzielnie: strony bez warstwy tekstowej trafiają do dokumentu Word jako obrazy. Dopiero PDF po OCR zawiera tekst, który można wykorzystać podczas konwersji. Przy złożonych tabelach lub układzie wielokolumnowym miej otwarty oryginalny PDF obok DOCX, aby łatwo porównać rezultat.
FAQ
Czy OCR PDF online za darmo działa bez zakładania konta?
Tak. OCR PDF w PDF Toucan nie wymaga konta ani nie dodaje znaku wodnego. Wybierasz plik, wskazujesz język dokumentu, klikasz „Rozpoznaj tekst” i pobierasz wynik. Możesz dodać kilka plików, a każdy z nich zostanie przetworzony osobno.
Czy po OCR mogę wyszukiwać tekst w PDF na telefonie?
Tak, jeśli aplikacja lub przeglądarka używana na telefonie obsługuje wyszukiwanie w PDF. Po OCR dokument zawiera warstwę tekstową, więc możesz korzystać z funkcji wyszukiwania dostępnej w czytniku i zaznaczać rozpoznane fragmenty. Wygoda zależy od konkretnej aplikacji.
Dlaczego po konwersji skanowanego PDF do Worda tekst jest obrazem?
Skan zawiera obraz strony, a nie znaki możliwe do edycji. Narzędzie PDF do Word przeniesie taki skan do DOCX jako obraz. Najpierw uruchom OCR, pobierz przeszukiwalny PDF, a dopiero potem konwertuj go do Worda, aby konwerter miał tekst do przetworzenia.
Czy OCR zachowuje ważność podpisu cyfrowego PDF?
Nie. Dodanie warstwy tekstowej zmienia zawartość PDF, przez co podpis cyfrowy nie jest już ważny. Zachowaj oryginalny podpisany plik jako dokument referencyjny. Wersję po OCR wykorzystuj wyłącznie do wyszukiwania, kopiowania, kontroli treści lub dalszej pracy.
Ile języków można wybrać podczas jednego rozpoznawania?
W jednym procesie można wybrać maksymalnie pięć języków. Dodawaj tylko te, które naprawdę występują w dokumencie. Dla polskiego skanu wystarczy polski, a dla dokumentu polsko-angielskiego wybierz polski i angielski. Nadmiar języków spowalnia OCR i może obniżyć trafność rozpoznania.
