Centrum Pomocy Primepdf

Wyodrębnianie tekstu ze skanów i zdjęć za pomocą OCR

Ostatnia aktualizacja: przez Zespół wsparcia Primepdf

Zeskanowany plik PDF wygląda na ekranie jak tekst, ale w rzeczywistości zawiera obrazy stron. OCR odczytuje z nich znaki, dzięki czemu treść można przeszukiwać, kopiować i konwertować.

Jak poprawić dokładność OCR

OCR działa najlepiej na wyraźnych, płaskich stronach sfotografowanych lub zeskanowanych na wprost, w równomiernym świetle. Wyższa rozdzielczość daje lepszy efekt niż nieostre zdjęcie z telefonu. Po rozpoznaniu warto ponownie sprawdzić nazwy i nazwiska, liczby oraz nietypowe terminy, bo to one są najczęściej odczytywane błędnie.

OCR dla zeskanowanych plików PDF

W przypadku zeskanowanych dokumentów PDF należy użyć narzędzia Skan na tekst.

  1. Należy otworzyć narzędzie pasujące do pliku (Skan na tekst lub Obraz na tekst).
  2. Należy dodać skan lub zdjęcie (pliki do 100 MB).
  3. Należy skopiować lub pobrać rozpoznany tekst.

Zamiana obrazów na tekst

W przypadku pojedynczych zdjęć lub plików graficznych (paragonów, tablic, wydruków) należy otworzyć narzędzie Obraz na tekst.

Kolejne kroki

Po rozpoznaniu tekstu można:

Potrzebna pomoc z OCR?

Pytania o OCR? Nasz zespół pomocy jest dostępny 24/7: kontakt z pomocą techniczną.