Centrum Pomocy Primepdf
Wyodrębnianie tekstu ze skanów i zdjęć za pomocą OCR
Ostatnia aktualizacja: przez Zespół wsparcia Primepdf
Zeskanowany plik PDF wygląda na ekranie jak tekst, ale w rzeczywistości zawiera obrazy stron. OCR odczytuje z nich znaki, dzięki czemu treść można przeszukiwać, kopiować i konwertować.
Jak poprawić dokładność OCR
OCR działa najlepiej na wyraźnych, płaskich stronach sfotografowanych lub zeskanowanych na wprost, w równomiernym świetle. Wyższa rozdzielczość daje lepszy efekt niż nieostre zdjęcie z telefonu. Po rozpoznaniu warto ponownie sprawdzić nazwy i nazwiska, liczby oraz nietypowe terminy, bo to one są najczęściej odczytywane błędnie.
OCR dla zeskanowanych plików PDF
W przypadku zeskanowanych dokumentów PDF należy użyć narzędzia Skan na tekst.
- Należy otworzyć narzędzie pasujące do pliku (Skan na tekst lub Obraz na tekst).
- Należy dodać skan lub zdjęcie (pliki do 100 MB).
- Należy skopiować lub pobrać rozpoznany tekst.
Zamiana obrazów na tekst
W przypadku pojedynczych zdjęć lub plików graficznych (paragonów, tablic, wydruków) należy otworzyć narzędzie Obraz na tekst.
Kolejne kroki
Po rozpoznaniu tekstu można:
Potrzebna pomoc z OCR?
Pytania o OCR? Nasz zespół pomocy jest dostępny 24/7: kontakt z pomocą techniczną.