Spraw, aby zeskanowane pliki PDF dało się przeszukiwać i kopiować, dzięki optycznemu rozpoznawaniu znaków (OCR). Prześlij zeskanowany dokument, a nasz serwer uruchomi Tesseract, aby odczytać tekst i osadzić go w pliku PDF — dzięki temu przeszukasz, zaznaczysz i skopiujesz treść z pliku, który wcześniej był samym obrazem. Obsługujemy angielski i wiele innych języków.
OCR (optyczne rozpoznawanie znaków) zamienia obrazy tekstu w prawdziwy, zaznaczalny tekst. Zeskanowane pliki PDF to tylko obrazy — OCR sprawia, że stają się przeszukiwalne i pozwala kopiować z nich treść.
Tesseract obsługuje dziesiątki języków. Przed konwersją wybierz język dokumentu, aby uzyskać najdokładniejszy wynik.
Tak. OCR wymaga programu Tesseract działającego na naszym serwerze. Twój plik jest usuwany automatycznie po pobraniu wyniku.
Przetwarzanie zajmuje zwykle od 30 do 60 sekund, zależnie od liczby stron i ilości tekstu. Dokumenty wielostronicowe trwają dłużej.
Tak. Gotowy plik PDF zachowuje pierwotny wygląd, a rozpoznany tekst jest osadzany jako niewidoczna warstwa pod spodem — dokument staje się przeszukiwalny bez zmiany wyglądu.
Spraw, aby skany w PDF stały się przeszukiwalne dzięki dokładnemu rozpoznawaniu tekstu.
lub upuść plik tutajObsługiwane: PDF