Tee skannatuista PDF-tiedostoista haettavia ja kopioitavia optisella tekstintunnistuksella (OCR). Lataa skannattu asiakirjasi, ja palvelimemme ajaa Tesseractin tekstin poimimiseksi ja upottamiseksi PDF:ään — jotta voit hakea, valita ja kopioida sisältöä tiedostosta, joka oli aiemmin pelkkä kuva. Tukee englantia ja monia muita kieliä.
OCR (optinen tekstintunnistus) muuntaa tekstistä otetut kuvat todelliseksi valittavaksi tekstiksi. Skannatut PDF-tiedostot ovat vain kuvia — OCR tekee niistä haettavia ja mahdollistaa tekstin kopioimisen niistä.
Tesseract tukee kymmeniä kieliä. Valitse asiakirjasi kieli ennen muuntamista tarkimman tuloksen saamiseksi.
Kyllä. OCR-käsittely vaatii palvelimellamme toimivan Tesseractin. Tiedostosi poistetaan automaattisesti, kun olet ladannut tuloksen.
Käsittely kestää tyypillisesti 30–60 sekuntia riippuen sivumäärästä ja tekstin tiheydestä. Monisivuiset asiakirjat kestävät kauemmin.
Kyllä. Tuloste-PDF säilyttää alkuperäisen visuaalisen asettelun, ja tunnistettu teksti upotetaan näkymättömänä kerroksena sen taakse, jolloin asiakirjasta tulee haettava sen ulkoasua muuttamatta.
Tee skannatuista PDF-tiedostoista haettavia tarkalla tekstintunnistuksella.
tai pudota tiedosto tähänTuetut muodot: PDF