Ekstrakt besedila iz PDF-ja
Izvlecite navadno besedilo iz besedilne plasti PDF-ja v brskalniku, stran za stranjo, pripravljeno za kopiranje ali prenos.
Rezultat
Na tej strani se odpre orodje za pretvorbo PDF v besedilo, ki je pripravljeno za črpanje navadnega besedila iz dokumenta. Spustite PDF in orodje prebere njegovo besedilno plast stran za stranjo, označi vsak blok z oznako »Stran N« in prikaže celoten rezultat v polju, ki ga lahko kopirate ali prenesete kot datoteko .txt.
Ekstrahiranje besedila je najhitrejši način za ponovno uporabo besed v dokumentu PDF: citiranje klavzule iz pogodbe, premikanje telesa poročila v urejevalnik, podajanje vsebine v prevajalnik ali iskanje besedne zveze v dolgem dokumentu. Ker besedilo izvira iz lastne besedilne plasti PDF-ja, je natančno – brez ugibanj OCR, brez napačno prebranih znakov.
Vse deluje lokalno v vašem brskalniku prek mehanizma pdf.js, tako da zaupni dokumenti nikoli ne zapustijo vaše naprave. Če je dokument PDF optično prebran brez plasti besedila, vam orodje jasno pove in vas usmeri na OCR, namesto da vrne prazno datoteko.